首页 > 科技 > 比AlphaFold2快十倍!国产开源项目加速蛋白质预测,支持超长序列

比AlphaFold2快十倍!国产开源项目加速蛋白质预测,支持超长序列

22分钟推理出长达4K+的超长蛋白质序列,1分15秒搞定将近2K长的序列预测。

这是国产开源项目的最新战绩!

最近,由Colossal-AI团队(https://github.com/hpcaitech/ColossalAI)联合百图生科的蛋白质预测模型xTrimo Multimer,正式免费开源。

它在支持蛋白质单体(Monomer)和复合物(Multimer)的同时,还能大幅提升蛋白质预测速度。

面对2K到3K序列长度的预测任务,使用多卡推理,最高速度可达AlphaFold 2的11.15倍

还能挑战4K以上的超长序列,而AlphaFold 2和OpenFold都受限于显存,无法完成这类任务。

目前,该项目已在GitHub上免费开源

https://github.com/hpcaitech/ColossalAI/#xTrimoMultimer

怎么实现的?

本次解决方案背后优化加速技术来自Colossal-AI,这是一个旨在全面助力AI大模型工业化应用的通用深度学习系统。

xTrimo Multimer开源版模型通过引入Colossal-AI的大模型优化技术,显著降低蛋白质结构预测模型训练和推理的时间和经济成本,提高蛋白质结构预测模型领域的设计和部署效率。

这次Colossal-AI系统在AI大模型&生物医药落地应用,使其在该领域训练和使用更大的模型成为可能。

Colossal-AI是一个面向大模型时代的通用深度学习系统。

自开源以来,它在数个月内获得近五千颗Github Star,多次登上GitHub Trending榜首。

相关解决方案也已成功在生物医药、自动驾驶、云计算、零售、芯片等行业知名厂商落地应用,广受好评。

此次和百图生科联手,是结合了双方在高性能计算和生物计算领域上的前沿技术积累,提出了蛋白质单体与复合体的结构预测加速方案。

这对于精准高效探寻癌症、衰老等疾病的免疫规律,逐一攻破AI技术在靶点挖掘、创新药物设计应用上,都有所帮助,对于更多疾病的预警、控制和治愈都有深远意义。

众所周知,蛋白质结构预测是结构生物学领域最为重要的课题之一,也是人类理解基因翻译和蛋白质功能的重要手段。

蛋白质之间的相互作用,是蛋白质发挥生物学功能的重要结构基础。

但是由于蛋白质的多级结构和复杂的相互作用,使得精确预测三维结构这一关键问题十分有挑战性。

近年来,深度神经网络的成功使得人工智能在各个领域得到了广泛的应用。

自DeepMind发布的AlphaFold能够实现根据氨基酸序列精准预测蛋白质结构以来,生命科学领域掀起了使用人工智能预测蛋白结构的热潮。

AlphaFold能够实现端到端的从序列直接预测单体蛋白质三维结构,但在生物体内,多数蛋白质是以复合体的形式来发挥功能的。

因此,为了打破AlphaFold仅在预测单体蛋白方面表现优异的局限,DeepMind后来也发布了用于预测蛋白复合体结构的AlphaFold-Multimer模型。

在2022年3月,Colossal-AI 团队曾推出蛋白质结构预测模型AlphaFold的训练推理加速方案FastFold,用更低的成本将总体训练时间从11天减少到67小时,在长序列推理应用中实现超11倍的提升。

以此为起点,Colossal-AI 团队在进一步探索蛋白质结构预测领域的技术革新。

针对蛋白质单体(Monomer)与复合物(Multimer)结构预测的难题,本次Colossal-AI 团队联合百图生科提出行业内最新解决方案xTrimo Multimer开源版模型,能够更好地理解蛋白互作关系,从而提升药物研发平台中靶点分析、蛋白质结构预测和模拟以及高精准抗体设计等方面的能力。

此外,推理阶段昂贵的经济和时间成本使得AlphaFold模型相关的研究和开发十分困难,尤其是面对长序列推理时,计算复杂度和内存消耗都面临着巨大挑战。

xTrimo Multimer开源版模型针对AlphaFold-Multimer模型中的计算特性,进行了针对性的CUDA优化,并且进行了Kernel Fusion。

相较于AlphaFold2和哥伦比亚大学的OpenFold,xTrimo Multimer开源版模型在单卡推理上性能有明显提升 ,推理速度分别提高1.58~2.14倍1.14~2.23倍

xTrimo Multimer开源版模型还支持超长序列的分布式推理。

由于使用了动态轴并行(Dynamic Axial Parallelism)技术,xTrimo Multimer可以高效地将计算和部分显存分配到不同的设备上,从而解决超长序列面临的计算和内存挑战。

在2K到3K的序列长度下,xTrimo Multimer使用多卡进行推理,相对于OpenFold和AlphaFold 2推理速度最高提升8.47倍11.15倍,对比Uni-Fold2.0速度最高提升4.45倍

xTrimo Multimer可以支持长达4K的序列推理,此时OpenFold和AlphaFold 2受限于显存无法完成推理,而xTrimo Multimer可以在20分钟左右完成。

百图生科首席AI科学家宋乐表示:

从对单个蛋白质结构的模拟,到对不同蛋白质之间的相互作用的识别,再到对蛋白质复合物的绘制,百图生科致力于解码、建模复杂人体免疫系统,开发突破创新药物,编程免疫系统,治愈多种免疫相关疾病。

此次xTrimo Multimer开源版模型的发布,是我们携手潞晨科技Colossal-AI 团队,借助其在高性能计算上的优势以及百图生科生物计算领域前沿的技术积淀,朝着百图生科xTrimo多模态生物计算大模型体系迈出的又一步。

正如我们一直以来所努力的方向,精准高效地探寻癌症、衰老等疾病的免疫规律,逐一攻破AI技术在靶点挖掘、创新药物设计落地应用上的难关,让更多疾病可预警、可控制、可治愈!

潞晨科技创始人尤洋教授表示:

此次 Colossal-AI 团队与百图生科合作的蛋白质单体与复合物结构预测最新方案,是面向大模型时代的通用深度学习系统 Colossal-AI 在生物医药领域应用落地的重要进展。

未来我们双方将会继续在生物计算大模型上有更深入的合作,助力深度学习在创新药物研发上的应用和落地。

随着人工智能对各个领域的高度渗透,各行业的智能化产业转型升级都离不开高性能AI的加持,而潞晨的AI大模型的高效训练和推理方案,刚好可为AI市场提供解决方案。

团队介绍

关于百图生科

百图生科(BioMap)是生物计算引擎驱动的突破创新药物研发平台,由百度创始人李彦宏发起创立,致力于将先进AI等信息技术(IT)与前沿生物技术(BT)相结合,构建独特的靶点挖掘及药物设计能力,聚焦于解析免疫调控机理,开发创新的治疗性药物,造福人类健康。

目前公司拥有近万平米的实验室,50+个靶点及药物研发资产组合。

关于潞晨科技

潞晨科技致力于解放AI生产力,打造面向大模型时代的通用深度学习系统Colossal-AI ,高效促进AI大模型落地应用。

核心成员来自美国加州伯克利、斯坦福、清华、北大、新加坡国立、南洋理工大学等世界一流高校,在国际顶级学术刊物或会议共发表论文近百篇,曾在谷歌、微软、NVIDIA、IBM、英特尔等头部科技公司任职。

公司成立即获得位列“清科中国早期投资机构30强”榜首的创新工场、真格基金超千万元种子轮投资。

传送门

GitHub地址:

https://github.com/hpcaitech/ColossalAI/#xTrimoMultimer

https://github.com/hpcaitech/ColossalAI

参考链接:

https://www.technologyreview.com/2021/07/22/1029973/deepmind-alphafold-protein-folding-biology-disease-drugs-proteome/

本文来自网络,不代表趣头条立场,转载请注明出处:https://www.ngnnn.com/article/4_140908.html
上一篇共享单车“扣车”变成产业链,外包管理谨防胡来|新京报快评
下一篇疫苗无须冷藏?新型水凝胶包裹技术可在65°C高温下保持疫苗活性

为您推荐

盖茨盛赞ChatGPT:人工智能历史意义不亚于“PC或互联网诞生”

盖茨盛赞ChatGPT:人工智能历史意义不亚于“PC或互联网诞生”

腾讯科技讯 2月3日消息,微软联合创始人比尔·盖茨表示,像ChatGPT这样的AI聊天机器人将变得与个人电脑或互联网同样重要。盖茨今日接受采访时表示:“AI将成为2023年最热门的话题。这是不可避免的。”他随后补充道:“ChatGPT将变得与个人电脑、互联网同样重要。”盖茨在20世纪80年代帮助开创了个人电脑时代。在微软和苹果等
专访墨奇科技CEO邰骋:人工智能需要新的AI数据基础设施

专访墨奇科技CEO邰骋:人工智能需要新的AI数据基础设施

“人工智能要发展到下一代,必然需要基础理论和基础设施的革新,特别是需要新的 AI 数据基础设施。”9月2日,新京报贝壳财经记者获悉,在近日举办的HICOOL2022全球创业者峰会上,AI(人工智能)基础技术和平台墨奇科技的项目团队获得“HICOOL 2022 全球创业大赛一等奖”。墨奇科技联合创始人、CEO 邰骋接受了新京报贝壳财
人工智能大会将举办智慧体育高峰论坛,发布AI+体育蓝皮书

人工智能大会将举办智慧体育高峰论坛,发布AI+体育蓝皮书

2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。  主办方供图AI+体育,将成为世界人工智能大会的全新命题和新亮点。2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。论坛上将发布由上海人工智能研究院牵头,联合上海交通大学、上海体育学院、首都体育学院、同济大学等单位编制的国内首本《“AI+体育”蓝
大脑还有多少秘密?世界人工智能大会首开脑机接口主题论坛

大脑还有多少秘密?世界人工智能大会首开脑机接口主题论坛

在2022世界人工智能大会上,天桥脑科学研究院(简称TCCI)转化中心联合中国科学院上海微系统与信息技术研究所、脑虎科技、中国神经科学学会、上海市神经科学学会共同举办“脑·机智能融合-让大脑连接未来”论坛,这也是脑机接口首次以主题论坛的形式登陆世界人工智能大会。英国皇家工程院院士、上海交大医疗机器人研究院院
我国人工智能学科主要奠基人涂序彦逝世,享年 88 岁

我国人工智能学科主要奠基人涂序彦逝世,享年 88 岁

IT之家 3 月 28 日消息,据北京科技大学消息,我国人工智能领域著名科学家、人工智能学科的主要奠基人、中国人工智能学会的主要创始人之一、第二和第三届中国人工智能学会理事长、北京科技大学计算机与通信工程学院教授涂序彦先生,因病医治无效,于 2023 年 1 月 1 日 0 时 10 分在北京逝世,享年 88 岁。IT之家附讣告原文
梁建章:人工智能如何影响经济和各行各业

梁建章:人工智能如何影响经济和各行各业

近日人工智能再次成为了热门话题。很多人好奇的是,人工智能未来到底会如何影响经济、人口和创新?今天,我跟大家分享个人的一些看法——谈谈人工智能对于经济以及各行各业的影响。自从深度神经网络出现以来,人工智能的发展速度超乎想象。ChatGPT的出现是个奇迹,超出了几乎所有计算机科学家的预料。一个简单的神经网络模
AI炒股新纪元?头部量化私募幻方宣布全力探索人工智能应用

AI炒股新纪元?头部量化私募幻方宣布全力探索人工智能应用

头部量化私募幻方宣布成立新的独立的研究组织,探索AGI(即通用人工智能,Artificial General Intelligence)的本质。4月14日,幻方发布公告显示,幻方将集中资源和力量,全力投身到服务于全人类共同利益的人工智能之中,成立新的独立的研究组织,探索AGI的本质,“我们将充分而持续地投入,不做中庸的事,用最长期的眼光去
卷完模型卷芯片!为提升效率,微软准备推出专属人工智能芯片

卷完模型卷芯片!为提升效率,微软准备推出专属人工智能芯片

在早期成功押注ChatGPT的研发公司OpenAI之后,市场发现,微软在其武器库中还拥有另一个秘密武器:自研人工智能芯片,这一芯片将为生成式AI背后的大型语言模型提供强大动力。4月18日周二,据媒体援引两位知情人士的话说,微软早在2019年就开始开发内部代号为Athena的AI芯片。其中一位知情人士称,一些微软和OpenAI的员工已经
真正的应用级量子人工智能距离我们还有多远?

真正的应用级量子人工智能距离我们还有多远?

·“量子科技是强国竞争的战略制高点,但不能一哄而上,低水平重复内卷,或片面追求发论文、抢专利,各自为战,闭门造车,而缺少真正的技术投入和系统配合。”·“当下量子系统的规模非常重要,而这很大程度上取决于芯片。”当前,发展量子计算和人工智能已成为世界各国的重要战略,两者交汇而生的量子人工智能更是发展迅速
返回顶部