所有生命分子皆可AI预测!AlphaFold3来了,全球科学家免费使用 所有生命分子皆可AI预测!AlphaFold3来了,全球科学家免费使用
admin
2024-05-09 10:40:26
0

梦晨 明敏 发自 凹非寺
量子位 | 公众号 QbitAI

AlphaFold 3再登Nature!

这次重磅升级,不再仅限于蛋白质结构预测——可以以前所未有的精度预测所有生命分子的结构和相互作用。

只有了解它们如何在数百万种组合中相互作用,我们才能开始真正理解生命的过程。



这次的最大创新之一,是用上了AI绘画上常见的去噪扩散模型,直接生成每个原子的3D坐标

现在,AlphaFold 3对普通感冒病毒Spike蛋白(蓝色)的结构预测,灰色部分为预测结果。这能让人类更进一步了解冠状病毒。



对蛋白质和DNA结合的分子复合物进行预测,其预测结果与真实结构几乎一致。



在不输入任何结构信息的情况下,AlphaFold3预测准确度比现有方法提高了50%,对于部分相互作用类别甚至提高了1倍。

这使得AlphaFold 3成为首个超越基于真实生物分子结构预测工具的AI系统

而且全球科学家通过AlphaFold服务器即可免费访问使用AlphaFold 3进行非商业研究(开放大部分功能)。

DeepMind联创兼CEO哈撒比斯在发布会上非常肯定地表示,AlphaFold 3是人类了解生物学动态系统历史性的第一步



网友都纷纷感慨:这就是AI的用处所在啊。



用扩散网络生成预测结果

事实上,在AlphaFold 3之前还进行过一系列小规模更新,重点提高了对蛋白质复合体的预测精度。

所以总结下来:

AlphaFold,开创了蛋白质结构预测的新时代AlphaFold 2,大幅提高了预测精度AlphaFold-Multimer,将预测范围扩展到具有多个蛋白质链的复合物AlphaFold 2.3,它提高了性能并将覆盖范围扩大到更大的复合物

这次革命性的AlphaFold 3,继续将预测范围扩展到蛋白质、DNA、RNA以及一系列配体、离子和化学修饰等更多生物分子结构



AlphaFold 3建立在AlphaFold 2的基础上,但在架构和训练过程上有很大改进:

遗传特征编码器(MSA module)被大幅简化,聚焦提取更关键的进化信息。成对残基关系编码器(Pairformer)取代了原有的进化特征处理单元(Evoformer),增强了复杂相互作用模式的建模能力。结构生成器从以氨基酸为中心,改为直接预测原子坐标,增加了处理通用分子结构的灵活性。

为了避免扩散方法在一些无结构区域产生幻觉,还引入了一种新的交叉蒸馏方法,通过AlphaFold-Multimer v2预测的结构数据来丰富训练数据。



更让人惊叹的是,AlphaFold 3即便在训练数据极度匮乏的领域,也展现出了惊人的泛化能力。

举个例子,在CASP15的RNA预测任务中,它在10个公开靶点上的平均表现超过了专门的RNA结构预测模型。要知道,这可是在几乎没有RNA训练数据的情况下实现的。

尽管AlphaFold 3在多个维度实现了突破,但它并非完美无缺。比如在对映异构、自相互作用等方面,它还存在一定局限性。

此外,它目前专注的是分子结构的静态预测,对动力学行为的刻画还不够。对人工合成分子的适用性也有待考证。

AlphaFold 3偶尔也会产生错误,对无序区域产生幻觉,导致对某些目标的预测准确性降低。

目前的缓解手段,是在生成时使用多个随机种子,确保正确的手性并避免蛋白质-配体轻微碰撞。

但瑕不掩瑜,AlphaFold 3的意义不仅在于具体指标的跃升,而是展示了用统一的深度学习架构,来建模复杂生命系统组件之间相互作用的可能性。



AlphaFold开始商业化

2021年AlphaFold一代推出后,谷歌DeepMind积极为其寻找商业化途径,并成立了Isomorhpic Labs公司。



这次虽然以谷歌DeepMind的名义新推出了免费的AlphaFold Server,号称科学家只需点击几下就模拟由蛋白质、DNA、RNA 以及一系列配体、离子和化学修饰组成的结构。



然而Nature报道指出,科学家对AlphaFold 3服务器的访问是有限的。目前每天只能进行10次预测,而且不可能获得可能与药物结合的蛋白质结构。

Isomorphic Labs正在使用AlphaFold3通过自己的管道或与其他制药公司合作开发药物。



审稿人也在线喊话哈撒比斯,自己从服务器上得到了非常好的结果,但是发布论文里为什么没有给代码?



他在审稿评论中列出了AlphaFold2代码发布后的一系列科学事件,它认为如果不公布代码就不会有如此多科学成果。



不过,可不要小看开源社区的力量。

可能不少人论文都没看完,开源复现工作就已经开启了。



虽然现在还只是空仓,但网友推测,对于复现过ViT、DALL·E 2、Imagen等工作的这位大神来说,可能几天之内就能完成。



目前Nature已经放出的AlphaFold3论文预印版。感兴趣的同学可以前去了解。

论文地址:
https://www.nature.com/articles/s41586-024-07487-w

参考链接:
[1]https://www.nature.com/articles/d41586-024-01383-z
[2]https://www.isomorphiclabs.com/articles/a-glimpse-of-the-next-generation-of-alphafold
[3]https://github.com/lucidrains/alphafold3-pytorch

相关内容

热门资讯

linux入门---制作进度条 了解缓冲区 我们首先来看看下面的操作: 我们首先创建了一个文件并在这个文件里面添加了...
C++ 机房预约系统(六):学... 8、 学生模块 8.1 学生子菜单、登录和注销 实现步骤: 在Student.cpp的...
A.机器学习入门算法(三):基... 机器学习算法(三):K近邻(k-nearest neigh...
数字温湿度传感器DHT11模块... 模块实例https://blog.csdn.net/qq_38393591/article/deta...
有限元三角形单元的等效节点力 文章目录前言一、重新复习一下有限元三角形单元的理论1、三角形单元的形函数(Nÿ...
Redis 所有支持的数据结构... Redis 是一种开源的基于键值对存储的 NoSQL 数据库,支持多种数据结构。以下是...
win下pytorch安装—c... 安装目录一、cuda安装1.1、cuda版本选择1.2、下载安装二、cudnn安装三、pytorch...
MySQL基础-多表查询 文章目录MySQL基础-多表查询一、案例及引入1、基础概念2、笛卡尔积的理解二、多表查询的分类1、等...
keil调试专题篇 调试的前提是需要连接调试器比如STLINK。 然后点击菜单或者快捷图标均可进入调试模式。 如果前面...
MATLAB | 全网最详细网... 一篇超超超长,超超超全面网络图绘制教程,本篇基本能讲清楚所有绘制要点&#...
IHome主页 - 让你的浏览... 随着互联网的发展,人们越来越离不开浏览器了。每天上班、学习、娱乐,浏览器...
TCP 协议 一、TCP 协议概念 TCP即传输控制协议(Transmission Control ...
营业执照的经营范围有哪些 营业执照的经营范围有哪些 经营范围是指企业可以从事的生产经营与服务项目,是进行公司注册...
C++ 可变体(variant... 一、可变体(variant) 基础用法 Union的问题: 无法知道当前使用的类型是什...
血压计语音芯片,电子医疗设备声... 语音电子血压计是带有语音提示功能的电子血压计,测量前至测量结果全程语音播报࿰...
MySQL OCP888题解0... 文章目录1、原题1.1、英文原题1.2、答案2、题目解析2.1、题干解析2.2、选项解析3、知识点3...
【2023-Pytorch-检... (肆十二想说的一些话)Yolo这个系列我们已经更新了大概一年的时间,现在基本的流程也走走通了,包含数...
实战项目:保险行业用户分类 这里写目录标题1、项目介绍1.1 行业背景1.2 数据介绍2、代码实现导入数据探索数据处理列标签名异...
记录--我在前端干工地(thr... 这里给大家分享我在网上总结出来的一些知识,希望对大家有所帮助 前段时间接触了Th...
43 openEuler搭建A... 文章目录43 openEuler搭建Apache服务器-配置文件说明和管理模块43.1 配置文件说明...