新闻中心

AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF

2025-01-16
浏览次数:
返回列表

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

字节跳动推出全新小分子力场ByteFF:兼顾精度与效率,覆盖广阔化学空间

编辑 | ScienceAI

小分子力场在药物发现领域至关重要,是计算机辅助药物设计的核心工具。一个覆盖范围广、精度高的小分子力场,将为药物研发提供坚实基础。

现有基于机器学习的力场(MLFF),例如ANI-2x和MACE-OFF23,虽然能提供精准的分子势能面预测,但却面临数据需求量巨大、计算速度慢以及外推能力不足等挑战,限制了其在药物研发中的实际应用。

Espaloma等一系列研究尝试在保留传统力场势函数形式的基础上,利用图神经网络(GNN)预测传统力场的参数,在精度和效率之间取得平衡,为传统力场的发展指明了新方向。

基于此,字节跳动研究团队开发了ByteFF力场。该力场采用符合物理约束的模型结构,构建了涵盖广泛化学空间的大规模数据集,并设计了相应的训练方案。测试结果表明,ByteFF在结构优化、分子势能面预测等多个方面均达到业界领先水平。

相关研究成果已发表在《Chemical Science》期刊上,论文标题为“Data-Driven Parametrization of Molecular Mechanics Force Fields for Expansive Chemical Space Coverage”。

论文链接:https://www.php.cn/link/908d139fadc56a731135f96e130c652a

研究背景

在虚拟筛选、分子对接和自由能预测等计算方法中,小分子力场扮演着关键角色。随着计算机辅助药物设计(CADD)和有机合成技术的进步,药物研发探索的化学空间不断扩大,迫切需要一种能够在广阔化学空间内提供高精度预测的小分子力场。

近年来,量子化学和机器学习技术为传统力场的发展带来了新的机遇。虽然备受关注的MLFF能够提供高精度预测,但其模型复杂性导致训练数据需求量大、计算速度慢等问题,难以兼顾计算效率和化学空间覆盖范围。

2025年,Espaloma力场提出了一种兼顾精度和效率的新方法,即保留传统力场的势函数形式,并使用GNN预测力场参数,取代传统的查表方法。这种数据驱动的参数化方法在提高传统力场精度的同时,保持了计算效率。

在此基础上,提升力场精度和化学空间覆盖率,需要更精巧的模型结构设计和训练策略。

模型结构与训练策略

ByteFF模型结构分为特征提取层(Featurization)、图神经网络层(GNN)和输出层(Output)三部分。

特征提取层将原子和化学键的化学特征转换为向量表示。GNN层采用EGT结构进行信息传递,充分利用原子和键的特征,获得每个原子和键的化学环境表示。输出层根据化学环境预测力场参数。

Perplexity Perplexity

Perplexity是一个ChatGPT和谷歌结合的超级工具,可以让你在浏览互联网时提出问题或获得即时摘要

Perplexity 302 查看详情 Perplexity

ByteFF模型结构的设计保证了参数预测结果符合物理约束,例如相同化学环境的结构具有相同的结构参数预测,原子部分电荷之和等于分子的总电荷等。

在训练方面,研究团队构建了包含240万个不同分子碎片的优化数据集和320万个不同二面角的扭转数据集。基于这些数据集,研究人员设计了针对性的Hessian损失函数,能够对批量数据进行端到端训练。

由于传统力场形式的限制,难以完美拟合量子化学计算的势能面,研究人员在扭转数据集上采用了迭代的“结构优化-训练”策略,以确保ByteFF在二面角(关键自由度)上提供准确的势能面预测。

此外,研究团队还采用了预训练、训练和微调的多阶段训练流程,以达到最佳训练效果。

性能评估

在结构优化方面,ByteFF显著优于业界领先的OPLS4+ffbuilder(标记为“OPLS4 cst”)。

图片

ByteFF能够准确预测小分子(包括环状和非环状分子)的二面角势能面。

图片

更多结果请参考原文。

总结与展望

ByteFF力场凭借其先进的网络结构设计、充足的训练数据和匹配的训练方案,在结构优化和分子势能面预测等方面取得了显著成果。

ByteFF继承了GAFF2的非键参数,保证了与Amber力场的兼容性,但其非键相互作用方面仍有提升空间,这将是未来的研究重点。

目前,ByteFF免费API测试正在进行中,如有需求,请联系论文通讯作者并注明单位和用途。欢迎同行试用并提供反馈。

以上就是AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF的详细内容,更多请关注其它相关文章!


# 化学  # 药物  # 理论  # 解锁  # 互联网  # 小鹏  # 是一个  # 速度慢  # 官网  # 万个  # 采用了  # 结构优化  # 2025  # ai  # cad  # 分子  # 科学  # 但其  # 潮州营销网站建设方案  # 服饰号怎么营销推广的呢  # 音乐生能做的网站推广  # 哪些网站适合推广淘宝店  # 浙江seo基础知识  # 义乌网站建设信息网  # 山东网站建设模板制作  # 长沙推广营销网站排名  # 绥化seo线上营销技巧  # 抚州营销推广 


相关栏目: 【 行业资讯67740 】 【 技术百科0 】 【 网络运营39195


相关推荐: 怎么批量烧写单片机  kingston是什么_kingston是什么意思  忐忑不安是什么意思  分享一个稳定的ao3镜像网址  16苹果有哪些机型  春运抢票到哪里抢票啊  域名批量查询工具有哪些  oppo手机nfc功能是什么意思  单片机log怎么看  animal是什么意思  怎么打印数组j*a  干股是什么意思  夸克是什么空间单位  j*a整形怎么转数组  1tb等于多少mb  类似微信的聊天软件有哪些  征信信誉不好如何恢复 如何修复不良征信方法  折叠屏手机选择哪个好  今天是农历多少号  如何用命令打开光驱  爱奇艺vip会员可以同时几个人用?  手机如何更改固态硬盘  j*a怎么复制数组中  awful是什么意思  j*a中怎么截取数组  linux如何用命令修改ip  壁挂炉power常亮是什么意思  春运抢票如何快速抢到票  51单片机贴片怎么*  净水器上的power是什么意思  春运高速高铁抢票攻略  笔记本电脑多少钱  怎么在typescript定义集合  点焊机接触器上power是什么意思  typescript中文怎么读  r中如何逐行执行命令  自由服务器如何做动态ip域名解析  如何为服务器配置静态路由?服务器配置静态路由详细教程  dos命令 如何将变量 作为路径的一部分  春运抢票如何抢连坐的票  单片机速度怎么看  为什么夸克书架书单没了  路由器上的power按钮是什么意思  driver是什么意思  苹果16日发售哪些机型  hen是什么意思  j*a数组怎么取元素  如何把一个命令后台运行  台机如何安装固态硬盘  一天多少分钟 

搜索