新闻中心
AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

字节跳动推出全新小分子力场ByteFF:兼顾精度与效率,覆盖广阔化学空间
编辑 | ScienceAI
小分子力场在药物发现领域至关重要,是计算机辅助药物设计的核心工具。一个覆盖范围广、精度高的小分子力场,将为药物研发提供坚实基础。
现有基于机器学习的力场(MLFF),例如ANI-2x和MACE-OFF23
,虽然能提供精准的分子势能面预测,但却面临数据需求量巨大、计算速度慢以及外推能力不足等挑战,限制了其在药物研发中的实际应用。
Espaloma等一系列研究尝试在保留传统力场势函数形式的基础上,利用图神经网络(GNN)预测传统力场的参数,在精度和效率之间取得平衡,为传统力场的发展指明了新方向。
基于此,字节跳动研究团队开发了ByteFF力场。该力场采用符合物理约束的模型结构,构建了涵盖广泛化学空间的大规模数据集,并设计了相应的训练方案。测试结果表明,ByteFF在结构优化、分子势能面预测等多个方面均达到业界领先水平。
相关研究成果已发表在《Chemical Science》期刊上,论文标题为“Data-Driven Parametrization of Molecular Mechanics Force Fields for Expansive Chemical Space Coverage”。
论文链接:https://www.php.cn/link/908d139fadc56a731135f96e130c652a
研究背景
在虚拟筛选、分子对接和自由能预测等计算方法中,小分子力场扮演着关键角色。随着计算机辅助药物设计(CADD)和有机合成技术的进步,药物研发探索的化学空间不断扩大,迫切需要一种能够在广阔化学空间内提供高精度预测的小分子力场。
近年来,量子化学和机器学习技术为传统力场的发展带来了新的机遇。虽然备受关注的MLFF能够提供高精度预测,但其模型复杂性导致训练数据需求量大、计算速度慢等问题,难以兼顾计算效率和化学空间覆盖范围。
2025年,Espaloma力场提出了一种兼顾精度和效率的新方法,即保留传统力场的势函数形式,并使用GNN预测力场参数,取代传统的查表方法。这种数据驱动的参数化方法在提高传统力场精度的同时,保持了计算效率。
在此基础上,提升力场精度和化学空间覆盖率,需要更精巧的模型结构设计和训练策略。
模型结构与训练策略
ByteFF模型结构分为特征提取层(Featurization)、图神经网络层(GNN)和输出层(Output)三部分。
特征提取层将原子和化学键的化学特征转换为向量表示。GNN层采用EGT结构进行信息传递,充分利用原子和键的特征,获得每个原子和键的化学环境表示。输出层根据化学环境预测力场参数。
Perplexity
Perplexity是一个ChatGPT和谷歌结合的超级工具,可以让你在浏览互联网时提出问题或获得即时摘要
302
查看详情
ByteFF模型结构的设计保证了参数预测结果符合物理约束,例如相同化学环境的结构具有相同的结构参数预测,原子部分电荷之和等于分子的总电荷等。
在训练方面,研究团队构建了包含240万个不同分子碎片的优化数据集和320万个不同二面角的扭转数据集。基于这些数据集,研究人员设计了针对性的Hessian损失函数,能够对批量数据进行端到端训练。
由于传统力场形式的限制,难以完美拟合量子化学计算的势能面,研究人员在扭转数据集上采用了迭代的“结构优化-训练”策略,以确保ByteFF在二面角(关键自由度)上提供准确的势能面预测。
此外,研究团队还采用了预训练、训练和微调的多阶段训练流程,以达到最佳训练效果。
性能评估
在结构优化方面,ByteFF显著优于业界领先的OPLS4+ffbuilder(标记为“OPLS4 cst”)。

ByteFF能够准确预测小分子(包括环状和非环状分子)的二面角势能面。

更多结果请参考原文。
总结与展望
ByteFF力场凭借其先进的网络结构设计、充足的训练数据和匹配的训练方案,在结构优化和分子势能面预测等方面取得了显著成果。
ByteFF继承了GAFF2的非键参数,保证了与Amber力场的兼容性,但其非键相互作用方面仍有提升空间,这将是未来的研究重点。
目前,ByteFF免费API测试正在进行中,如有需求,请联系论文通讯作者并注明单位和用途。欢迎同行试用并提供反馈。
以上就是AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF的详细内容,更多请关注其它相关文章!
# 化学
# 药物
# 理论
# 解锁
# 互联网
# 小鹏
# 是一个
# 速度慢
# 官网
# 万个
# 采用了
# 结构优化
# 2025
# ai
# cad
# 分子
# 科学
# 但其
# 潮州营销网站建设方案
# 服饰号怎么营销推广的呢
# 音乐生能做的网站推广
# 哪些网站适合推广淘宝店
# 浙江seo基础知识
# 义乌网站建设信息网
# 山东网站建设模板制作
# 长沙推广营销网站排名
# 绥化seo线上营销技巧
# 抚州营销推广
相关栏目:
【
行业资讯67740 】
【
技术百科0 】
【
网络运营39195 】
相关推荐:
怎么批量烧写单片机
kingston是什么_kingston是什么意思
忐忑不安是什么意思
分享一个稳定的ao3镜像网址
16苹果有哪些机型
春运抢票到哪里抢票啊
域名批量查询工具有哪些
oppo手机nfc功能是什么意思
单片机log怎么看
animal是什么意思
怎么打印数组j*a
干股是什么意思
夸克是什么空间单位
j*a整形怎么转数组
1tb等于多少mb
类似微信的聊天软件有哪些
征信信誉不好如何恢复 如何修复不良征信方法
折叠屏手机选择哪个好
今天是农历多少号
如何用命令打开光驱
爱奇艺vip会员可以同时几个人用?
手机如何更改固态硬盘
j*a怎么复制数组中
awful是什么意思
j*a中怎么截取数组
linux如何用命令修改ip
壁挂炉power常亮是什么意思
春运抢票如何快速抢到票
51单片机贴片怎么*
净水器上的power是什么意思
春运高速高铁抢票攻略
笔记本电脑多少钱
怎么在typescript定义集合
点焊机接触器上power是什么意思
typescript中文怎么读
r中如何逐行执行命令
自由服务器如何做动态ip域名解析
如何为服务器配置静态路由?服务器配置静态路由详细教程
dos命令 如何将变量 作为路径的一部分
春运抢票如何抢连坐的票
单片机速度怎么看
为什么夸克书架书单没了
路由器上的power按钮是什么意思
driver是什么意思
苹果16日发售哪些机型
hen是什么意思
j*a数组怎么取元素
如何把一个命令后台运行
台机如何安装固态硬盘
一天多少分钟


2025-01-16
浏览次数:次
返回列表