新闻中心

AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF

2025-01-16
浏览次数:
返回列表

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

字节跳动推出全新小分子力场ByteFF:兼顾精度与效率,覆盖广阔化学空间

编辑 | ScienceAI

小分子力场在药物发现领域至关重要,是计算机辅助药物设计的核心工具。一个覆盖范围广、精度高的小分子力场,将为药物研发提供坚实基础。

现有基于机器学习的力场(MLFF),例如ANI-2x和MACE-OFF23,虽然能提供精准的分子势能面预测,但却面临数据需求量巨大、计算速度慢以及外推能力不足等挑战,限制了其在药物研发中的实际应用。

Espaloma等一系列研究尝试在保留传统力场势函数形式的基础上,利用图神经网络(GNN)预测传统力场的参数,在精度和效率之间取得平衡,为传统力场的发展指明了新方向。

基于此,字节跳动研究团队开发了ByteFF力场。该力场采用符合物理约束的模型结构,构建了涵盖广泛化学空间的大规模数据集,并设计了相应的训练方案。测试结果表明,ByteFF在结构优化、分子势能面预测等多个方面均达到业界领先水平。

相关研究成果已发表在《Chemical Science》期刊上,论文标题为“Data-Driven Parametrization of Molecular Mechanics Force Fields for Expansive Chemical Space Coverage”。

论文链接:https://www.php.cn/link/908d139fadc56a731135f96e130c652a

研究背景

在虚拟筛选、分子对接和自由能预测等计算方法中,小分子力场扮演着关键角色。随着计算机辅助药物设计(CADD)和有机合成技术的进步,药物研发探索的化学空间不断扩大,迫切需要一种能够在广阔化学空间内提供高精度预测的小分子力场。

近年来,量子化学和机器学习技术为传统力场的发展带来了新的机遇。虽然备受关注的MLFF能够提供高精度预测,但其模型复杂性导致训练数据需求量大、计算速度慢等问题,难以兼顾计算效率和化学空间覆盖范围。

2025年,Espaloma力场提出了一种兼顾精度和效率的新方法,即保留传统力场的势函数形式,并使用GNN预测力场参数,取代传统的查表方法。这种数据驱动的参数化方法在提高传统力场精度的同时,保持了计算效率。

在此基础上,提升力场精度和化学空间覆盖率,需要更精巧的模型结构设计和训练策略。

模型结构与训练策略

ByteFF模型结构分为特征提取层(Featurization)、图神经网络层(GNN)和输出层(Output)三部分。

特征提取层将原子和化学键的化学特征转换为向量表示。GNN层采用EGT结构进行信息传递,充分利用原子和键的特征,获得每个原子和键的化学环境表示。输出层根据化学环境预测力场参数。

Perplexity Perplexity

Perplexity是一个ChatGPT和谷歌结合的超级工具,可以让你在浏览互联网时提出问题或获得即时摘要

Perplexity 302 查看详情 Perplexity

ByteFF模型结构的设计保证了参数预测结果符合物理约束,例如相同化学环境的结构具有相同的结构参数预测,原子部分电荷之和等于分子的总电荷等。

在训练方面,研究团队构建了包含240万个不同分子碎片的优化数据集和320万个不同二面角的扭转数据集。基于这些数据集,研究人员设计了针对性的Hessian损失函数,能够对批量数据进行端到端训练。

由于传统力场形式的限制,难以完美拟合量子化学计算的势能面,研究人员在扭转数据集上采用了迭代的“结构优化-训练”策略,以确保ByteFF在二面角(关键自由度)上提供准确的势能面预测。

此外,研究团队还采用了预训练、训练和微调的多阶段训练流程,以达到最佳训练效果。

性能评估

在结构优化方面,ByteFF显著优于业界领先的OPLS4+ffbuilder(标记为“OPLS4 cst”)。

图片

ByteFF能够准确预测小分子(包括环状和非环状分子)的二面角势能面。

图片

更多结果请参考原文。

总结与展望

ByteFF力场凭借其先进的网络结构设计、充足的训练数据和匹配的训练方案,在结构优化和分子势能面预测等方面取得了显著成果。

ByteFF继承了GAFF2的非键参数,保证了与Amber力场的兼容性,但其非键相互作用方面仍有提升空间,这将是未来的研究重点。

目前,ByteFF免费API测试正在进行中,如有需求,请联系论文通讯作者并注明单位和用途。欢迎同行试用并提供反馈。

以上就是AI赋能传统力场:字节跳动开发高精度通用小分子力场ByteFF的详细内容,更多请关注其它相关文章!


# 化学  # 药物  # 理论  # 解锁  # 互联网  # 小鹏  # 是一个  # 速度慢  # 官网  # 万个  # 采用了  # 结构优化  # 2025  # ai  # cad  # 分子  # 科学  # 但其  # 潮州营销网站建设方案  # 服饰号怎么营销推广的呢  # 音乐生能做的网站推广  # 哪些网站适合推广淘宝店  # 浙江seo基础知识  # 义乌网站建设信息网  # 山东网站建设模板制作  # 长沙推广营销网站排名  # 绥化seo线上营销技巧  # 抚州营销推广 


相关栏目: 【 行业资讯67740 】 【 技术百科0 】 【 网络运营39195


相关推荐: 折叠屏手机选择哪个好  三星固态硬盘如何保修  交管12123协议头不完整怎么解决  类似微信的聊天软件有哪些  linux如何切换到命令行模式  广东春运抢票怎么抢的  直接gmV是什么意思?直接GMV:定义和概念  夸克网盘下载为什么要钱  怎么在爱奇艺中投屏到电视最新方法  如何用ftp连接命令行  typescript和nodejs哪个好  电焊机power灯亮是什么意思  如何进入 dos 命令行  360手机壁纸怎么改  win7怎么做幻灯片  typescript与es6学哪个  如何注释typescript  python和typescript学哪个  春运抢票准备什么  linux如何打开命令窗口  建伍遥控器power是什么意思  如何查看硬盘是固态硬盘  j*a中如何创建列表数组  ao3镜像网站永久地址入口  typescript能干什么  苹果16promax有哪些颜色  r中如何逐行执行命令  一分钟等于多少秒  如何在命令提示符播放音频  折叠屏手机好不好,耐不耐用  typescript数据怎么写  grub命令如何进dos  市盈率负值是什么意思  苹果16系统有哪些系列  联想手机如何输入命令行  华硕k20ce怎么装win7  typescript中如何引入本地js  360桌面壁纸怎么弄掉  交管12123协议头是什么  命令行ftp如何创建目录  单片机怎么发送can 信号  油电混动车仪表盘上的power是什么意思  如何查看固态硬盘分区  如何更新typescript  如何以命令符运行程序  光刻机的分类及特点  命令行如何打开文件  如何看固态硬盘信息  type-c全能接口是什么意思  dos命令 如何将变量 作为路径的一部分 

搜索