玻尔 DPA4 发布:单卡 RTX 5090 实现 SOTA 精度,重新定义原子势能模型效率边界

ADK 玻尔官方 / ADK编译 2026-07-29 5 分钟 104 次浏览
速览导读 / Summary

由玻尔(Bohrium)联合北京大学等机构推出的 DPA4 模型,通过创新的 EMFA SO(2) 卷积架构,在 Matbench Discovery 榜单上斩获全球第一。相比前代模型 eSEN,DPA4 将训练成本从 300+ 张 GPU 天降低至单张消费级 RTX 5090 约 1 天,同时保持同等精度。该模型首次原生支持 torch.compile 编译加速,并在物理一致性上严格满足能量守恒与对称性要求,标志着高精度原子势能模型从云端超算走向桌面端。

训练成本 1 RTX 5090 (1 天) 相比前代 eSEN 的 300+ GPU 天,降低 99% 以上
参数量 < 1/10 eSEN 在同等精度下实现参数最小化
训练加速 2-3x (torch.compile) 原生编译支持带来的端到端加速
综合效率 10x vs DPA3 相比前代模型的整体效率提升
基准排名 Global #1 Matbench Discovery 与 SPICE-MACE-OFF 双榜第一

Key Insights / 核心看点

  • 1 架构创新:首创 EMFA SO(2) 卷积,将计算复杂度从 $O(l_{max}^6)$ 降至线性级别,大幅降低等变计算开销。
  • 2 成本革命:训练成本从 300+ GPU 天降至单张 RTX 5090 约 1 天,参数量减少至前代的 1/10。
  • 3 效率飞跃:原生支持 torch.compile 编译加速,训练速度较前代提升 2-3 倍,整体效率提升约 10 倍。
  • 4 物理一致性:严格满足平移、旋转、置换对称性及能量守恒,确保在极端物理条件下的鲁棒性。
  • 5 性能登顶:在 Matbench Discovery 和 SPICE-MACE-OFF 两大权威基准上均斩获全球第一。

玻尔 DPA4:单卡实现 SOTA 精度的原子势能新纪元

在大型原子模型(LAMs)领域,竞争范式正经历深刻变革:从单纯堆砌参数转向构建更强、更快且计算轻量化的模型。2026 年 7 月,由 AI for Science Institute(AISI)、北京大学、DP Technology 及应用物理与计算数学研究所联合发起的 OpenLAM 团队,正式发布了下一代架构——DPA4

DPA4 在权威基准 Matbench Discovery 上以综合性能得分(CPS)位列全球第一,确立了新的 State-of-the-Art(SOTA)。更令人振奋的是,DPA4 并未依赖庞大的参数规模,而是通过架构创新,将训练成本大幅压缩。此前领先的 eSEN 模型需要超过 300 个 GPU 天的训练时间,而 DPA4 仅需单张消费级 RTX 5090 显卡约 1 天即可达到相当精度,其参数量不足 eSEN 的十分之一。

这意味着,曾经只有企业级超算预算才能触及的 SOTA 精度,如今已可在普通桌面显卡上实现。DPA4 重新定义了精度与效率的帕累托前沿。

核心架构突破:EMFA SO(2) 卷积

DPA4 的核心创新在于其独特的EMFA SO(2) 卷积设计,旨在解决传统等变模型计算开销过大的瓶颈。

传统等变模型依赖 Clebsch-Gordan (CG) 张量积来耦合不同阶的几何特征以维持旋转对称性,但其计算复杂度随最大角动量阶数 $l_{\max}$ 呈 $\mathcal{O}(l_{\max}^6)$ 增长,成为高精度模型的计算瓶颈。

DPA4 的策略是将对称操作简化为更简单的子群:

  1. 局部坐标系重构:为每一条原子间键构建平滑的局部坐标系,使键方向与统一参考轴对齐。
  2. SO(2) 等变映射:将原本在全局 $SO(3)$ 群上的旋转等变性,降低为围绕参考轴的 $SO(2)$ 子群等变性。
  3. 块对角结构优势:由于 $SO(2)$ 是阿贝尔群,其等变线性映射具有极简洁的块对角结构,成功用高效的 $SO(2)$ 等变算子替代了昂贵的 $SO(3)$ 张量积。

此外,模型结合了注意力机制进行邻域特征聚合,自适应关注对中心原子关键的相互作用,在紧凑的参数 footprint 下实现了强大的表达能力。整个模型严格满足平移、旋转、置换对称性及能量守恒,确保物理一致性。

工程优化与性能指标

除了算法创新,DPA4 在工程实现上也进行了深度优化:

  • 原生 torch.compile 支持:DPA4 从设计之初就面向编译器优化,无需修改代码即可通过 torch.compile 实现端到端加速,训练速度提升 2-3 倍
  • 原生 ZBL 短程势:内置 Ziegler-Biersack-Littmark (ZBL) 排斥势,使模型在高压、辐射及结构缺陷等极端配置下依然稳健。
  • 双榜 SOTA:不仅在 Matbench Discovery 登顶,还在小分子基准 SPICE-MACE-OFF 上取得第一。

实际应用价值

DPA4 的发布对开发者与科研界具有深远影响:

  1. 降低科研门槛:材料发现不再受制于昂贵的算力集群,高校实验室或个人研究者均可利用单卡设备运行高精度模型。
  2. 加速材料发现:在保持预测精度的前提下,训练效率相比前代 DPA3 提升了约 10 倍,极大缩短了从数据训练到模型部署的周期。
  3. 物理可信度:严格遵循物理定律(如能量守恒),使得模型在模拟极端环境下的材料行为时更加可靠。

目前,DPA4 已向 DeepModeling 社区开放早期预览,完整论文与官方仓库即将开源。这一突破无疑将推动 AI for Science 从“可用”迈向“普惠”的新阶段。

DPA4 redefines the accuracy-efficiency Pareto frontier. SOTA accuracy—once accessible only through enterprise-level supercomputing budgets—can now be achieved on a single desktop graphics card.

OpenLAM Team / Bohrium

同主题深度资讯

查看更多 →
模型发布 2026-09-08

Framer AI 发布 CMS List Field:重构重复内容管理,赋能动态网站构建

Framer 于 2026 年 9 月正式发布 CMS List Field,彻底革新了重复内容(如 FAQ、产品特性)的管理方式。该更新引入原生列表字段,支持通过 Framer Agent 一键迁移旧数据,并优化了编辑器的内容复用与排序能力。此次更新不仅解决了垂直视频嵌入等长期存在的 Bug,还显著提升了大型 CMS 集合的滚动性能,为开发者提供了更强大的动态内容构建工具。

Framer AI官方 / ADK编译 4 分钟
模型发布 2026-09-08

Ajelix 自研 GPU 基础设施并推出企业级 Agentic 平台,解决数据主权与生产落地难题

Agentic AI 平台 Ajelix 宣布投资自建 GPU 计算基础设施,并正式发布面向企业的 Ajelix Enterprise Platform。此举旨在解决企业级 AI 落地中数据不可控、审计困难及中断风险等痛点。新平台提供从智能体编排、RAG 知识库到严格治理的全栈能力,支持私有化部署,助力企业将 AI 从实验阶段平稳过渡到生产运营。

Ajelix官方 / ADK编译 4 分钟
AI 工具 2026-09-08

DreamFace 发布 AI 直播生成器:零设备打造虚拟主播,重塑内容创作流程

DreamFace 正式推出 AI 直播生成功能,彻底消除传统直播对相机、灯光及推流软件的依赖。用户仅需上传照片或选择虚拟形象,配合脚本即可在数分钟内生成具备真实直播节奏与能量的视频。该工具支持游戏、带货、播客等多种模板,让创作者无需露脸即可测试新内容形式,大幅降低内容生产的门槛与试错成本。

DreamFace官方 / ADK编译 3 分钟
技术解读 2026-09-08

Accio Work 发布 F1 电视转播技术深度解析:8K 流媒体与超低延迟架构揭秘

Accio Work 深度编译 F1 TV 如何永久改变体育转播的历程,聚焦于日本市场策略、8K 流媒体技术革新及超低延迟架构。文章揭示了现代体育直播对带宽、编码及 CDN 的极致要求,包括 45% 的带宽消耗增长和亚 200ms 延迟标准。同时探讨了数字观众如何驱动 23 亿美元的周边销售,为开发者与架构师提供了从传统广播向数字化、智能化转型的宝贵案例与技术指标参考。

Accio Work官方 / ADK编译 3 分钟
search · 免费+付费
★ 5.0 · 120评测

玻尔

新一代科研知识库与AI学术搜索平台

玻尔(Bohrium)是深势科技联合北京科学智能研究院(AISI)推出的全球首个覆盖“读文献-做计算-做实验-多学科协同”的AI科研平台。平台以“科学导航(Science Navigator)”为核心,提供强大的AI学术搜索、多模态搜索能力、个性化推荐、知识库管理等功能,帮助科研人员高效筛选文献、整理数据、发现关键问题。玻尔能重构科研流程,释放科研创造力,让人工智能成为科学发现的真正参与者。

查看 玻尔 使用教程与功能