Anthropic 发布 Claude Opus 5:近 Fable 5 智商,一半成本,代码与科学任务全面突破

ADK Claude Code官方 / ADK编译 2026-07-24 5 分钟 57 次浏览
速览导读 / Summary

Anthropic 正式发布 Claude Opus 5,宣称在保持 Opus 系列成本优势的同时,智商水平逼近旗舰模型 Fable 5。Opus 5 在 Frontier-Bench、CursorBench 等代码评测中表现卓越,甚至在特定任务上超越 Fable 5 且成本减半。在科学计算、自动化工作流及视觉生成领域亦展现出显著进步,成为开发者与科研人员的理想选择。

成本效率 50% 相比 Fable 5 成本降低一半
代码性能提升 22% 相比 Opus 4.7 在 FrontierCode 上的提升
自动化任务通过率 1.5x 相比次优模型在 Zapier 评测中的表现
视觉生成能力 Enhanced 支持复杂交互式图表与物理模拟图

Key Insights / 核心看点

  • 1 性能逼近 Fable 5:在代码与科学任务中表现卓越,成本仅为前代的一半。
  • 2 自主智能体能力:具备自主编写视觉解析管道、深度根因分析及全栈应用构建能力。
  • 3 科学计算突破:在有机化学与蛋白质任务上得分显著提升,优于前代模型。
  • 4 极致稳定性:在复杂长程任务中展现出极低的方差,确保结果可重复。
  • 5 视觉生成增强:能够生成高质量的风洞模拟与交互式细胞结构图。

Claude Opus 5:重新定义生产力与科学探索的平衡点

7 月 24 日,Anthropic 正式推出了其最新旗舰模型 Claude Opus 5。这款模型被定位为“深思熟虑且主动”(thoughtful and proactive)的 AI 智能体,其核心愿景是在提供接近顶级模型 Fable 5 的智力水平时,将价格降低至一半。

对于依赖代码编写、复杂问题解决及科学研究的开发者而言,Opus 5 不仅是一次性能升级,更是一次成本效益的革命。

核心突破:性能与成本的极致平衡

Opus 5 在多个关键基准测试中确立了新的行业标准,特别是在软件工程和知识工作领域。

  • 代码能力飞跃:在 Frontier-Bench v0.1 评测中,Opus 5 的表现超越了所有其他模型,且任务成本比前代 Opus 4.8 降低了一半以上。在 CursorBench 3.2 中,它在最大努力模式下得分仅比 Fable 5 低 0.5%,但成本仅为后者的一半。
  • 科学计算新高度:在生命科学评估中,Opus 5 在所有指标上均优于 Opus 4.8。特别是在有机化学任务(如从光谱数据推断分子结构)和蛋白质任务(如预测序列变异对功能的影响)上,其得分分别提升了 10.2 和 7.7 个百分点。
  • 视觉生成增强:模型在生成复杂视觉输出方面表现更强,成功构建了风洞空气流动模拟图及交互式细胞结构图。

真实场景中的“智能体”能力

Opus 5 展现了惊人的自主性(Agency)和严谨性,能够在缺乏直接辅助的情况下独立完成任务。

  1. 自主视觉解析:在一个测试中,模型被要求根据机器零件图纸编写 3D 重建代码,但被刻意剥夺了直接查看图纸的权限。Opus 5 通过编写自己的计算机视觉管道,从原始像素中提取几何信息,并成功反复重建了零件,而竞品模型在五次尝试后均失败。
  2. 深度根因分析:面对开源包管理器中的真实 Bug,Opus 5 不仅修复了表面症状,更找到了社区补丁遗漏的根本原因。相比之下,竞品模型仅修复了表象。
  3. 全栈应用构建:一名交易员利用 Opus 5 在单次会话中构建了新的市场数据 feeds。由于缺乏实时数据源验证,Opus 5 甚至自行构建了测试框架来验证代码解析的正确性。

关键指标与价值总结

| 指标/场景 | 表现描述 | 关键数据 | 对比基准 | | :--- | :--- | :--- | :--- | :--- | 代码效率 | 成本减半,性能翻倍 | 成本降低 >50% | Frontier-Bench v0.1 | 自动化任务 | 通过率领先 | 通过率 1.5 倍 | Zapier AutomationBench | 科学计算 | 有机化学显著提升 | +10.2 个百分点 | 内部有机化学基准 | 视觉生成 | 复杂场景构建 | 风洞/细胞图 | 交互式细胞图 | 稳定性 | 极低方差 | 22% 提升 | FrontierCode 1.1 |

结语

Anthropic 强调,Opus 5 是 Opus 家族自 4.5 版本以来最大的飞跃。它不仅仅是一个更强的模型,更是一个能够像严谨科学家一样进行多步骤分析、像资深工程师一样进行根因排查的可靠伙伴。对于追求高智商与高成本效益并存的开发者生态,Opus 5 无疑是一个里程碑式的发布。

"Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost." —— Anthropic 官方团队

Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.

Anthropic 官方团队

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
AI 工具 2026-09-08

Accio Work 2026 安全剃须刀刀片评测指南发布:覆盖敏感肌与硬茬胡须的全场景解决方案

Accio Work 于 2026 年 9 月发布最新评测指南,针对 2026 年湿剃市场的演变,深度解析了 8 款最佳安全剃须刀刀片。指南涵盖从 Astra Superior Platinum 的全能王者到 Feather Hi-Stainless 的极致锋利,特别强调了针对敏感肌肤(如 Derby Extra Super Stainless)和环保需求(如 Personna Lab Blue)的专项解决方案,为不同肤质与胡须类型的用户提供精准选型建议。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 发布厨房研磨工具智能指南:材料选择与性能优化解析

Accio Work 发布了一篇关于研磨钵(Mortar and Pestle)最佳材料选择的深度指南。文章详细对比了花岗岩、大理石、陶瓷、木材及不锈钢等主流材质在研磨性能、耐用性、维护难度及美学风格上的差异。该指南旨在帮助消费者及零售商根据烹饪需求(如香料粉碎、酱汁制作)做出精准决策,体现了 Accio Work 在垂直领域知识库构建与搜索优化方面的技术实力。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 2026 年迷你喷射快艇设计趋势:电动化与模块化重塑水上运动

Accio Work 发布 2026 年迷你喷射快艇设计趋势报告,展示了 9 款重新定义水上运动的新概念。核心亮点包括革命性的充气式电动快艇、热插拔电池系统的通勤者设计、以及专为家庭安全优化的模块化构建方案。这些设计利用先进复合材料与零排放电动动力,解决了传统水上运动便携性差、续航焦虑及安全性不足的问题,为个人娱乐与商业租赁市场提供了全新灵感。

Accio Work官方 / ADK编译 3 分钟
code · 付费
★ 5.0 · 120评测
C

Claude Code

Anthropic 推出的AI编程工具

Claude Code 是 Anthropic 公司推出的基于命令行的AI 编程工具。Claude Code集成先进的 Claude Opus 4 语言模型,能理解自然语言指令,自动生成、修改和调试代码,并与 VS Code、JetBrains 等主流 IDE 深度集成。Claude Code支持 200K 超长上下文,能快速索引整个代码库并理解复杂依赖关系。Claude Code 具备文件操作、代码搜索、网页浏览和 Git 工作流管理等功能,显著提升开发效率。Claude Code帮助开发者快速生成高质量代码,能直接在开发环境中执行命令,避免频繁切换界面,极大地优化开发流程。最新版推出自动安全审查功能,在漏洞发布之前捕获漏洞。Claude Code 新功能 Opus 规划模式支持高效且智能的开发规划,用户能在复杂项目中借助 Opus 4.1 模型的强大分析能力制定高质量的开发计划,在执行阶段切换到 Sonnet 模型,实现高效、低成本的代码生成。

查看 Claude Code 使用教程与功能