THEVOS
实用技巧

Anthropic 发布 Claude Opus 5 — 以半价提供前沿级性能

作者 THEVOS 編集部· 2026-07-27 ·2 分钟阅读 ·677
Anthropic 发布 Claude Opus 5 — 以半价提供前沿级性能

2026年7月24日,Anthropic 发布了新的 AI 模型 Claude Opus 5。重点有两个:性能逼近旗舰模型(Fable 5),部分项目还更胜一筹价格与上一代(Opus 4.8)保持不变

1. 价格 — 没有上涨

  • Claude Opus 5 — 输入每百万 token $5 / 输出每百万 token $25
  • Fable 5(旗舰模型) — 输入 $10 / 输出 $50

同样的任务有了以一半成本完成的空间。由于单价与 Opus 4.8 相同,已经在用 Opus 的团队相当于成本不变、性能提升

2. 基准测试 — 代际差距明显

  • FrontierBench v0.1 — Opus 5 43.3% / Opus 4.8 18.7% / Fable 5 33.7%
  • ARC-AGI-3(推理) — Opus 5 30.16% / Opus 4.8 1.52%
  • OSWorld 2.0(计算机操作) — Opus 5 70.57% / Opus 4.8 55.7%
  • SWE-bench Verified(真实代码修复) — 96.0%
  • Zapier AutomationBench(业务自动化) — Opus 5 26.0% / Opus 4.8 17.0%
Opus 5 Opus 4.8 Fable 5 0% 20% 40% 60% 80% 43.3 18.7 33.7 FrontierBench v0.1 30.16 1.52 ARC-AGI-3 70.57 55.7 OSWorld 2.0 26.0 17.0 17.4 AutomationBench
主要基准测试得分对比(单位 %)。SWE-bench Verified 96.0% 超出坐标范围,未纳入图表。来源:2026年7月24日发布及相关报道。

提升最明显的是智能体型任务:修改代码、操作界面、自主串联多个步骤。不过这些数值来自官方发布与相关报道,实务中建议用自己的数据验证

3. 规格

  • 100 万 token 上下文 — 可一次处理长文档或大型代码库
  • 最大输出 12.8 万 token(Batches API 为 30 万)
  • 知识截止为 2026年5月 — 历代 Claude 模型中最新
  • 模型 ID claude-opus-5 · Claude Max 默认模型、Pro 最高级模型

4. 实务上如何看待

性能提升而单价不变,意味着此前因成本而搁置的自动化开始越过盈亏平衡点。结合我们自身的服务运营,有三点值得关注。

  • AI 咨询应答 — 在提升回答质量的同时,维持甚至降低单次咨询成本。
  • 多语言内容 — 运营 13 种语言时,逐词替换式翻译与结合上下文的翻译差异会直接显现。
  • 开发与运维自动化 — 代码修改、日志巡检等人工作业可委派的范围扩大。

但仅更换模型并不会自动带来更好的结果。提供什么资料、如何提供(知识与上下文设计)依然决定质量。

小结

Claude Opus 5 动摇了"想要更好效果就必须用更贵模型"的前提。能以半价尝试旗舰级效果,这是它在实务上最大的意义。

※ 性能与价格数值基于 2026年7月24日的发布及相关报道。

分享 LINE X Facebook

评论 (0)

暂无评论,来发表第一条评论吧。

相关文章

THEVOS
首页 首页 服务 网站制作服务 网站托管 邮件服务 域名服务 解决方案 VosCMS 解决方案 商城解决方案 TMS 解决方案 AI Hanes 解决方案 预约解决方案 夜间行业配对解决方案 社区 公告 自由论坛 问答 常见问题 案例展示 博客 联系我们
登录 注册