Anthropic 发布 Claude Opus 5 — 以半价提供前沿级性能
2026年7月24日,Anthropic 发布了新的 AI 模型 Claude Opus 5。重点有两个:性能逼近旗舰模型(Fable 5),部分项目还更胜一筹;价格与上一代(Opus 4.8)保持不变。
1. 价格 — 没有上涨
- Claude Opus 5 — 输入每百万 token $5 / 输出每百万 token $25
- Fable 5(旗舰模型) — 输入 $10 / 输出 $50
同样的任务有了以一半成本完成的空间。由于单价与 Opus 4.8 相同,已经在用 Opus 的团队相当于成本不变、性能提升。
2. 基准测试 — 代际差距明显
- FrontierBench v0.1 — Opus 5 43.3% / Opus 4.8 18.7% / Fable 5 33.7%
- ARC-AGI-3(推理) — Opus 5 30.16% / Opus 4.8 1.52%
- OSWorld 2.0(计算机操作) — Opus 5 70.57% / Opus 4.8 55.7%
- SWE-bench Verified(真实代码修复) — 96.0%
- Zapier AutomationBench(业务自动化) — Opus 5 26.0% / Opus 4.8 17.0%
提升最明显的是智能体型任务:修改代码、操作界面、自主串联多个步骤。不过这些数值来自官方发布与相关报道,实务中建议用自己的数据验证。
3. 规格
- 100 万 token 上下文 — 可一次处理长文档或大型代码库
- 最大输出 12.8 万 token(Batches API 为 30 万)
- 知识截止为 2026年5月 — 历代 Claude 模型中最新
- 模型 ID
claude-opus-5· Claude Max 默认模型、Pro 最高级模型
4. 实务上如何看待
性能提升而单价不变,意味着此前因成本而搁置的自动化开始越过盈亏平衡点。结合我们自身的服务运营,有三点值得关注。
- AI 咨询应答 — 在提升回答质量的同时,维持甚至降低单次咨询成本。
- 多语言内容 — 运营 13 种语言时,逐词替换式翻译与结合上下文的翻译差异会直接显现。
- 开发与运维自动化 — 代码修改、日志巡检等人工作业可委派的范围扩大。
但仅更换模型并不会自动带来更好的结果。提供什么资料、如何提供(知识与上下文设计)依然决定质量。
小结
Claude Opus 5 动摇了"想要更好效果就必须用更贵模型"的前提。能以半价尝试旗舰级效果,这是它在实务上最大的意义。
※ 性能与价格数值基于 2026年7月24日的发布及相关报道。

评论 (0)
暂无评论,来发表第一条评论吧。