今日头条 · 2026.07.26
Anthropic 发布 Claude Opus 5,主打接近前沿能力和更低任务成本
Anthropic 发布 Claude Opus 5,价格维持每百万输入 5 美元、输出 25 美元。原帖称它在多项基准接近 Fable 5,但任务成本约为后者一半。
解读模型发布的看点不只是分数,而是把“接近最强能力”包装成可规模化使用的成本问题。团队选型时需要用自己的任务集复测,而不是只看发布基准。
今天先看两件事:Opus 5 把前沿模型竞争拉回到成本和任务表现,Replit、Cognition、Atomic Agent 与 Dari 则把 Agent 能力放进真实工程场景。工具和应用层也在变实用,重点从“生成一个结果”转向“接入后续工作流”。
短期更值得验证的不是单个最强模型,而是模型路由、缓存、评测和流程边界。能把任务拆成可评价步骤的团队,会更快把 AI 变成稳定产能。
只看重点,先读前 6 条;做工程效率,看 Agent / 工具分组;关心企业落地,再看应用 / 商业分组。
模型能力、开放权重、研究结果与评测层变化。
产品更新、工作流入口与开发者工具能力变化。
智能体、协作系统、cloud agent 与自动化工作流。
真实场景、企业落地、产品化与采用路径。
值得保留的产品思想、方法论与趋势判断。