Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.067 — 2026-09-09
NEWS 约 5 分钟

Claude Sonnet 5登场

Anthropic推出主力模型Claude Sonnet 5:更强的代理能力与更低门槛,正重新划定中档模型的竞争位置。

IMAGE — Anthropic (via Google News)

你交给 AI 一项跨软件的工作:先修改客户资料,再筛选联系人,最后发送通知。它往往不是不会做,而是做到一半便停下,或在某一步选错工具。Anthropic 推出的 Claude Sonnet 5,瞄准的正是这种需要连续执行、纠错和收尾的任务。它仍处在强调能力、速度与成本平衡的 Sonnet 主力档,但公司想让它承担过去往往需要更大、更贵模型完成的工作。

需要先说明:目前关于发布日期、价格和能力的材料主要来自 Anthropic,尚无独立评测或云平台公告交叉印证。官方页面还混有 Claude Sonnet 4.6 的标题和描述,因此不能确认 Sonnet 5 是否具备页面提到的 100 万 token 上下文窗口。

“中档”开始接更难的活

Anthropic 将 Claude Sonnet 5 的发布日期标为 2026 年 6 月 30 日,并称它是迄今“代理能力最强的 Sonnet”。所谓 Agent,也就是能围绕一个目标连续规划、调用工具并根据结果调整行动的 AI。工具调用则是让模型按规定格式操作搜索、终端或企业软件,而不只是生成一段文字。

按照 Anthropic 的产品描述,Sonnet 5 重点覆盖编程、工具使用和日常专业工作。公司称,它能以 Sonnet 档位的速度和价格,提供近期还需要更大、更昂贵模型才能实现的表现。不过,官方没有在供稿中给出足以验证这一比较的具体基准数字,“最强”“更可靠”等表述仍应视作产品方主张。

这次变化的看点在于产品定位。Sonnet 原本位于 Claude 家族中间:Haiku 更轻便,Opus 通常更强也更贵。据 Anthropic 与 Axios 的材料,Sonnet 5 推出时被设为 Claude 免费版和 Pro 版的默认模型;Anthropic 还称其表现接近 Opus 4.8,在部分高强度任务上可达到后者的能力水平。换句话说,过去留给旗舰模型的代理任务,正在被推向面向更多用户的主力档。

价格也是产品能力的一部分

据 Anthropic 公布的信息,Sonnet 5 已可在 Claude.ai 网页端、iOS 和 Android 使用。开发者可通过 Claude Platform、Amazon Web Services、Google Cloud 和 Microsoft Foundry 调用;Claude API 中的模型标识为 claude-sonnet-5

标准价格是每百万输入 token 2 美元、每百万输出 token 10 美元。Token 可以粗略理解为模型处理文字时使用的计量单位。输入是交给模型的内容,输出是模型生成的内容。对必须在美国境内完成推理的工作负载,输入和输出均按标准价格的 1.1 倍收费。

成本还取决于怎么调用。Anthropic 称,prompt caching 最高可节省 90%:它会缓存反复使用的提示内容,避免每次都重新处理。batch processing 可节省 50%,也就是把不要求即时返回的任务集中成批处理。这些数字都有适用条件,并不意味着任何工作负载都会自动获得同等折扣。

API 用户还可以细粒度调节 thinking effort,即模型在回答前投入多少推理计算。这是混合推理模型的重要开关:简单任务可以快速作答,复杂任务则允许模型多花计算。对实时 Agent 或大批量业务来说,使用者由此能在响应时间、成本和质量之间做取舍。

为什么值得关注?

模型市场的竞争不只看谁能回答最难的问题,也看谁能以可接受的成本,把任务稳定做完。Sonnet 5 的真正挑战,是能否把工具选择、持续执行和出错后的修正变成可规模化使用的能力。如果官方主张能够在真实业务中成立,它会压缩“主力模型”与“旗舰模型”之间的能力距离,也会迫使竞争者重新调整价格和产品分层。

发布当天的一个插曲也值得记住。据 Anthropic 的更正说明,最初的 BrowseComp 性价比图使用了比公司标准流程更简单的评测方法,低估了 Sonnet 5 的表现;公司随后依照系统卡的方法更新图表和文字。无论修正方向如何,这都说明模型大战中的漂亮坐标图不能脱离评测口径来读。

局限与未知

  • 现有材料没有提供可供比较的完整基准成绩,编程、工具使用和长期代理能力仍主要是官方定性描述。
  • 页面排版把 Sonnet 4.6 与“100 万 token 上下文窗口”放在一起,无法稳妥确认该规格属于 Sonnet 5。上下文窗口是模型一次能读取的信息总量;窗口更大,也不代表模型能同样准确地利用其中每个细节。
  • 官方列出了多个云平台,但现有材料没有相应平台的独立公告交叉验证。

供稿材料 SOURCES — 1
01
Claude Sonnet 5 Anthropic (via Google News) · NEWS
原文 ↗

← 返回 2026-09-09 · 科技板块