Claude Sonnet 5 上线:中阶模型打出 Opus 级表现,8 月底前促销价 2 美元起跑

Anthropic 于 6 月 30 日推出 Claude Sonnet 5,agentic 编码测试拿下 63.2%、直逼旗舰 Opus 4.8,价格却只要每百万输入 tokens 2 美元(8/31 前促销)。免费版与 Pro 版已预设采用。这对台湾开发者与企业的意义,我们拆给你看。

台北一位接案工程师最近发现,他挂在 Claude 免费版上的预设模型悄悄换了——跑一个爬虫加资料清理的多步骤任务,以前中途会断,现在一路跑完还自己检查了输出。他用到的,就是 Anthropic 在 6 月 30 日正式推出的 Claude Sonnet 5。

事件背景

Anthropic 的产品线一直是三层:轻量的 Haiku、中阶的 Sonnet、旗舰的 Opus(以及更上层的 Fable/Mythos)。Sonnet 5 是 Sonnet 4.6 的接班人,官方定位讲得很直白:几个月前还需要更大、更贵模型才办得到的自主规划、用浏览器与终端机这类工具、长时间自跑任务,现在中阶模型就给你。

发布后它直接成为 Claude 免费版与 Pro 版的预设模型,API 型号是 claude-sonnet-5,Claude Code 也同步支援。

本次重点

  • 价格是最大亮点:2026 年 8 月 31 日前促销价每百万输入 tokens 2 美元、输出 10 美元;之后回到 3/15 美元。即使原价,也比 Opus 4.8、GPT-5.5 与 Gemini 3.1 Pro 便宜。
  • agentic 编码 63.2%:同一基准下 Opus 4.8 是 69.2%、前代 Sonnet 4.6 是 58.1%——中阶模型与旗舰的差距,从一个世代缩到六个百分点。
  • 知识工作略胜旗舰:官方数据显示 Sonnet 5 在知识工作类任务甚至小胜 Opus 4.8。
  • 更能跑完长任务:早期测试者的一致回馈是「以前跑到一半会停,现在会自己跑完、还会主动检查输出」;Zapier 工程师直言对日常自动化是 no-brainer。
  • 安全性同步提升:相比 Sonnet 4.6,误用配合、欺瞒、幻觉与谄媚回应的比率都降低,对提示注入的抵抗力也更好。

市场影响分析

台湾使用者:免费仔最有感——免费版预设就是 Sonnet 5,等于零成本用上接近旗舰的能力。写报告、整理资料、翻译润稿这类日常任务,现在免费额度内的品质天花板又抬高了一截。

企业应用:对评估导入 AI 客服、内部自动化的台湾企业,Sonnet 5 把「能自主跑完多步骤任务」的价格门槛砍掉一大截。搭配 n8nZapier 这类自动化平台,以前要旗舰模型才稳的流程,现在用中阶价格就能上线,POC 成本直接减半以上。

开发者:8 月 31 日是个真实的行事历事件——促销期内输入 tokens 省 33%,重度 agent 工作负载值得趁这两个月把测试跑满再决定长约。在 Cursor、Claude Code 这类工具里把预设模型切到 Sonnet 5,多数编码任务的性价比目前很难找到对手。

未来发展趋势

Sonnet 5 标志的产业转向很明确:战场从「谁的旗舰最聪明」移到「谁能把 agent 级能力压到最低单价」。当中阶模型追到旗舰九成功力、价格只要几分之一,旗舰模型就必须靠真正拉开差距的难任务(长程规划、科研级推理)证明自己。对使用者是好消息:接下来半年,各家的中阶与轻量模型会被迫跟进降价或加料。

TheAI学院 总结与评语

我们实际把日常的资料整理与写程式任务丢给 Sonnet 5 跑了两周,体感最明显的不是「更聪明」,而是「更不会半途而废」。这对拿 AI 当生产力工具的人,比跑分重要得多。

评语:Sonnet 5 是 2026 年目前性价比最高的主力模型,没有之一;8/31 前的促销价是真便宜,开发者请把握。一般使用者什么都不用做——你的免费版已经升级了。

资料来源

依公开资讯整理,定价与功能以 Anthropic 官方为准。

常见问题

Claude Sonnet 5 免费版可以用吗?

可以。Sonnet 5 上线后直接成为 Claude 免费版与 Pro 版的预设模型,一般使用者不用做任何设定就已经在用了;Max、Team 与 Enterprise 方案也都支援。

Claude Sonnet 5 的 API 价格是多少?

2026 年 8 月 31 日前是促销价:每百万输入 tokens 2 美元、输出 10 美元;9 月起回到 3 美元与 15 美元。即使是原价,也比 Opus 4.8、GPT-5.5 和 Gemini 3.1 Pro 便宜。

Sonnet 5 跟旗舰 Opus 4.8 差多少?

agentic 编码基准 Sonnet 5 拿 63.2%、Opus 4.8 是 69.2%,差距约六个百分点;知识工作类任务 Sonnet 5 甚至略胜。多数日常与开发任务用 Sonnet 5 就够,超难任务再上旗舰。

现在导入该选 Sonnet 5 还是等其他新模型?

如果你的需求是编码、自动化与日常知识工作,Sonnet 5 的性价比目前很难找到对手,而且促销价只到 8 月底。与其等传闻中的新模型,不如先用真的上线的把事做完。

繁體中文版 →