⚠️ 平时只把 Claude 当聊天和写代码助手的人,这次最容易被宣传带偏。你本来只是来看模型是不是又变强了,结果真正会让你吃亏的,是把 Claude 当成同一种工具,以为谁分高谁就适合自己。要是按这个思路看,你会以为自己只是拿到更强版本,实际更可能把整套任务分工用错,后面越用越乱。
这类发布最值得看的,常常不是它多强,而是它为什么先把边界收紧。我的判断只有一句:Sonnet 5把中档模型推成默认执行层。[C002] 翻成人话,就是你平时最常开的那档,开始能接更完整的活。最会引发讨论的,从来不是模型又强了,而是最强的那个为什么没直接端上来。
我去看官方那篇《Introducing Claude Sonnet 5》(可以先理解成 Sonnet 5 发布说明)后,才觉得这次别按“聊天升级”来理解。[C001] 发布页直接把它定义成 Sonnet 系列里最能自主执行(agentic)的一档:能规划、使用浏览器和终端,还把几个月前还要更大更贵模型才能做的自主任务,下放到 Sonnet 这一档。[C003]
更直接的一条,是 Effort 文档给 Sonnet 5 单独开放最高努力档(xhigh),用于超过 30 分钟的长程自主执行和编程任务。[C004] 连“超过 30 分钟”都写出来了,意思已经很明显:它被安排去扛长活,不只是陪聊,也不只是补一段代码。
所以这波更新,更适合正在分聊天、写代码、连续任务的人先收藏,再回头改自己的模型分工;不太适合拿来找一个“无脑最强”答案的人。我不会把“某些任务接近 Opus 4.8”硬说成“全面平替”。先收藏,再拿你手里的连续任务对一遍:哪些该先交给 Sonnet 5,哪些还不能一把全切。
🤔 你现在最想先避开的,是哪一个坑?