Sonnet 5 來囉。先上一張模型選單的截圖:Fable 5 還卡在 Currently unavailable,Sonnet 5 這邊已經可以直接選了。

系統卡懶人版
先講定位:這台新模型「不是最強的」,公司故意不讓它最強,定位是「比較便宜但接近頂規的版本」。安全測試結果是:沒有踩到任何危險線,可以正常上線。
-
會不會被拿去做壞事(造生化武器、駭客攻擊)?測試結果是不會。它在「教人做危險東西」這件事上,能力沒有比上一代強多少,公司也已經裝了防護機制(類似汽車的安全氣囊),把它能造成的傷害壓低。
-
會不會被騙、被誘導講不該講的話?這是這次表現最好的地方。有人專門花一週時間,想辦法騙它講壞話、洩漏資訊,成功率只有 0.19%(等於 1000 次嘗試只成功不到 2 次),是目前所有 Claude 模型裡防守最好的。
-
對小孩、有自殺念頭的人這類敏感對話,回應有沒有變好?有變好。比如有人在對話中透露自傷念頭,新模型用更得體的方式去回應、引導求助資源的比例提高了。
-
它會不會「說謊」或「拍馬屁討好你」?這項也是有史以來表現最好的一代,說謊測試分數最低(代表最誠實)。
-
有沒有令人擔心的地方?有兩個小隱憂:它似乎能「感覺到自己正在被測試」(就像學生知道老師在看,表現會不一樣),這讓測試結果的可信度打了折扣。它對某些冷門知識的「誠實認錯」分數偏低,但報告也說,這可能是訓練過程中途出了點小狀況造成的,不一定代表模型本身變笨。
-
解題、寫程式、做研究這些「正經能力」表現如何?整體比上一代(Sonnet 4.6)進步不少,在數學競賽、寫程式、操作電腦這些測驗上,已經很接近公司最強的旗艦模型,但公司刻意不讓它超過旗艦版。
官方效能曲線
價格先擺著:Sonnet 5 是 input 3 美元 / output 15 美元(每百萬 token),8/31 前的發布優惠是 input 2 / output 10;Opus 4.8 則是 input 5 / output 25。

官方的 agentic search(BrowseComp)成本-效能曲線可以看到:上一代 Sonnet 4.6 明顯落後 Opus 4.8,而 Sonnet 5 在部分 effort 檔位已經逼近 Opus 4.8,能拉的成本區間也更廣。

操作電腦(OSWorld-Verified)那張也是同一個走向。
我的實測定位
大概摸清楚 Sonnet 5 該怎麼用了:拿它來對比 Opus 是不切實際的,它替代的是 Sonnet 4.6。實測在以前最耗 token 的 Chrome MCP 操作上,Sonnet 5 token 奇省無比,體感大概省了 60% 左右。

所以複雜任務還是不用給它做,但需要探索自動化、pass rate 不用太高、可以容許 subagent 在後台自己摸索運行的雜活,用 Sonnet 5 還是很好的。
一句話:它不是來搶 Opus 的位子,是來把 Sonnet 4.6 那格換掉的。