Anthropic推出Claude Sonnet 5.5:速度快3成、成本降3成,多項Benchmark直逼旗艦Opus 5.5

-

廣告刊登廣告? 點此聯絡

Anthropic在美西時間9月28日上午11點(台灣時間9月29日凌晨)正式發表新一代模型Claude Sonnet 5.5,這是繼9月22日推出旗艦Claude Opus 5.5之後,Claude 5.5世代家族中第二款亮相的模型。官方將Sonnet 5.5定位為「速度更快、成本更低」的日常主力款,鎖定一般任務、除錯(bug fixing)、文件撰寫與設計工作等場景,同時強調本次升級並非單純的性能微調,而是在多項代理式(agentic)工作流Benchmark上出現大幅躍進,部分指標已經逼近旗艦Opus 5.5的水準。

Anthropic推出Claude Sonnet 5.5:速度快3成、成本降3成,多項Benchmark直逼旗艦Opus 5.5 eaa6046f4ae8c88e368c3c530c4c1312f7ff6f2e-1200x630-1

Claude 5.5家族第二棒:從Opus 5.5接續而來

Anthropic在9月22日發表Claude Opus 5.5時,官方就已透露Claude Sonnet 5.5與Claude Haiku 5.5將在「接下來幾週內」陸續推出,補齊完整的5.5世代模型家族。如今Sonnet 5.5準時登場,也代表這波升級不是單一旗艦模型的獨立事件,而是Anthropic針對整條產品線(從輕量到旗艦)的系統性換代計畫。官方表示,這次升級的核心方向鎖定在代理式程式撰寫與複雜軟體工作、知識工作與研究、電腦操作與視覺理解,以及提示注入(prompt injection)防禦與對齊能力四大領域,Sonnet 5.5則是把這些能力進一步下放到定價更親民的中階模型上。

效能大躍進:多項Benchmark翻倍甚至跳增數倍

根據Anthropic官方公布的數據,Claude Sonnet 5.5在多項代理式工作流Benchmark上的進步幅度相當驚人,甚至有部分項目直接跳增數倍:

Benchmark Claude Sonnet 5.5 Claude Sonnet 5(前代) Claude Opus 5.5(旗艦)
Terminal-Bench 4.0(代理式程式撰寫) 70.6% 10.3% 66.4%
OSWorld 2.1(電腦操作) 80.1% 57.0% 81.8%
CursorBench 4.0(長時間程式任務) 55.5% 34.1% 57.8%
GDPval-AA v2.1(知識工作) 1844 1449 1846
Chartography(圖表理解) 61.6% 15.6% —

值得注意的是,Sonnet 5.5在Terminal-Bench 4.0與GDPval-AA v2.1等指標上,分數已經非常接近甚至局部超越旗艦Opus 5.5,顯示Anthropic這次確實把不少原本只留給旗艦模型的能力,下放到了中階、價格更平易近人的Sonnet系列。官方也提到,在Low、Medium等較低運算強度設定下,Sonnet 5.5就能打平Sonnet 5過去在最高強度設定下的成績,等於用約十分之一的成本達到相近效果。

定價維持不變,成本卻因效率提升而降低

與不少競品新模型上市同步調漲價格不同,Claude Sonnet 5.5延續了Sonnet 5原本的定價:輸入token每百萬美元2元、輸出token每百萬美元10元,快取讀取每百萬0.2美元、快取寫入每百萬2.5美元,價格完全沒有調整。Anthropic強調,實際使用成本之所以能再降低最多30%,主要來自模型效率提升後所需的token與工具呼叫(tool call)次數減少,而非帳面上的降價。也就是說,同一項任務若過去需要較多輪對話或較多次工具呼叫才能完成,Sonnet 5.5能用更少的步驟達成同樣結果,帳單自然跟著變薄。

Anthropic推出Claude Sonnet 5.5:速度快3成、成本降3成,多項Benchmark直逼旗艦Opus 5.5 cf0eae4b26b6fbe29e370d300ecac766cb94bc2d-1600x1000-1-scaled

企業實測:Box、Zendesk、Slack、Lovable怎麼說

Anthropic在發表文中引用了多家既有企業客戶的實測數據。雲端內容管理商Box表示,導入Sonnet 5.5後處理速度提升達2.4倍,且token使用量減少12%;客服平台Zendesk指出工單處理速度加快20%;協作工具Slack則觀察到輸出token數量減少14%;AI開發平台Lovable更提到,完成同樣任務所需的工具呼叫次數減少約三分之一,shell指令執行次數更是直接砍半。程式碼審查工具CodeRabbit與遊戲引擎商Unity也分別給出正面評價,其中Unity提到在其場景中任務完成率達到90%,優於同類模型。這些數字均為個別客戶自行揭露的實測結果,實際效果仍會因使用情境與工作流設計而有所差異。

安全與對齊同步升級

在能力提升的同時,Anthropic也強調Sonnet 5.5在安全與對齊(alignment)面向的表現至少維持、甚至優於前代Sonnet 5,並搭載與旗艦Opus 5.5相當等級的資安防護措施;生物安全(biosafety)防護層級則與Sonnet 5維持一致。官方另外提到,這一代模型新增了防止模型被蒸餾(distillation)複製的機制,並擴充了「保留思考鏈」(preserved thinking)相關功能,用意是讓模型在處理複雜推理任務時,能維持更穩定、更難被繞過的安全防線。

現在就能用:全平台同步上線

Claude Sonnet 5.5即日起已在Anthropic自家的Claude API平台,以及Amazon Web Services(AWS Bedrock)、Google Cloud(Vertex AI)與Microsoft Azure等三大主要雲端平台同步開放使用,開發者可透過模型代號「claude-sonnet-5-5」直接呼叫。隨著Sonnet 5.5到位,Claude 5.5世代家族目前已集齊旗艦Opus 5.5與中階Sonnet 5.5兩款模型,官方先前預告的輕量款Claude Haiku 5.5則尚未正式公布上線時間,後續是否會維持同樣的效能與成本雙提升走勢,值得持續關注。

更多AI相關報導

相關文章/報導
手哥 HANDBRO
手哥 HANDBRO
硬是要學共同創辦人兼職打雜編輯,熱愛網路、熱愛 3C!腦袋是個不定時炸彈,隨時會炸出新玩意兒!如有開箱、評測或各種合作需求,請洽:contact@soft4fun.net。 YouTube 頻道:手哥科科

留下一個評論

請輸入你的評論!
請在這裡輸入你的名字

網站搜尋
我們的頻道
看更多新聞
- 廣告 -
分享給朋友