Anthropic 發布 Claude Sonnet 5,性能更接近 Opus 4.8

-

廣告刊登廣告? 點此聯絡

在 AI 代理(Agentic AI)競爭進入白熱化的階段,Anthropic 於今日(6/30)正式發表了最新一代的 Claude Sonnet 5。這款被官方譽為「至今最具代理能力」的中階模型,不僅在自主規劃、工具使用上獲得了史詩級的升級,更將過往需要昂貴大型模型才能完成的自動化任務,直接下放到了更親民的價格帶。

目前,Claude Sonnet 5 已全面取代前代,成為 Claude 免費版與 Pro 版的預設模型,讓所有用戶都能第一時間體驗這波強大的技術升級。

代理能力(Agentic)大躍進:能自己查 Bug、找工具的 AI

如果你過去使用 AI 幫忙寫程式或處理複雜工作時,常遇到它「做到一半卡住」或「需要人類不斷下指令推動」的窘境,那麼 Sonnet 5 將會讓你眼睛一亮。

根據 Anthropic 釋出的資料與早期測試者的反饋,Sonnet 5 在程式碼編寫、邏輯推理與知識工作上的表現,有著全面性的突破。它現在能更熟練地操作瀏覽器與終端機等外部工具,並且具備強大的「端到端(End-to-End)」執行力。

Anthropic 發布 Claude Sonnet 5,性能更接近 Opus 4.8 image-1-1500x828

有開發者實測發現,當要求 Sonnet 5 去調查一個程式 Bug 時,它能在沒有人類提示的情況下,主動寫出測試代碼、實作修復方案,甚至自己驗證 Bug 是否真的被解決。這種能夠「自我檢查」並完成複雜多步驟任務的能力,過去通常只有在頂級模型(如 Opus 系列)上才能看到。

效能直逼 Opus 4.8,性價比卻高得驚人

在官方的基準測試中,Sonnet 5 的整體表現不僅大幅超越前代 Sonnet 4.6,更緊緊咬在目前最強的 Opus 4.8 後面。

Anthropic 發布 Claude Sonnet 5,性能更接近 Opus 4.8 image-1500x709
▲ Sonnet 5 分數較前一代有長足進步,許多評分接近旗艦 Opus 4.8

對於開發者來說,最棒的消息莫過於它的定價策略。Sonnet 5 完美填補了「低成本」與「高精確度」之間的空白地帶。為了慶祝上線,Anthropic 推出了極具競爭力的早鳥推廣價(至 2026 年 8 月 31 日):

  • 輸入(Input): $2 / 每百萬 Tokens
  • 輸出(Output): $10 / 每百萬 Tokens

(註:推廣期結束後,將恢復為輸入 $3 / 輸出 $15 每百萬 Tokens,但相較於 Opus 4.8 高達 $5 / $25 的定價,依舊香到不行!)

透過 API 串接的開發者,現在可以根據任務難度,在 Sonnet 5 與 Opus 4.8 之間彈性調整,用更低的成本打造出高品質的自動化 AI 代理應用。

安全性再升級,幻覺率更低

在模型能力大幅提升的同時,Anthropic 也沒有妥協安全性。部署前評估顯示,Sonnet 5 在拒絕惡意請求、抵抗提示詞劫持(Prompt Injection)的表現上,都優於 Sonnet 4.6,且產生「幻覺(Hallucination)」與「阿諛奉承(Sycophancy)」的機率也顯著降低。

不過官方也特別提醒,Sonnet 5 並未針對專業的網路安全任務進行特訓,因此在開發系統漏洞等進階資安測試上,表現仍不及 Opus 4.8 或是針對資安特化的 Mythos 5。為了防範未然,Sonnet 5 預設開啟了與 Opus 相同的網路安全防護機制,以阻擋潛在的危險行為。

AI 代理真正走向實用化的里程碑

Claude Sonnet 5 的推出,宣告了 AI 助理正式從「一問一答的聊天機器人」,進化為「能獨立作業的虛擬員工」。無論你是需要處理日常自動化流程的企業用戶,還是想要打造全自動化開發工具的工程師,Sonnet 5 都是目前市場上性價比最高的選擇之一。

現在就打開 Claude.ai 體驗看看這位超級助理的威力吧!

相關文章/報導
手哥 HANDBRO
手哥 HANDBRO
硬是要學共同創辦人兼職打雜編輯,熱愛網路、熱愛 3C!腦袋是個不定時炸彈,隨時會炸出新玩意兒!如有開箱、評測或各種合作需求,請洽:contact@soft4fun.net。 YouTube 頻道:手哥科科

留下一個評論

請輸入你的評論!
請在這裡輸入你的名字

網站搜尋
我們的頻道
看更多新聞
- 廣告 -
分享給朋友