AI 根據文章內容回答
在提升能力的同時,Anthropic 也針對 Sonnet 5 的安全性與輸出品質進行了深度優化。1. 抵禦惡意攻擊:部署前的評估顯示,Sonnet 5 在「拒絕惡意請求」以及「抵抗提示詞劫持(Prompt Injection)」的表現上,均優於前一代的 Sonnet 4.6。2. 降低錯誤率與偏差:該模型產生「幻覺(Hallucination)」的機率顯著降低,這意味著其輸出的資訊準確度更高。同時,它也減少了「阿諛奉承(Sycophancy)」的傾向,能更客觀地回應使用者,而非盲目順從錯誤的引導。3. 預設防護機制:為了防範潛在的危險行為,Sonnet 5 預設開啟了與旗艦模型 Opus 相同的網路安全防護機制。雖然安全性大幅提升,但官方也明確指出,Sonnet 5 並未針對專業資安任務進行特訓,因此在開發系統漏洞等進階資安測試上,其表現仍遜於 Opus 4.8 或資安特化模型 Mythos 5。整體而言,Sonnet 5 透過降低幻覺率與強化防禦機制,為企業用戶提供了更穩定且安全的自動化作業環境。