返回 EgentHub 觀點列表
6 分鐘閱讀智慧方案股份有限公司

Claude Sonnet 5 深度解析:逼近旗艦的行動力,Effort 分級讓企業按任務調配算力

分享這篇

Claude Sonnet 5 懶人包

前一陣子,Anthropic 的能力躍進幾乎都集中在 Opus 與 Mythos 系列,Sonnet 系列一度顯得停滯。這個局面在 2026 / 6 / 30 被打破——Anthropic 正式推出 Claude Sonnet 5,官方稱它是至今最具行動力的 Sonnet。

這次更新把 Sonnet 系列推到逼近 Opus 4.8 的表現水準,價格卻更親民。從企業使用 AI Agent 的角度來看,EgentHub 認為這替「AI Agent 依任務選模型」提供了相當大的彈性。以下就由 AI Agent 導入專家 EgentHub 為各位讀者整理本次更新的重點。

目錄


重點整理

  • 逼近旗艦等級的智慧: Sonnet 5 在推理、工具使用、程式撰寫與知識工作等 agentic 能力上,較前代 Sonnet 4.6 明顯進步,整體表現已貼近 Opus 4.8。
  • Effort 分級,以彈性換效能: 使用者可依任務調整 effort(力度)等級。在 BrowseComp、OSWorld-Verified 等測試中,中等力度就展現優於前代的 CP 值,力度拉高後某些任務甚至追平 Opus 4.8。
  • 即日全面上架、定價更友善: Sonnet 5 已成為 Free、Pro 方案的預設模型。即日起至 2026 年 8 月 31 日享早鳥價每百萬 token 輸入 2 美元、輸出 10 美元,之後調整為 3 美元/15 美元。
  • 更少幻覺、更抗攻擊: 不當行為比率低於 Sonnet 4.6,拒絕惡意請求與抵禦提示注入的能力提升,幻覺與逢迎傾向雙雙下降。
  • 網路攻擊能力刻意收斂: 官方未特別針對網路攻擊技能訓練,在 Firefox 漏洞測試中兩代 Sonnet 都無法完整開發出可用漏洞(成功率 0%),並預設啟用與 Opus 4.7、4.8 同級的網路安全防護。

Sonnet 系列的定位翻轉

過去 Sonnet 系列是日常使用的主力,但近期亮眼的進步幾乎全發生在 Opus 身上。Sonnet 5 的登場,某種程度上把這道差距重新拉近了。

它在推理、工具使用、程式撰寫、知識工作等關鍵能力上,相較 Sonnet 4.6 是全面性的提升,整體已逼近 Opus 4.8。在 BrowseComp(代理式搜尋)與 OSWorld-Verified(電腦操作能力)這兩項測試裡,Sonnet 5 在各個 effort 等級下都比 Sonnet 4.6 明顯改善,同時提供比前代更寬的成本效能區間;在高 effort 模式下,部分任務的表現甚至能打平 Opus 4.8。

換句話說,企業不必每次都直接跳到最貴的旗艦模型,才能拿到夠好的結果。透過調整 effort 等級,Sonnet 5 就能在成本與效能之間找到更划算的甜蜜點。

Claude Sonnet 5 效能與力度分級


長鏈步驟一次做到底

過去讓 AI Agent 執行多步驟任務,最常見的窘境是做到一半就卡住,得靠人工接手收尾。而這次早期測試者的回饋幾乎口徑一致:Sonnet 5 更能把任務一路做到底。

有企業把「更新 Salesforce 客戶等級、再發送上市公告給企業客戶」這種兩段式任務交給它,結果一次到位完成,而過去這類流程常常卡在中間等待人工確認。也有工程團隊分享,請 Sonnet 5 調查一個 bug,它在沒被特別要求的情況下,主動寫了重現測試、實作修復,還把修復暫存起來驗證,整套流程一氣呵成。

對企業而言,這代表可以把更多端到端的流程放手交給 Agent,而不必再全程盯場、隨時準備救火。


安全性同步提升,網路攻擊能力刻意收斂

模型越聰明,安全風險是否也水漲船高,一直是近期監管的重要議題。官方這次的安全評測顯示,Sonnet 5 整體不當行為比率低於 Sonnet 4.6,拒絕惡意請求與抵禦提示注入都有進步,幻覺與逢迎傾向也雙雙下降,是目前相對安全的 Sonnet 世代;不過相較 Opus 4.8 與 Mythos Preview,不當行為比率仍略高一些。

值得注意的是,Anthropic 這次刻意不針對網路攻擊技能訓練 Sonnet 5。在與 Mozilla 合作的 Firefox 漏洞測試裡,兩代 Sonnet 都未能開發出完整可用的漏洞,成功率皆為 0%,只是 Sonnet 5 出現部分成功的比例略高於前代。因此官方已為它預設啟用與 Opus 4.7、4.8 同級的即時網路安全防護機制。

這也意味著:Sonnet 5 適合扛日常高頻的自動化工作,但若涉及高風險的網路安全任務,建議仍搭配 Opus 系列或額外的治理機制,而非單靠一個模型打天下。

Claude Sonnet 5 安全性評測


8/31 前享有早鳥優惠

Sonnet 5 即日起至 2026 年 8 月 31 日享早鳥價:

  • 8/31 前: 輸入 2 美元、輸出 10 美元(每百萬 token)
  • 8/31 後: 輸入 3 美元、輸出 15 美元(每百萬 token)

要留意的是,Sonnet 5 換了新的 tokenizer,同樣的內容可能被切成更多 token(依內容類型,大約是原本的 1.0 到 1.35 倍)。官方說明早鳥定價已把這個轉換比例算進去,目的是讓從 Sonnet 4.6 轉換過來的成本大致持平。


結語:別讓 AI Agent 被單一模型綁架

Sonnet 5 透過 effort 等級的切換,讓同一顆模型就能同時服務輕量日常任務與高強度任務。在 AI Agent 的使用上,不妨先從 Sonnet 5 開始嘗試,評估它是否貼合自身的使用情境。

但企業導入 AI Agent 時,更該做的是降低對單一模型的依賴,建立一套能隨任務彈性切換模型與力度的整合架構——這正是 EgentHub 作為企業級 AI Agent 管理平台的價值所在。EgentHub 支援多模型自由配置,搭配細緻的 RBAC 權限管理與 MCP 串接能力,再由專業 AI 導入顧問陪跑,協助企業把 Sonnet 5 這類新模型穩穩落地到實際工作流程,建立專屬的 AI Agent 資產。

覺得這篇有用?分享給朋友

打造企業專屬 Agent