
▲Claude Sonnet 5正式登場。(圖/路透)
記者吳立言/綜合報導
Anthropic 於 6 月 30 日正式推出全新中階模型 Claude Sonnet 5,主打以更低成本提供接近旗艦模型的 Agent 能力,可自主規劃工作流程、使用瀏覽器與終端機等工具完成任務,並將成為 Claude 免費版與 Pro 方案的預設模型。
代理能力成 AI 新競爭焦點
Anthropic 表示,Claude Sonnet 5 能夠自主制定計畫、呼叫瀏覽器、終端機等工具執行任務,並可長時間獨立完成工作。公司認為,這類代理能力如今已逐漸成為大型 AI 模型的基本配備,未來競爭重點將從「是否具備 Agent 能力」,轉向「能否以更低成本、更高可靠性完成任務」。
近期包括 OpenAI 推出的 GPT-5.6 Sol,以及 Google 的 Gemini 3.5 Flash,也都將 Agent 功能列為主要賣點,顯示 AI 業界正加速朝自主執行任務發展。
效能接近 Opus 4.8 價格更便宜
Anthropic 表示,Claude Sonnet 5 的整體表現已接近旗艦模型 Claude Opus 4.8,但使用成本大幅降低。 Sonnet 5 即日起提供所有免費、Pro 及付費訂閱用戶使用,並於 8 月 31 日前採優惠價格:
* 每 100 萬輸入 Tokens:2 美元
* 每 100 萬輸出 Tokens:10 美元
9 月 1 日起則調整為:
* 每 100 萬輸入 Tokens:3 美元
* 每 100 萬輸出 Tokens:15 美元
Anthropic 指出,即使調漲後,Sonnet 5 仍比 Opus 4.8、OpenAI GPT-5.5 等模型便宜,但價格仍高於 Google Gemini 3.5 Flash。
推理、程式設計與知識工作全面提升
官方公布的測試結果顯示,Claude Sonnet 5 在推理、工具使用、程式設計及知識工作等多項 Agent 測試均較前代 Sonnet 4.6 有明顯進步。 其中,在代理程式設計測試中,Sonnet 5 獲得 63.2%,高於 Sonnet 4.6 的 58.1%,雖仍略低於 Opus 4.8 的 69.2%;而在知識工作測試中,Sonnet 5 則略微超越 Opus 4.8。
Anthropic 表示,開發者可依照成本與效能需求,在 Sonnet 5 與 Opus 4.8 之間選擇適合的模型。
可完成更長流程任務 自動檢查輸出結果
根據參與測試的合作夥伴回饋,Claude Sonnet 5 在執行複雜、多步驟工作時,能夠完成以往模型容易中斷的流程,並具備主動檢查自身輸出的能力。 自動化平台 Zapier 資深工程師 Daniel Shepard 表示,測試中讓 Sonnet 5 同時更新 Salesforce 客戶等級並寄送產品公告,模型能夠完整完成整個流程,而過去版本通常會在中途停止。
安全性同步提升 降低幻覺與惡意配合風險
除了效能提升外,Anthropic 也強調 Claude Sonnet 5 在安全性方面有所改善。 官方指出,新模型降低了配合惡意用途、欺騙、幻覺(Hallucination)及迎合使用者(Sycophancy)等情況,在面對提示詞注入等攻擊時,也更能拒絕惡意指令。 不過 Anthropic 也表示,在高風險行為防護方面,Sonnet 5 仍不及 Opus 4.8 與 Claude Mythos Preview,而其執行危險資安任務的能力也刻意維持較低,以降低遭濫用的風險。
