-
日期: 2026-07-01 | 來源: 騰訊科技 | 有0人參與評論 | 字體: 小 中 大
Anthropic能力更強的模型,不當行為發生率比Sonnet 5更低,但Sonnet 5相較前代已有明顯改善
與Opus 4.8和Claude Mythos Preview相比,Sonnet 5在相同審計中顯示出略高的不當行為發生率。Anthropic的安全評估是壹套梯度體系:模型能力越強,安全對齊表現越好。Sonnet 5處於中間位置,優於前代但不及旗艦模型。
在網絡攻擊能力方面,Anthropic與Mozilla合作進行了評估,測試模型為Firefox 147瀏覽器中的漏洞開發利用程序的能力。相關漏洞已在Firefox 148中修補。
兩個Sonnet模型都未能針對Firefox漏洞生成可利用程序,而Mythos 5的成功率接近90%
兩個Sonnet模型均未能成功開發出可用的漏洞利用程序,成功率為0.0%。Sonnet 5的部分成功率為13.2%,Sonnet 4.6為8.8%。與之相比,Opus 4.8的漏洞利用成功率為68.8%,Mythos 5為88.4%。兩個Sonnet模型與旗艦模型在網絡攻擊能力上的差距在壹個數量級以上。
Anthropic表示沒有特意針對網絡安全任務訓練Sonnet 5。該公司分析認為,Sonnet 5在部分成功率上的微小提升很可能來自通用智能的改善,而非專項訓練。它可以執行壹些常規、無害的網絡任務,但在開發軟件漏洞利用等有潛在危險的技能上,遠低於Opus和Mythos系列。
由於Sonnet 5在這類任務上比前代稍強,Anthropic默認啟用了網絡安全防護功能。這套防護系統可實時檢測並阻止危險的網絡使用行為,防護等級與Opus 4.7和4.8上的相同。
與之對照,Fable 5的防護措施更為嚴格,會攔截范圍更廣的網絡安全任務。Anthropic對Sonnet 5的整體網絡風險判斷為較低水平,因此沒有采用最嚴等級的防護。對於需要較少防護的網絡安全工作,Anthropic推薦使用Opus 4.8。
03 性能、token消耗同步提升
Anthropic在公告腳注中披露了壹項技術變更。
Sonnet 5使用了更新的tokenizer,改變了模型處理文本的方式,目的是提升性能。這個改動與Claude Opus 4.7中引入的tokenizer更改類似。
更新tokenizer的代價是,相同內容的輸入可能映射為原來1.0到1.35倍的token數量,具體取決於內容類型。也就是說,同壹段文字在Sonnet 5中可能比在Sonnet 4.6中消耗更多token。
Anthropic解釋稱,優惠定價的設定旨在使用戶過渡到Sonnet 5時大致保持成本中性。但“大致”意味著存在變量,運行高容量工作負載的企業客戶需要對自己特定用例做基准測試,不能直接假定賬單不變。
速率限制方面,為適應Sonnet 5更高等努力程度設置帶來的更高token使用量,Anthropic已提高Chat、Cowork、Claude Code和Claude Platform的速率限制。
在此之前,2026年4月26日,Anthropic已將每個使用層級的Sonnet和Haiku速率限制調高,同時將Claude Platform的層級簡化為叁個:Start、Build和Scale。用戶可以在Claude Console中查看自己所在的層級和當前限制。
04 用規模換估值
Sonnet 5發布的時間節點處於Anthropic籌備IPO的關鍵階段。
該公司已經於2026年6月初向SEC秘密提交了IPO招股說明書,CNBC稱這將是“科技史上最受審視的公開募股活動”。
據《衛報》報道,Anthropic在2026年2月以3800億美元估值融資300億美元時,年化營收達到140億美元,過去叁年每年增長超過拾倍。到5月下旬,該公司完成650億美元H輪融資,由Altimeter Capital和Sequoia Capital等共同領投,投後估值9650億美元,年化營收超過470億美元。- 新聞來源於其它媒體,內容不代表本站立場!
-
原文鏈接
原文鏈接:
目前還沒有人發表評論, 大家都在期待您的高見