[AI 發布] Anthropic推出Claude 5.1雙版本,強化科研、程式設計與安全防護
摘要 : Claude 5.1提升程式設計、科研能力,並兼顧企業隱私與安全。
內容:
當地時間9月1日,Anthropic宣布推出兩個Claude 5.1版本,並稱其為全球最先進的程式設計與知識工作模型。兩者採用相同的基礎模型,主要差異在於安全防護等級:一般版本面向所有使用者,較寬鬆版本則僅透過可信訪問計畫,提供給經審核的網路安全及生命科學機構。
根據Anthropic公布的基準測試,Claude 5.1在多項測試中超越前代模型、Opus 5及OpenAI GPT-6。在智慧體科學研究基準TerminalBench Science 0.1中,5.1獲得52.6%,高於前代的24.7%、Opus 5的29%及GPT-6的22.4%。
在智慧體程式設計基準TerminalBench 4.0中,一般版5.1得分55.8%,採用較寬鬆安全防護的版本則達60.9%。知識工作方面,5.1在GDPVal AAV2測試取得1853分,也高於原文所列前代模型的1824分與1723分。
價格方面,5.1的快取讀取費用下調75%,降至每百萬token 0.25美元。典型工作負載的成本約比前代低25%,高度智慧體化工作負載最高可降低40%。基礎定價維持每百萬token輸入10美元、輸出50美元。
企業隱私方面,Anthropic推出Enterprise Frontier Safeguards(EFS),結合零資料保留與先進安全防護。客戶資料將儲存在由企業完全控制的雲端基礎設施,而非Anthropic系統。EFS預計於今年秋季分階段向企業客戶推出;在正式上線前,符合資格的客戶可依零資料保留政策使用5.1。
安全防護方面,Anthropic調整了5.1的防護機制,以降低誤判。網路安全領域的誤攔截數量較過去減少約60%。模型可協助發現軟體漏洞,但不會用來開發針對這些漏洞的利用程式。
生物學領域方面,Anthropic與美國政府合作建立訪問計畫,讓研究人員在受控條件下運用5.1的進階生物學能力,並計畫近期開放科學家註冊。
在分子設計領域,5.1利用開源蛋白質設計與折疊工具,設計出高親和力結合劑。在三個靶點上,其結合親和力比Adaptive Bio蛋白質設計競賽的最佳作品高出10倍;在12個靶點上的命中率接近50%,高於目前蛋白質設計常見的10%至15%。
在計算分析領域,5.1運用NASA麥哲倫任務30多年前取得的雷達影像訓練神經網路,繪製出涵蓋金星約三分之一區域的高解析度高程地圖。解析度由過去的10至20公里提升至2至3公里,高程精度提高25%。
在計算生物學方面,5.1透過編寫自訂GPU核心及快取中間結果,使七個開源深度學習模型的執行速度提升2.5倍,預計可降低30%至60%的GPU成本。
合規方面,Anthropic於2026年7月簽署歐盟《人工智慧法案》有關AI生成內容透明度的實踐準則。依規定,2026年8月2日後發布的模型輸出須加入不可見水印。5.1生成的文字已內建此類水印,不影響內容與輸出品質,也不包含使用者或對話資訊。
Anthropic亦以私人預覽方式推出水印檢測API。符合資格的監管機構、執法部門、媒體及事實查核組織,可依歐盟法律要求申請使用。
Claude 5.1已登上Anthropic各平台,以及Amazon Web Services、Google Cloud與Microsoft Azure,開發者也可透過Claude API使用。較寬鬆安全防護的版本目前僅提供給經審核的美國組織。
此次更新進一步加劇Anthropic與OpenAI之間的競爭。原文並推測,OpenAI執行長Sam Altman可能很快推出代號「Astra」的產品作為回應。
註:原始資料將兩款模型都寫作「Claude 5.1」,且部分前代型號重複或不明,因此本文依其安全防護與開放條件區分為一般版及受限版。