Anthropic 於今日(美東時間 8 月 21 日)正式宣布,旗下最強網路安全模型 Claude Mythos 5 已整合至 Claude Security 服務,即日起對所有 Claude Enterprise 客戶開放公開測試。與此同時,該公司推出總額 3,500 萬美元(約 11.4 億台幣)的 Defender Advantage Fund(代號 0xDAF),用於資助開源軟體安全維護工作,並宣布擴大 Cyber Verification Program 的適用範圍。

Claude Mythos 5:從封閉到企業工具
Claude Mythos 5 是 Anthropic 在網路安全領域最強大的模型,自今年 4 月透過 Project Glasswing 計畫僅提供給少數經審核的組織使用,包含美國政府合作夥伴與關鍵基礎設施保護者。該模型在漏洞利用推理等資安能力上大幅超越一般大語言模型,但也因其雙重用途特性,可用於防禦也可用於攻擊,Anthropic 一直採取嚴格的存取管控,避免模型落入惡意行為者手中。
Anthropic 發表 Claude Mythos Preview 專為資安打造的 AI 模型,不過因「太危險」不公開釋出
根據 Anthropic 官方說明,最危險的行為發生在用戶能直接與模型互動的情況下,此時惡意使用者可能試圖引導模型產生危害。但如果用戶只能接收特定產出,例如漏洞修補程式或安全警示,風險便大幅降低。這次整合的關鍵設計就是讓企業用戶透過 Claude Security 這個目的導向介面來取得 Mythos 5 的分析結果,而非直接存取模型本身。稍早推出的 Claude Fable 5 已透過阻擋雙重用途網路安全工作來擴大模型使用範圍,Claude Security 的整合則以此為基礎再進一步。
具體使用流程上,管理員先在後台啟用功能,團隊從 claude.ai/security 選取 GitHub 儲存庫進行掃描。Mythos 5 會掃描程式碼找出漏洞,回傳每項發現的 CWE(Common Weakness Enumeration)分類、信心與嚴重程度評級,以及建議的修補程式。使用者可以接著在 Claude Code 網頁版中打開修補程式進行實作,但每個修補都必須經過人工審查與批准才能套用。Anthropic 強調,互動式修補使用的是組織在 Claude Code 中已擁有的模型權限,Mythos 掃描本身不會將模型存取權延伸到其他對話。掃描費用按既有 Enterprise 方案的標準 Token 用量計算,無需額外加購。
Mythos 掃描本身不會將模型存取權延伸到其他功能,用戶無法因為有 Security 權限就在一般對話中使用 Mythos 5。Anthropic 對此的表述是「防禦者可以獲得 Mythos 5 的能力,但不會讓模型本身對可能濫用它的人開放」。這與該公司一貫的立場完全一致:將最強模型的能力透過工具包裝後提供給企業,而非直接開放模型讓任何人存取。
3,500 萬美元 Defender Advantage Fund
Anthropic 同時宣布成立 Defender Advantage Fund(代號 0xDAF),初期投入 3,500 萬美元的 Claude 點數,用於支援開源軟體安全維護工作。這項基金將聚焦三大方向:第一,修補廣泛使用專案中的即時漏洞;第二,將掃描與修補流程自動化,讓其他專案可以複製使用;第三,協助專案採取更進階的安全策略,從根本上抵抗整類攻擊。
此基金是 Project Glasswing 的延伸。該計畫先前已向開源安全組織提供 400 萬美元的直接捐贈與 Claude 點數,協助掃描和修補多個廣泛使用的開放原始碼專案,並支援了 Akrites 與 Gold Eagle 等由社群發起的協調漏洞修補行動。Anthropic 表示將從少數大型先導補助開始,學習哪些做法效果最佳且可規模化,並在未來數週內對外公布首批受補助組織的具體名單。
合作夥伴整合與驗證計畫擴張
Anthropic 同時將與多家網路安全技術和服務合作夥伴合作,把 Mythos 5 整合到既有安全產品與服務中。許多合作夥伴已基於 Claude Opus 建構了安全工具,包含警報分類、威脅識別和漏洞修復,現在則進一步升級至 Mythos 等級。在此模式下,終端使用者同樣不會直接與 Mythos 互動,而是透過產品專用介面接收特定產出。合作夥伴也設有濫用防制措施,確保模型保持在預期範圍內運作。
Cyber Verification Program 也將在未來數週內擴大。此計畫原本已為通過審核的組織在 Opus 和 Sonnet 模型上提供降低安全防護限制的體驗,減少正當網路安全工作時的干擾。新版將把雙重用途能力的存取權擴展到 Mythos 等級模型,並持續透過 Project Glasswing 與美國政府合作,聚焦於關鍵基礎設施保護者。對於已在 Cyber Verification Program 中的組織,無需重新申請,Anthropic 會主動聯繫。
Anthropic 也提到,他們正與合作夥伴持續開發安全分類器(safety classifiers)與防護機制,這些技術是擴大 Mythos 等級模型存取的基礎,確保防禦能力能夠擴散到更多人手上,同時不讓模型的攻擊能力被不當使用。該公司強調,他們的目標是幫助組織適應 AI 模型日益強大後所帶來的網路安全節奏與需求,未來將持續開發防護機制、存取計畫與社群支援。

