Anthropic 讓 Claude Mythos 5 上工:網安超級模型開始掃描企業程式碼,同步成立 3,500 萬美元開源防禦基金
Anthropic 將自 4 月起僅限審核通過防禦者使用的網安旗艦模型 Claude Mythos 5,部署到 Claude Security 供所有企業客戶掃描漏洞,並成立 3,500 萬美元的 Defender Advantage Fund 協助保護開源軟體。
Anthropic 剛跨過了一條它環繞了四個月的界線。2026 年 8 月 21 日,該公司宣布:自 4 月問世以來一直僅限審核通過之防禦者使用的網安旗艦模型 Claude Mythos 5,如今已在 Claude Security 中為所有 Claude Enterprise 客戶執行漏洞掃描,進入公開測試階段。與此同時,Anthropic 成立了 Defender Advantage Fund(0xDAF)——一筆 3,500 萬美元的 Claude 額度,專門用於保護開源軟體——並預告將擴大 Cyber Verification Program,最終把 Mythos 等級的存取權延伸至已登記的防禦者。
對一家以謹慎建立起品牌的公司而言,這是一次刻意的加速——而其背後的邏輯,恰恰說明了前沿 AI 實驗室正在學習如何將最危險的能力商業化。
本次公告:四項變革
根據 Anthropic 8 月 21 日的聲明,這次推出包含四項具體行動:
- Claude Security 掃描現由 Claude Mythos 5 驅動,自 8 月 21 日起為所有 Claude Enterprise 客戶提供公開測試。
- 合作夥伴整合即將到來。 Anthropic 正與網安技術及服務廠商合作,將 Mythos 5 嵌入防禦者日常使用的工具。
- Defender Advantage Fund(0xDAF) 將發放 3,500 萬美元的 Claude 額度,給修補廣泛使用之開源專案中現存漏洞的組織。
- Cyber Verification Program 即將擴編——未來數週內將涵蓋 Opus 與 Sonnet 模型上更廣泛的雙用途能力,Mythos 等級的存取權則在後續跟進。
這是 Anthropic 刻意放慢腳步的第三階段部署。該公司的論述是:網安能力的風險,集中在使用者能直接存取模型、並試圖將其導向攻擊用途的情境。當使用者只會收到「特定輸出——例如某個漏洞的修補程式或安全警示」時,風險便大幅降低。這次擴張打開的是「防禦性成果」的存取權,模型本身仍被圍欄包住。
Claude Security 如何不開放模型、卻交付 Mythos 5
範圍控制正是這裡的工程亮點。Claude Security(企業版公開測試中)的 Mythos 5 掃描以標準 token 用量計費,納入現有方案,不需另外加購。管理員在管理主控台啟用功能後,使用者可從 claude.ai/security 選擇一個儲存庫,模型便會掃描整個程式碼庫尋找漏洞。
每一項發現都會附上 CWE(通用弱點分類)類別、信心與嚴重度評等,以及建議修法。接著使用者可在網頁版 Claude Code 中實作修補——而每個修補程式都必須經過人工審查核准後才能落地。
關鍵在於:執行 Mythos 5 掃描並不會把 Mythos 存取權延伸到任何其他介面。掃描回傳的是詳盡的漏洞報告而非原始模型輸出,而互動式修補使用的是該組織在 Claude Code 中既有的模型。
合作夥伴整合也遵循同一套模式。合作產品的使用者從不直接對 Mythos 5 下提示;一個專門打造的介面會在背景為特定任務運行模型,只回傳預期的產物(例如建議修補清單)。Anthropic 表示,該公司與合作夥伴都設有濫用防護機制,確保模型不越出範圍。
從 Project Glasswing 到更大規模的防禦者部署
Anthropic 對這一模型等級的謹慎,可追溯至 2026 年 4 月 7 日啟動的 Project Glasswing——當時的聯盟成員包括 AWS、Microsoft、Google、CrowdStrike 與 Linux 基金會。該計畫將 Claude Mythos Preview 交到一小群保護關鍵軟體的專家手中,並提供最高 1 億美元的使用額度與 400 萬美元的直接捐款。
成果相當驚人。Mythos Preview 找到了數千個高嚴重度漏洞,而且遍及所有主流作業系統與瀏覽器:OpenBSD 中一個存在 27 年的可遠端觸發缺陷、FFmpeg 某支程式裡一個 16 年來自動化測試執行了五百萬次都沒抓到的錯誤,以及一條鏈式的 Linux 核心權限提升路徑。三者在揭露前都已通報維護者並完成修補。
2026 年 6 月 9 日,Anthropic 將模型一分為二。Claude Fable 5——同一個底層模型,加上將網安、生物、蒸餾相關查詢導向 Claude Opus 4.8 的安全分類器——開放一般使用。Claude Mythos 5 則為審核通過的用戶解除網安防護,以每百萬輸入 token 10 美元、每百萬輸出 token 50 美元的價格提供給 Glasswing 合作夥伴——不到 Mythos Preview 的一半。一項外部漏洞獵捕計畫在超過 1,000 小時的測試中,未能找到任何通用越獄手法。
此後,除了 Glasswing 的 12 個創始夥伴外,另有超過 40 個維護關鍵軟體基礎設施的組織取得存取權,Horizon3.ai 等安全廠商也於 7 月加入漏洞獵捕行列。
Defender Advantage Fund 的數字面
0xDAF 的 3,500 萬美元 Claude 額度,鎖定三類工作:修補廣泛使用之開源專案中的現存漏洞、打造可被其他專案複製的自動化掃描與修補管線,以及讓專案對「整類攻擊」而非單一漏洞免疫的防禦方法。
該基金延續了 Glasswing 已開展的工作,包括對 Akrites 與白宮 Gold Eagle 計畫等協調修補行動的支持。基金將從少數較大規模的試點補助開始,讓 Anthropic 觀察哪些做法可以規模化——首批受補助者將於未來數週公布。
為什麼重要:把最危險的模型產品化
商業脈絡一目了然。Anthropic 正在籌備一場重量級 IPO,而它自 5 月以來集結的合作夥伴生態系——Wiz、Palo Alto Networks、CrowdStrike、Accenture——用具體數字描繪了市場機會。Wiz 表示其 Opus 驅動的攻擊測試代理每週持續掃描超過 15 萬個正式環境資產;Accenture 則說安全測試涵蓋率在 1,600 個應用程式上從約 10% 提升到超過 80%,掃描週轉時間從 3–5 天縮短到一小時內。
CrowdStrike 顧問事業負責人 Mark Manglicmot 如此總結:「像 Anthropic Claude Opus 這樣的前沿模型,給了防禦者一年前還不存在的優勢,把漏洞管理一路推向最左端(最早期的預防)。」
Mythos 5 自身的數據也支持這個論點——但有但書。Anthropic 報告 Mythos 5 在 CyberGym 漏洞重現上達到 83.1%,相較 Opus 4.6 的 66.6%,不過這些是公司自行量測的數據,並非獨立評測。
更深層的意義在於架構面。Anthropic 找到了將高風險能力產品化的範本:把模型包進一個狹窄的介面、回傳淨化後的輸出而非原始模型存取、要求人工核准每個行動,然後以一般用量的名義計費。若這套模式成立,預期其他握有危險前沿模型的實驗室將起而效尤——而隨著 Mythos 等級存取權在未來數週透過 Cyber Verification Program 擴散,「能力圍堵 vs. 產品介面面積」的辯論也會愈演愈烈。
對企業來說,近期的結論更簡單:如果你是 Claude Enterprise 客戶,史上最強的漏洞發現系統之一,剛剛變成你現有方案裡的一個功能。
Sources
- [1] https://www.unite.ai/anthropic-deploys-claude-mythos-5-in-security-tools-35m-open-source-fund/
- [2] https://www.marktechpost.com/2026/08/21/anthropic-brings-claude-mythos-5-to-claude-security/
- [3] https://www.anthropic.com/news/claude-fable-5-mythos-5
- [4] https://releasebot.io/updates/anthropic/claude