AI 領域精選文章翻譯
by Hayden Field

原文連結: Anthropic is launching a new AI model for cybersecurity
Anthropic 正在透過一個新的 AI 模型,和一票科技巨頭一起做資安合作。這個計畫叫做 Project Glasswing,目標是讓大公司,甚至未來可能包含政府部門,能用 AI 更快找出系統裡的漏洞。
Anthropic 提供給合作夥伴的,是一個尚未公開發布的新模型 Claude Mythos Preview。公司說,這個模型的強項不是聊天,而是「強大的代理式程式設計與推理能力」,因此能在安全掃描上發揮作用。Anthropic 表示,這幾週的測試裡,Mythos Preview 已經找出「數千個高風險漏洞」,其中包括每一個主要作業系統與瀏覽器中的問題。
Anthropic 也刻意把存取範圍關得很窄。Project Glasswing 的參與者包含 Nvidia、Google、Amazon Web Services、Apple、Microsoft、JPMorgan Chase、Broadcom、Cisco、CrowdStrike、Linux Foundation、Palo Alto Networks 等公司,另外還有約 40 個維護或建構關鍵軟體基礎設施的組織。Anthropic 說,現在不打算把 Mythos Preview 開放給一般大眾,因為它太強,也太危險。
為了推動這個計畫,Anthropic 承諾投入最多 1 億美元的模型使用額度,另加 400 萬美元捐給 Linux Foundation 與 Apache Software Foundation。公司也表示,已經和美國政府官員就 Mythos Preview 的攻防能力持續溝通。
這篇新聞最有意思的地方,不是單純又一個「AI 很強」的宣示,而是 Anthropic 直接承認,前沿模型的安全風險已經強到不能隨便公開。換句話說,資安不再只是 AI 的一個應用場景,而是前沿模型能否被放心釋出的門檻。
但這也會讓問題變得更尖銳,因為能幫忙守住系統的能力,通常也能反過來幫忙攻擊系統。Glasswing 很像是 Anthropic 在替整個產業提早演練:當模型真的能自動找洞、寫 exploit、還能把修補流程串起來時,防守方要怎麼比攻擊方更快一步。