AI Articles

AI 領域精選文章翻譯

View the Project on GitHub Kumazan/ai-articles

15 April 2026

資安現在越來越像 proof of work

by Drew Breunig

AI News · 2026-04-15

原文連結: Cybersecurity Looks Like Proof of Work Now

摘要

· · ·

資安現在像是在做 proof of work 嗎?

上週才剛看到 Anthropic 的 Mythos,一個在電腦資安任務上「強到驚人」的模型,以致 Anthropic 根本沒有公開釋出。相反地,只有關鍵軟體的開發者被給予存取權,好讓他們有時間先把系統加固。

大家很快就走完了一套面對大型 AI 宣稱時的標準流程,震驚、害怕、炒作、懷疑、批評,最後再繼續往下一件事前進。這篇文章也一直呼籲大家先等等看,因為資安能力本來就特別適合拿來做驚人的 demo。找漏洞是一個界線清楚、而且可驗證的搜尋問題。你不是在打造一個複雜系統,而是在戳一個已經存在的系統,而且這很適合丟進幾百萬個 token 去試。

昨天,第一份第三方分析出爐,來自 AI Security Institute(AISI),大致上支持 Anthropic 的說法。Mythos 確實很強,甚至可以說在原本就快速進步的資安能力地景裡,又往前踩了一大步。

整份報告都值得讀,但這篇特別想聚焦在一張圖,圖中顯示不同模型在模擬複雜企業網路攻擊時的成功率。

《The Last Ones》是一個 32 步驟的企業網路攻擊模擬,從初步偵察一路到完整接管網路,AISI 估計人類需要 20 小時才能完成。圖上的線條是多次執行的平均值,Mythos、Opus 4.6 與 GPT-5.4 各跑了 10 次,而「max」線則是每一批裡的最佳結果。Mythos 是唯一成功完成任務的模型,10 次裡有 3 次做到。

這張圖其實在暗示一個有趣的資安經濟學,想要把系統加固,就得花比攻擊者更多的 token 去找出漏洞。

AISI 給每次嘗試都編了 1 億 token 的預算。換算下來,每次 Mythos 嘗試要 12,500 美元,十次總共是 12.5 萬美元。更麻煩的是,被給到 1 億 token 預算的模型,沒有任何一個出現明顯的邊際效益遞減。AISI 也寫道,模型在測試過的 token 預算範圍內,隨著預算增加,表現仍然持續進步。

如果 Mythos 只要一直加 token 就能持續找出漏洞,那資安就會被簡化成一個殘酷但直接的公式,想要加固系統,就得花比攻擊者更多的 token 去找漏洞。換句話說,安全成本變成了市場價格問題。

這不靠聰明取勝,而是靠花更多錢。這個結構很像加密貨幣裡的 proof of work,成功與否取決於原始運算工作量。它像是一場低溫度的彩券,買 token,可能找到漏洞;希望你能比攻擊者撐得更久。

這個算式帶來幾個直接結論。

第一,開源軟體依然非常重要。

對那些沒有天天被 AI 極客包圍的人來說,這句話聽起來可能有點荒謬。但最近在 LiteLLM 和 Axios 供應鏈風波之後,很多人開始主張,用 coding agent 直接重寫依賴套件功能就好。

Karpathy 幾週前才說過這樣的話:

傳統軟體工程會告訴你,依賴是好事(我們是在用磚塊蓋金字塔),但我覺得這件事得重新評估。我對依賴越來越反感了,因為我比較喜歡用 LLM 去「偷」功能,只要那功能夠簡單、也做得到。

如果安全本質上就是對一個系統投入更多 token,那麼 Linus’s law 也會被重新改寫成,給足夠多的眼睛,也要再加上足夠多的 token,漏洞才會變淺。若依賴開源套件的大公司願意花 token 去保護它們,通常會比一般團隊自己重寫的替代品更安全。當然,這裡有個現實難題,因為一個被廣泛使用的 OSS 套件,一旦被打穿,價值也更高,這反過來又會鼓勵攻擊者把更多資源投向開源目標。

第二,hardening 會成為 agentic coding 的額外階段。

現在已經可以看到,開發流程開始被拆成兩步,開發與 code review,而且常常還會用不同模型各做一段。隨著這個模式成熟,也會出現專門對應它的工具。Anthropic 已經推出 code review 產品,每次審查收費 15 到 20 美元。

如果上面的 Mythos 敘事成立,那很可能會變成三段式流程,開發、review、hardening。

關鍵差異在於,第一階段的瓶頸是人類投入,最後一階段的瓶頸是錢。這也讓它們自然分成不同流程,畢竟在還沒做出東西之前,根本沒必要先花錢加固。過去安全審查又少、又零散、又不一致。現在可以把它變成持續性的流程,而且希望是在合理預算內持續進行。

Code 仍然很便宜,除非它必須是安全的。即使 inference 持續優化、成本一直下降,只要模型還沒到安全回報遞減的地步,就還是得買比攻擊者更多的 token。最後的成本,還是由漏洞在市場上的價值決定。

· · ·

延伸評論:安全成本終於開始可計價了

這篇最值得注意的地方,不是 Mythos 有多強,而是它把資安從「抽象的風險」拉成「可計算的成本」。一旦攻防雙方都能用 token 和預算衡量,安全就不再只是流程問題,而是持續的經濟戰。

這也解釋了為什麼開源軟體會更關鍵。當防護成本能被共享,OSS 的價值就不只是在可修改,還在於能被集體加固。對真的在做 agentic coding 的團隊來說,未來最該補上的不只是測試,還有把 hardening 變成工作流的一部分。