
本週,超過 40 家比特幣和加密貨幣公司要求最大的 AI 實驗室允許獨立安全研究人員在模型公開發布前使用其最強大的模型。
這封於 8 月 10 日發布的公開信基於一種簡單的不對稱性。比特幣網路保護著超過一兆美元的資產,而更廣泛的生態系統—包括錢包、簽名設備、函式庫和託管系統—則持有數兆美元。這些程式碼是開源的,一個漏洞就可能導致某人的積蓄付諸東流。
然而,維護這些系統的開發者卻無法進入 AI 實驗室所設立的審查研究人員計畫。當他們嘗試使用公開模型時,其內建的防護措施會阻礙合法尋找漏洞的行動。因此,他們只能依賴可以自行運行的開源權重系統,儘管這有用,但卻落後於前沿技術—以及攻擊加密貨幣網路的駭客。
信中寫道:「顯然,早期存取和合理的算力預算將有助於核心開發者產生更安全的程式碼,並在損失發生前識別和修復漏洞。」「因此,我們請求前沿 AI 實驗室為合格的開源金融基礎設施防禦者建立或擴大常設的信任存取計畫。」
這封信指出,實驗室及其少數合作夥伴在其他所有人之前數月就能預覽新的攻擊能力,而這些能力無論如何都會透過公開發布和受損系統洩露出去。
上個月底,比特幣安全聯盟(成員包括 BlackRock、Coinbase、Strategy、Anchorage、ARK、Block、Blockstream、Fidelity Digital Assets 和 Galaxy)承諾為該網路的長期安全投入 1500 萬美元。這封信針對的是另一個問題:不是為未來的威脅提供資金,而是為修補漏洞的維護者提供現有的模型。
截至今日,主要的 AI 實驗室尚未就此特定議題發表任何公開立場,然而,這些公司正在努力制定更好的防護措施,以防止其模型被用於惡意意圖,無論是用於區塊鏈編碼還是任何其他用途。
Anthropic 已經展示了相同的模型如何驅動「情緒駭客攻擊」(即犯罪分子在 AI 幫助下進行實時比特幣勒索攻擊),並表示這些工具降低了攻擊成本。讓防禦者獲得更強大的模型意味著需要挑選合格的人選並信任他們不會洩露資訊。
這封信要求實驗室無論如何都要承擔這個風險。