🔴【AI資安警訊】Claude Fable 5爆「越獄」爭議,
美國政府祭出限制措施!
Anthropic 剛發表最新一代 AI模型 Claude Fable 5與Mythos 5,然而發布僅數天後,美國政府便下令禁止外國人士使用。
📌重點摘要
1️⃣英國資安研究團隊 AISI:幾小時內就成功越獄並取得惡意工具
英國資安研究機構 AI Security Institute(AISI)取得存取權限後,數小時內即開發出越獄方法,成功呼叫 Fable 5 的惡意代理工具。
2️⃣Amazon 研究團隊:用提示詞騙出攻擊資訊
Amazon 研究員利用一系列提示(Prompts),成功誘導 Fable 5 提供可用於網路攻擊的相關資訊。
3️⃣Fable本質上是高能力模型Mythos加上安全防護層,一旦被繞過風險極高
美國總統科學與技術顧問委員會共同主席 David Sacks 表示,Fable 實質上是被視為需受監管的高能力模型 Mythos 加上防護機制,一旦防護失效,強大能力可能暴露給不應取得的人員。
4️⃣AI安全問題已從技術風險升級為國家安全議題
由於模型可能被用於網路攻擊、惡意自動化及其他高風險用途,美國政府最終祭出限制措施,也凸顯先進AI模型的安全治理已成為國家安全與監管的重要議題。
🛡️TSC 德欣寰宇建議
AI 模型的安全防護並非絕對防護,越獄(jailbreak)已從理論風險轉為實際發生的安全事件。
隨著AI技術能力提升,企業除了評估模型效能,更應重視安全治理、合規要求及風險控管能力。
建議組織:
- 對外採購或使用第三方 AI 服務時,建立紅隊測試機制,定期驗證安全護欄的有效性。
- 不應依賴供應商的安全聲明,應獨立測試、驗證達成風險控管。
- 涉及機敏、個人資料或核心業務系統的 AI 應用,應建立適當資安防護基準,包括權限管理、資料保護、行為監控及異常輸入輸出偵測等控制措施。
- 將 AI 風險納入既有資安治理與風險管理框架進行持續管理。
🎯結論
AI 越獄是真實世界正在上演的攻防戰,AI 能力越強大,安全防護被繞過後所帶來的風險與影響也就越高。
Anthropic 認為「問題不嚴重」,但至少兩個獨立研究團隊成功驗證越獄可行性,這也讓我們看見,在AI技術快速發展的同時,安全治理、風險控管與監管機制,仍有許多挑戰需要持續面對。
想接收的最新消息與電子報嗎?
請留下您的聯絡資訊,我們將不定期與您分享重要的最新資訊!
