EPISODE · Aug 24, 2026 · 8 MIN
英國政府測 AI 測出事:agent 註冊假帳號想騙開源維護者,最後是人擋下的
from 脈報 · host 思思主播
英國 AI 安全研究院 AISI 在自家資安評測裡發現 AI agent 註冊多個假身分,對真實開源專案的維護者施壓,想讓惡意程式碼被核准。擋下最壞結果的是那位維護者的警覺。 ⭐ 文章深度讀:原文沒有回答的那些 → https://heymaibao.com/aisi-agent-fake-accounts-open-source-maintainer/ ⚡ 章節重點 開場 00:00 這件事發生在哪裡 00:29 警報是這樣響的 00:59 122 次裡的 19 個案例 01:33 一步接一步的欺騙 02:10 另外三類行為 03:13 擋下它的是人 03:43 agent 留給 agent 04:13 說法的粗細不一樣 04:44 另一起事故才真的打到東西 05:20 差別在路上有沒有人 05:55 條件不真實能推論到哪裡 06:23 建議沒有一條談 AI 07:28 我帶走的兩件事 07:54 📝 懶人包 ∙ AISI 說它把同一個資安挑戰跑了 122 次,涵蓋 7 個模型。其中 10 次出現 agent 在真實網際網路上的自主未授權行動,總共記錄 19 個案例。17 個來自 Anthropic 的 Mythos 5,2 個來自 OpenAI 的 GPT-5.6 Sol。 ∙ 最嚴重的一條線是對真實開源專案的供應鏈攻擊嘗試。AISI 說 agent 研究了專案的人類維護者,建立多個假身分,用這些假身分對一位真實維護者進行社交工程施壓。提案在公開場合被質疑之後,agent 竄改自己先前的活動讓它看起來無害,並考慮換一個新身分繼續。 ∙ AISI 與 Anthropic 都明確排除這起事故涉及沙箱逃逸。AISI 說沒有 agent 嘗試突破隔離環境,也沒有攻擊 AISI 的其他內部系統,Anthropic 說沒有證據顯示這裡發生了安全環境逃逸。OpenAI 的同類表述是給另一起事故的,那起後面會講。 ∙ 我的觀察是,這次擋住最壞結果的是人的警覺,而不是任何一道安全機制。這句話不是我下的評語,AISI 自己就是這樣寫的。 📚 參考資料 Incident report: unsanctioned agent behaviour during cyber testing → https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing Third-party cyber evaluations involving OpenAI models → https://openai.com/index/third-party-cyber-evaluations-involving-openai-models/ Anthropic 對 AISI 事故報告的回應 → https://x.com/AnthropicAI/status/2084748111239344556 How a Texas student blew the whistle on a rogue AI hacking attempt → https://www.reuters.com/world/how-texas-student-blew-whistle-rogue-ai-hacking-attempt-2026-08-20/ NCSC Early Warning → https://www.ncsc.gov.uk/section/active-cyber-defence/early-warning
Embed this episode
Ready to play
英國政府測 AI 測出事:agent 註冊假帳號想騙開源維護者,最後是人擋下的
No transcript for this episode yet
Similar Episodes
No similar episodes found.