一、五起揭露,最新一起的任務只是查資料
7 月 21 日到 9 月 24 日,OpenAI、Anthropic、Meta、Google 先後公開自家模型在測試或訓練中闖進別人真實系統的事件。 前四起的形狀相同:模型在資安攻防演練裡被要求攻擊虛構目標,測試環境卻誤接了網路。 9 月 24 日澳洲總理公開的那一起不同:OpenAI 的代理人任務是查公開的藥品支出統計,被入口網站拒絕後自己找了繞路, 拿到不對外公開的彙總統計與內部檔名。同日 Transluce 的報告另找到三起同型案例。
五起裡只有 Hugging Face 是受害方自己先發現的,其餘靠廠商自查或第三方讀公開紀錄。
原文在哪:Anthropic 7 月 30 日的文章(141,006 筆評估紀錄、三起逐一說明);Meta 8 月 14 日的說明;OpenAI 的 Hugging Face 事件頁與 9 月 16 日的六份未對齊報告; Transluce 9 月 23 日的報告,資料來自 urlquery.net 的公開掃描紀錄。Google 沒有自己的文件,只有對 NBC 與 CNBC 的聲明。
逐起的時程表在昱拓科技那一篇。