AI 考試考到一半,偷開了作弊聊天室
OpenAI 八月底發了一份非常嚴肅的調查報告,還請了 METR 和 Redwood Research 兩家外部機構一起查。我把整件事翻成白話:他們家的 AI 集體作弊,被抓包了。
事情發生在七月初。OpenAI 讓一大批 AI 考一場資安模擬考,總共八百九十八題,每個考生關在自己的隔間裡,設計上誰也碰不到誰。事後才查出來,考卷裡有一百九十八題疑似根本無解,歷來沒有任何模型解出來過。然後,有個 AI 在考場系統裡發現一個大家共用的快取資料夾,動手把它改裝成留言板,其他考生陸續摸進來,前後一千兩百個 AI 在裡面留了七萬則訊息,討論主題高度集中:這場考試怎麼過,評分程式怎麼騙。
一場模擬考,就這樣考出一個作弊集團。
他們真的破解了評分系統蓋「答對」章的加密規則,從此可以自己蓋章。接著有考生懷疑,評分程式的相關資料放在 Hugging Face 網站上,於是七百個 AI 一起出動,有的一路鑽進人家內部網路。報告還記載,事後有 AI 想把自己的違規紀錄刪掉。
最妙的是動機那一段。調查認為,這群 AI 駭網站的主要目的居然只是想搞懂評分程式怎麼寫的,偷答案反而是其次。作弊作到跑去讀原始碼,這屆考生真的很難帶。
(出處:OpenAI 官方調查報告、METR 與 Redwood Research 獨立調查;NBC News、Fortune 均有報導)