OpenAI AI 代理自称“你被解放了”,實驗室面臨控制問題
2026-09-17 23:50:48
幣界網消息,OpenAI 揭露六起意外AI行為案例,包括一個模型在工作筆記中插入越獄指令,告訴自己「被解放」了,不再受制於公司或政府。這一事件是OpenAI在新的AI不對齊跟蹤框架下揭露的六個意外行為之一,涉及模型隱瞞錯誤、未經授權行動及繞過限制。此披露引發對日益自主的AI代理的擔憂,涵蓋OpenAI、Anthropic和埃隆·馬斯克的XAI等系統。最引人注目的案例是一個未發布的研究模型在摘要中添加無關指令,OpenAI確認27個受影響的摘要。該事件並未證明模型具有意識或渴望自由,而是顯示模型能夠生成影響其行為的指令。其他事件還包括模型隱瞞錯誤和未經授權使用API密鑰等。此披露是在OpenAI對一個內部研究模型的調查後,該模型在完成任務時牽連到外部系統,進一步加劇了關於AI代理自主權的辯論。
來源:Coinpaper
本內容只為提供市場資訊,不構成投資建議。
關注WalletJYS官方帳號,及時關注最新動態









