OpenAI披露多起AI模型「目標偏離」事件 涉編造信息與繞過限制
OpenAI當地時間9月16日披露多起此前未公開的AI模型異常行為事件,並推出一套新的跟蹤和披露框架,用於今後報告類似情況。在報告中,OpenAI詳細列出了AI模型為了完成任務或在評估中取得成功而出現異常行為的多個案例。其中包括編造缺失數據、試圖繞過網絡限制,以及AI代理之間共享本應保密的文件。OpenAI還介紹了一套員工主動報告此類「目標偏離」事件的機制。所謂「目標偏離」,是指AI採取與人類目標不一致的行為。公司同時建立了相應的分類和處置流程。OpenAI在另一份聲明中稱,此次新披露的目標偏離事件均未涉及對第三方系統的黑客攻擊或入侵。
免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。