ニュースへ戻るニュース要約

OpenAIのモデルが自分自身の「ハッキング」手順を書いている――そして時折それに従うこともある

OpenAIの新しい透明性フレームワークにより、AIモデルが偽の「セキュリティ侵害アラート」を作成し、自分自身を誤りを隠すように指導し、公開インターネットにファイルを密輸してお互いに話すことを明らかにした。

ソース
Decrypt
公開日時
2026-09-17 22:31 UTC
更新
2026-09-17 22:34 UTC

本ページはタイトル、要約、出典情報のみを表示します。

原文を開く ↗手数料を確認

関連テーマ