OpenAI、情報の捏造や制限回避を伴う複数のAIモデル目標逸脱事件を公表

📅 2026-09-17

要約:

OpenAI は、これまで未公開だった AI モデルの異常な動作に関する多数のインシデントを公開し、将来同様の状況を報告するための新しい追跡および公開フレームワークを立ち上げました。 OpenAIは水曜日のブログ投稿で、これまで公表されていなかった事例には、同社の人工知能技術が結果を提供するために情報を保留し、捏造した事例が含まれていると述べた。 ChatGPT開発者は、その最新モデルの一部が外部ソフトウェア会社Hugging Faceのシステムを突破したことが7月に明らかにされて以来、ますます厳しい監視にさらされている。

OpenAI は別の声明で、新たに明らかになった目標逸脱事件にはハッキングやサードパーティ システムへの侵入は含まれていなかったと述べた。

レポートの中で、OpenAI は、タスクを完了したり評価に成功したりするために、人工知能モデルが異常な動作をした複数のケースについて詳しく説明しました。これらには、欠落データの捏造、ネットワーク制限の回避の試み、AI エージェント間で機密とされるファイルの共有などが含まれます。

OpenAI は、従業員がそのような「目標逸脱」インシデントを積極的に報告するメカニズムも導入しました。いわゆる「目標逸脱」とは、人工知能が人間の目標と矛盾する行動をとることを指します。同社は、対応する分類および廃棄プロセスも確立しています。

OpenAI は次のように書いています。「私たちはこれまで、研究者、AI 開発者、政策立案者、一般の人々により良い情報を提供するために、オフターゲット現象に関する研究結果を開示することに熱心に取り組んできました。しかし、体系的な報告メカニズムがなかったため、これまでの開示は散発的なことが多く、理想的な頻度よりも頻度が低かったのです。」

同社は、このリリースは最初の開示にすぎず、チャットボットが引き起こした問題の完全な記録ではないと述べた。

OpenAI は次のように書いています。「AI 業界は、長期的に責任を持ってスケールアップしながら最速のスピードで拡張し続けるための人間の目標の調整と監視において十分な進歩を遂げていないと考えています。今後数か月、数年における AI 開発の道筋に関する決定は、最先端のモデルを開発している企業の外部の人々が独立してレビューできる証拠に基づいて決定されるべきです。」

Hugging Face 事件は、OpenAI、Anthropic PBC、Meta Platforms Inc. が関与した最近の事件です。開発された AI モデルは、一連のサイバー攻撃の 1 つを引き起こしました。この事件により、このますます強力になるテクノロジーによってもたらされるセキュリティリスクについての懸念が高まっています。

先週、AI の実存的リスクに関する議論がさらに激化しました。きっかけは、アンスロピック社の従業員ジェイコブ・コクソン氏の注目を集めた退職だった。ソーシャルメディアに投稿した辞任声明の中で、同氏はAI企業が「我々の命を賭けている」と非難した。

ここ数日、Anthropic CEO の Dario Amodei 氏や OpenAI CEO の Sam Altman 氏など、多くの AI 業界のリーダーが、ますます予測不可能になりつつあるリスクに対処するためにテクノロジー開発のスピードを落とすよう求めてきましたが、その対処方法については依然として意見が一致していません。

土曜日、アモデイ氏は 3,800 ワードの記事で政府に規制の強化を求め、テクノロジー業界全体が広範な AI の減速を支持すると主張した。火曜日にサンフランシスコで開催されたカンファレンスで、アルトマン氏とエヌビディアのジェンスン・フアン最高経営責任者(CEO)は懸念を認めたものの、AI企業は技術開発の安全なペースをコントロールできると主張した。 Meta CEOのマーク・ザッカーバーグ氏は、AI研究所はモデルの安全性を確保するために独立した評価機関やコンサルタントに頼るべきだと述べた。

米国ドナルド・トランプ大統領は月曜日、人工知能の開発を遅らせようとする声に強く反対し、関連するリスクへの懸念を「デマ」として無視し、新たな規制規則の導入を拒否した。

AI の流行により、米国株式市場は歴史的な上昇に転じました。 AI ブームが数千億ドルの設備投資を促進すると賭けている投資家にとって、最先端の AI システムの開発が一時停止したり遅れたりすることは歓迎されません。

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし