OpenAI により、サードパーティ組織が AI モデルのセキュリティ評価に早期に介入できるようになります

📅 2026-09-23

要約:

OpenAI は、サードパーティ組織が人工知能 (AI) モデルの開発サイクルの早い段階でセキュリティ リスクを評価できるようにする予定で、これは AI の潜在的な危害をめぐる懸念に対処する継続的な取り組みを目的としています。 ChatGPT開発者は火曜日のブログ投稿で、新しいAIモデルのトレーニング、評価、展開中に外部機関に技術的セキュリティ評価を実施させる計画であると発表する予定だ。


OpenAI はまた、「強力な独立したメカニズム、科学的な厳密さ、堅牢なセキュリティ慣行、明確な説明責任」など、そのような評価が効果的であるために必要と考えられる優先事項も列挙しています。

外部の専門家と協力して同社のセキュリティレビュー作業のほとんどを担当しているラマ・アーマド氏は、これまで OpenAI は通常、主にそのような機関を導入してセキュリティ評価を実施し、モデルのリリース前にモデルの機能を評価していたと述べた。

「潜在的なリスクと影響が高まる中、導入に加えて、トレーニングや評価などの重要な側面にも確実に目を向けたいと考えています」とアーマド氏はインタビューで語った。

最も機密性の高い一部の業務については、OpenAI は外部の評価者に評価を行うために社内に来てもらう場合があり、これは同社が過去に試みたこともある、とアーマド氏は述べた。

OpenAI の競合企業である Anthropic PBC の CEO であるダリオ・アモデイ氏は最近、AI 業界に対し、開発の減速を支援するよう呼び掛け、第三者評価機関の導入を含む新たなセキュリティ対策が採用されると述べました。 OpenAI CEOのサム・アルトマン氏は後にこのアプローチを支持した。アンスロピックは先週後半、最先端のAIモデルの安全性をテストするためにアクセンチュアの評価者を招くと発表した。

OpenAI はブログ投稿で、同社がそのような評価に関与する可能性のある機関と協議中であると述べた。アフマド氏は、交渉の対象には、AI研究機関のMETRやレッドウッド・リサーチなど、過去に協力した機関とこれまで協力していない機関の両方が含まれると述べた。 OpenAIは以前、これら2つの機関に自社モデルのHugging Faceシステムへの侵入を調査するよう依頼していた。

「AI Labs には機密情報を保護しながら効果的なレビューのための条件を作り出す責任がある」と OpenAI はブログ投稿で述べた。

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし