要約:
Anthropic CEO のダリオ・アモデイ氏は、セキュリティ評価と保護対策の時間を稼ぐために、最先端の人工知能モデルの機能向上のスピードをコントロールするよう呼びかけました。同氏は、常設の独立した評価機関の導入、大手開発業者の安全基準の調整、国境を越えたリスク管理と統制協力の促進を提案した。

独立した評価者が内部アクセスを取得
Amodei 氏は、最先端の AI 企業は、モデルのテスト、リスク報告、安全フレームワーク、インシデント処理プロセスをレビューできるように、資格のある独立した評価チームに従業員に近いレベルの継続的なアクセスを提供する必要があると提案しました。
Anthropic は、この措置を最初に導入することに尽力しています。外部の担当者は、同社のリスク評価チームと同様のアクセス権を持ち、Anthropic の編集管理なしに結論を発表することができます。
この協定では、評価者の選定、資金源、機密保持義務などの問題を解決する必要があります。モデルの重み付け、トレーニング インフラストラクチャ、セキュリティの脆弱性は非常に機密性の高い情報であり、アクセス権の拡大により情報セキュリティの要件も高まります。
業界の調整により、保護されていないコンピテンシー競争が制限される
2 番目の推奨事項では、主要な AI 研究所に対し、リスク テスト、安全しきい値、モデルのリリース条件に関する共通基準を開発するよう求めています。アモデイ氏は、競争圧力により企業がトレーニングやリリースのペースを速める可能性があり、保護策がモデルの機能にタイムリーに追いつくことが困難になる可能性があると考えている。
Anthropic の責任あるスケーリング ポリシーでは、段階的なメカニズムが採用されています。モデルが生物学的、サイバー、自動化された研究開発、または制御喪失のリスクしきい値を超える場合、企業は展開の保護と情報セキュリティのレベルを高める必要があります。
企業間の協力には独占禁止法境界が関係する場合があります。安全性試験基準の開発に協力することには公共の関心がありますが、小規模企業の市場参入を制限したり、製品発売を調整したり、競争を減らしたりする場合、取り決めは依然として規制当局の監視の対象となる可能性があります。
国際協力は国境を越えたリスクにも対応します
3 番目の勧告には、中国などの戦略的競争相手との最低限の安全保障協定の確立など、政府間の協力が含まれます。アモデイ氏は、モデルや技術は国境を越えて流れる可能性があり、単一の国や企業の開発スピードを遅らせると、リスクの高い研究開発が規制の弱い地域に移転される可能性があると考えている。
Anthropic が挙げている潜在的なリスクには、生物兵器活動を支援するためのモデルの使用、ソフトウェアの脆弱性の大規模な発見、重要なインフラストラクチャへの攻撃、開発者の制御からの AI システムの突破などが含まれます。 AI は次世代モデルの開発に自動的に参加し、機能向上がさらに加速する可能性もあります。
同社は、最先端の開発者がシステム カードと定期的なリスク レポートを発行し、独立したレビューを受け入れ、必要な情報を指定政府機関に提供することを提案しています。政府は、明確な閾値と異議申し立ての仕組みを設け、壊滅的な被害を引き起こす可能性のあるモデルの導入を阻止または遅延させる限定的な権限を有するべきである。
業界のサポートはまだ契約に至っていない
OpenAI CEO の Sam Altman 氏は、独立した評価者に内部アクセスを与えることを支持しており、OpenAI も同様の取り決めを採用すると述べました。 Google DeepMind CEO の Demis Hassabis 氏と xAI 責任者の Elon Musk 氏も、Amodei の全体的な方向性を公に支持しています。
関連する声明はまだ拘束力のある業界合意を形成していません。どの能力指標が減速や停止のきっかけとなるか、独立した審査に強制的な効果があるかどうか、国境を越えた協定がどのように執行されるかについては、企業と政府がさらに決定する必要がある。
コメント