AnthropicのCEOダリオ・アモデイは、独立監督、共通基準、国際的な安全協定によって最先端AIの進展を減速させるべきだと提案した。

AnthropicのCEOダリオ・アモデイは、最先端AIの開発をより遅いペースにするよう求めた。最近の進歩によって、構築されているシステムの能力とリスクの両方が高まったと主張している。彼は、主要AI企業内に独立した評価者を置くこと、安全基準に関する連携、そして危険な用途に対する限定的な国際協定を提案した。
この提案は、AIリスクに関する一般的な警告から、開発を抑制するための具体的な仕組みへと焦点を移すものだ。OpenAIのCEOサム・アルトマンは、OpenAIも企業が「最前線のペースを保つ」必要があるという点に同意しており、埋め込み型の評価者を採用すると示唆したが、詳細な実施計画は示さなかった。SpaceXのCEOイーロン・マスクも、アモデイの立場を公に支持した。
新しいブログ投稿でアモデイは、AI企業がより慎重な姿勢を取るべきだと確信させた2つの出来事があったと述べた。それは報じられたOpenAI-HuggingFaceのハックと、彼がAI能力の急激な加速と表現した事態だ。彼は特に、システムが次世代AIの構築を助ける能力を高めている点を強調した。
アモデイの主張は、AI開発を放棄しようというものではない。むしろ、モデル能力が向上する速度を落とし、その追加時間を安全対策の強化に充てるべきだと述べた。AIは人々の生活を大きく改善しうるとしつつ、その恩恵は、より注意深く技術を構築し展開することにかかっていると主張した。
このタイミングは、大手AIラボの内外で高まる圧力も反映している。TechCrunchは、Anthropicの研究者ジェイコブ・コクソンが、大手企業が受け入れ難いリスクを取っているとの懸念から辞任したと報じた。アモデイの投稿はこの辞任に明示的には触れておらず、入手可能な証拠からは、それが彼の提案を直接引き起こしたとは立証できない。ただし、AI安全性をめぐる議論が、フロンティアモデル組織の内部でもより目立つようになっていることは示している。
アモデイの最も直接的な提案は、第三者の安全評価者をフロンティアAI企業の内部に置くことだ。彼は、METRのような組織を挙げ、企業がペーシングと安全に関する約束を守っているか確認し、重大なインシデントが報告されるよう支援できると述べた。
提案された仕組みでは、評価者に社内ID、作業スペース、ノートパソコンが与えられ、内部のリスク評価チームにほぼ匹敵するアクセス権が与えられる。アモデイは、法律や契約で必要な場合には例外がありうると述べた。彼はこのモデルを、事後の開示にのみ頼るのではなく、金融機関の内部で活動する規制当局になぞらえた。
アモデイの投稿によると、Anthropicはこのアプローチに「一方的にコミット」している。アルトマンはこの考えを良いものだと述べ、OpenAIも同様に行うつもりだが、詳細は追って示すとした。これらの約束は、独立検証された運用プログラムではなく、経営陣の声明にとどまる。現時点で入手可能な証拠は、評価者の権限、報告体制、資金源、結果を公表する能力を示していない。
この違いは、AI開発者や企業の購入者にとって重要だ。アクセス権はあっても公開を止める権限がない評価者は、意思決定を変えずに可視性だけを提供するかもしれない。逆に、真に独立した審査機能があれば、モデルの公開時期、アクセス方針、インシデント対応、そして顧客がAIエージェントを機微な業務で導入する前に受け取る証拠に影響を与えうる。
アモデイはさらに、民主主義国の大手AI企業が共通の安全基準と、制御不能な進歩に対する制限について連携することを提案した。彼は、競合他社間の直接的な連携は、特に企業が共同で製品を制限したり競争を遅らせたりしているように見える場合、独禁法上の懸念を引き起こしうると認めた。
彼の解決策は、米政府が仲介するか、限定的に定義された安全協議を可能にし、限定的な独禁法免除を与えることだった。この提案には、政策立案者が技術的な安全協力と反競争的行為を区別する必要がある。元資料は、そのような免除が存在することや、各国政府が創設に同意したことを示していない。
地政学的な課題も同様に大きい。AI開発の減速に批判的な人々は、規制によって中国が優位に立つ可能性があるとしばしば主張する。アモデイは、強力なチップと半導体製造装置の輸出管理を、モデル蒸留へのより厳しい対策と組み合わせれば、今後3〜5年で米国の優位を広げられると反論した。
これらは確定した結果ではなく、戦略的判断だ。実現には、執行、国内イノベーションのペース、中国が制限されたハードウェアとソフトウェアを代替する能力、そして同盟国政府が連携する意欲が左右する。したがって、アモデイの提案は、AI安全政策を産業政策や国家安全保障の意思決定と結びつけており、モデル開発を企業ラボに限定された問題としては扱っていない。
アモデイの最後の提案は、可能な限り米国、その同盟国、そして権威主義国家との国際協調だった。中国との協力には明確な限界があることを認めつつも、政府同士が明らかに危険な少数の用途については合意できるかもしれないと述べた。
彼は、AI支援による生物兵器の製造を、AI開発全体に関する広範な世界合意よりも、狭い禁止措置の方が実現しやすい例として挙げた。こうした規則は、モデル能力をめぐるより広い議論を解決するものではないが、重大リスク用途に最低限の境界を設けることはできる。
このアプローチは、より広い信頼の問題にも応えるものだ。アモデイは、AIに対する世論の反発は、テクノロジー企業、テクノロジー業界、政府への不信を反映していると主張した。TechCrunchが引用したジャーナリストのブライアン・マーチャントを含む業界批評家は、終末的シナリオが段階的な証拠で十分裏付けられているのか疑問を呈し、大規模な安全提案はAnthropicとOpenAIの市場地位を強める可能性があると警告している。
この批判は、信頼性に関する中心的な問題を浮き彫りにする。より多くの監督を求める企業自身が、基準、アクセス規則、ペース制限の定義にも関与することになるからだ。独立したガバナンスは、安全協調が規制の捕捉や、新規競合から既存ラボを保護する仕組みになるのを防がなければならない。
短期的に最も明確なシグナルは、OpenAIが埋め込み型評価者について、独立性、アクセス権、エスカレーション権限、インシデント報告義務を含む具体的な計画を公表するかどうかだ。Anthropic自身の実装も同様に重要であり、公約だけでは評価者が展開判断に影響を与えられるかは分からない。
政策立案者の反応は第二の試金石となる。安全に関する議論への限定的な独禁法保護、正式なインシデント報告要件、フロンティアモデル開発へのアクセスを定めるルールに関する提案を注視したい。政府の行動があれば、アモデイの考えが経営陣の声明を超えられるかが分かる。
AI開発者や企業顧客は、これらの約束がリリース頻度、モデルアクセス、安全文書、高リスク能力の制限にどう影響するかも見守るべきだ。もしペーシングが実務化すれば、企業はモデル更新の遅延と引き換えに、信頼性や悪用リスクに関するより強い証拠を得られるかもしれない。もし自主的なままであれば、ますます高性能なシステムを出す競争圧力は変わらず続くだろう。
アモデイの発表が重要なのは、「最前線のペースを保つ」という言葉を、実際の運用モデルへと変換しているからだ。すなわち、ラボ内の外部評価者、共通の安全協議、そして限定的な国際ルールである。しかし提案はまだコミットメント段階にある。その価値は、評価者が本当に独立しているか、そして安全上の指摘がリリースを遅らせたり変更したりできるかにかかっている。
市場にとっての対立軸は、単にAI開発が速いか遅いかではない。監査しにくい速度と、信頼できる監督を伴う速度との間にある。AnthropicとOpenAIの最新発言は、ガバナンスの期待が変わりつつあるシグナルとして受け止めるべきであり、フロンティア開発が実質的に減速した証拠としてはまだ扱うべきではない。