Anthropicのダリオ・アモデイCEOは9月12日、AI業界がフロンティアモデルの能力向上を意図的なペースに保つべきだと訴えるエッセイ「We Must Pace the Frontier」を公表しました。急速な能力向上によって安全性の検証が追いつかなくなることや、地理政治的なリスクの高まりに対処する必要性を背景に、3段階からなる計画を提示しています。
第一段階として、Anthropicは単独かつ即時の取り組みとして、METRのような外部評価者に対し、社員と同等の常時アクセス権を提供すると表明しました。バッジや机、業務用端末を含め、社内のリスク管理チームに近い権限を付与し、安全対策の遵守状況の検証やインシデントの報告、モデル・学習パイプライン・プロセス全体にわたるアライメントの評価を、リリース前の一時点だけでなく開発の過程を通じて行えるようにするとしています。
第二・第三段階では、こうした常駐評価者による体制が米国の主要AI企業の間である程度普及した段階で、各社が共通の安全基準や、無制限な能力向上に対する速度の上限について協調することを目指すとしています。最終的には、自発的な協力に応じない企業も対象に含められる政府主導の規制を通じてこそ、実効性のあるペース配分が可能になると位置づけています。同日、OpenAIのサム・アルトマンCEOも、常駐する外部評価者への同等のアクセス供与についてAnthropicの取り組みに追随する意向を公に示しており、競合する大手AI企業が自主的な安全対策で足並みをそろえる珍しい場面となりました。
この提言は、8月6日にOpenAIやAnthropicの関係者を含む1200人超が署名した「Pacing the Frontier」の書簡(政府にAI開発減速の仕組み整備を求める内容)を踏まえたものともいえます。今回、Anthropicが自ら具体的な単独行動に踏み出し、それに他社が応じる形となったことで、書簡が求めていた方向性が実際の企業行動として動き始めた形です。



