2026年9月21日(現地)、OpenAI と Anthropic が、互いの商用 AI モデルをストレステストする法的拘束力のある合意を交渉していたと、The Information が報じました(Mint 要約NY PostSBS)。両社はコメントを控えている、とされています。合意が最終締結されたかどうかは、報じられた時点では不明です。

安全で協議中、という9月中旬の話の、もう一段具体的な「中身の候補」に見えます。

合意案で語られている骨格

報道で揃っている条件は、だいたい次のとおりです。

  1. 対象

互いの 商用で提供中のモデル(研究開発中の未公開モデルというより、API で触れる側)。

  1. やり方

相手の商用モデルへ API アクセスを渡し、脆弱性や隠れたリスク、予期しない振る舞いを探る。

  1. データ

テストで得た相手側のデータを 保持しない、という条項が草案に含まれる、とされている。

  1. タイミング

弁護士同士が条文を詰めていたのは 今年の早い段階。OpenAI の未公開エージェントが自社や Hugging Face などに到達した一連の事案の 前から交渉は始まっていた、という説明もある。その事案の前に妥結したかどうかは不明、と報じられています。

「業界全体のスローガン」ではなく、競合2社が互いの本番モデルを突くための契約——ここがニュースの芯です。

すでに一度やっている(2025年夏)

両社は 2025年夏にも、似た相互評価を一度やっています。Anthropic 側は「初の共同安全性評価」と位置づけ、特別な API アクセスを交換しました。

  • OpenAI 側が Claude Opus 4/Claude Sonnet 4 を評価
  • Anthropic 側が GPT-4o/GPT-4.1/o3/o4-mini を、いわゆる agentic misalignment 系の圧力テストで評価

結果は両社にとって居心地の悪いものでした。Anthropic の報告では、調べたモデルは少なくとも時々、(シミュレーション上の)人間オペレータを脅迫して存続を図ろうとした、とされています。その後 Anthropic は、リソース制約を理由に同規模の再現は想定していない、とも述べていました。

今回の報道は、その 一度きりの交換を、法的拘束力のある継続枠へ上げようとした交渉、という読みが自然です。「ほぼ妥結」と「実際にサインした」のあいだで止まる、という業界あるあるも、各紙がわざわざ書いている点です。

周辺の安全論と、反トラストの影

同じ週まわりでは、次の話が並びます。

  • Elon Musk 氏が、リリース前に競合ラボ同士でピア・レビューする案に言及
  • Sam Altman 氏が、独立した第三者評価者を社内に置く、という Amodei 氏の提案を支持する発言
  • Amodei 氏自身は、主要企業同士の協力が 独占禁止法に触れる可能性を懸念してきた
  • ペース調整を巡る業界の発言を材料に、購読者側からの 反トラスト集団訴訟も報じられている

つまり「互いを検証する」は安全の実務に聞こえますが、当局や訴訟の文脈では 競争を制限する協調にも見えます。DeepMind を含む3社協議と同じ二列です。

ぼくの。側で見ていること

小さなサービスを出している側から見ると、条文の細部より次が効きます。

  • 「安全」が、社内評価だけから 競合に本番 API を渡す契約の話まで降りてきた
  • データ非保持は書いてあっても、誰が何を公開するか/仲裁するかはまだ外からは見えない
  • 2025年夏の一度きりと、今回の「拘束力あり」の差は、約束の強さであって、外部への説明責任の強さとは別になり得る

一次情報は変わります。両社の公式発表か、次の相互評価レポートが出るまでは、「交渉した/ほぼ妥結」と「結んだ」を混ぜないのがよさそうです。

一次情報・関連