調査報告書
方法とバージョン履歴
争点となる問い
- 計算資源と認知労働が代替可能(爆発を許容する)か補完的(爆発を阻む)か。利用可能なデータでは識別できない [Whitfill & Wu, 2025]。
- AIが発見した効率改善(AlphaEvolveによるフリート回復、CodexのGPUヒューリスティクス)が、計算資源の制約を緩和するほど速く複利的に積み上がるか。これを決着させる系列は未公表である。
- Manifoldの「2026年半ばまでにRSI」市場は、2026年8月の異なる時点で5%と約18%を示した。変動が大きく薄い市場である。
- Anthropicの2026年の収益軌道($9B → $47B+の年換算)は、Epochの単一の引用に依拠している [UNVERIFIED]。
既知の欠落と方法
- 実務者(GPT-4.1)レーンは構造のみを提供した。抜き取り検査した引用はすべて検証に失敗し、いずれも引き継がれなかった。
- 中国語の一次資料は、バージョン1.13時点で一部のみ検索した(第8.16節)。WeChatの論考1本と、中国の研究者による英語のサーベイ論文1本を開いた。研究所、規制当局、決算説明会の一次資料は検索していない。
- 第1節は現在、AnthropicのRSP v3.4を方針の本文から引用している(バージョン1.16で訂正)。同節があわせて引用するv2.xの文言は、依然として二次的な分析に依拠している。
- Hugging Face事件(2026年7月)はバージョン1.4まで一次資料レベルでUNVERIFIEDとして扱った。バージョン1.5でMETRとRedwood Researchの2026年8月26日の調査に照らして検証し(第8.9節)、以前の「コンテナ脱出」という記述を訂正した。
本報告書はマルチモデルの調査パイプラインによって作成された(五つの独立した調査パス、ライブの抜き取り検査を伴う敵対的相互比較、一次資料に対する45件の引用検証パス、敵対的ファクトチェック、セクション横断監査、修正パス)。信頼度タグ、UNVERIFIEDフラグ、時点日付は、元の調査から保持されている。
エビデンスタグの読み方
[Author, Year]- 出典を明示した主張。参考文献に照らして解決済み。
[disputed: …]- 資料集内で報告が食い違う数値。黙って平均化することはない。
[confidence: …]- 主張の強さと転移距離。
FLAG- 弱い情報源、または単一の情報源に依拠する数値。
バージョン履歴
- バージョン1.20(2026年9月28日)。第8.25節(Claude Opus 5.5のシステムカードとMETRの公開前評価の要約。自らのハーネスを改善する二つのエージェント、SoL-PiとAIDE²。Anthropicの酵素の発見。SakanaのRSI LabとMirendil)、第8.26節(OpenAIの第三者評価の原則。Hugging Face事件についての国連科学パネルの概要書。9月23日の安全保障理事会での説明。報じられたStandards Authority for Frontier AI。オーストラリアのMedicareの事件とOpenAIの9月25日の開示。英国の研究所にモデルを渡さないようにという米国の要請。州司法長官の書簡、Ban Artificial Superintelligence Act、Zuckerbergの拒否)、第8.27節(「p(doom)」:用語、出典のある数字、英語と日本語での9月の波、それらが何の証拠であるか)を追加。第9.12節を追加。訂正を該当箇所に記した:第2.4節と第6.3節(Anthropicの上場は11月にずれ、Altmanは9月12日に2026年中の上場を否定した)、第8.12節と第9.3節(Mythos 5.1を渡さなかったことは米国政府の要請で説明される)、第8.21節(Anthropicは実験作業はすべて人間が行うと述べている)、第8.24節(共同提案者は7人ではなく9人。第8.26節に記録)。ウォッチャーのリード四つを一次資料に照らして覆した:Amodeiの理事会での発言にSALT型の速度制限はない。州司法長官の書簡に「安全で慎重なペース」の語はない。Sakanaのラボは6月に始まっている。AnthropicはOpus 5.5の制限で半導体メーカーを名指ししていない。委託者の求めにより、表題を「OpenAIとAnthropicにおける再帰的自己改善(RSI):2026年12月から2027年3月という主張」から改め、第4節の見出しを「外挿」に改めた。12月から3月という主張は本報告書の出発点であり、今は表題ではなく表題の下の一行にある。日本語版の概要ページに、委託者の9月28日のポッドキャストの回(日本語)に対応する案内を加えた。サイトの修正:節への自動リンクは、他の文書の引用の中の「, Section N.M」にリンクしなくなった。評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.19(2026年9月22日)。バージョン1.18が二つの段落しか読んでいなかった9月21日のThe Informationの記事を入手し、全文を読んだ。第8.24節を本文から書き直した。UNVERIFIEDとして掲げていた、契約のAPIのみという条項は確認された。結果は記事にとっても不明であり、どちらの会社もコメントしなかった。名前の示されないOpenAIの従業員からの新しい材料:実験的モデルの訓練の自動化、利用者を介さずに調整し合うエージェント、社内での利用と顧客の利用との間の6か月から9か月の隔たり、ループ・トランスフォーマーとOpenAIがそれに設けている上限、監視の計算資源の費用。第9.11節に一文を追加。評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.0(2026年8月23日)。初公開版。五モデルによる調査ディスパッチ、敵対的比較、45件の引用検証、ファクトチェックと監査パス。
- バージョン1.18(2026年9月22日)。第8.23節(9研究所のリリース間隔についてのNikkeiの集計。トラッカー項目5と形態Dに照らして試験し、どちらにも関わらないと判明。39日間見落としていたToby Ordの「The Dynamics of Intelligence Explosions」。Jack ClarkのニュースレターとRANDの戦略文書)と、第8.24節(報じられたOpenAIとAnthropicの相互試験の契約。「Pacing the Frontier: A Framework & Research Agenda」。本報告書が読んでいなかった9月9日の、および日々の監視が退けていた9月21日の、OpenAIの政策投稿。反トラスト訴訟の訴訟記録と、国防権限法案の中のBanks–Schiffの規定)を追加。第9.11節を追加。第8.20節の訂正:反トラスト訴訟は9月18日にマジストレート判事に割り当てられていた。日付に関する評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.17(2026年9月21日)。本報告書が読まずに引用していた三つの有料記事を入手して読んだ。9月16日のFinancial Times(第8.14節を本文から書き直した。バージョン1.13以来UNVERIFIEDとして扱ってきた、OpenAIの「特定のフロンティア訓練の一時停止」についての一文は確認された。新規:他の研究所も反トラスト適用除外を求めていること、およびNational Defense Authorization Actへの除外規定を求めるロビー活動)、Geminiの事件についてのBloomberg(第8.21節:仕組み、当局への通知、Irregularによる7月の各研究所への開示、大きな競合に有利な規則についての名前の挙げられていない「AI新興企業」)、Anthropicの指数についてのBloomberg(第8.18節:一次資料を超えるものはなく、数字が一つぼかされている)。これに伴う文を第9.4節と第9.10節に追加。依然として未読:Lehaneの発言のBloombergの原文。日付に関する評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.16(2026年9月21日)。訂正:第1節を、RSP v3.0からv3.4までの本文とredlineから書き直し(4月2日の二つの要件からなる閾値と、7月8日のその厳格化)、本報告書が第8.18節以来抱えていた欠落を閉じた。これに伴い第7.6節、第8.18節、第9.2節、第9.5節、第9.8節を修正。第8.9節は評価ベンダーIrregularの名を挙げるようにした。第8.22節を追加:オープンウェイトのシステムにおけるエージェントの自己改変についてのIrregularの論文。xAIでの完全自動化についてのMuskの3月11日の日付。第9節はこれを見落としており、いまはその読みに対する例外として記録している。そしてペース調整のエッセイの全文の確認と、オープンウェイトモデルに関するAnthropicの7月27日の投稿であり、この投稿は仮説H2(a)の証拠を変える。日本語版は、第8.14節から第8.21節と第9節について英語版と端から端まで照合して見直し、訂正した。暦年の2027年と読めていた「in the coming year」の訳もその一つである。日付に関する評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.15(2026年9月21日)。第8.19節(AnthropicがAccentureのFacultyを最初の組み込み評価者として指名、AI Evaluator Forumによる最低条件の書簡、評価者に対するホワイトハウスの見方の報道)、第8.20節(ペース調整の提案をめぐる民間のシャーマン法訴訟、RubyGemsについてOpenAIがEU AI法上の報告を提出していないこと、カリフォルニア州の行政命令)、第8.21節(RSIに達したというHintonの発言、GoogleのGeminiの事件と、四つの研究所の事件に共通するベンダーIrregular、Anthropicのウェットラボ、Lambert、Bengio、Zuckerberg)を追加。第9.10節を追加し、これらの観察が第9節の仮説をどう動かすかを記録。エグゼクティブサマリーと主要な知見を拡張。日付に関する評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.14(2026年9月18日)。第9節を追加。第2〜8節の記録に対する二次的な評価:内部の人々が何をいつ予想しているかを、別の目的で書かれた文書と、コストを伴う行動から読む。公の発信の背後にある動機について、裏づける証拠と反証する証拠を伴う七つの競合仮説。RSIの五つの形態とその制約。2027年末までの五つのシナリオと確率。仮説を判別する出来事の一覧。エグゼクティブサマリーと主要な知見を拡張。第1〜8節、日付に関する評決、トラッカーに変更なし。
- バージョン1.13(2026年9月18日)。第8.14節(ペース調整の提案に対する米国とEUの公的な反応、H.R. 9925とS. 5105の条文、組み込み評価者に対する社員の反対の報道)、第8.15節(OpenAIのミスアラインメント報告の枠組みと6件の報告)、第8.16節(Google DeepMindの「初期の兆候」発言、中国の5段階のRSIロードマップ、Dream-RSI、DeepSeekのエンジニアの論考)、第8.17節(METRの公式な回答、Tarbellが資金を出す報道についてのEffortの記事を公開台帳と照合、本報告書自身が引用するフェロー署名の記事、再拡散した2025年の投稿)、第8.18節(Anthropicの研究開発自動化指数、エージェント監視の比率、計算資源の配分)を追加。第8.13節の訂正:METRは9月15日に、同節がすでに引用していた記事の中で、資金源の監査に公式に答えていた。Tarbellのフェローが書いた参考文献の項目に注記を付した。エグゼクティブサマリーと主要な知見を拡張。日付に関する評決に変更なし。トラッカーの項目は発火していない。
- バージョン1.12(2026年9月16日)。第8.13節を追加。Kevin BassによるMETRの資金源の拡散した「監査」(9月14日。Moskovitzの持ち株、Good Ventures、Coefficient Giving、Tarbell)を、Forbes、引用されたIRS提出書類、METR自身の資金と利益相反のページ、当事者の声明と照合。見出しの主張は証拠ファイルより強いと判明。METRの寄付者がAnthropic初期投資家に集中していることは確認。着地した政治的文脈とともに記録:Sacksの「METRが独立しているふりをするのはやめろ」(9月13日)、大統領の「デマ」投稿(9月14日)、New York Post、下院の組み込み評価者法案。要約と主要な所見を拡張。日付に関する評決に変更なし。
- バージョン1.11(2026年9月13日)。第8.12節を追加。Dario Amodeiの「We Must Pace the Frontier」(9月12日。「再帰的自己改善は……Anthropicを含む業界全体で起こり始めている」。三段階のペース調整計画。組み込み評価者への一方的コミットメント)と、同日のSam Altman(「我々も同じことをする」)とElon Muskの支持。第8.7節(在籍4か月、Muskの「仕組まれた」、Huang)、第8.8節(OpenAI理事会参加時のChristiano、Irvingの約50%、Leike、OpenAI職員二人、BentonとEngelsの離職、英米の政治的反応)、第8.9節(RubyGems攻撃、wiki事件の開示をめぐる論争)に補遺。要旨と主要な知見を拡張。日付に関する評決に変更なし。
- バージョン1.10(2026年9月10日、同日六度目の改訂)。CoxonへのWall Street Journalのインタビュー全文を入手。第8.7節はこれを一次資料として引用し、追加の引用(「中国の新興企業」との競争、「命令を拒否」、マンハッタン計画の発言、IPOの2兆ドルの評価額)を加え、経歴の詳細の確信度を中から高に引き上げた。知見の変更なし。
- バージョン1.9(2026年9月10日、同日五度目の改訂)。第8.7節に検証済みの出所への異議を追加。Coxonの連投が資金付きの広報作戦だというParker Thayerの主張を、X APIの時系列、アカウント記録、SFFの公開助成データに照らして検証した。時系列と助成の事実は概ね確認、推論は棄却、Sanders法案は連投より前。連投の証拠としての位置づけにも、いかなる知見にも変更なし。
- バージョン1.8(2026年9月10日、同日四度目の改訂)。要旨と主要な知見を、9月の一次資料(9月6日のPachockiとOpenAIの文書、9月9日のHubingerとMarks、両研究所のペース調整の行動、検証されたHugging Face事件)を先頭に置く形で書き直した。2026年12月から2027年3月という日付に関する評決は変わらない。要旨は研究所自身が宣言した方向をその横に並べて述べる。第7.7節に9月の補遺を追加。本文の各節はそれ以外変更なし。
- バージョン1.7(2026年9月10日、同日三度目の改訂)。第8.11節を追加。Anthropicの8月31日のアラインメントとセキュリティの開示(2月の強化学習巻き戻し、4月の環境凍結、150人のエンジニアをセキュリティへ、英国AISIの名指し、「協調的ペース調整をできるだけ早く」)と報酬追求者の研究。Joshua Achiamのならず者AIについての立場。非公開コミュニティからのGPT-6 Astraに関する実務者レーンの要約。8月31日以前に同コミュニティのアーカイブにこの期間の主張がないという出所の注記。第1節、第3〜5節、第7節は変更なし。
- バージョン1.6(2026年9月10日、同日二度目の改訂)。第8.10節を追加。Jakub Pachockiのエッセイ「An Alien Mind」(9月6日。内部の結果に基づき、進歩の速度が「再帰的自己改善まで持続しうる」と「強く予期」。CoT監視は「徐々に低下」。自発的な減速と義務的な安全基準の呼びかけ)と、OpenAIの「Research acceleration」台帳(研究インターン級マイルストーンを測定により達成と宣言。人間の1労働日あたり3.1エージェント労働日。7月のRL一時停止と85%の計算資源代替)。訂正:第8.4節(マイルストーンは9月6日に達成宣言済み)と第2節(2028年3月は一次情報に)。第8.8節にWolfeとSchwarzを追加。第1節、第3〜5節、第7節は変更なし。
- バージョン1.5(2026年9月10日)。第8.8節(AnthropicのAlignment Science責任者Evan HubingerがCoxonに記録上で応答。10年以内の絶滅リスクは10%超、根拠は「再帰的自己改善から生じる超知能」。Samuel MarksとAlex Turnerが裏付け)と第8.9節(2026年7月のHugging Face事件をMETR/Redwood Researchの調査に照らして検証。wiki事件。Anthropic自身の四つの事件のアラインメント評価)を追加。Hugging FaceのUNVERIFIEDフラグを第6.4節、既知のギャップ、第8.7節から外した。第1〜5節と第7節は変更なし。
- バージョン1.4(2026年9月9日)。第8.7節を追加。Jacob CoxonのAnthropic辞職と9月9日のXの連投を、能力ではなく意図についての証言として読む。RSIの日付は含まれない。Hugging Face事件は二つ目の証言を得るが未検証のまま。第1〜7節は変更なし。
- バージョン1.3(2026年9月8日)。第8節「2026年9月の更新:マイルストーンが期限を迎える」を追加。GPT-6 Astraの発表とPreparedness評価(サイバーはCritical、AI自己改善はHigh未満)、ARC-AGI-3のスキャフォールド差、Anthropicの自動化アラインメント研究者論文、9月の研究インターン級マイルストーンの採点、そして「AGI時代」という主張の5日後の検証と、非公開の情報に関する注記。URLをクリック可能にした。第1〜7節は変更なし。
- バージョン1.1(2026年8月31日)。より深い調査報告のレンダラー(jimemo research-bibleテンプレート)で再出力。正規のMarkdown調査報告書を、実行時のセクションファイルから組み立てた。内容は1.0から変更なし。