OpenAIとAnthropicにおける再帰的自己改善(RSI) · 第2節(全9節)
2. 出所:"2026年12月から2027年3月"はどこから来たのか
OpenAIまたはAnthropicが2026年12月から2027年3月の間に再帰的自己改善 (RSI) に到達すると主張する、日付のある一次的な公式声明は存在しない。研究所のブログ、システムカード、政策文書、2026年8月までの報道にわたってこの主張を独立に繰り返し遡っても、同じ結論に達する [confidence: high]。この期間はメディアが作り出した複合的な産物である。期間を構成する各要素は実在する文書に遡れるが、組み立てられた主張そのものを述べる文書は一つもない。四つの源流がこれに流れ込んでいる。
2.1 四つの源流
第一の源流:AI 2027シナリオ。 2027年3月という具体的な日付は、AI Futures Projectが2025年4月に公開した物語形式の予測「AI 2027」(Kokotajlo, Alexander, Lifland, Larsen, Dean; ai-2027.com) に最も直接的に遡る [Kokotajlo et al., 2025]。このシナリオは架空の研究所「OpenBrain」に2027年3月の「超人的コーダー」を置き、社内向けAI研究アシスタント (「Agent-1」) を2026年11月から12月頃に配備し、その数か月後に超人的AI研究者が登場するとしている。
拡散した期間とシナリオ内部の日付との一致はほぼ完全である。2026年12月はAgent-1が配備される時期であり、2027年3月は超人的コーダーが到来する時期である。著者らはこれを研究所の予測ではなく、不確実性の大きい最頻シナリオとして提示しており、OpenAIやAnthropicによる声明ではない [confidence: high]。「研究所は2027年3月までにRSIと言っている」という又聞きの主張は、このシナリオをあたかも研究所の計画であるかのように日付を付け替えたものである。推測を事実に洗浄する行為である。
決定的な更新がある。シナリオの著者ら自身が、その後中央値を3年から4年後ろにずらした。2026年1月27日時点で、Kokotajloの超人的コーダーの中央値はおよそ2029年末から2030年初頭、AGIの中央値は2030年12月にあり、Liflandのそれは2035年に移った。Kokotajloは「物事はAI 2027シナリオよりいくらか遅く進んでいるようだ」と述べている [Lifland, Kokotajlo & Halstead, 2026]。著者らは自らが供給した日付をもはや支持していない。
第二の源流:OpenAIのロードマップ。 2025年10月28日、OpenAIが公益法人への再編を完了したのと同じ日に、Sam Altman、チーフサイエンティストのJakub Pachocki、共同創業者のWojciech Zarembaはライブ配信で、「2026年9月までにインターン級の研究アシスタント」、2028年までに「本格的なAI研究者」という社内目標を述べた [TechCrunch, 2025]。どちらの日付も2026年12月から2027年3月の期間には入らず、どちらもRSIの主張ではない。「研究インターン」と「自動化された研究者」は研究労働の自動化を指すものであり、AIの貢献が次のAIの開発サイクルを短縮する閉ループを指すものではない。
二次的な報道は2028年の日付を具体的に2028年3月としているが、その月は後の再報道 (TIME、MIT Technology Review) にのみ現れ、バージョン1.5まで録画に照らして確認されていなかった。OpenAI自身の2026年9月6日の投稿は目標を「2028年3月までに自動化AI研究者」と明記している [OpenAI, 2026, Research acceleration; バージョン1.6で確認。第8.10節参照]。この期間はOpenAIの二つのマイルストーンの間に位置する。2026年9月のインターンが後ろにずれ、2028年の研究者が前にずれて、中間で出会う形である。検証可能な範囲では、OpenAI自身が述べた目標は、同社に帰属させられている主張より遅く、弱い。
第三の源流:Amodeiの能力に関する発言。 Dario Amodeiは、圧縮するとRSIの日付として読める一連の広く引用される発言をしている。2025年3月10日のCouncil on Foreign Relationsのイベント (Axiosではない。報道が媒体と会場を混同した) では、「3か月から6か月でそこに到達する。AIがコードの90%を書く世界だ。そして12か月後には、AIが実質的にすべてのコードを書く世界にいるかもしれない」と述べた [CFR recording]。
「Machines of Loving Grace」(2024年10月11日) では、「強力なAI」、「データセンターの中の天才の国」が「早ければ2026年」にもあり得るとした。このエッセイは物理世界のボトルネックにも長い分析を割いており、即時のシンギュラリティという読みを明確に退けている。2025年1月のダボスでは、「ほぼすべてのことでほぼすべての人間より広く優れた」システムが「2026年か2027年」までに登場するとした (ほぼ同一の文が「On DeepSeek and Export Controls」(2025年1月) に活字で現れる)。
コーディングに関する発言は段階1から2の主張であり、「強力なAI」の発言は自己改善の仕組みを伴わない能力の予測である。いずれもRSIという語を使わず、閉ループを名指してもいない。「コードの90%」と「2026年から27年の強力なAI」を「AnthropicはRSIを2027年初頭までと予測している」へ圧縮するのが、最もよく見られる形のすり替えである。
第四の源流:閾値の洗浄。 AnthropicのResponsible Scaling PolicyとOpenAIのPreparedness Frameworkは、AI研究開発 (R&D) 能力の閾値、すなわち越えた場合に安全策を要求するガバナンス上のトリガーを定義しているが、これらは予測として日常的に誤読されている。閾値の文言と、それに伴うRSP v3.0の再構成は第1節に示した。この種の「越える」という言い回しは、研究所が安全策を望む不測の事態を記述するものであり、予定された出来事ではない。「我々の方針はジュニア研究者を自動化し得るモデルを対象とする」を「研究所は自動化された研究者を予測している」に変換する報道はこの誤りを犯しており、この議論において定義のすり替えが最も明確に記録された事例である。
2.2 最も強力な単一の根拠:Frontier Safety Roadmap
一つの文書がこの期間に近づいている。AnthropicのFrontier Safety Roadmap (2026年7月10日) は次のように述べる。「我々は、早ければ2027年初頭にも、我々のAIシステムが大規模で最上位の人間研究者チームの仕事を完全に自動化するか、あるいは劇的に加速させることがあり得ると考えている」[Anthropic, 2026b, https://anthropic.com/responsible-scaling-policy/roadmap]。これは主張されている期間に最も近い研究所の公式声明であり、公正に述べる価値がある。フロンティア研究所が、自らの名で、日付のある文書において、2027年初頭をチーム規模の研究自動化があり得る日付として記述しているのである。検討対象の主張に単一の最も強力な根拠があるとすれば、これがそれである。
三つの留保が、この文書に主張を担わせない理由である。これは安全策の計画文書であり、Anthropicが何に備えなければならないかについての声明で、RSPと同じ種類のものであり、「期待される」ではなく「あり得る」という語を使っている。その選言が重い仕事をしている。「完全に自動化するか、あるいは劇的に加速させる」は段階4から強い段階2の支援までのすべてを含み、RSIに近づくのは前者の選言肢だけである。そして再帰的改善の仕組みを何も名指していない。労働の自動化についての主張であり、次のサイクルを短縮するループについての主張ではない。厳密に読めば、この文書が支持するのは「Anthropicは2027年初頭までに研究が劇的に加速する可能性に備えて計画している」であり、「AnthropicはRSIを2027年3月までと予測している」より実質的に弱い。しかし、この主張の期間を擁護する者は誰であれ、この文書を引用すべきである。
2.3 統合された引用台帳
| 発言者 | 検証済みの文言 | 場所、日付 | 実際に主張している内容 | 検証状況 |
|---|---|---|---|---|
| Amodei | AIが3か月から6か月で「コードの90%を書く」、12か月で「実質的にすべて」 | CFRイベント、2025年3月10日 | コーディング自動化 (段階1から2) | CONFIRMED (会場をAxiosから訂正) |
| Amodei | 「データセンターの中の天才の国」、強力なAIは「早ければ2026年」 | 「Machines of Loving Grace」、2024年10月11日 | 能力予測、ボトルネックを考慮 | CONFIRMED |
| Amodei | 「2026年か2027年」までに「ほぼすべてのことでほぼすべての人間より広く優れた」 | ダボス、2025年1月 | 能力予測 | 記録により検証済み |
| Amodei | 「コーディングに優れAI研究に優れたモデル…次世代を生み出し…それを加速してループを作る」 | ダボス、2026年1月 | RSIの仕組みの記述、日付なし | UNVERIFIED、単一の集約された要約のみ [confidence: low-medium] |
| Altman | 超知能は「数千日以内」にあり得る | 「The Intelligence Age」、2024年9月23日 | 能力予測 (約10年以上) | CONFIRMED (出典を「Three Observations」から訂正) |
| Altman | 「我々は今、AGIの作り方を知っていると確信している」 | 「Reflections」、2025年1月6日 | 能力への確信、日付なし | CONFIRMED |
| Altman | 「我々は事象の地平線を越えた。テイクオフは始まった」、2026年には「新規の洞察を見出せる」システム | 「The Gentle Singularity」、2025年6月10日 | 漸進的に積み上がるという枠組み。新規性であってループの閉鎖ではない | CONFIRMED |
| Altman, Pachocki, Zaremba | 「2026年9月までにインターン級の研究アシスタント」、2028年までに「本格的なAI研究者」 | OpenAIライブ配信、2025年10月28日 | 社内の製品マイルストーン (研究労働) | TechCrunchによりCONFIRMED。「2028年3月」はOpenAI自身の2026年9月6日の投稿で一次確認(第8.10節) |
| Pachocki | 「深層学習システムは超知能まで10年を切っている」 | 同じライブ配信 | 能力予測 | TechCrunchによりCONFIRMED |
| Clark | 「再帰的自己改善は2028年末までに60%の確率で起こる」 | Xの投稿、2026年5月4日 (https://x.com/jackclarkSF/status/2051312759594471886)。「自分自身のより良い版を作る…完全に自律的に」という文言は2026年5月7日のAxiosインタビュー | 個人的なRSI確率推定。2027年までに約30%は二次的に報道 | CONFIRMED (一次資料を特定) |
| Kaplan | 人類はAIに自己訓練を許すかどうかを「2027年から2030年の間に」決める | Guardian、2025年12月2日 | 決定の時間枠という枠組みであり、予測ではない | CONFIRMED。流布している「早ければ1年以内」版には一次資料がない (SNS上の言い換え) |
| Anthropic Institute | RSIは「不可避ではない」が「多くの組織が備えているより早く来る可能性がある」。2027年には数週間規模のタスク | 「When AI builds itself」、2026年6月 | 能力予測と備えの枠組み | CONFIRMED |
| Anthropic | 「早ければ2027年初頭にも、我々のAIシステムが大規模で最上位の人間研究者チームの仕事を完全に自動化するか、あるいは劇的に加速させることがあり得る」 | Frontier Safety Roadmap、2026年7月10日 | 安全策計画上の閾値。期間に最も近い声明 | CONFIRMED |
| Anthropic / OpenAI | RSPのAI R&D閾値、Preparednessの「Critical」自己改善閾値 | RSP v2.x/v3.0、PF v2、2025年4月15日 | ガバナンス上のトリガーであり、予測ではない | CONFIRMED |
| Kokotajlo et al. | 架空の「OpenBrain」で2027年3月に超人的コーダー | 「AI 2027」、2025年4月、ai-2027.com | シナリオであり研究所の予測ではない。著者らの中央値は現在およそ2030年以降 | CONFIRMED |
2.4 インセンティブの文脈
上記の主要な研究所の声明はすべて、資金調達または政策ロビイングの近傍で行われた。Anthropicは2026年5月28日にポストマネー評価額9650億ドルで650億ドルのシリーズHを完了し、2026年6月1日にS-1草案を非公開で提出した。Anthropic Instituteが「When AI builds itself」を公開する数日前である [Fortune, 2026a; TechCrunch, 2026; VERIFIED]。OpenAIは2026年3月にポストマネー8500億ドルで1200億ドルのラウンドを完了したと報じられ、両社とも2026年第4四半期の上場を目標にしていると報道されている [secondary; confidence: low-medium]。[バージョン1.20で更新:Altmanは9月12日に2026年中の上場を否定し、Anthropicの目標は11月に移った。第8.27節参照。]それ以前の発言も同じように集中している。AmodeiのCFRでの発言はAnthropicの2025年3月の35億ドルの調達から数週間後であり、Altmanのエッセイ群はOpenAIの再編交渉の最中であった。批判者はそれを直接に指摘した。Georgia TechのMark Riedlは「大手AI企業はこぞって『再帰的自己改善』という誇大宣伝の列車に飛び乗っている」と述べた [Scientific American, 2026]。
この割引は対称的に適用しなければならない。加速の主張は能力面での主導権と評価額に資し、破滅寄りの主張や備えの主張は安全性の立場づけと規制戦略に資する。この時期にはどちらの方向も商業的な含みを帯びており、インセンティブとの近接性は台帳のすべての声明に慎重であるべき理由であって、好ましい結論に反するものを捨てる許可ではない。
2.5 算術的な痕跡と評決
構造的な観察を一つ示す。この期間は恣意的ではない。無関係な三つの成果物を圧縮すると生じるものである。AI 2027の内部日付はAgent-1を2026年11月から12月、超人的コーダーを2027年3月に置く。2025年初頭のデータからのMETRの中央値外挿は、約8時間という「人間の一営業日」の自律性閾値を同じ2026年末から2027年初頭の範囲で越える。そしてOpenAIの二つのロードマップ上のマイルストーンがそれを挟み、Clarkの2027年までに約30%という報道された数字が点予測として読める状態で存在する。この期間は算術的な痕跡を帯びている。出典文書自身の数字から自然に導かれるのである。これが、この期間が裏付けられているように感じられる理由であり、その裏付けが幻である理由でもある。これらの成果物は入力 (同じMETRのトレンド、同じ研究所の声明) を共有しているのであって、独立に日付を確認しているのではない。
出所についての評決はこうである。「2026年12月から2027年3月」は複合的な産物である。AI 2027シナリオのマイルストーンの日付に、Amodeiの2026年から2027年という能力に関する言い回し、OpenAIのコーディング自動化とロードマップに関する声明、予測と誤読された安全策の閾値を加え、「AIが我々のコードの大半を書く」から「AIがAI研究を自動化する」を経て「AIが人間なしに後継を設計する」へと、あたかも一つの日付を持つ一つの主張であるかのように滑らせる定義のすり替えによって組み立てられたものである。Frontier Safety Roadmapの「早ければ2027年初頭にも、あり得る」という一文は、この期間に本当に触れる唯一の研究所の声明であるが、それは自動化または加速についての計画文書であって、RSIの予測ではない。どの研究所もこの期間内の日付を挙げていない。日付を供給したシナリオは、その著者ら自身によって撤回されている。