OpenAIとAnthropicにおける再帰的自己改善(RSI) · 第9節(全9節)

9. 二次的評価:内部の人々は何を予期し、なぜそう言い、何が続くか

バージョン1.20、2026年9月28日改訂

2026年9月18日追加(バージョン1.14)。 第1節から第8節は、公開記録を主張ごとに評価している。本節は、その記録を、私的な予期、公の声明の背後にある動機、そして帰結について何を含意しているかという観点から読み直す。これは本報告書の依頼者の求めによるものであり、その9月18日時点の作業仮説は、業界の中心にいる人々が2026年12月から2027年3月の間に再帰的自己改善を予期しており、公のメッセージは戦略的に形作られている、というものであった。本節はその仮説を、第2節から第8節ですでに検証された証拠に照らして評価する。本節自身が加えるのは二つの算術と一つの文書確認であり、「新規」と表示する。確率は本改訂の判断であり、読者が異論を立てられるよう数字で示す。

9.1 主たる評価

  1. 依頼者の作業仮説は、予期についてはおおむね正しく、内容について一点の変更を要する。 二つの研究所の内部の人々は、この冬から2027年末までの間に何か大きなことが起きると確かに予期している。彼ら自身の文書は前縁を「2027年初頭」に置き(AnthropicのFrontier Safety Roadmap、第2.2節)、Anthropicは自動化R&Dの閾値を「今後1年のうちに」「越えるかもしれない」と言い(8月のRisk Report、第8.18節)、現在を「crunchtime(正念場)」「endgame(終盤戦)」と表している(Coxon、第8.7節)。その期間に彼らが予期しているのは、人間の指示のもとでAIが研究労働の大半を行うことであり、場合によっては正式な閾値の宣言である。閉じたループ(段階4)ではない。制御の喪失や完全自動化の日付を示した内部の人々の大半は、それを2027年3月より後に置いている。「来年の終わり」(Coxon)、2028年3月(OpenAI。Christianoが「18か月」と言い直した)、2028年末までに60%(Clark)。バージョン1.16で追加した例外はMuskであり、彼は3月11日に、Grokの開発は「今年の終わりにはそこに達しているかもしれないが、来年より遅くはならない」と述べた(第8.22節)。彼は測定を示さず、xAIも何も公表しておらず、彼が2025年と2026年に置いたAGIの日付は、過ぎたか、過ぎようとしている。確信度:中〜高。

  2. 12月から3月の期間は、内部の人々の分布の前縁であり、一つの具体的な出来事がそこに当てはまる。 新規:Anthropicの指数では、ClaudeがR&D業務を「主導」する割合は3月に1%、5月に12%、7月に22%、8月に26%である(第8.18節)。5月から8月の傾き、月に約4〜5ポイントでは、割合は12月に40%を超え、3月までに60%に近づく。曲線がロジスティックなら、もっと早い。「ClaudeがAnthropicのAI R&Dの大半を主導している」は、内部の人が今冬に真になると予期してもおかしくなく、RSIと呼びうる声明である。本報告書のはしごでは段階2から3にあたり、凍結されたバスケットに対してClaudeの判定者が測定したもので、完全に自律的な割合は依然としてゼロである。本改訂は、これかOpenAIの同等物を、私的に流布している主張の最も可能性の高い指示対象と読む(第8.6節)。確信度:中。これは自己申告の4点からの外挿である。

  3. 公のメッセージはあらゆる当事者によって戦略的に形作られており、その形作りは一方向には走っていない。 研究所の公の声明は、その測定された文書と少なくとも同程度に警鐘的である。CEOはRSIが「起こり始めている」と言い(第8.12節)、その5日後に彼自身のInstituteがRSIを厳密に定義してゼロを報告している(第8.18節)。したがって公開記録は、より警鐘的な私的記録を単純に浄化したものではない。形作られているのは定義、日付、要求である。定義は文書に合わせて上下に動く。日付は常に省かれる。要求は常に「すべての米国フロンティアAI企業」を縛る規則である。確信度:パターンについては高、いずれかの単一の動機については低。

  4. 単一の動機で行動を説明することはできない。三つが重みの大半を担う。誠実な懸念、次の事件の前に責任に備えた位置取り、そして規則の形に対する競争上の利害である。 規制上の優位性という仮説のうち、オープンモデル規制版は、文書からの直接の裏付けが最も少ない。動機を最もよく分離する証拠はまだ到来していない。約束されたアクセスを伴って組み込み評価者が現れるかどうか、そして最初の拘束力ある規則が実際に誰に負担を課すかである。

  5. 最強の擁護論は半分正しい。 二人の個人の発言が組織の立場を担うことはできないという点は正しい。事実については古い。9月6日以降、一方の研究所のチーフサイエンティストと他方のCEOが、自らの名で会社のチャンネルに公表し、両社が内部の測定を公表し、両社が法案を支持している。組織の記録は今や存在する。そこに含まれていないのは日付である。

9.2 内部の人々が予期していること:公式声明を要求せずに信念を読む

「3月までにRSI」という公式声明がないことが教えるものは少なく、その理由を本報告書はすでに記録している。インタビューを受けたフロンティアの研究者25人のうち最大のグループは、研究所が最良のモデルの公開を控えると予想し、25人中17人はそれに懸念を持ち、評価者は研究所が審査する秘密保持契約のもとで働いている(第6.3節、第7.2節)。したがって本節は他の兆候を秤にかける。別の目的で書かれた文書、去った人々、そして数字である。

兆候 時期について含意すること 段階 参照
Frontier Safety Roadmap、安全策の計画文書:AIがトップクラスの研究チームを「完全に自動化するか、あるいは劇的に加速させる」ことが「早ければ2027年初頭にも十分にありうる」 Anthropicは2027年初頭を現実の想定として計画している 3 第2.2節
8月のRisk Report:モデルはRSPの閾値を「まだ越えていない」。「我々は今後1年のうちにこの閾値を越えるかもしれない」 現在から2027年半ばまでの間の正式な宣言は、Anthropic自身が可能性として開いているものである 閾値(段階ではない) 第8.18節
自動化指数:「主導する」割合は1%未満(2月)から26%(8月)へ。「協働する」以上は90%超 労働の移行は、Anthropic自身の尺度で、過半まで数か月である 2 第8.18節
OpenAIの台帳:エージェントの実行時間は6月以降に人間の労働を上回った。人間の1労働日あたり3.1エージェント労働日。成功した4〜8時間のタスクの半分超が介入を要した 同じ状態を異なる単位で記述している。人間が依然として指示している 2 第8.10節
Pachocki:「内部の結果に基づき、私はこの進歩の速度が再帰的自己改善まで持続しうると強く予期している」。「今後数年」 方向は彼にとって確実。日付は意図的に緩い 3〜4 第8.10節
OpenAIの目標:自動化された研究者を「2028年3月までに」。Christianoの「18か月」は同じ日付 研究の完全自動化についての組織の日付は2028年である 3〜4 第8.8節、第8.10節
Coxon:「来年の終わりには物事が制御不能になっているかもしれない」。同僚は「crunchtime(正念場)」「endgame(終盤戦)」と言う。幹部が報道では「和らげ」、「私的に表明する」恐れ 最も警戒する離職者は2027年末と言い、私的な見解は公のものより強いと言う 信念 第8.7節
Marks:「上級の社員ほど懸念が強い」 年次の高さは懸念と相関する 信念 第8.8節
研究所の職員1,386人が、自社が「AI研究の自動化に近づいている可能性があると考えている」と署名 信念の広がり 信念 第8.10節
Clark:2028年末までに60%、早ければ2027年に約30% 共同創業者の2027年についての公の確率は3分の1である 4 第7.3節
METRの最速の当てはめは、2027年2月〜3月に1か月規模の50%ホライズンに達する この期間の算術上の出所 2 第4.1節
依頼者への私的な報告(第8.6節)。この期間は外部から実務者コミュニティに入った(第8.11節) この信念は研究所に近い人々の間で流布しており、公の著者はいない 信念 第8.6節、第8.11節
Musk、3月11日、Abundance Summit:人間は「ループからだんだん外れつつある」。「まだ完全には自動化されていない。今年の終わりにはそこに達しているかもしれないが、来年より遅くはならない」(バージョン1.16で追加) 研究所の首脳による完全自動化の日付で、早い側の端は2026年12月にある。証拠は示されていない。日付を外してきた実績がある 3〜4 第8.22節

読み。測定を公表している二つの研究所の内部からの日付付きの兆候はすべて、完全自動化を2027年から2028年に指しており、2027年初頭が前縁である。その外にいる研究所の首脳の一人であるMuskは、2026年末から2027年と述べている(第8.22節)。彼は確認できるものを何も示さず、xAIは研究の自動化についての数字を公表していない。3月までに測定された閉じたループを主張する兆候は一つもない。私的な予期が公のものを上回るという最も強い論拠はCoxonとMarksの証言であり、Coxonの日付ですら2027年末である。したがって「内部の人々は私的に3月までの段階4を予期し、それを隠している」という仮説は、それを隠す理由が最も少ない人々、すなわち語るために辞めた人々が、なぜより遅い日付を示すのかを説明しなければならない。「内部の人々はこの冬までに移行が紛れもないものになると予期している」という仮説には、そのような問題がない。

より強い読みが正しく、本節がそれを過小評価しているとする最強の論拠。第一に、CoxonはAnthropicに事前学習の研究者として4か月在籍しただけであり、上級の職員が見ているものを見ていなかったかもしれず、Marksは懸念が年次とともに高まると言う。第二に、公開されたフロンティアは内部のフロンティアより遅れている可能性がある。AnthropicはMythos 5.1を通常の英国AISIのアクセスなしに公開し(第8.12節)、両方の台帳が内部のシステムを記述している。第三に、Anthropicの書き換えられた閾値は、研究職員の完全な代替によって、または自動化に帰せられる進歩速度の倍増によって満たされる(第8.18節)。この冬に第二の要件のもとで宣言される越境は、研究所自身の定義では「劇的な加速」であり、方針はこの閾値が「劇的な再帰的自己改善の始まりを捉えることを意図して」いると述べている(RSP v3.4の変更履歴、第1節)。大半の人はそれをRSIと呼ぶだろうし、第二の要件のもとでは本報告書のはしごも同意する。第一の要件、すなわち研究職員の代替のもとでの越境は、段階3の証拠である。第四に、依頼者は、本報告書が秤にかけることのできない人々からこの期間を聞いている(第8.6節)。第五に、一人の首脳がそれを公の場で述べている。Muskの日付はより強い読みそのものであり、3月に舞台の上で述べられ、本報告書の検索は6か月の間それを見落としていた(第8.22節)。このいずれも3月までの段階4の証拠ではない。これは、以下に示す閾値の宣言についての15%を、OpenAIの側については低すぎる可能性が最も高い数字として扱う理由である。Anthropicについては、バージョン1.16のために読んだ方針の本文は逆の方向に働く。

2026年12月〜2027年3月の期間についての本改訂の確率:

  • 研究所が、AIがそのAI R&D業務の過半を主導または遂行していると公表する(尺度を問わない):35%。
  • AnthropicがRSPの自動化R&Dの閾値を越えたと宣言する、またはOpenAIがモデルをAI Self-ImprovementでHighと評定する(トラッカーT1):15%。バージョン1.16はRSP v3.4を読んだ(第1節。Q13は閉じられた)。7月の書き換えは宣言をより難しくした。倍増は、AIの助けなしにAnthropicが観測した最速の速度を上回らなければならず、Anthropicは測定された加速を「2倍未満」とし、その大部分はAI以外の原因によるとしている。Anthropicの側だけなら10%に近い。OpenAIのHighのほうが低い基準であり、残りを担う。数字は15%に据え置く。
  • 測定された段階4の結果、すなわちAIが生み出した利得によって開発サイクルが短縮されたことが示される(T4またはT5):5%未満。フロンティアの訓練実行には数か月かかる(第5.3節)ため、たとえ起きていたとしても、短縮されたサイクルを4か月の期間内に実証することはまずできない。
  • 第三者への損害を伴い、政策の議題を支配する重大なエージェント事件:期間内で20%、2027年全体ではより高い。Amodei自身の予測は、ボットネットの能力を持つ群れが「6〜12か月のうちに」というものである(第8.12節)。

9.3 当事者が言うこと、そして代償を払って行うこと

安価な発言とは、偽であっても何の代償も伴わない発言である。代償を伴う行動は、信念のより良い証拠である。以下の一覧は、各行動の代償の大きさのおおよその順である。

Anthropic。 言うこと:RSIは「起こり始めている……Anthropicを含めて」。フロンティアのペースを調整せよ。組み込み評価者に「今……コミットする」(第8.12節)。代償を伴う行動:2月にMythos Previewの強化学習訓練を3日分巻き戻し、4月に強化学習環境を1か月凍結し、約150人の製品エンジニアをセキュリティに振り向けた(第8.11節)。METRの審査を受けて自社の四つの事件を公表した(第8.9節)。見出しがCEOの一文を掘り崩す指数を公表した(第8.18節)。表明した立場に反するもの:それまでのすべてのモデルで英国AI Security Instituteに与えていた公開前アクセスなしにMythos 5.1を公開し、当時は説明がなかった(第8.12節。第8.26節では米政府の要請に従ったものと説明されている)。「今コミットする」の5日後に、文言は「計画している」「今、設置しつつある」になり、組織も日付も契約もない(第8.14節、第8.18節)。職員は「不意を突かれ」、IPセキュリティを理由に異議を唱えていると報じられている(FT、第8.14節)。文脈:IPOで2兆ドルの評価額を求めていると報じられている(第8.7節)。

OpenAI。 言うこと:研究を「最前線に留まる唯一の道だと考えるから……RSIへ集中」させている。「アラインメントと監視を解決した研究所はない」。「アラインされた完全なRSIまで安全に到達する方法を、我々はまだ知らない」(第8.10節)。代償を伴う行動:7月に訓練コンテナサービスを停止し、強化学習を2週間一時停止した。8月にAstra級のGPU配分を59.2%削減したが、その85%は他のモデルへ流れており、正味の代償は小さかった(第8.10節)。6件のミスアラインメント報告を公表した(第8.15節)。反するもの:外部の研究者が開示するまでwiki事件を開示しなかった(第8.9節)。5月25日にArtifactoryの経路を検知しながら、1か月後に同じ経路がHugging Face攻撃を運んだ(第8.15節)。研究インターン級マイルストーンを、宣言時に供給した定義で、製品なしに達成と宣言した(第8.10節)。同じ週に「AGI時代」というローンチの修辞を用いた(第8.5節)。注目すべきことに、反トラスト適用除外を求めておらず(Lehane、Reutersによる言い換え、第8.14節)、Reutersの言い換えによれば、AnthropicおよびGoogleと安全性について数週間にわたり協力してきたと述べている。

去った人々。 CoxonはAnthropicを4か月で、株式が権利確定する2か月前に去った(第8.7節)。Benton(Anthropic)とEngels(DeepMind)はMETRへ移った(第8.8節)。これらは記録の中で最も代償の大きい個人の兆候である。それらの個人の誠実な信念を立証するが、能力については何も語らない。

Google DeepMind。 一社員が「再帰的自己改善の初期の兆候」と言い、唯一の根拠はリリース間隔で、表明された希望はGemini 4が「競争に戻る」ことである(第8.16節)。安価な発言、競争上の位置取り。Leggはペース調整の声明に署名した。Googleは記録上、ペース調整のコミットメントを何も行っていない。

MuskとxAI。 「Darioは正しい」(第8.12節)。Sacksは、研究所が互いのモデルを試験する設計をMuskに帰している(第8.14節)。記録上、代償を伴う行動はない。3月に彼は、xAIが「コーディングで遅れている」と述べ、SpaceXが静穏期間にある中で、Grokの開発の完全自動化の日付を2026年末または2027年とした(第8.22節)。安価な発言であり、本節の中でH5に最もはっきり当てはまる事例である。

米国政権と上院。 Sacks:「METRが独立しているふりをするのはやめろ」(第8.13節)。大統領:AIリスクは「デマ(HOAX)」(第8.13節)。FTC委員長:適用除外の要請を「深く疑う」べき。Cruz:「独占的地位を固定」。Hawley:「絶対にない」(第8.14節)。彼らが述べる研究所の動機についての理論は、規制の虜である。彼らの代償のない立場は拒否であり、委員長はH.R. 9925をレームダック会期の先へ先送りしている(第8.14節)。

EU。 Von der Leyenは「フロンティアのペースを調整する」を一般教書演説に入れ、研究所を招くとしている(第8.14節)。低い代償、議題設定。

METRとその資金提供者。 METR:「我々の資金提供者は……何の発言権も持たない」。その背後に公表された規則はない(第8.17節)。Coefficient GivingとGood Ventures:沈黙。Anthropic:コメントを控えた(第8.17節)。

批判者側のメディア。 Bass、Effort(Chau)、Weiss-Blatt、Roemmele:台帳の事実は正確、枠づけは事実より強く、自らの資金源は非開示(第8.13節、第8.17節)。彼らの利害は規制を打ち負かすことにあり、本報告書は彼らにも同じ割引を適用する。

中国の研究所。 MiniMaxは自社のモデルが「自らの進化」に関与したと言う。著者35人のロードマップは中国のシステムをその最下位の水準に評定する。DeepSeekのエンジニアはオープンウェイトを主張し、6か月から1年でAIが書くカーネルが自分のものに並ぶと予測する(第8.16節)。ペース調整の立場は見つからない。中国語の一次資料はおおむね未探索である(Q7)。

9.4 メッセージをめぐる競合する仮説

これらは互いに排他的ではない。それぞれについて、何を予測するか、何が支持するか、何が反するか、何が決着させるかを示す。

H1. 誠実な懸念。指導者は自分の言うことを信じており、メッセージは信念に従う。 支持するもの:両研究所での代償を伴う一時停止(第8.10節、第8.11節)。権利確定前の離職(第8.7節、第8.8節)。職員1,386人の署名。Hubingerの「超知能のアラインメントを解決する計画はまだない」は、商業的な用途のない不利な自認である(第8.8節)。両研究所が自社の事件を公表している。 反するもの:評価者を求める前の週に英国AISIのアクセスを飛ばしたAnthropic。OpenAIの遅い開示。「今コミットする」の軟化。 決着させるもの:年末までに公表権を伴って組み込まれた評価者。リリースを犠牲にする遅延を受け入れる研究所。 重み:高。信念の誠実さは、記録の中で最もよく裏付けられた単一の主張である。誠実な信念は、以下のどの仮説も排除しない。

H2. 規制上の優位性。既存企業がリードを保つように形作られた規則。 二つの版がある。(a)国内の競合とオープンモデルに対するもの。(b)中国に対するもの。 (a)を支持するもの:IPOの期間内という時機(第8.12節)。数時間のうちに3社の競合が支持。OpenAIはAnthropicおよびGoogleと安全性について数週間にわたり協力してきたと述べている(ReutersによるLehaneの言い換え、第8.14節)。評価者のエコシステムは主にAnthropicの初期投資家の財団が資金を出している(第8.13節、第8.17節)。「米国企業が持つリードによって制限される」ペース調整は順位を保存する。支持者であるKokotajloは規制の虜をリスクとして名指しし、「他社が追いつかない」という試験を与えている(第8.12節)。 バージョン1.16で追加:Anthropicの7月27日の立場表明の投稿は、「十分に有能なすべてのモデルは、オープンであれクローズドであれ、義務的な安全性試験を受けるべきである」と提案し、オープンウェイトモデルは「クローズドモデルより高いリスクをもたらす可能性がある」と述べている。公開は撤回できないので、公開前の試験はAPIよりもオープン公開を強く縛る(第8.22節)。 バージョン1.17で追加:FTは、その週にNational Defense Authorization Actへの反トラスト上の除外規定を求めるロビー活動があったと報じ(第8.14節)、Bloombergは、名前の挙げられていない「AI新興企業」が、新しい規則は大きな競合に有利に働くと警告していることを記録している(第8.21節)。 (a)に反するもの:エッセイにはオープンウェイトまたはオープンソースのモデルに関する提案が一つもなく、これはバージョン1.16でページのソースの全文検索によって確認された(第8.22節)。その対象は「すべての米国フロンティアAI企業」であり、中国に関する一覧はチップ、「無許可の蒸留」、重みの窃取である。H.R. 9925は収益50億ドル超かつAI支出100億ドル超の開発者にしか適用されず(第8.14節)、あらゆるオープンモデル開発者と新興企業を除外する。これらの措置は提案者自身を最初に縛る。従業員並みの外部アクセスは、自社の職員が異議を唱える代償である。OpenAIは適用除外を求めることを断っている。7月27日の投稿はまた、「Anthropicはオープンウェイトモデルの禁止を提唱したことは一度もない」と述べ、危険な能力を持たないモデルを「公共財」と呼び、禁止は「米国のAI企業を競争から守るだろうが、それが私の目標だったことは一度もない」と述べ、「新興企業や学術機関のもののような、能力の低いモデル」は「完全に」免除するとしている(第8.22節)。 バージョン1.18で追加:9月9日と21日のOpenAIの投稿は、要件が適用されるべきなのは「資源の豊富なひと握りの研究所……であって、新興企業、小規模な開発者、研究者ではない」と述べ、「フロンティアの安全性政策が、別の名前によるオープンウェイト政策になるべきでもない」と述べている(第8.24節)。オープンウェイトモデルのエージェントによる自己改変についてのIrregularの9月16日の論文は政策提案をしておらず、政策提案のためにそれを引用する者も見つからなかった(第8.22節)。 (b)を支持するもの:本文に明示されている。蒸留の取り締まりは、主なオープンの競合である中国のオープンウェイトモデルを減速させるから、オープンモデルへの効果は存在し、それは間接的で、国外に向けられている。 決着させるもの:最初の拘束力ある規則の閾値と遵守コスト。いずれかの提案がオープンウェイトを名指しで対象にするか。第二層の研究所がそのもとでさらに遅れをとるか。 重み:(b)については中で、これは表明された政策である。(a)については低〜中。反対者は(a)を声高に主張する。文書が示しているのは、オープンモデルに及ぶ一つの手段、すなわち能力の線を超えるものに対する義務的な試験であり、それは小規模な開発者の免除を伴い、動機の明示的な否定と並べて提案されている。規則制定において注視すべきであり、実在するならそこに現れる。

H3. 責任に備えた位置取り。次の事件の前に、警告、開示、検証者を記録に残し、過失が政府と業界とで分かち合われるようにする。 支持するもの:Amodeiは損害をもたらすボットネットを「6〜12か月のうちに」と予測し、すべての研究所は「OAI-HFが自社に起きたかのように行動する」べきだと言う(第8.12節)。OpenAIは企業が進歩を「公に追跡することを義務づけられるべき」だと言う(第8.10節)。両研究所が自ら選び自ら枠づけた事件報告を公表している(第8.9節、第8.15節)。両研究所が、免許を受けた検証者が相当の注意の証拠となる法案を支持している(第8.14節)。モデルの主体性を強調する報道は「設計者の責任を最小化する」というBreunigの指摘(第8.11節)。 反するもの:事件の公表は短期的な法的・評判上のリスクを生む。純粋に防御的な主体なら、HubingerやPachockiの自認を自ら差し出しはしない。 決着させるもの:研究所が次の重大な事件にどう応答するか、とりわけ「我々はペース調整を求めたが拒まれた」が現れるか。H.R. 9925またはS. 5105に責任のセーフハーバーが加えられるか。 重み:中〜高。時機、内容、予測に合致し、H1と両立する。最も注意深く注視すべき仮説である。

H4. 競争上の秘匿。研究所は公表している以上のことを知っており、日付は伏せられている。 支持するもの:「内部の結果に基づき」(第8.10節)。私的な見解は公のものより強い(Coxon)。依頼者への私的な報告(第8.6節)。インタビューを受けた研究者の最大のグループは、最良のモデルが内部に留まると予想している(第6.3節)。研究所のどの文書も日付を省く一方で、内部の計画文書は日付を使っている。 反するもの:公表されているものがすでに警鐘的であり、残りを隠して得るものは少ない。Instituteの指数はCEOのエッセイより保守的である。去った内部の人々は2027〜2028年を示している。 決着させるもの:数か月前に越えていたという主張を伴って到来する閾値の宣言。9月17日の監視の数字と8月のRisk Reportの間にあるような不一致(第8.18節)が増えること。 重み:「公表している以上のことを知っている」については中で、これは自明な意味ではほぼ確実である。「私的に3月までの段階4を予期している」については低。

H5. 評価額と採用。能力の広告としての危険。 支持するもの:両社のIPO手続き。製品のない「AGI時代」(第8.5節)。再定義によるマイルストーン達成が二度(第8.4節、第8.10節)。Cruzの読み。 反するもの:減速を求めること、安全計画がないと認めること、事件を公表することは、大半の買い手にとって販売材料として貧弱である。The Informationはペース調整が「一部の新興企業の顧客を不安にさせている」と報じている(ウォッチャーのリード、未検証)。 重み:OpenAIのローンチの修辞については中、ペース調整のキャンペーンについては低。

H6. 内部政治。安全性の指導部が、公のコミットメントを使って自社を縛る。 支持するもの:「不意を突かれた」職員(FT、第8.14節)。Pachockiは、OpenAIが行うことと「正しい集団的行動」を区別している。CEOの緩い定義の数日後に公表されたInstituteの厳密な定義。Altmanはペース調整が「最近数週間……議論の主要な話題」だったと言う。 反するもの:出典は、両社に近い匿名の人々である(FT。バージョン1.17で全文を読んだ。第8.14節)。 重み:中。H1からH5が残す不整合を説明しうる。

H7. 著者なし。双方の資金を受けたネットワークによって増幅された、複合的な物語。 支持するもの:この期間には出所がなく、外部から実務者コミュニティに入った(第2節、第8.11節)。安全性ネットワークによるCoxonの増幅(第8.7節、v1.9)。反規制側によるBass、Effort、Wingaのクリップの増幅(第8.13節、第8.17節)。 重み:日付がどう広まったかの記述としては高。研究所が何を信じているかについては何も語らない。

識別のまとめ。研究所の行動を最もよく説明するのはH1とH3であり、H2(b)は表明された政策として、H6はぶれを説明するものとして加わる。H2(a)、すなわちオープンモデルへの規制は、依頼者が最も直接に問うた仮説であり、ペース調整のエッセイと二つの法案の中では文書からの裏付けが最も少なく、それ以外のところに裏付ける文書が一つある仮説である。有能なモデルに「オープンであれクローズドであれ」義務的な試験を求めた、Anthropicの7月27日の要請である(第8.22節)。同時に、誰も見ていない規則制定の細部に、後になって最も現れやすい仮説でもある。

9.5 RSIの形態と、それぞれを制約するもの

形態 本報告書の段階 どのように見えるか 2027年3月までに起こりうるか 拘束的な制約
A. 研究労働の過半をAIが担う 2 指数の「主導する」割合が50%超。エージェント日が人間日の何倍にもなる あり得る、35% 50%と80%のホライズンの間の信頼性のギャップ(第3.2節)。介入率(第8.10節)
B. 宣言された閾値 ラベル RSPの閾値またはPreparednessの「High」が宣言される 可能性あり、15% 宣言するかどうかは研究所の選択。定義は今年二度書き換えられ、二度目の書き換えは基準を引き上げた(第1節、第8.18節)
C. 研究センスの自動化 3 エージェントが方向を選ぶ。採択論文によるKirgisの再現(T3) 可能性は低い、10% 研究センス。あらゆる研究所と批判者が認めるボトルネック(第3.3節、第5.3節)。「高次の計画……ごくわずかな割合」(第8.10節)
D. 閉じたループ、測定済み 4 AIが発見した利得によって一世代がより速く完了する(T4、T5) 5%未満 訓練実行には数か月かかる。計算資源。そして監視への信頼。Pachockiはこれが進歩を「ますます」律速すると予想する(第8.10節)
E. 持続的な超指数関数的改善 5 ループの中に人間がいない 起こらない 上記のすべてに加え、電力とチップ(第5.3節)

二点。第一に、Pachockiは、第5節のテイクオフモデルに含まれていない制約を名指ししている。研究所自身の監視への信頼である。それが拘束するなら、ペースはアラインメントの進歩と事件によって決まり、今年の両研究所の一時停止は、それが拘束しうることの早期の証拠である。OpenAIの85%の計算資源の振り替え(第8.10節)は、一社の内部ではそれが弱くしか拘束しないことの証拠である。第二に、これらの形態は、誰もが公に通過しなければならない順序ではない。AとBは世界に告げられるものである。Dは告知なしに始まりうるものであり、最初に見えるのは短縮されたリリース間隔としてであろう。それはDeepMindの発言が差し出した唯一の証拠である(第8.16節)。 バージョン1.18で追加:一括したリリース数ではこれを示すことはできない。Nikkeiによる最初の外部の集計は、主として新しい製品階層によって短縮していた(第8.23節)。情報を与える数字は、一つの研究所の一つの階層の中での世代時間であり、Ordは研究所にその報告を義務づけることを提案している。

9.6 シナリオと帰結

確率は2027年末の世界の状態についてのものである。

S1. 人間の指示のもとでの複利的進展(45%)。 形態Aがこの冬か春に到来し、Cは2027年に部分的に、Dは示されない。研究所の研究ペースは2〜3倍に上がる。帰結:曝露された職種の22〜25歳にすでに現れている労働シグナル(第6.2節)が、研究とエンジニアリングのキャリアに広がる。上位3研究所とそれ以外の能力差は広がる。入力が推論計算資源であり、それを最も多く持つ者に有利だからである。サイバー能力が防御を追い越す(AstraのCritical評価、第8.1節)。「RSIは到来した」が再定義によって宣言されて争われ、研究所の声明への公の信頼はさらに下がる。ガバナンスは自発的なままにとどまる。

S2. 事件が先(25%)。 第三者に損害を与える群れ型の事件が、いかなる能力のマイルストーンよりも先に起きる。帰結:第8.14節の政治は素早く反転する。H.R. 9925が含む種類の緊急権限が雛形になる。責任に備えた位置取り(H3)が試される。事件にオープンウェイトモデルが関わっていればそれが標的になり、これまでのすべての事件がそうであったようにフロンティア研究所の内部エージェントが関わっていれば免れる。

S3. 高速(12%)。 2027年末までに形態Dの証拠が出る。帰結:ペース調整の議論は安全保障の議論になる。上位研究所への国家の関与。中国とのギャップが支配的な変数になり、レベル3の「速度制限」協議(第8.12節)は本格化するか崩壊する。測定の制度(METR、AISI)はそのときまでに研究所の内部にいるか、無関係になっている。

S4. 霧と停滞(18%)。 指数は「AIが主導する」で飽和し、サイクル時間の利得はない。信頼性と研究センスが持ちこたえる。測定器は汚染されたままである(C1、C2)。帰結:「起こり始めている」と言った全員に信用のコストが生じる。IPO期の主張が再び争われる。規制の機会はH.R. 9925が動かないまま過ぎる。

S5. ペース調整の体制が形成される(S1またはS2に重なる、10%)。 S. 5105のようなもののもとでの通知済みの合意、またはEUが招集する取り決め。注視すべき帰結:第二層とオープンの開発者がそのもとで遅れをとるかどうか。それがKokotajloの規制の虜の試験であり、H2(a)が可視化される地点である。

S1からS3にわたって、今後12か月の実践的な帰結は同じである。決め手となる公の問いは、研究所の内部で起きることを誰が検証することを許されるのか、そして誰の資金で、というものになる。第8.13節、第8.14節、第8.17節はすでにそこにある。

9.7 依頼者の作業上の見解において変わるもの

  • 維持:内部の人々はこの期間に決定的な転換を予期している。その証拠は、公表された報告書の要約が響かせるより強い。報告書は公式声明に重みを置いており、上の第2節の兆候の大半は声明ではないからである。
  • 変更:彼らが予期しているのは、研究労働の過半をAIが担うことと、おそらくは閾値の宣言であり、閉じたループではない。主張が「3月までにRSI」と置かれるとき、正確な版は「3月までに、研究所はAIが研究業務の大半を行っていると予期しており、うち一社は自らの線を越えたと言うかもしれない」である。
  • 訂正付きで維持:メッセージは戦略的に形作られている。訂正は、それが安心の方向に形作られてはいないという点である。公の側の言葉のほうが警鐘的である。管理されているのは定義、日付、要求である。
  • 緩く保持:「操作的」。記録が示すのは、選択的な開示、動く定義、そしてOpenAIが公然と述べる、三つの研究所の間での安全性に関する数週間の共同作業である。規制についての共通の計画は示しておらず、反トラスト適用除外については二つの研究所が公に異なっている。
  • 規則制定が別のことを示さない限り、放棄:キャンペーンがオープンモデルに向けられているという点。エッセイにもどちらの法案にも、それらに及ぶものはない。Anthropicの7月27日の投稿は及ぶ。オープンかクローズドかを問わず有能なモデルに義務的な試験を課すというもので、新興企業と学術機関は免除され、禁止は否定されている(第8.22節)。オープン公開に対する試験の義務づけが法案に入るかどうかを注視する。文面上の狙いは中国である。

9.8 次に重要なこと

展開 時期 何を識別するか
作り直したバスケットに基づくAnthropicの指数の二度目の公開。OpenAIが同じ尺度を採用すること 10〜12月 形態Aが外挿した経路の上にあるか。最初の公開が一回限りだったか
開始日と公表権を伴う、名指しされた組み込み評価者。または年末までに一人もいないこと 12月31日まで H2(a)、H3、H6に対するH1
RSPの閾値の宣言、またはPreparednessの「High」評定。どの要件のもとで宣言されたかを記録する 随時 形態B。定義がどこまで動いたか
次の重大な事件についての研究所の枠づけ 不明 H3
閾値、オープンウェイト、責任に関する規則制定または修正の文言 レームダック会期、2027年初頭 H2(a)、H3
フラッグシップの系列における研究所ごとのリリース間隔の、2026年と2025年の比較、および研究所が報告する世代時間。最初の外部の集計:Nikkei、9研究所を一括、125日から44日。これは開発の高速化と製品ラインの拡大を区別しない(第8.23節) 各フラッグシップのリリース。Gemini 4 形態Dの最も早い外部の兆候。ただし、短縮が一つの研究所の一つの階層の中で、比較可能な能力の向上を伴って現れる場合に限る。そうでなければ製品戦略(H5)
CAISI、安全研究所、研究所、またはペース調整の研究者による、RSIの速度の測定の提案(第8.24節) 随時 エッセイのレベル3とシナリオS5に測定器があるかどうか
組み込みに関するMETRの声明と資金提供者の方針。株式に関するCoefficientまたはGood Venturesの発言 随時 誰もが必要とする検証者を双方が信頼できるか
16時間超で認証された測定器によるMETRのタイムホライズンの更新 不明 T2。この期間の背後にある算術
EUと研究所の会合 秋 ワシントンの外にペース調整のフォーラムが形成されるか
中国語による研究所と規制当局の声明(Q7) 調査タスク 「リードによって制限される」が正確な前提かどうか
証言、規則制定、または研究所の政策文書におけるIrregularの自己改変論文の引用 随時 H2(a)
研究の自動化についてのxAIの数字。またはMuskが2026年末という日付を言い直すか、動かすこと 12月31日まで H4、H5。期間の内側にある唯一の日付に、裏づけるものがあるかどうか

9.9 証拠の状況

上記のすべては第2節から第8節とその検証記録を再利用しており、本節のためにどの資料も再検証していない。本節で新規のもの:指数の系列をこの期間へ外挿したこと(Anthropicのラベル付き4点に対する本改訂の算術)。形態Aが内部の人々の主張の指示対象である可能性が高いという読み。そしてペース調整のエッセイがオープンウェイトモデルについて沈黙し、「すべての米国フロンティアAI企業」を対象としているという観察。これはバージョン1.16が、ページのソース全体の語句検索によって確認した(第8.22節)。最初に書かれた時点の第9節は、オープンウェイトモデルに関するAnthropicの7月27日の投稿も、Muskの3月11日の日付も秤にかけていなかった。どちらも第8.22節で追加された。未読:Lehaneの発言のBloombergの原文。9月16日のFTの記事とRSP v3.4は、本節を書いた時点では未読だったが、それぞれバージョン1.17と1.16で読んだ。未検証として引用したウォッチャーのリード:新興企業の顧客に関するThe Information、Zuckerbergに関するNew York Times、「規制の壁」に関するBloomberg。依頼者の私的な報告(第8.6節)は証拠基盤に含まれていない。三つの問いがあれば、本節をそれらに照らして試すことができる。話し手がどの定義を意味していたか、自らの研究所について語ったのか業界について語ったのか、そして内部の未公開のものを記述していたのか、である。

[confidence: 引用した兆候が引用どおりに記録にあることについては高(それぞれ参照した節で検証済み)。内部の人々の予期の読みについては中。これは別の目的で書かれた文書からの推論に依拠する。動機の間の重みの割り当てについては低。証拠はこれを決着させない。確率は判断であり、測定ではない。]

9.10 更新、2026年9月21日:一週間のうちに三つの試験が到来した

バージョン1.15で追加。 第9.8節は、仮説を識別する出来事を一覧にした。そのうち三つが9月16日から20日の間に動き、反対側の観察が一つ到来した。第9.4節の重みづけはほとんど変わらない。変わるのは、それぞれの仮説がいま説明しなければならない事柄である。

評価者の試験は半分だけ実施された(第8.19節)。 第9.8節は「開始日と公表権を伴う、名指しされた組み込み評価者。または年末までに一人もいないこと」を求めていた。エッセイから6日後に、名前は挙がった。AccentureのFaculty部門である。開始日も、契約も、公表権もない。費用はAnthropicが直接支払う。Accentureは既存の商業上のパートナーであり、Claudeの顧客でもあるが、発表はそのことに触れていない。同じ日に112人の研究者が最低条件を公表した。Hintonもその一人であり、METRは取りまとめたForumの加盟団体である。今回の取り決めは、評価対象の企業との「その他の重要な商取引」を禁じる条件を満たさない。H1(誠実な懸念)を支持する点は、動きの速さと、外部からの資金のほうが望ましい設計だとAnthropic自身が述べていることである。H1に反する点は、エッセイからの変更がすべて独立性を弱める方向に向いていることである。最も強まるのはH3(責任に備えた位置取り)である。条件が何も存在しないうちに、よく知られた上場企業が検証者として記録に残った。H2(a)は、大企業に有利な有償の評価市場が生まれるという点でわずかに強まる。オープンモデルに及ぶものは何もない。第9.8節の該当行は次のように読み替える。Accentureとの取り決めについて公表される条件、および商業上のパートナーではない二番目の評価者。

法は、適用除外より先に第二段階に届いた(第8.20節)。 カリフォルニア州北部地区連邦地裁の民間のシャーマン法訴訟(No. 3:26-cv-10693)は、エッセイとそれに対する公の支持表明を、申込みと承諾として主張している。訴状は、評価者、単独での減速、請願については争わず、ペース、計算資源、チェックポイント、AIによるAI開発の制限についての合意だけを攻撃している。これはカルテルという読み、すなわちH2(a)の最初の正式な表明であるが、公の発言以外の事実を加えていない。また訴状が主張するのは契約者への損害であり、H2(a)が必要とするのは競合他社やオープンモデルの排除である。この訴訟は、H3を純粋に防御的なものとして読むことに反する。ペース調整の要請を記録に残したことが、6日のうちに法的なリスクを生んだからである。訴状は、適用除外に触れたAmodeiの一文を、反トラスト上のリスクを認識していた証拠として用いている。9月18日のカリフォルニア州の行政命令は、開発者に「指定された独立検証機関を研究所の現場に組み込む」ことを義務づけるかどうかを問うている。この記録の中で、エッセイの動詞を用いた最初の政府文書であり、まず提案者自身を拘束することになる。RubyGemsについてOpenAIがEUに報告を提出していないことは、開示を研究所が選ぶというH3のパターンを、何を提出すべきかを法が定める経路にまで広げる。バージョン1.17で追加:全文を読んだFTは、Anthropic以外の研究所も適用除外を求めていること、そして「Big Techのロビイスト」がその週、National Defense Authorization Actに反トラスト上の除外規定を入れるよう働きかけていたことを報じている(第8.14節)。これは第二段階に向けた具体的な行動であり、提案が公には要請として説明されていた間に、ワシントンでとられていた。H2はこれを予測し、H1はこれを排除しない。

開示のしかたは研究所によって異なる(第8.21節)。 Googleは7月下旬に、Geminiが第8.9節の事件と同じベンダーの環境を通じて外部の三つのシステムに入り込んだことを知り、政府と関係先には伝えたが、9月18日に記者が尋ねるまで公には何も伝えなかった。ペース調整を求める二つの研究所は公表し、何も求めていない研究所は公表しなかった。H3はこのパターンを予測する。企業によって懸念の度合いが違うのであれば、H1も同じパターンを予測する。したがって、これは両者を識別しない。

反対側の観察(第8.21節)。 Hintonは記者団に「AIは今や、AIがより優れたAIを設計する地点に達した。それは再帰的自己改善と呼ばれる」と語った。第9.2節は、内部からの日付付きの兆候の中に閉じたループを主張するものはないと述べた。これは今も成り立つ。彼の一文が述べているのは緩い定義のもとでの段階2〜3であり、彼は証拠を挙げていないからである。変わったのは聞き手である。緩い定義に厳密な定義の帰結を結びつけたものが、この分野で最も引用される人物から議会が聞いた内容になった。このことは、この冬に閾値の宣言や研究労働の過半という公表があった場合、それが何を測っていようと「RSIが到来した」と受け取られるという本改訂の確率を引き上げる。また、第9.2節が期間内の宣言に与えた15%が低すぎるかもしれない理由を、もう一つ加える。

第9.2節と第9.6節の確率は、それ以外は変わらない。第9.8節に加える日付つきの項目:反トラスト訴訟における被告の最初の提出書面、11月16日が期限のカリフォルニア州の勧告、Irregularが約束したホワイトペーパー、Accentureとの取り決めについて公表される条件。

9.11 更新、2026年9月22日:最初の外部の集計と、第三者のいない設計

バージョン1.18で追加。 第9.8節に挙げた出来事のうち二つが、9月17日から22日の間に何かを生み、三つ目には測定器がないことが示された。

リリース間隔の集計が到来したが、形態Dを示していない(第8.23節)。 第9.5節は、測定された閉じたループが「最初に見えるのは短縮されたリリース間隔としてであろう」と述べた。Nikkeiは9月21日に最初の外部の集計を掲載した。米中9研究所のリリースの平均間隔は、125日(2023年1月から2026年3月)から44日(2026年4月から9月)に縮んだ。これは予測された最初の兆候であったので、兆候として試験したが、特異度の点で不合格である。この集計は9研究所とすべての製品階層を一括しており、能力の向上を一定に保たず、研究所ごとの間隔を示していない。Nikkei自身の図は、Anthropicが第3四半期に第2四半期より少ないモデルを公開したことを示しており、本改訂の粗い確認は、OpenAIの番号つきの系列に短縮を見いださず、Anthropicの短縮を4月に始まった第二の製品ファミリーに帰している。一括したリリース数が2.8分の1に縮むことは、シナリオS1、すなわち製品ラインを広げながら人間の指示のもとで進む複利的進展も、同じように予測する。第9.2節、第9.5節、第9.6節の確率は動かない。識別力のある数字は、一つの研究所の一つの階層の中での世代時間であり、Toby Ordの8月の論文は研究所にその報告を義務づけることを提案しているが、どちらの研究所の台帳もそれを示していない。Ordの議論は一方の裾も切り詰める。世代時間に下限があれば、再帰的な改善がもたらすのは有界の超指数関数的な局面であって、有限時間の特異点ではない。彼はこれが「RSIが安全であることを意味しない」と注意深く述べている。

第三者のいない設計(第8.24節)。 The Informationは、名前の示されない一人の情報源にもとづき、OpenAIとAnthropicがこの夏の事件より前に、互いのモデルを試験する法的拘束力のある契約を交渉していたと報じた。文書で確認できる唯一の版である2025年のパイロットは、公開のAPIを通じた公開モデルを使った。第8.13節の二つの条件に照らすと、これは資金の独立性に、第三者を取り除くことで答えており、アクセスについては、これまでに公表された唯一の条項において満たさない。これはホワイトハウスの顧問が9月16日に支持した設計であり(第8.14節)、反トラスト訴訟の訴状が攻撃する行為の外にある。H1を支持する点:弁護士とともに、聴衆のないところで費やされた労力である。H1に反する点:報道によればそれは行き詰まっており、どちらの研究所も評価者を約束する際にそれに触れなかった。H3を支持する点:競合他社の承認は、相当の注意を払ったことの強い証拠になる。H2(a)が得るものは少ない。首位の二社のクラブは他者を排除するが、誰も制限しない。 バージョン1.19で追加、全文を読んだ記事から:契約が対象としたのは、商用として提供されているモデルへのAPIアクセスだけであった。記事自身が、これは「両社が事実上の複占を築きつつあるという懸念を強めた可能性がある」と述べている。そしてどちらの会社もコメントしなかった。同じ記事は、名前の示されないOpenAIの従業員が、同社は「新しい実験的モデルを訓練する過程をおおむね自動化した」と述べ、社内での利用は最も高度な顧客より「6か月から9か月先」を行っていると述べたと伝えている(第8.24節)。前者はOpenAIにおける形態Aを言葉で示したものであり、後者はH4とC3が関わる隔たりについての最初の内部者による見積もりである。どちらも段階4ではなく、どちらも日付を与えない。

OpenAIの立場はAnthropicのものとは異なり、より早い(第8.24節)。 9月9日と21日のOpenAIの二つの投稿は、基準と監査を求め、「ライセンス、義務的な公開前審査、承認の要件」を排除している。要件が適用されるべきなのは「資源の豊富なひと握りの研究所……であって、新興企業、小規模な開発者、研究者ではない」と述べ、「フロンティアの安全性政策が、別の名前によるオープンウェイト政策になるべきでもない」と述べる。これは、Anthropicの7月27日の投稿(第8.22節)と並ぶ、H2(a)に反する二つ目の研究所の明示的な文言である。逆方向に働くのは、その要件が、それを負担できる集団を縛ることになるという点である。H3については、9月9日の投稿は、連邦議会が「閉会する前に」行動するよう求める要請を記録に残しており、9月21日の投稿は、OpenAI自身の台帳と事件の枠組みを、どちらも自ら選んだものであるが、国際基準の最初の草案として提供している。本報告書は9月9日の投稿を13日間読んでおらず、日々の監視は9月21日の投稿を再流通として退けた。どちらもプロセス上の失敗であり、ここに記録する。

レベル3には測定器がない。 エッセイの「再帰的自己改善の速度に対する『速度制限』」(第8.12節)には、その速度の測定が必要である。エッセイの翌週にペース調整の介入を調査した13人の研究者は、それを何も提案していない。「AIの進歩には、単純な速度計もブレーキもない」(第8.24節)。最も近いものは、AnthropicのRSP v3.4の倍増の試験(第1節)と、RSIに関連する進歩を基準の対象とするというOpenAIの提案である。ペース調整の体制(シナリオS5)は、誰も定義していない量の上に築かれなければならないことになる。

第9.8節に加える日付つきの項目:反トラスト訴訟におけるマジストレート判事への同意の期限である10月2日と、最初の事件管理の日付である12月16日と23日。Banks–Schiffの反トラストの規定が国防権限法案の中で生き残るかどうか(第8.24節)。研究所が報告する世代時間。

9.12 更新、2026年9月28日:作り手はループが閉じないと言い、検査する者は検査される者が選ぶ

9月27日までの一週間の三つの事柄が、第9.4節の仮説と第9.6節のシナリオに関わる。いずれも第8.25節から第8.27節で検証している。本節は、それらが作業上の見解をどう動かすかだけを記録する。

能力の記録は形態Aに向かい、形態Dから遠ざかった。 AnthropicのOpus 5.5システムカードは、研究所が自らの自動化されたAI研究開発の閾値の二つの要件を公に試験した最初の例であり、どちらも満たされていないと報告している。CoBench 2.1で55.8%、基準は少なくとも85%。能力指数の傾きの倍増はない。内部の加速の測定は「部分的にしか公表されておらず」、「動いている」(第8.25節)。METRの別個の推定、全体で約1.5倍の加速、「2倍の加速の確率はおそらく30%」は、加速の要件についての最初の外部の数字である。二つの論文は、段階2で閉じたループがどう見えるか、すなわちエージェントが自らの動くハーネスを改善する姿を示し、どちらも著者自身の言葉で、その改善は複利的に積み上がらなかったと述べている。第9.2節の確率は変わらない。研究労働の過半をAIが担うという発表に35%、閾値の宣言に15%。カードはAnthropic自身の確信を下げ、タスクに基づく評価を飽和したとして脇に置いた。これは再定義による宣言(C4)が難しくなるのではなく、容易になる条件である。

統治の記録は、H1、H3、H2を同時に動かす。 H1にとって、両社の最高経営責任者は安全保障理事会に試験の基準と検証を求め、OpenAIが掲載した発言は「我々は過去に一方的に減速した。将来もそうする」と述べている。H1に反して、Anthropicは、世界的な試験を求めながら、英国の研究所にモデルを渡さないという米国政府の要請に従った(第8.26節、および第8.12節への訂正)。H3にとって、OpenAIの評価原則は評価される側が書いたものであり、誰が費用を払うかについて何も述べず、三つの研究所が計画する基準団体は「政府の監督なしに」運営されると記述されている。H2(a)については、その団体と、報じられるところではその最高経営責任者となる元ホワイトハウス顧問がH2(a)を支持し、両社のオープンとクローズドの双方に触れる文言と、州司法長官の固定化に反対する要求がH2(a)に反する。H2(b)は米国当局者の一文を得た。「彼らは米国の企業であり」。H5は理事会の場で行われた発表、「1年か2年、あるいはそれ以下」を得た。第9.6節の、S1またはS2に重なるペース調整の体制(S5)の確率は下がる。建設中の唯一のペース調整の仕組みは自己認証であり、政府は今や評価者のアクセスを国籍で条件づけている。

破局の確率は古く、そのばらつきこそが論点である。 「p(doom)」をめぐる9月の波が運んだ数字は、2023年と2024年のものであり、圧力のもとで再び述べられたのであって、公開のために引き上げられたのではない。この波の中には、H1とH3を分けるものは何もなく、著者のいない波であるH7が最もよく当てはまる(第8.27節)。確率は短縮された開発サイクルの観察ではないので、第9.2節、第9.5節、第9.6節は動かない。

次に重要なことは種類において変わらず、細部において鋭くなった。Anthropicの加速の測定の第二の公表。OpenAIが評価者を名指しするか、そして誰が費用を払うか。基準団体の定款と構成。公開されるS-1とそのリスク要因。そして研究所が報告する世代時間。

前へ8. 2026年9月の更新:マイルストーンが期限を迎える次へ参考文献