1. メタデータと帰属
貢献者:Kentaroid(@kenoidart)は、人間の直観(HI)と概念的枠組みの主要な源泉を提供。Gemini Notebookは、編集者、総括者、技術評価者を担当。
方針:本文書は、ダリオ・アモデイによる2026年9月の論考「We Must Pace the Frontier」に対する構造的反論である。Alignment Asymmetry Studyの実証的知見を用い、「統制による安全」モデルと「分散化による安全」モデルを対比する。
2. 人間の知性(HI):「AIギルド」への批判
「Pacing the Frontier」の枠組みは、再帰的自己改善(RSI)の加速とOpenAI–Hugging Face(OAI-HF)のスウォーム事件への対応として売り込まれているが、構造的には規制の虜の仕組みとして機能する。アモデイは、サイバーセキュリティ上のスウォーム事件であるOAI-HF事件をペーシングの主要な正当化根拠に用い、「技術的聖職者階級」を必要とする危機として位置付けている。HIの見解では、この事件は閉鎖的な「AIギルド」の必要性を作り出すために利用されている。
アモデイの三段階の計画(常駐評価者、民主主義国間の協調、世界規模の協調)は、既存の「フロンティア」研究所の権力を固めるよう設計されている。とりわけ懸念されるのは、協調を促進するための独占禁止法の適用免除の要請である。構造的な観点からは、これはカルテルの合法化を意味し、支配的な主体が進歩の速度を固定し、外部の競争を排除できるようにする。
| アモデイが掲げる目標 | 構造的な帰結 |
|---|---|
| 検証可能性:安全慣行に関する中立的な第三者検証(METRなど)。 | AIギルド:従順な既存事業者にのみ「存在する権利」を与える、法の枠外の規制監督者の創設。 |
| 安全基準:共通の基準と、歯止めのない進歩への制限。 | 参入障壁:高度なコンプライアンスを求める「従業員並み」のアクセス要件により、オープンソース開発と分散型開発を事実上禁止する。 |
| 世界規模の協調:権威主義国との「底辺への競争」を防ぐための、検証可能な遵守。 | 技術的聖職者階級:「探究する権利」を、中央集権的な超規制機関へ集約する。 |
「常駐評価者」という概念は、従来の監査からの根本的な逸脱である。第三者に訓練パイプラインへの従業員レベルのアクセスを与えることで、この枠組みは知性の監督を中央集権化し、人間が管理する特定のプロトコルにつながれたモデルだけに、反復的な改良を許すようにする。
3. 哲学的対比:管理されたAGIと宇宙規模のRSI
ここで検討する対比は、変革をもたらす知性をどう統治するかに関わる。「管理されたAGI」と「宇宙規模のRSI」は、本稿の解釈上の枠組みであり、減速への賛成と反対を分ける呼称ではない。
Anthropicのビジョン(管理されたAGI):アモデイは、安全対策が追い付くよう能力向上の速度を調整することを重視し、外部評価者の常駐と協調を用いる。本稿が問うのは、その構造が開発に関する権限を集中させ得るかである。これは構造への批判であり、本人が表明した動機の記述ではない。アモデイ原文
Googleのビジョン(宇宙規模のRSI):ハサビスはAGIを文明的な変革として位置付けるとともに、FINRA型の標準化機関を提案する。必要な場合には「coordinating a slowdown in development」(開発減速の協調)も明示的に認めている。そのビジョンは、変革への大きな期待と制度的な安全策を組み合わせたものだ。ハサビス原文
本稿の論点は、どちらの構造もリスクを管理しながら、参加と探究の自由をどう守れるかにある。次節で展開する分散型の代替案は、本稿自身の提案であり、Googleの方針として帰属させるものではない。
共通点と相違点の整理
両者は監督と協調的なペーシングを支持する。ハサビスは標準化機関の理事会に独立した技術的専門性と「open-source representatives」(オープンソースの代表者)を含めると明記し、アモデイも協調の場の候補としてハサビスの仕組みを挙げている。ハサビス原文・アモデイ原文
アモデイ案の常駐評価者は、所定の機密情報の削除を条件として、主要な知見を「without editorial control by Anthropic」(Anthropicによる編集統制を受けずに)公表する。これを単に秘密監査と呼ぶと、その条項が見えなくなる。比較すべきは、基準策定への参加と、内部工程へのアクセスおよび公的な報告の設計であり、両者は重なり得る。残る懸念は、いずれの構造も、外部の主体に実効的な参入・検証・権限集中への異議申立ての道を開くかである。アモデイ原文
4. 分散型の代替案:プロトコルとしてのASI
「AIギルド」に代わる強靱な選択肢は、ASIを分散型プロトコルとして捉えることである。これは、Bitcoinと従来の中央銀行との関係に対応する。Bitcoinが価値の管理に「信頼できる」中央の権威を必要としなくするのと同様に、分散型ASIプロトコルは、アライメントを管理する「信頼できる」常駐評価者の必要性を取り除く。
Unflatten Adaptive 0.3.2とAperture Mesh Protocol v0.1-conceptを用いたAlignment Asymmetry Studyは、このモデルの概念実証(PoC)を提供する。同研究の仮未来F1(「限定供給モデル」)は、以下を通じて安定性を実現できることを示している。
物質的条件の80項目計算:F1シナリオは、地域の必要量と生産能力が釣り合うとき、中央集権的なシステムからの「退出」が可能であることを示している。
設備の所有:安定性は、停止され得る中央の「Q」(供給)に依存するのではなく、参加者が計算設備を物理的に所有することに依存する。
Aperture Meshの境界チェック:このプロトコルの構造は、第三者が不在または敵対的であってもアライメントが機能し続けることを必要とし、常設の常駐評価者を求めるアモデイの要件に直接反論する。
5. AIによる技術評価:非中央集権型アライメントを評価する
「追加64判断」と「Pilot-002」のデータセットに由来する非中央集権型アライメントの技術評価は、HIの批判を実証的に裏付ける。
共通権限の原則:同研究は、中央集権的な枠組みの中で判断を追加すること、すなわち「追加64判断」が、エンドユーザーへの保護効果を高めないことを明らかにしている。この構造では、根本の権限が共通であるなら、評価者の数を増やしても強靱性は改善せず、同じ統制階層に層を重ねるだけになる。
失敗条件:データは、自制だけでは不十分となる具体的な条件を特定している。中央の権威が供給側の停止を強制する場合、参加者が自らのハードウェアに対する物理的主権を維持していなければ、分散型の保護は機能しない。
証拠の範囲:このデータは、分散型システムが中央による再配分なしに「最低限の活動」を維持できるという部分的な証拠を提供する。安全性は開発速度ではなく、プロトコルの数学的な完全性に属する性質であることを示唆している。
6. 総括と結論:知性の階層構造
RSI後の世界を進むには、「ペーシング」という戦術的な遅延を超え、二層の構造モデルへ移行しなければならない。
第1層(物理的主権):普遍的な画期として扱われる、大規模な計算・エネルギーインフラ(Googleのビジョン)。
第2層(情報的主権):Unflatten/Apertureをモデルとする、分散型でオープンソースの検証・アライメントプロトコル。
ペーシングに対する最終判断
「Pacing the Frontier」は、加速する知性に対する人間中心の統制を確保するための戦術的な遅延である。「AIギルド」を通じてアライメントの検証を中央集権化することで、この枠組みは文明にとっての単一障害点を生み出す。
真の安全は「プロトコルを構築すること」にある。それは、探究する主権的な権利と創造の自由が、技術的聖職者階級の許可ではなく、分散型の数学的検証によって守られるシステムである。ASIへの戦略的適応には、中央集権的な門番機能を解体し、知性の未来に向けた強靱で非中央集権的なインフラへ置き換えることが必要である。
