Paul Jialiang Wu agentic-portfolio English 中文 Español 한국어✉️ 無料リスト
← ポートフォリオへ戻る

AI-Nativeシリーズ · スーパーリポジトリ

v1.0で最も優れていた数字は、NO-GOだった。

1分でわかる要点——ここから得られるもの

私のスーパーリポジトリは、たった1日でM0からv1.0まで駆け上がった。17のサテライト、5本のライブ検証済みチェーン、検証済みリーチ40。だが出荷された数字の中で最も重要なのは、NO-GOと告げたセキュリティ評価だ。そしてコードは、それに従う。信頼できる自律性とは、主張された自律性ではなく、キャリブレーションされた自律性のことである。

私のスーパーリポジトリは、空のフォルダから1日でv1.0へと辿り着いた。10のマイルストーン、5本の機械検証済みチェーン。だがそのセキュリティ評価自体が、自律モードを不合格にした。コードはこの失敗に従う。所要時間約6分。

allin-anything v1.0: verified reach 40 on the left; the BRACE NO-GO verdict, obeyed by design, on the right
二つの数字が同時に出荷された。ゲートが稼いだリーチと、評価が拒んだ自律性だ。

始まりはここから

昨日、私はallin-anythingについて書いた。私の17のリポジトリを一つの入口の裏側に組み合わせたスーパーリポジトリであり、原則はただ一つ。ゲートなきバッジは認めない。全10マイルストーンの流れの中で、それはマイルストーン4だった。ここからは、その日の残りで出荷されたものの話であり、チェンジログの中で最も恐ろしく見える一行こそが、私が最も誇りに思う一行である理由の話だ。

一連の流れを圧縮すると

そして自律性がやってきた。ここに興味深い失敗がある

マイルストーン8は、たいていのプロジェクトが自分自身に嘘をつき始める地点だ。システムを自分だけで動かすという段階である。私は人間がループに入らずにチェーンをエンドツーエンドで実行するランナーを構築した。決定論的で、LLMに操縦されず、すべての実行が記録される。何かを許可する前に、私はセキュリティ・ルーブリックをそれに適用した:BRACE、エージェント型自律デプロイメントに対するコントロール単位の評価であり、証拠収集ゲートとしてコード化されている(証拠なければNo)。

判定:NO-GO。44項目中15項目のみ合格。 分離された環境はない。独立して取り消し可能な認証情報もない。再帰的なキルスイッチもない。すべて事実だ。それはただ私のラップトップ上で動くローカルプロセスなのだから。

ここで重要な一手がある。リポジトリは判定に反論せず、それに従うのだ。 自律性の天井はチェーン仕様に書き込まれている。すべてのサテライトが緑であるチェーンだけが無人実行を許され、ランナーは実行時にそのステータスを再チェックする(降格があれば自律性は即座に取り消される)。依存関係の欠落はBLOCKEDとして報告され、決して偽装されない。そしてすべてのチェーンはヒューマンゲートを宣言しなければならず、それがないものはバリデータが拒否する。この範囲に収めた実行はきちんと機能する:インク→プラン→ゲート、exit 0、そして次のようになる:

⏸ execution stops here — human owns:
  🔑 approving any real-world build (READY is design-sanity, not a permit)
One day, ten milestones: born green, chain 01, real ink, five chains, BRACE NO-GO obeyed, v1.0 with reach 40
6つの停止点で見る一日。暗い停止点こそが、失敗した評価であり、天井を定めたものだ。

15歳でも理解できるメンタルモデル

新しいドライバーがハイウェイに出られないのは、彼らが「準備できた」と感じた「準備できた」と感じたからではない。彼らが乗れるのは免許のクラスがカバーする道路だけであり、その免許は他人が判定する試験から与えられるものだ。私のリポジトリの自律モードも、いわば仮免許証を持っている状態だ。ローカルな道路で検証作業という「用事」を走らせてよいが、取り返しのつかない一手一手には付き添いの大人が付く。この許可証がアップグレードされるのは、実際の障壁——分離環境、取り消し可能な認証情報、乗客にまで届くキルスイッチ——が本当に解消されたときだけであり、運転手が待ちきれなくなったときではない。

なぜ失敗した数字を出荷するのか?

なぜかというと、その代替案こそがデモ当日にありがちな既定値だからだ。見出しには「完全自律」、脚注には人間がそっと見守っている——というやつだ。従うべきNO-GOは、信頼を二重に生み出す。境界線が本物であるという点で一度、そしてシステムが自分自身を告発しているのを誰もが目撃できるという点で、もう一度。同じ規律が、前回は私自身の過大計上を見抜いた(チャーターゲートが、実際は2つしかない「緑」を3つだと私が主張していたのを見つけたのだ)。声高に失敗を告げるシステムだけが、その「緑」に本当の意味を持たせられる。

v1.0スコアボード、すべて機械検証済み: 17個のサテライト(🟢8・🟡9・⚪0)・5つのチェーン、ゲートはライブ実行・検証済みリーチ = 8 × 5 = 40、READMEでドリフト管理・41個のテスト・自己監査100/100・自律性:範囲限定、BRACE基準で検証済み、ヒューマンゲートあり。

AI-Nativeシリーズの続き

その全てはホームページのWritingセクションにある。

AI-Nativeシリーズの一部。自律性はチェーンごとに獲得され、アセスメントによって検証され、ヒューマンゲートによって範囲が定められる。Publishボタンも、印刷ボタンも、マージボタンも、あなた自身が握っている。