Paul Jialiang Wu agentic-portfolio English 中文 Español 한국어 ✉️ Free list
← ポートフォリオに戻る

AI-Native Series · Happy College

ジャンプシュートこそが君のシラバスだ。Happy Collegeへようこそ。

著者:Paul Jialiang Wu · agentic-portfolio-lovat.vercel.app · 2026-07-30

1分でわかる要点——君が持ち帰るもの

君はトレーニングをするたびに、すでに世界最高の学習アルゴリズムを実行している——挑戦し、正直なフィードバックを受け、調整し、また挑戦する。自分の限界で、それを繰り返す。Happy Collegeは、そのループを技術的な題材に向けて回すAI読書会だ。スポーツからMLへ応用できるマッピング、鍛錬としてのADEPT(Kalid Azadの五段階の手法、Feynmanの精神を受け継ぐもの)、そして検証済みの読書リスト・生きた知識グラフ・教え合いのスパーリングからなるAIスタック。これらすべてが、注釈ではなく成果物でセッションを終わらせる。

この仕組み全体を支えるルールは、ソフトウェアを検証する方法から借りてきたものだ——証拠がなければ、ノー。読了時間は約7分。

Your jump shot is your syllabus — Happy College, the AI reading club that trains technical subjects like sport
君がすでに鍛えてきた六つのこと。技術的な学習に必要な六つのメカニズム。同じループだ。

君はすでに線形代数より難しい何かをマスターしている

それはようやくガシャンと音を立てなくなったジャンプシュートだったかもしれない。目を閉じてでも決められるアームバー・エスケープ。フリップターン、澄んだビブラート、30回落ちたV4のクラックスムーブ。何千回もの反復。容赦なく、即座に返ってくるフィードバック。そして——正直に言おう——喜び.

誰もそれを「勉強」とは呼ばなかった。それこそが問題の核心だ。

学校で教わった嘘

学校は、技術的な内容を学ぶとは黙って座って情報を受け取ることだ、と教えた。だが身体はもっとよく知っている。君が身につけたどんな難しい身体スキルも、同じループで作られている。試行 → 正直なフィードバック → 小さな調整 → 自分の限界の縁で、もう一度試行する。

学習科学はその一つひとつに名前をつけている――意図的練習(deliberate practice) [1], 想起練習 [2], 望ましい困難[3]、そして最近接発達領域[4]。バスケットボールのコートはこれらすべてを自然に実装している。講義室はどれひとつ実装していない。ジムは講義が絶対に与えてくれない、たった一つのものを与えてくれる。それは、言い逃れできないフィードバックループだ。リムは君の言い訳など気にしない。水はカーブをつけて採点しない。タップアウトと交渉することもできない。

私にはその資格が二つある。一つはPhDだ。もう一つは、十年にわたって自分より小柄で冷静な男たちに、まるで折り紙のように畳まれ続けてきた経験だ。PhDを出した機関は六桁の金額を要求し、十二月には成績表を郵送してきた。もう一方は月150ドルを要求し、六分おきに私の腕を教材にして真実を教えてくれた。だが即座にレッスンへの再受講を許してくれたのは、片方だけだった――しかもそれは、ディプロマの代わりに打撲を授ける方だ。

だから問題はこうではない。"can we learn transformers while playing basketball?"(訳:バスケットボールをしながらトランスフォーマーを学べるだろうか?)もっと鋭い問いはこうだ。君はトレーニングをするたびに、すでに世界最高の学習アルゴリズムを走らせている――Happy Collegeはそれを技術的な分野に向けるだけだ。

対応表(そのまま盗め)

Mapping table: free throws to frozen evals, MMA sparring to red-teaming, swimming to simplification, slow music practice to curriculum learning, singing to unfakeable evals, climbing to zone of proximal development
すべての学習セッションは、トレーニングセッションのように感じられなければならない――それがこのクラブの掟だ。

この表を胸に刻め。すべての学習セッションには、三つの要素――反復、言い逃れできないフィードバック、そして実際に自分の限界の縁にいること――がすべて揃っていなければならない。

パターン

アンチパターン

手法:ADEPT、正しいやり方で

コンセプトレベルのドリルがADEPT――生み出したのはBetterExplainedのKalid Azadだ [5]。Richard Feynmanの教え方の精神に則っている。つまり、ある概念を友人が理解できるアナロジーにまで落とし込めないなら、まだ自分のものになっていないということだ。

ADEPTを60秒でやってみよう。題材はattention――現代のAIモデルすべての内部にある仕組みだ。ポイントガードがボールを運びながらコートを読む(アナロジー)。すべてのチームメイトがそれぞれの度合いでフリーを主張しているが、パスはたいてい一番空いている選手に渡る――ただしガードの判断は全員を加重平均したものだ(平易な言葉)。5人の選手を描き、フリー度に応じて矢印を太くする(図解)。プレーをひとつ実行してみる。「猫がその上に座った___」――モデルはそれより前のどの単語を参照するのか?(実例)。技術的に言えば、各単語はqueryを発し、すべての単語がkeyを提供する。そのマッチングスコアをソフトマックスにかけたものが重みとなり、valueをブレンドする――softmax(QKᵀ/√d)Vqueryはガードの判断、keyは各チームメイトのフリーの度合い、valueは各チームメイトがボールを持ったときに何をするかに対応する(テクニカルには——項目ごとにアナロジーへ逐語対応させると、クエリはガードの読み、キーは各選手の空き具合、バリューは各選手がボールをどう活かすかになる).

それで1レップだ。1セッションで何本もこなす。

現役最高峰の数学者たちも、この鍛え方をしている

これはスケールすることを願っているだけの比喩ではない。研究レベルの数学が実際にこう機能し始めているのだ [6]。Ernest Ryuが42年来の未解決問題——Nesterovの加速法の収束性——を解決したとき、モデルは彼に渡し続けた誤った完全な証明を、その中には正しい中間補題を含みながら。彼はそのモデルを相手にスパーリングした——攻める、検証する、生き残ったものだけを残す。彼の評決はこうだ:"The use of ChatGPT really accelerated the discovery."(訳:ChatGPTの使用が発見を本当に加速させた)[6] 機械が物量を投げ込み、人間がホイッスルを握る——スパーリングの役割分担そのままだ。

DeepMindのAlphaEvolveがBruhat区間に隠れた超立方体構造を浮かび上がらせたとき、数学者Geordie Williamsonはこう言った:"It's a structure that's been sitting there for 50 years in front of our nose. We just hadn't noticed it."(訳:それは50年もの間、私たちの鼻先にずっとあった構造だ。私たちがただ気づかなかっただけなのだ)[6] 専門家たちが50年間、静かに読み続けてきた場所で——大量のレップをこなす一つのシステムが、見逃されていたものをあっさり見つけ出した。

そしてTerence Taoは、これらのシステムが実際に何のためにあるかについてこう言う——それらは"very good at scouring big lists of problems for low-hanging fruit. It's tedious and thankless and not something humans want to do."(訳:手の届きやすい果実を求めて長大な問題リストを漁ることに非常に長けている。それは退屈で報われない作業であり、人間がやりたがるようなものではない)[6] フィールズ賞受賞者が、ボクサーがヘビーバッグを語るのとまったく同じ口ぶりで自分のAIを語っている——一人では絶対に反復練習しないような部分を、無限にレップしてくれる相手として。そのメカニズムを一文にまとめるとこうなる:AI makes attempts cheap; honest verification makes them count; the human supplies taste.(訳:AIは試行を安価にし、正直な検証がそれを意味あるものにし、人間が審美眼を提供する)

AIスタック(この部分は5年前には存在しなかった)

グループチャット付きの読書会は、しょせん読書クラブだ。それに対してHappy Collegeはトレーニング施設だ。そのためのツールが、ついに揃ったのだから。

セッションの実際の姿(60分間)

  1. ウォームアップ(5分): 復習ではなく想起練習——先週学んだことを、何も見ずに書き出す [2]。そう、これはただの抜き打ちテストだ。だが「自発的な苦しみ」を売る者はいなくても、CrossFitを売る者はいくらでもいるのと同じ理由で、私たちはこれに別の名前をつけただけだ。
  2. ADEPTスプリント(20分): 一つの概念を、五つの手順で。最後は用語ごとの対応関係で締めくくる。
  3. スパーリング(20分): ペアを組む。一方が教え、もう一方は「もしこうしたら何が破綻する?」という問いで攻め込む。タップは敗北ではなく、データだ。
  4. 成果物づくり(10分): 小さな成果物を一つ——コード20行、図を一枚、実例を一つ、最後まで解き切る。ノートを取る者ではなく、作る者であれ。
  5. 記録(5分): その成果物は、生きた知識グラフへ組み込まれる。翌週のウォームアップはそこから引き出される。
手元に残るのは成果物であって、注釈ではない。 指標はシンプルで、しかも公開されている:1人1セッションにつき成果物1つ、例外なし。連続記録は追跡されるが、言い訳は単位にならない。

参加する

Happy Collegeは、大学が本来あるべき姿だ——ジムの喜び、ラボの厳格さ、そしてAIスタックが、これまでエリート選手だけが持っていたもの——コーチ、スパー相手、嘘をつかないスコアボード——をすべての学習者に与える。

始まりは、私たちと同じでいい:AI reading list から一つ選び、君がこれまで身につけた最も過酷な身体的スキルを持ってきて、両者を重ね合わせる準備をしてきてほしい。最初のコホートに参加したいか?このページ上部の✉️ Free list ボタンを使ってほしい。

君のジャンプショットが、君のシラバスだ。Happy Collegeで会おう。

参考文献

生存テストによって選ばれたものだ:どれも一つの流行サイクルではなく、数十年にわたる再現と実践を支え続けてきた。

  1. Ericsson, K. A., Krampe, R. T., & Tesch-Römer, C. (1993). The role of deliberate practice in the acquisition of expert performance. (訳:専門的パフォーマンスの獲得における意図的練習の役割) Psychological Review, 100(3), 363–406. doi:10.1037/0033-295X.100.3.363
  2. Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. (訳:テストによる学習効果の増強——記憶テストの実施は長期的な記憶保持を向上させる) Psychological Science, 17(3), 249–255. doi:10.1111/j.1467-9280.2006.01693.x
  3. Bjork, E. L., & Bjork, R. A. (2011). Making things hard on yourself, but in a good way: Creating desirable difficulties to enhance learning. (訳:良い意味で自分を苦しめる——学習を高める「望ましい困難」を作り出す) In M. A. Gernsbacher et al. (Eds.), Psychology and the Real World (pp. 56–64). Worth Publishers.
  4. Vygotsky, L. S. (1978). Mind in Society: The Development of Higher Psychological Processes. (訳:『精神と社会——高次心理機能の発達』) Harvard University Press.
  5. Azad, K. Learn Difficult Concepts with the ADEPT Method. BetterExplained. betterexplained.com/articles/adept-method
  6. The AI Revolution in Math Has Arrived. Quanta Magazine (2026). quantamagazine.org ——Ryu、Williamson、Taoの引用の出典。逐語で検証済み。

関連記事

Paul Jialiang Wu・AI-Native Series・v1.1(2026-07-30):この記事が自社の5-Sレビューに落ちたのを受けて、参考文献とインサイダーの逐語引用を追加した——採点表はFM-osリポジトリで公開されている。うちは自分たちの基準を、身内にも容赦なく適用する。