JA EN

体系

AI

機械学習の基礎から、CNN・Transformer・VLM・エージェントまで。モデルが「なぜその形になったのか」を系譜でたどる。

機械学習の基礎9学習とは何か・損失関数・過学習・評価まで、すべての土台

このジャンルのページへ →

  1. 第1 機械学習とは何か — 「学習」を数式なしで理解する 無料7分で読めます
  2. 第2 損失関数と最適化 — モデルはどうやって「間違いから学ぶ」のか 無料9分で読めます
  3. 第3 過学習と評価設計 — 精度99%を疑え ★ 会員9分で読めます
  4. 第4 決定木と勾配ブースティング — 表データ最強の座は今も 無料14分で読めます
  5. 第5 教師なし学習を1から — クラスタリングと次元削減 ★ 会員14分で読めます
  6. 第6 自己教師あり学習 — ラベルなしデータが宝になった日 ★ 会員14分で読めます
  7. 第7 データリークと実験管理 — 精度が高すぎたら疑うこと ★ 会員14分で読めます
  8. 第8 不均衡データの実務 — 99%が正常のとき何を最適化するか ★ 会員14分で読めます
  9. 第9 MLシステム設計 — モデルの外側の9割 ★ 会員11分で読めます
深層学習の基礎7ニューラルネット・逆伝播・最適化・正則化

このジャンルのページへ →

  1. 第10 ニューラルネットワークを1から理解する — 1個のニューロンから多層まで 無料9分で読めます
  2. 第11 誤差逆伝播を1から解説 — 連鎖律だけで全部わかる ★ 会員12分で読めます
  3. 第12 正規化レイヤー全史 — BatchNormからRMSNormまで ★ 会員13分で読めます
  4. 第13 活性化関数を1から — なぜ非線形が必要なのか 無料15分で読めます
  5. 第14 重みの初期化と正則化 — 学習が始まる条件・続く条件 ★ 会員20分で読めます
  6. 第15 ハイパーパラメータ探索 — 勘・グリッド・ベイズ最適化 ★ 会員17分で読めます
  7. 第16 GNNを1から — つながりを学ぶネットワーク ★ 会員15分で読めます
CNN・画像認識9畳み込みの発明からResNet・軽量化・物体検出まで

このジャンルのページへ →

  1. 第17 画像分類を1から理解する — 畳み込みという発明 無料10分で読めます
  2. 第18 物体検出を1から解説(YOLO・DETRまで) ★ 会員12分で読めます
  3. 第19 CNNアーキテクチャの系譜 — AlexNetからResNet・EfficientNetまで ★ 会員10分で読めます
  4. 第20 自動運転の認識スタックを1から — カメラとLiDARは何を分担しているのか 無料11分で読めます
  5. 第21 異常検知を1から — 正常だけから学ぶという発想 ★ 会員12分で読めます
  6. 第22 医用画像とAI — 精度より先に問われる検証設計 ★ 会員10分で読めます
  7. 第23 ImageNetの瞬間 — 深層学習が勝った日 無料12分で読めます
  8. 第24 論文解説: TurboVLA — LLMを追い出したロボット方策が、RTX 4090・VRAM 1GB未満で32Hzを叩き出す ★ 会員10分で読めます
  9. 第25 論文解説: PhiZero — 映像を描く前に「物理の言葉」で考える世界モデル ★ 会員13分で読めます
Transformerの仕組み13Attention・位置エンコーディング・アーキテクチャの解剖

このジャンルのページへ →

  1. 第26 Attention機構を1から理解する — Transformerの心臓部を絵解きで 無料10分で読めます
  2. 第27 位置エンコーディングを1から理解する(絶対位置からRoPEまで) 無料13分で読めます
  3. 第28 トークナイザを1から — LLMが世界を切り刻む単位 無料13分で読めます
  4. 第29 Attentionの変種図鑑 — MQA・GQA・スライディング窓・線形注意 ★ 会員11分で読めます
  5. 第30 Transformer完全解剖 — 埋め込みから出力まで一気通貫 無料13分で読めます
  6. 第31 FlashAttentionを1から — 計算を増やして速くする逆説 ★ 会員13分で読めます
  7. 第32 長文脈LLMの技術 — RoPE補間からリング注意まで ★ 会員13分で読めます
  8. 第33 エンコーダとデコーダ — BERTとGPTの分岐点 ★ 会員12分で読めます
  9. 第34 【実装】BPEトークナイザを自作する — マージ規則を学習し、日本語で殴られる ★ 会員15分で読めます
  10. 第35 【実装】ミニGPTを自作する — 300行の言語モデル ★ 会員19分で読めます
  11. 第36 論文解説: Qwen3.8-Next の設計 — 精度・効率・学習安定性を1つの問題として解く ★ 会員18分で読めます
  12. 第37 論文解説: Gated DeltaNet はなぜ4bit量子化に耐えるのか — ハイブリッド27BのNVFP4 W4A4 ★ 会員15分で読めます
  13. 第38 論文解説: 最初の1枚を基準にするのをやめる — Scal3R の複数参照・相対姿勢クエリ ★ 会員15分で読めます
LLM — 大規模言語モデル14スケーリング則・プロンプティング・LLMの内部挙動

このジャンルのページへ →

  1. 第39 スケーリング則を1から解説 — なぜ大きくすると賢くなるのか ★ 会員11分で読めます
  2. 第40 プロンプトエンジニアリングの科学 — 何が実証され、何が迷信か 無料10分で読めます
  3. 第41 Mamba と状態空間モデル(SSM) — 注意機構なしで系列を扱う 無料16分で読めます
  4. 第42 事前学習データの作り方 — Webから教科書品質へ ★ 会員11分で読めます
  5. 第43 LLM評価を1から — ベンチマークの読み方と汚染問題 ★ 会員13分で読めます
  6. 第44 ハルシネーションはなぜ起きる — 仕組みと現実的な対策 無料11分で読めます
  7. 第45 推論時スケーリング — 「長く考える」モデルの原理 ★ 会員17分で読めます
  8. 第46 知識蒸留を1から — 大きなモデルを小さく写す ★ 会員13分で読めます
  9. 第47 アライメント概説 — RLHFからConstitutional AIまで ★ 会員10分で読めます
  10. 第48 スケーリング懐疑論 — 「大きくするだけ」批判の系譜 ★ 会員12分で読めます
  11. 第49 論文解説: 危機映像のAI捏造は見抜けるか — RA-Benchが暴いた検出器の実力 ★ 会員10分で読めます
  12. 第50 論文解説: SA-MRPO — 満点の科目を勉強し続けるな。飽和した報酬から勾配を引きはがす ★ 会員16分で読めます
  13. 第51 論文解説: Agentic Artifact Creation — 「生成」と「納品物を組み立てる」はどう違うのか ★ 会員13分で読めます
  14. 第52 論文解説: Puro-2B — コンシューマGPUで2Bモデルを$6.9Kからゼロ事前学習する ★ 会員15分で読めます
VLM・マルチモーダル6CLIP・ViT・画像と言語を同じ空間に置く技術

このジャンルのページへ →

  1. 第53 論文解説: ViT — 画像を単語のように扱う ★ 会員10分で読めます
  2. 第54 論文解説: CLIP — 言葉と画像を同じ地図に置く ★ 会員9分で読めます
  3. 第55 VLMの成立と現在 — 視覚エンコーダとLLMをどう繋ぐか ★ 会員10分で読めます
  4. 第56 BEV表現を1から — 複数カメラを俯瞰図に統合する ★ 会員11分で読めます
  5. 第57 文書理解とOCRのいま — 帳票をLLMが読むまで ★ 会員11分で読めます
  6. 第58 動画理解を1から — フレームの束から時間の理解へ ★ 会員10分で読めます
生成モデル10拡散モデル・VAE・GAN。「作る」側のモデル

このジャンルのページへ →

  1. 第59 拡散モデルを1から理解する — ノイズを足して、引く ★ 会員14分で読めます
  2. 第60 VAEを1から — 「圧縮して戻す」に確率を混ぜると生成になる 無料13分で読めます
  3. 第61 GANの栄枯盛衰 — 敵対で学ぶ発明と、拡散に負けた理由 ★ 会員14分で読めます
  4. 第62 Flow Matchingを1から — 拡散の次に来た「まっすぐ運ぶ」生成 ★ 会員12分で読めます
  5. 第63 CFGとサンプラー — 生成AIの「強さ」パラメータの正体 ★ 会員12分で読めます
  6. 第64 拡散モデルの数学 — スコアとSDEで見る生成 ★ 会員15分で読めます
  7. 第65 画像生成の実務地図 — SD・ControlNet・LoRA適用 無料16分で読めます
  8. 第66 音楽・音声生成を1から — トークン化された音 ★ 会員11分で読めます
  9. 第67 3D生成のいま — NeRFからGaussian Splattingまで ★ 会員13分で読めます
  10. 第68 【実装】拡散モデルを自作する — MNISTからはじめる ★ 会員15分で読めます
学習手法・アライメント13事前学習・SFT・RLHF/DPO・ファインチューニング

このジャンルのページへ →

  1. 第69 Instruction Tuning と RLHF を1から解説 — 指示に従うモデルはどう作られるか ★ 会員13分で読めます
  2. 第70 学習率スケジュール — warmupとcosineの理由 ★ 会員14分で読めます
  3. 第71 混合精度学習 — fp16/bf16/fp8で壊れずに速くする ★ 会員14分で読めます
  4. 第72 データセット構築の実務 — 集める・洗う・混ぜる ★ 会員12分で読めます
  5. 第73 DPOとその後 — RLHFを単純化する系譜 ★ 会員18分で読めます
  6. 第74 継続学習と破滅的忘却 — 学び続けるモデルの難しさ ★ 会員11分で読めます
  7. 第75 学習が壊れた時の診断学 — loss発散・NaN・停滞の切り分け 無料14分で読めます
  8. 第76 データとモデルのバージョン管理 — 再現できない実験は存在しない ★ 会員15分で読めます
  9. 第77 論文解説: ABSeeker — 答えから逆算して「良い一手」を採点する、長距離検索エージェントの訓練法 ★ 会員14分で読めます
  10. 第78 論文解説 PAWBench — 動画生成は「起こりうる未来の確率」まで当てられるのか ★ 会員12分で読めます
  11. 第79 論文解説: PaperGym — 論文1本を「採点基準つきの練習場」に変えて研究計画を学習させる ★ 会員15分で読めます
  12. 第80 論文解説: StudentSim — 「その生徒そのもの」を訓練で作る学習者シミュレータ ★ 会員18分で読めます
  13. 第81 論文解説: It Takes Two to Match — 検索の「両側」をRLで共進化させるCoGR ★ 会員19分で読めます
  14. LoRA と全パラメータ微調整 — 何を失い、何を得るか 執筆予定
推論・高速化29KVキャッシュ・量子化・バッチング・サービング

このジャンルのページへ →

  1. 第82 KVキャッシュを1から理解する — 推論高速化の核心 無料10分で読めます
  2. 第83 LLM量子化を1から解説 — なぜ精度を落としても動くのか ★ 会員10分で読めます
  3. 第84 投機的デコーディングを1から解説 — 小さな下書きモデルで、出力を一切変えずにLLMを速くする ★ 会員11分で読めます
  4. 第85 LLMサービングを1から — vLLM・連続バッチングで、GPUを遊ばせない 無料13分で読めます
  5. 第86 構造化出力と制約デコーディング — JSONを壊さない仕組み ★ 会員15分で読めます
  6. 第87 GPUメモリ不足サバイバル — OOMの原因と対処の全パターン ★ 会員15分で読めます
  7. 第88 推論コスト削減の実務 — 何から手を付けるか ★ 会員13分で読めます
  8. 第89 プロンプトキャッシュとコンテキスト設計 — 前方一致という一本の制約が、請求額を桁で変える ★ 会員14分で読めます
  9. 第90 論文解説: The Personalization Mirage — LLMは「あなた」を勝手に作り上げ、自己申告は逆を指す ★ 会員12分で読めます
  10. 第91 論文解説: DAPD — 蒸留の教師が持つ「カンニングペーパーの幻想」を二重アンカーで断つ ★ 会員11分で読めます
  11. 第92 論文解説: CodeNib — コーディングエージェントにリポジトリの文脈を「配膳」する多ビューデータシステム ★ 会員11分で読めます
  12. 第93 論文解説: BDH-CQ — 言葉にせずに考えるAI。再帰メモリ×潜在推論がARCのコスト効率を塗り替えた ★ 会員11分で読めます
  13. 第94 論文解説: AgentOPSD — 「どのターンが勝敗を分けたか」をベイズ信念の再帰更新で見つけるエージェントRL ★ 会員14分で読めます
  14. 第95 論文解説: 正解も強い教師もなしで伸びる — u-OPSD が使う「自分の多数決」 ★ 会員18分で読めます
  15. 第96 論文解説: Agentic ESOpt — 逆伝播をやめて「モデルを揺らす」だけで、長丁場のLLMエージェントを鍛える ★ 会員23分で読めます
  16. 第97 論文解説 WarpSAC: 強化学習の「安定化装置」は、データが潤沢になると足枷に変わる ★ 会員12分で読めます
  17. 第98 論文解説 TTPO: 正解ラベルなしで、テストの最中にモデルを鍛える ★ 会員15分で読めます
  18. 第99 論文解説: Self-OPD — 教師モデルなしで、画像生成モデルが自分を蒸留する ★ 会員19分で読めます
  19. 第100 論文解説: CyberFactory — 野生のCVEを「実行できる訓練問題」に変える ★ 会員15分で読めます
  20. 第101 論文解説: DART-SD — ツール呼び出しエージェントの「ダイヤ型の解空間」を壊さずに学習する ★ 会員17分で読めます
  21. 第102 論文解説 SMELT — 「同じ層をもう一周」は、予算を揃えても得なのか ★ 会員16分で読めます
  22. 第103 論文解説: Normalized Low-Rank Adaptation — LoRAの「入口行列」を正規化するだけで効く理由 ★ 会員15分で読めます
  23. 第104 論文解説: 本番トラフィックから事後学習へ — 社内200アプリを1つの自前LLMに寄せる ★ 会員18分で読めます
  24. 第105 論文解説: On-Policy Distillationは本当に蒸留しているのか — ノイズまみれの教師から自己改善へ ★ 会員15分で読めます
  25. 第106 論文解説: LatentPress — 圧縮した文脈を、テキストにも画像にも戻さずLLMに直接読ませる ★ 会員18分で読めます
  26. 第107 論文解説: Language Models Can Control Their Own Attention — モデルに「どこを見るか」を宣言させる ★ 会員13分で読めます
  27. 第108 論文解説: Compile by Training — 自然言語の仕様を「手元で動く関数」にコンパイルする ★ 会員14分で読めます
  28. 第109 論文解説: 訓練データが1問でも、オンポリシー蒸留は数百ステップ伸び続ける ★ 会員16分で読めます
  29. 第110 論文解説: Random Attention — KVキャッシュの追い出しは「ランダムで十分」だった ★ 会員15分で読めます
  30. KVキャッシュ圧縮 — 量子化・追い出し・共有で長文推論を軽くする 執筆予定
RAG・検索拡張10埋め込み・チャンク戦略・リランキング・評価

このジャンルのページへ →

  1. 第111 RAGの基礎と設計パターン — 埋め込み・チャンク・リランキング・評価を1から ★ 会員10分で読めます
  2. 第112 RAG vs ファインチューニング — どちらを、いつ選ぶか 無料10分で読めます
  3. 第113 埋め込み(Embedding)を1から理解する — word2vecの直感から文脈化埋め込みまで 無料9分で読めます
  4. 第114 推薦システムと埋め込み — RAGと同じ数学、違う目的 ★ 会員13分で読めます
  5. 第115 チャンキング戦略 — 分け方で検索は決まる ★ 会員12分で読めます
  6. 第116 GraphRAGを1から — 知識グラフと検索の融合 ★ 会員14分で読めます
  7. 第117 RAG評価の実務 — 「なんとなく良い」を数字にする ★ 会員16分で読めます
  8. 第118 【実装】ベクトルDBを自作する — 線形走査からHNSWへ ★ 会員18分で読めます
  9. 第119 論文解説: WeMM-Embedding — 文も画像も動画も「同じ物差し」に載せるWeChatの埋め込みモデル ★ 会員18分で読めます
  10. 第120 論文解説: Hi-Q — 質問を「検索できる粒度」まで、証拠を見ながら割っていく ★ 会員18分で読めます
エージェント55ツール使用・計画・マルチエージェント

このジャンルのページへ →

  1. 第121 LLMエージェントを1から解説 — ツール使用とループの設計 ★ 会員11分で読めます
  2. 第122 End-to-End運転を1から — 認識から制御までを1つのネットワークで ★ 会員11分で読めます
  3. 第123 MCPとツールプロトコル — エージェントの手をつなぐ規格 無料15分で読めます
  4. 第124 マルチエージェント設計パターン — 分担・討論・検証 ★ 会員12分で読めます
  5. 第125 エージェントの記憶設計 — 短期・長期・エピソード ★ 会員14分で読めます
  6. 第126 エージェント評価 — ベンチとハーネスの作法 ★ 会員15分で読めます
  7. 第127 AlphaGoを1から — 探索と学習の結婚 ★ 会員11分で読めます
  8. 第128 【実装】エージェントループを自作する — ツール呼び出しの最小形 ★ 会員12分で読めます
  9. 第129 論文解説: SWE-Bench ProMax — 多言語・大規模リファクタリングでコーディングエージェントの本当の実力を測る ★ 会員13分で読めます
  10. 第130 論文解説: Macaron-V1 — 凍結ベース×LoRA混合で「出荷後も育つ」エージェントモデルを作る ★ 会員10分で読めます
  11. 第131 論文解説: EnvACE — 環境まで自分で演じる「world rehearsal」がエージェントRLの環境不足を解く ★ 会員11分で読めます
  12. 第132 論文解説: Video-DeepResearch — 動画を「見て、調べ尽くす」次世代マルチモーダル・エージェント ★ 会員10分で読めます
  13. 第133 論文解説: ToolArtist — 検索するか、描くか、描き直すか。それも自分で決める画像生成エージェント ★ 会員11分で読めます
  14. 第134 論文解説: Recursive Synthesis — 検証済みタスクを「増築」して、長時間ターミナル課題を4万件量産する ★ 会員15分で読めます
  15. 第135 論文解説: Qwen-UI-Agent — スマホもPCも操る「実世界基準」のGUIエージェントはこう作られた ★ 会員11分で読めます
  16. 第136 論文解説: OSReward — AIの「採点者」は信用できるか。コンピュータ操作エージェントの報酬を測り直す ★ 会員12分で読めます
  17. 第137 論文解説: Metis — 記憶を外付けせず、モデルの中に住まわせる「Memory Foundation Model」 ★ 会員11分で読めます
  18. 第138 論文解説: MerchantBench — LLMエージェントは1年間ネットショップを経営できるか。人間の27.3%しか稼げない理由 ★ 会員12分で読めます
  19. 第139 論文解説: Mental World Modeling — 物理だけでなく「心」まで遷移させるワールドモデル ★ 会員12分で読めます
  20. 第140 論文解説: LongHorizon-Harness — 長時間タスクは「実行」ではなく「状態管理」で解く ★ 会員10分で読めます
  21. 第141 論文解説: Frontis-MA1 — 「AIを作るAI」を鍛える。MLエンジニアリングで再帰的自己改善に一歩迫るOpenMLE ★ 会員16分で読めます
  22. 第142 論文解説: ComBodied Agents — エージェントの「作用対象」を人そのものに置き直す ★ 会員15分で読めます
  23. 第143 論文解説: 共進化するエージェント系 — 人間の設計を超えた自己進化への三段階 ★ 会員11分で読めます
  24. 第144 論文解説: Zetta ζ — 方策を凍結したまま、ロボットが実行中に自分を直す「閉ループ・ハーネス」 ★ 会員21分で読めます
  25. 第145 論文解説: StateM — モデルの重みを1gも動かさず、Terminal-Bench 2.1で95.3%・実行費15ドルへ ★ 会員17分で読めます
  26. 第146 論文解説 SemaPLC — 「できました」と言わせない検証ゲート型エージェント ★ 会員18分で読めます
  27. 第147 論文解説: OmniScientist — 生データを直接「見る」AI科学者。36ケースを1つのエンジンで走らせる ★ 会員15分で読めます
  28. 第148 論文解説: FACET — 指示・環境・解答・採点を「同じ実行状態」に接地させる課題合成 ★ 会員17分で読めます
  29. 第149 論文解説: EnvHarness — 練習場を作り直さず、外から「治具」をかぶせてエージェントを鍛える ★ 会員12分で読めます
  30. 第150 論文解説: Agent Skillsはなぜ効くのか、そしてどこで壊れるのか ★ 会員11分で読めます
  31. 第151 論文解説: Co-RL — 正解ラベルなしでも、群れの多様性から推論が立ち上がる ★ 会員18分で読めます
  32. 第152 論文解説: SWE-bench Science — コーディングエージェントは「科学のコード」を直せるか ★ 会員14分で読めます
  33. 第153 論文解説: FreeToken — 手元のPCを「一台の推論基盤」として使い切る帯域適応型MoEサービング ★ 会員18分で読めます
  34. 第154 論文解説: Embodied-Navigator(TAMP-Nav) — VLMに「指を差させる」と、ナビゲーションは速く強くなる ★ 会員18分で読めます
  35. 第155 論文解説: ASI-Bench — 手引きを1枚ずつ剥がして、AIの「自力」を測る ★ 会員13分で読めます
  36. 第156 論文解説: FrontierChallenge — 科学の仕事を「最後まで納品できたか」で測る ★ 会員11分で読めます
  37. 第157 論文解説: JIT-Agent — エージェントの「ハーネス」をその場で書き起こすモデル ★ 会員23分で読めます
  38. 第158 論文解説: ZimaBlue — 12万時間の一人称動画でロボットを汎化させる ★ 会員16分で読めます
  39. 第159 論文解説: 良いエージェント学習データとは何か — ACE(正確さ・複雑さ・多様性)という見方 ★ 会員15分で読めます
  40. 第160 論文解説 UrbanGround: 街に降ろされたMLLMエージェントは、どこで崩れるのか ★ 会員13分で読めます
  41. 第161 論文解説: UI-Venus-2 — 画面を見て操作するAIを、ベンチマークから実運用へ ★ 会員19分で読めます
  42. 第162 論文解説: Training Agents to Evolve with Their Harness — ハーネスごと進化するエージェントを訓練する ★ 会員22分で読めます
  43. 第163 論文解説: StarHarness — モデルを凍結したまま「ハーネス」を進化させる ★ 会員21分で読めます
  44. 第164 論文解説: SecOPD — トークン1個ずつ採点して、適応的プロンプトインジェクションを1桁下げる ★ 会員15分で読めます
  45. 第165 論文解説: Repo-To-Skill — GitHubリポジトリを「AIのためのスキル」に蒸留する ★ 会員16分で読めます
  46. 第166 論文解説: PILOT in the Loop — 走っている最中に直す「ライブ自己改善」 ★ 会員22分で読めます
  47. 第167 論文解説: LoopArena — コーディングエージェントを「操縦する側」を測る ★ 会員17分で読めます
  48. 第168 論文解説: Code World Model — コーディングエージェントを「世界の脳」にする ★ 会員19分で読めます
  49. 第169 論文解説: Code as Worlds — 世界を「実行できるコード」として書き起こすエージェント ★ 会員18分で読めます
  50. 第170 論文解説: AutoSaddler — エージェントの失敗ログから「壊れないハーネス」を自動で育てる ★ 会員16分で読めます
  51. 第171 論文解説: HarnessDev — LLMは自分のエージェント・ハーネスを作り、育てられるか ★ 会員17分で読めます
  52. 第172 論文解説: EarlyEval — エージェント評価を「途中で打ち切って」安くする ★ 会員16分で読めます
  53. 第173 論文解説: Aspire — モデルは「曖昧な目標」から自己進化できるか ★ 会員20分で読めます
  54. 第174 論文解説: Terminal-Universe — エージェントの作業ログを、何度でも使える実行環境に戻す ★ 会員17分で読めます
  55. 第175 論文解説: CogEvol — 報酬が測れないものを、強化学習は静かに壊す ★ 会員12分で読めます
  56. 論文解説: Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training 執筆予定
  57. 論文解説: Editable Visual Design 執筆予定
  58. 論文解説: S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement? 執筆予定
  59. 論文解説: WHALE: A Simple Recipe for Joint Harness-Weight Optimization 執筆予定
  60. 論文解説: Iris: Climbing to the Search Frontier 執筆予定
  61. 論文解説: Bilevel Coordinated Reflection: A Game-Theoretic Approach to Multi-Agent LLM Systems 執筆予定
音声系9音声認識・合成・音声LLM

このジャンルのページへ →

  1. 第176 論文解説: Whisperはなぜ頑健なのか — 大規模弱教師あり学習 ★ 会員9分で読めます
  2. 第177 音声認識を1から — 波形からテキストまで 無料14分で読めます
  3. 第178 音声合成を1から — テキストから声まで ★ 会員14分で読めます
  4. 第179 音の表現 — メルスペクトログラムとトークン化 ★ 会員17分で読めます
  5. 第180 論文解説: SwanTale — 参照音声なしで「言葉から声をデザインする」統合音声・オーディオ生成 ★ 会員13分で読めます
  6. 第181 論文解説: Interpretable MEG Decoding of Perceived Speech — 脳磁図から「聞いた音声」を当てるAIの中身を、脳地図として読む ★ 会員11分で読めます
  7. 第182 論文解説: VoiceMem — 音声対話に「左脳と右脳」の記憶を、遅延ゼロで ★ 会員21分で読めます
  8. 第183 論文解説: Motion-Omni — 話しながら全身が動く、end-to-endの音声対話モデル ★ 会員18分で読めます
  9. 第184 論文解説: Last Translation Benchmark — 「モデルが壊れる例」と検証ルールで翻訳を測り直す ★ 会員12分で読めます
時系列データ系5RNN/LSTMから時系列基盤モデルまで

このジャンルのページへ →

  1. 第185 RNNとLSTMを1から理解する — Transformer時代になぜ学ぶのか 無料13分で読めます
  2. 第186 時系列予測を1から解説 — 古典手法から基盤モデルまで ★ 会員12分で読めます
  3. 第187 時系列にTransformerは効くのか — 論争と実務の答え ★ 会員13分で読めます
  4. 第188 時系列異常検知 — 監視の現場で動いている数学 ★ 会員13分で読めます
  5. 第189 論文解説 H3-World — 言語理解を「世界の操作」に変える ★ 会員18分で読めます
モデル系統図鑑7Gemma系・Llama系・Qwen系など系統別の特徴と使い分け

このジャンルのページへ →

  1. 第190 Gemma系を1から解説 — 系譜・特徴・使いどころ ★ 会員12分で読めます
  2. 第191 Llama系を1から解説 — オープンLLMの本流 ★ 会員11分で読めます
  3. 第192 Qwen系を1から解説 — HuggingFace DL数トップ勢の実力 ★ 会員10分で読めます
  4. 第193 DeepSeek系を1から — MoEと蒸留で殴り込んだ系譜 無料12分で読めます
  5. 第194 GPT系譜 — GPT-1から現在までの設計思想 ★ 会員13分で読めます
  6. 第195 Mistral系を1から — 小型高性能の欧州勢 ★ 会員13分で読めます
  7. 第196 オープンvsクローズド — 重み公開の経済学と安全論争 ★ 会員13分で読めます
論文解説13重要論文を1本ずつ、本文を根拠に背景から実務含意まで

このジャンルのページへ →

  1. 第197 論文解説 LoRA: Low-Rank Adaptation of Large Language Models — なぜ低ランクで足りるのか ★ 会員13分で読めます
  2. 第198 代理指標では、もう守れない — 自動運転 2026年8月新着8本を束ねて読む 無料20分で読めます
  3. 第199 論文解説 Attention Is All You Need — 再帰を捨てたモデルは何を証明したのか ★ 会員14分で読めます
  4. 第200 Mixture of Experts (MoE) を1から解説 — Switch Transformerのルーティングと負荷分散 ★ 会員13分で読めます
  5. 第201 論文解説: Alpamayo — 自動運転の推論モデル ★ 会員12分で読めます
  6. 第202 記号主義vs接続主義 — 60年論争の現在地 ★ 会員15分で読めます
  7. 第203 論文解説: WorldClaw — テキスト1文から「歩ける・編集できる」3Dオープンワールドをエージェントが建設する ★ 会員14分で読めます
  8. 第204 論文解説: AskChem — 検索の単位を「論文」から「出典付きクレーム」に変える文献インフラ ★ 会員11分で読めます
  9. 第205 論文解説 Large Discovery Models — LLMに「次に何を試すべきか」を教える価値信号 ★ 会員18分で読めます
  10. 第206 論文解説: Apodex 1.1 — 「完了した仕事」を単位にエージェントをスケールさせる ★ 会員14分で読めます
  11. 第207 論文解説: ゲーム開発を「検証できる軌跡データ工場」にする — RLHEV と AWoMo ★ 会員19分で読めます
  12. 第208 論文解説 J-Zero: 出題者・解答者・審判を同時に育てる「データゼロ」自己進化 ★ 会員16分で読めます
  13. 第209 論文解説 RoboTok — ネット動画から「手の動きが似た手本」を掘り出すデータエンジン ★ 会員15分で読めます
蒸留と圧縮9大きなモデルの能力を小さなモデルへ写す。損失関数・データ設計・失敗パターンまで

このジャンルのページへ →

  1. 第210 蒸留の数学 — なぜ「柔らかい答え」から学べるのか 無料11分で読めます
  2. 第211 蒸留レシピ図鑑 — logit・feature・attention・self をどう使い分けるか ★ 会員12分で読めます
  3. 第212 蒸留データの設計 — 教師に何を答えさせるか ★ 会員11分で読めます
  4. 第213 蒸留が失敗するとき — 容量ギャップと過信の伝染 ★ 会員10分で読めます
  5. 第214 オンポリシー蒸留 — 生徒自身の出力で教わる ★ 会員13分で読めます
  6. 第215 蒸留・量子化・枝刈りの使い分け — 小さくする3つの道 ★ 会員13分で読めます
  7. 第216 エージェントを蒸留する — 長い軌跡をどう圧縮するか ★ 会員14分で読めます
  8. 第217 蒸留モデルの評価 — 「教師に近い」は良い指標か ★ 会員12分で読めます
  9. 第218 【実装】蒸留を自作する — 100行で小さなモデルを育てる ★ 会員15分で読めます
評価と審判5AIをどう測るか。ベンチマーク・LLM審判・汚染・報酬ハッキングまで

このジャンルのページへ →

  1. 第219 LLM-as-a-Judge を1から — AIがAIを採点する仕組みと限界 無料12分で読めます
  2. 第220 エージェント評価ベンチ地図 — SWE-bench・GAIA・OSWorldは何を測るか 無料15分で読めます
  3. 第221 自己改善するAI — 共進化・自己対戦・カリキュラム生成の系譜 ★ 会員16分で読めます
  4. 第222 報酬ハッキング — 測り方を決めると、そこが壊れる ★ 会員12分で読めます
  5. 第223 ベンチマーク汚染 — 「高スコア」を疑う技術 ★ 会員12分で読めます

半導体

砂から取り出したシリコンが、どうして計算をするようになるのか。物質の性質から演算器・メモリ・電力・製造まで。

デバイス物理5バンド・ドーピング・pn接合・MOSFET・CMOS

このジャンルのページへ →

  1. 第224 MOSFETを1から — 電圧で開く水門と、リーク電流という現実 無料10分で読めます
  2. 第225 電力バジェットで読むチップ設計 — リークと発熱の物理 ★ 会員12分で読めます
  3. 第226 バンド理論を1から — なぜシリコンだったのか 無料14分で読めます
  4. 第227 FinFETからGAAへ — トランジスタ立体化の必然 ★ 会員12分で読めます
  5. 第228 NANDフラッシュの物理 — 電子を閉じ込めて記憶する ★ 会員13分で読めます
計算機アーキテクチャ5論理回路・クロック・メモリ階層・メモリの壁

このジャンルのページへ →

  1. 第229 メモリの壁を1から — なぜ演算より転送が高いのか ★ 会員11分で読めます
  2. 第230 GPUのメモリ階層 — HBM・SRAM・レジスタと「移動が支配する」現実 ★ 会員12分で読めます
  3. 第231 CPUパイプラインと分岐予測 — 1クロックの中の工場 ★ 会員12分で読めます
  4. 第232 シストリックアレイ — TPUの心臓部を1から ★ 会員12分で読めます
  5. 第233 インターコネクト — NVLink・PCIe・光が決めるスケール ★ 会員11分で読めます
スケーリングと電力4ムーアの法則の終焉・電力の物理・データ移動のコスト

このジャンルのページへ →

  1. 第234 電力の物理 — なぜ電圧を下げると劇的に効くのか ★ 会員12分で読めます
  2. 第235 ムーアの法則の実際 — 何が終わり、何が続いているのか 無料11分で読めます
  3. 第236 チップレットの経済学 — 大きく作れないから分ける ★ 会員12分で読めます
  4. 第237 熱設計を1から — 3D積層の壁は熱 ★ 会員13分で読めます
製造とパッケージ4ウェハ・露光・歩留まり・チップレット・3D実装

このジャンルのページへ →

  1. 第238 チップはこう作られる — ウェハから歩留まりまで ★ 会員11分で読めます
  2. 第239 先端パッケージング — CoWoS・HBM積層がAIの律速になった ★ 会員11分で読めます
  3. 第240 EUVリソグラフィ — 13.5nmの光を作るという狂気 ★ 会員12分で読めます
  4. 第241 歩留まりと設計 — DFMという妥協の技術 ★ 会員13分で読めます
アクセラレータ3数の表し方と量子化・GPU/NPU/TPUの設計様式・エッジ実装

このジャンルのページへ →

  1. 第242 AIアクセラレータの設計様式 — GPU/NPU/TPUは何が違うのか ★ 会員10分で読めます
  2. 第243 数の表し方 — FP32からFP8・INT4まで 無料11分で読めます
  3. 第244 推論チップ戦国時代 — Groq・Cerebras・LPUの設計思想 ★ 会員10分で読めます
サプライチェーン6素材・装置・EDA・IP。チップが生まれる前の「上流」で誰が何を握っているか

このジャンルのページへ →

  1. 第245 半導体サプライチェーン全体地図 — 砂からチップまで誰が何を握るか 無料10分で読めます
  2. 第246 半導体材料の上流 — ウェハ・フォトレジスト・特殊ガス ★ 会員15分で読めます
  3. 第247 製造装置メーカーの世界 — ASML・AMAT・TEL・Lamは何を作っているか ★ 会員11分で読めます
  4. 第248 EDAツールを1から — チップは「ソフトウェアで書かれている」 ★ 会員14分で読めます
  5. 第249 IPコアとファブレス — Armが1円も製造せず世界を握る仕組み ★ 会員15分で読めます
  6. 第250 半導体の地政学 — 輸出規制とサプライチェーン再編を技術から読む ★ 会員10分で読めます

計算アルゴリズム

計算量という物差しから、探索・動的計画法・行列計算・並列化まで。AIの下で実際に動いている計算の作法。

計算量と評価5オーダー記法・時間と空間のトレードオフ・実測との乖離

このジャンルのページへ →

  1. 第251 計算量を1から理解する — オーダー記法は何を測っているのか 無料8分で読めます
  2. 第252 計算量と実測が食い違うとき — キャッシュ・分岐・メモリ帯域 ★ 会員10分で読めます
  3. 第253 乱択アルゴリズム — サイコロを振ると速くなる不思議 ★ 会員14分で読めます
  4. 第254 NP完全を1から — 「解けない」ではなく「検証は速い」 無料12分で読めます
  5. 第255 近似アルゴリズム — 厳密を諦めて保証を取る ★ 会員16分で読めます
データ構造5配列・木・ハッシュ・ヒープ。どれを選ぶと何が速くなるのか

このジャンルのページへ →

  1. 第256 データ構造の選び方 — 配列・ハッシュ・木・ヒープ 無料8分で読めます
  2. 第257 ハッシュと近傍探索 — ベクトル検索の下地 ★ 会員9分で読めます
  3. 第258 キャッシュに優しいコード — 同じO(n)で10倍差がつく理由 ★ 会員13分で読めます
  4. 第259 B木とLSM木 — データベースの心臓 ★ 会員14分で読めます
  5. 第260 確率的データ構造 — 数えずに数える ★ 会員16分で読めます
探索と最適化4全探索・貪欲法・動的計画法・分枝限定・近似

このジャンルのページへ →

  1. 第261 動的計画法を1から解説 — 部分問題を覚えておくということ ★ 会員10分で読めます
  2. 第262 グラフアルゴリズムを1から — 最短経路とその応用 ★ 会員10分で読めます
  3. 第263 線形計画を1から — 最適化の王道 ★ 会員13分で読めます
  4. 第264 焼きなましと遺伝的アルゴリズム — 厳密に解けない時の実務 ★ 会員13分で読めます
数値計算6行列積・分解・FFT・反復法。AIの計算はほぼここに帰着する

このジャンルのページへ →

  1. 第265 行列積のコスト — AIの計算はほぼここに帰着する ★ 会員10分で読めます
  2. 第266 FFTを1から理解する — なぜ畳み込みが掛け算になるのか ★ 会員12分で読めます
  3. 第267 数値の落とし穴 — 桁落ち・丸め・logsumexp ★ 会員13分で読めます
  4. 第268 自動微分の仕組み — PyTorchの魔法を1から 無料14分で読めます
  5. 第269 連立方程式の解き方 — 直接法と反復法 ★ 会員16分で読めます
  6. 第270 【実装】自動微分を自作する — 100行のミニPyTorch ★ 会員18分で読めます
並列・分散3並列化の限界・GPUの実行モデル・分散学習の通信

このジャンルのページへ →

  1. 第271 GPUはなぜ速いのか — 実行モデルと並列化の限界 ★ 会員12分で読めます
  2. 第272 分散学習を1から — データ並列・モデル並列・通信がボトルネックになるとき ★ 会員13分で読めます
  3. 第273 並行処理を1から — ロック・アトミック・メモリモデル ★ 会員12分で読めます

AIのための数学

AIの論文を読むために本当に必要な数学だけを、記号の意味から。線形代数・微積・確率統計・情報理論・最適化。

線形代数6ベクトル・行列・固有値・特異値分解。次元とは何か

このジャンルのページへ →

  1. 第274 AIのための線形代数 — ベクトルと行列が何をしているのか 無料9分で読めます
  2. 第275 LoRAとRAGを支える線形代数 — 固有値・低ランク・ベクトル検索を、動かして掴む 無料10分で読めます
  3. 第276 特異値分解と低ランク近似 — LoRAの数学的な下地 ★ 会員13分で読めます
  4. 第277 行列分解ツアー — LU・QR・コレスキー・SVDの使い分け ★ 会員17分で読めます
  5. 第278 テンソルと形状操作 — einsumが読めれば論文が読める 無料14分で読めます
  6. 第279 対称性と等変性 — 群論がネットワーク設計に効く ★ 会員12分で読めます
微分と最適化の数学6偏微分・勾配・連鎖律・凸性・ラグランジュ

このジャンルのページへ →

  1. 第280 AIのための微分 — 勾配は「どちらに動けば良くなるか」の矢印 無料9分で読めます
  2. 第281 凸性と最適化 — なぜ深層学習は「凸でない」のに動くのか ★ 会員10分で読めます
  3. 第282 SGDの先へ — Adam・二次法・制約付き最適化 ★ 会員16分で読めます
  4. 第283 行列微分を1から — 逆伝播の数式を自分で導く ★ 会員16分で読めます
  5. 第284 ヤコビアンとヘッセ行列 — 多変数の微分を図で ★ 会員15分で読めます
  6. 第285 変分法 — 「関数を微分する」とはどういうことか ★ 会員17分で読めます
確率・統計10分布・期待値・ベイズ・最尤推定・サンプリング

このジャンルのページへ →

  1. 第286 AIのための確率・統計 — モデルの出力は確率である ★ 会員10分で読めます
  2. 第287 ベイズの定理をAIで使う — 事前分布・事後分布・不確実性 ★ 会員11分で読めます
  3. 第288 ベイズ的に考える — 事前・尤度・事後の実務感覚 ★ 会員13分で読めます
  4. 第289 マルコフ連鎖を1から — 「今だけ見る」確率過程 ★ 会員12分で読めます
  5. 第290 確率分布図鑑 — 正規・ポアソン・指数族はどこから来るか 無料16分で読めます
  6. 第291 モンテカルロ法を1から — 積分をサイコロで解く ★ 会員12分で読めます
  7. 第292 統計的検定とABテスト — p値の使い方と誤用 ★ 会員13分で読めます
  8. 第293 統計学習理論 — なぜ学習は汎化するのか ★ 会員16分で読めます
  9. 第294 最適輸送 — 分布を運ぶ数学 ★ 会員15分で読めます
  10. 第295 カーネル法とガウス過程 — NN以前の王者 ★ 会員15分で読めます
情報理論5エントロピー・KL情報量・交差エントロピー。損失関数の出どころ

このジャンルのページへ →

  1. 第296 情報理論とAI — 交差エントロピー損失はどこから来たのか ★ 会員11分で読めます
  2. 第297 KL情報量を1から — 2つの分布の「ズレ」を測る ★ 会員12分で読めます
  3. 第298 エントロピーと交差エントロピー — 損失関数の出どころ 無料12分で読めます
  4. 第299 相互情報量 — 「知っている」を測る ★ 会員14分で読めます
  5. 第300 圧縮=予測=知能 — 情報理論から見るLLM ★ 会員14分で読めます

メディアと圧縮

JPEGはなぜ劣化するのか。PNGはなぜ劣化しないのか。画像・動画・音声の符号化を、情報理論と現場の設定値の両側から。

符号化の理論3可逆と非可逆・エントロピー符号化・ハフマン・算術符号

このジャンルのページへ →

  1. 第301 エントロピー符号化を1から — ハフマンから算術符号まで ★ 会員11分で読めます
  2. 第302 誤り訂正を1から — 壊れる前提で送るという発想 無料13分で読めます
  3. 第303 LDPCとTurbo符号 — 5Gと宇宙探査を支える誤り訂正 ★ 会員13分で読めます
画像圧縮3JPEG・PNG・WebP・AVIF。DCTと量子化、可逆圧縮の仕組み

このジャンルのページへ →

  1. 第304 JPEGはなぜ劣化するのか — DCTと量子化を1から ★ 会員12分で読めます
  2. 第305 PNGはなぜ劣化しないのか — 予測フィルタとDeflate 無料10分で読めます
  3. 第306 WebP・AVIF・JPEG XL — 画像コーデック世代交代 ★ 会員14分で読めます
動画圧縮4MPEG・H.264・AV1。動き補償・GOP・レート制御

このジャンルのページへ →

  1. 第307 動画圧縮を1から — 動き補償とGOP ★ 会員10分で読めます
  2. 第308 H.264からAV1へ — コーデック世代交代の実際 ★ 会員9分で読めます
  3. 第309 動き補償を1から — 動画圧縮の9割はここ ★ 会員12分で読めます
  4. 第310 ニューラル圧縮 — 学習するコーデック ★ 会員13分で読めます
音声圧縮4MP3・AAC・Opus。聴覚マスキングという「捨て方」

このジャンルのページへ →

  1. 第311 音声圧縮を1から — 聴こえない音を捨てる技術 ★ 会員10分で読めます
  2. 第312 MP3と心理音響 — 「聞こえない音」の科学 ★ 会員12分で読めます
  3. 第313 Opusはなぜ最強か — 現代音声コーデックの設計 ★ 会員14分で読めます
  4. 第314 ニューラル音声コーデック — EnCodecとLLM音声の土台 ★ 会員17分で読めます
現場のメディア実務3配信のビットレート設計・エンコード設定・画質評価。仕事で問われること

このジャンルのページへ →

  1. 第315 配信のビットレート設計 — 現場で最初に任される仕事 ★ 会員11分で読めます
  2. 第316 エンコード設定の読み方 — CRF・プリセット・2パスは何を変えるのか ★ 会員10分で読めます
  3. 第317 HLSとDASH — 動画が届くまでのプロトコル 無料14分で読めます

システム基盤

AIを動かす足場そのもの。OS・ネットワーク・データベース・言語処理系・セキュリティ・クラウドを、仕組みから理解する。

OSと実行環境3プロセス・メモリ・コンテナ。プログラムが動く土台

このジャンルのページへ →

  1. 第318 プロセスとメモリを1から — OSは何を守っているのか 無料16分で読めます
  2. 第319 コンテナを1から — namespaceとcgroupの正体 ★ 会員15分で読めます
  3. 第320 ファイルシステムを1から — 「保存した」は何を保証するか ★ 会員12分で読めます
ネットワーク3TCP/QUIC・DNS・CDN。データが届く仕組み

このジャンルのページへ →

  1. 第321 TCPからQUICへ — 信頼できる通信の再発明 無料15分で読めます
  2. 第322 DNSとCDN — URLを打ってから画面が出るまで ★ 会員14分で読めます
  3. 第323 HTTP/1.1→2→3 — 多重化への道 ★ 会員10分で読めます
データベース3内部構造・トランザクション・分散。データが消えない仕組み

このジャンルのページへ →

  1. 第324 データベース内部構造 — SQLの1行の裏側 無料12分で読めます
  2. 第325 トランザクションとACID — 同時実行の地獄と分離レベル ★ 会員12分で読めます
  3. 第326 分散データベース — CAP・レプリケーション・合意 ★ 会員12分で読めます
言語処理系3コンパイラ・JIT・GC。コードが速く動く理由

このジャンルのページへ →

  1. 第327 コンパイラを1から — ソースが機械語になるまで 無料13分で読めます
  2. 第328 JITとGC — 実行しながら速くする・掃除する ★ 会員13分で読めます
  3. 第329 Pythonはなぜ遅いのか、をちゃんと言う ★ 会員15分で読めます
セキュリティ4暗号・認証・LLM攻撃。守る側の設計

このジャンルのページへ →

  1. 第330 暗号を1から — 共通鍵・公開鍵・ハッシュ 無料16分で読めます
  2. 第331 TLSを1から — 鍵交換と証明書の仕組み ★ 会員14分で読めます
  3. 第332 認証と認可 — パスワードからOAuth・パスキーまで ★ 会員19分で読めます
  4. 第333 LLMセキュリティ — プロンプトインジェクションと防御 ★ 会員13分で読めます
クラウドと運用3サーバーレス・コスト・可観測性。壊さず運ぶ技術

このジャンルのページへ →

  1. 第334 サーバーレスとコスト設計 — 破産しないクラウド 無料13分で読めます
  2. 第335 可観測性 — ログ・メトリクス・トレースの実務 ★ 会員12分で読めます
  3. 第336 GPUクラウドの経済学 — 借りるか・買うか・予約するか ★ 会員13分で読めます
開発プロセス5要件定義・設計・見積もり。コードを書く前に勝敗が決まる上流工程

このジャンルのページへ →

  1. 第337 上流工程を1から — 要件定義で勝負がつく理由 無料10分で読めます
  2. 第338 要件定義の技術 — 「言われた通り」が失敗する理由 ★ 会員14分で読めます
  3. 第339 アーキテクチャ設計 — 後から変えられないものを見分ける ★ 会員11分で読めます
  4. 第340 見積もりとスコープ — 不確実性コーンと握り方 ★ 会員11分で読めます
  5. 第341 AI時代の上流工程 — コードが安くなると何が価値になるか ★ 会員11分で読めます