ホーム › AI
◉ FIELD
AI
機械学習の基礎から、CNN・Transformer・VLM・エージェントまで。モデルが「なぜその形になったのか」を系譜でたどる。
この巻は ①教科書 → ②基礎 → ③論文解説 → ④ラボ の順に進むと、前提を飛ばさずに読めます。
① 教科書
② 基礎
前提知識を置かずに、その分野の考え方を組み立てる記事。ジャンル順に並べています。
機械学習の基礎
学習とは何か・損失関数・過学習・評価まで、すべての土台
深層学習の基礎
ニューラルネット・逆伝播・最適化・正則化
CNN・画像認識
畳み込みの発明からResNet・軽量化・物体検出まで
Transformerの仕組み
Attention・位置エンコーディング・アーキテクチャの解剖
LLM — 大規模言語モデル
スケーリング則・プロンプティング・LLMの内部挙動
準備中
VLM・マルチモーダル
CLIP・ViT・画像と言語を同じ空間に置く技術
準備中
生成モデル
拡散モデル・VAE・GAN。「作る」側のモデル
学習手法・アライメント
事前学習・SFT・RLHF/DPO・ファインチューニング
推論・高速化
KVキャッシュ・量子化・バッチング・サービング
RAG・検索拡張
埋め込み・チャンク戦略・リランキング・評価
エージェント
ツール使用・計画・マルチエージェント
音声系
音声認識・合成・音声LLM
時系列データ系
RNN/LSTMから時系列基盤モデルまで
モデル系統図鑑
Gemma系・Llama系・Qwen系など系統別の特徴と使い分け
論文解説
重要論文を1本ずつ、本文を根拠に背景から実務含意まで
準備中
蒸留と圧縮
大きなモデルの能力を小さなモデルへ写す。損失関数・データ設計・失敗パターンまで
準備中
評価と審判
AIをどう測るか。ベンチマーク・LLM審判・汚染・報酬ハッキングまで
準備中
③ 論文解説
元の論文を読んで書いた解説。各記事に論文ページとPDFへのリンクを付けています。
- 論文解説: Last Translation Benchmark — 「モデルが壊れる例」と検証ルールで翻訳を測り直す ★ 会員 arXiv:2609.04173
- 論文解説: Motion-Omni — 話しながら全身が動く、end-to-endの音声対話モデル ★ 会員 arXiv:2609.04250
- 論文解説: CogEvol — 報酬が測れないものを、強化学習は静かに壊す ★ 会員 arXiv:2608.30968
- Mamba と状態空間モデル(SSM) — 注意機構なしで系列を扱う 無料 arXiv:2111.00396
- 論文解説: Random Attention — KVキャッシュの追い出しは「ランダムで十分」だった ★ 会員 arXiv:2609.03430
- 論文解説: 訓練データが1問でも、オンポリシー蒸留は数百ステップ伸び続ける ★ 会員 arXiv:2609.04172
- 論文解説: Terminal-Universe — エージェントの作業ログを、何度でも使える実行環境に戻す ★ 会員 arXiv:2609.04148
- 論文解説 RoboTok — ネット動画から「手の動きが似た手本」を掘り出すデータエンジン ★ 会員 arXiv:2609.03199
- 論文解説: 最初の1枚を基準にするのをやめる — Scal3R の複数参照・相対姿勢クエリ ★ 会員 arXiv:2609.04201
- 論文解説: Gated DeltaNet はなぜ4bit量子化に耐えるのか — ハイブリッド27BのNVFP4 W4A4 ★ 会員 arXiv:2609.04098
- 論文解説: Compile by Training — 自然言語の仕様を「手元で動く関数」にコンパイルする ★ 会員 arXiv:2609.04199
- 論文解説: Hi-Q — 質問を「検索できる粒度」まで、証拠を見ながら割っていく ★ 会員 arXiv:2608.30468
- 論文解説: Language Models Can Control Their Own Attention — モデルに「どこを見るか」を宣言させる ★ 会員 arXiv:2609.02737
- 論文解説: LatentPress — 圧縮した文脈を、テキストにも画像にも戻さずLLMに直接読ませる ★ 会員 arXiv:2609.01507
- 論文解説: Aspire — モデルは「曖昧な目標」から自己進化できるか ★ 会員 arXiv:2608.31111
- 論文解説: EarlyEval — エージェント評価を「途中で打ち切って」安くする ★ 会員 arXiv:2609.02783
- 論文解説: HarnessDev — LLMは自分のエージェント・ハーネスを作り、育てられるか ★ 会員 arXiv:2609.01437
- 論文解説: It Takes Two to Match — 検索の「両側」をRLで共進化させるCoGR ★ 会員 arXiv:2609.00638
- エージェント評価ベンチ地図 — SWE-bench・GAIA・OSWorldは何を測るか 無料 arXiv:2310.06770
- 論文解説: AutoSaddler — エージェントの失敗ログから「壊れないハーネス」を自動で育てる ★ 会員 arXiv:2608.23041
- 論文解説: Code as Worlds — 世界を「実行できるコード」として書き起こすエージェント ★ 会員 arXiv:2608.27549
- 論文解説: Code World Model — コーディングエージェントを「世界の脳」にする ★ 会員 arXiv:2608.25927
- 論文解説: On-Policy Distillationは本当に蒸留しているのか — ノイズまみれの教師から自己改善へ ★ 会員 arXiv:2608.31046
- ベンチマーク汚染 — 「高スコア」を疑う技術 ★ 会員 arXiv:2311.04850
- 論文解説: 本番トラフィックから事後学習へ — 社内200アプリを1つの自前LLMに寄せる ★ 会員 arXiv:2609.01572
- 論文解説 H3-World — 言語理解を「世界の操作」に変える ★ 会員 arXiv:2609.01560
- LLM-as-a-Judge を1から — AIがAIを採点する仕組みと限界 無料 arXiv:2306.05685
- 論文解説: LoopArena — コーディングエージェントを「操縦する側」を測る ★ 会員 arXiv:2608.28281
- 論文解説: Normalized Low-Rank Adaptation — LoRAの「入口行列」を正規化するだけで効く理由 ★ 会員 arXiv:2608.31036
- 論文解説: Qwen3.8-Next の設計 — 精度・効率・学習安定性を1つの問題として解く ★ 会員 "arXiv:2608.30320
- 論文解説: PILOT in the Loop — 走っている最中に直す「ライブ自己改善」 ★ 会員 arXiv:2608.26530
- 論文解説: Puro-2B — コンシューマGPUで2Bモデルを$6.9Kからゼロ事前学習する ★ 会員 arXiv:2608.27370
- 論文解説: Repo-To-Skill — GitHubリポジトリを「AIのためのスキル」に蒸留する ★ 会員 arXiv:2609.02749
- 報酬ハッキング — 測り方を決めると、そこが壊れる ★ 会員 arXiv:1606.06565
- 論文解説: SecOPD — トークン1個ずつ採点して、適応的プロンプトインジェクションを1桁下げる ★ 会員 arXiv:2608.21500
- 自己改善するAI — 共進化・自己対戦・カリキュラム生成の系譜 ★ 会員 arXiv:1712.01815
- 論文解説 SMELT — 「同じ層をもう一周」は、予算を揃えても得なのか ★ 会員 arXiv:2609.01343
- 論文解説: StarHarness — モデルを凍結したまま「ハーネス」を進化させる ★ 会員 arXiv:2608.24804
- 論文解説: StudentSim — 「その生徒そのもの」を訓練で作る学習者シミュレータ ★ 会員 arXiv:2609.01591
- 論文解説: Training Agents to Evolve with Their Harness — ハーネスごと進化するエージェントを訓練する ★ 会員 arXiv:2608.15763
- 論文解説: UI-Venus-2 — 画面を見て操作するAIを、ベンチマークから実運用へ ★ 会員 arXiv:2609.00028
- 論文解説 UrbanGround: 街に降ろされたMLLMエージェントは、どこで崩れるのか ★ 会員 arXiv:2608.27456
- 論文解説: 良いエージェント学習データとは何か — ACE(正確さ・複雑さ・多様性)という見方 ★ 会員 arXiv:2608.27260
- 論文解説: ZimaBlue — 12万時間の一人称動画でロボットを汎化させる ★ 会員 arXiv:2609.00188
- 論文解説: DART-SD — ツール呼び出しエージェントの「ダイヤ型の解空間」を壊さずに学習する ★ 会員 arXiv:2608.18524
- 論文解説: PaperGym — 論文1本を「採点基準つきの練習場」に変えて研究計画を学習させる ★ 会員 arXiv:2608.31119
- 論文解説: Agentic Artifact Creation — 「生成」と「納品物を組み立てる」はどう違うのか ★ 会員 "arXiv:2608.28122
- 論文解説: CyberFactory — 野生のCVEを「実行できる訓練問題」に変える ★ 会員 arXiv:2608.23181
- 論文解説 J-Zero: 出題者・解答者・審判を同時に育てる「データゼロ」自己進化 ★ 会員 arXiv:2608.26582
- 論文解説: Self-OPD — 教師モデルなしで、画像生成モデルが自分を蒸留する ★ 会員 arXiv:2608.26872
- 論文解説 TTPO: 正解ラベルなしで、テストの最中にモデルを鍛える ★ 会員 arXiv:2608.27448
- 論文解説: JIT-Agent — エージェントの「ハーネス」をその場で書き起こすモデル ★ 会員 arXiv:2608.25593
- 論文解説 PAWBench — 動画生成は「起こりうる未来の確率」まで当てられるのか ★ 会員 arXiv:2608.27345
- 代理指標では、もう守れない — 自動運転 2026年8月新着8本を束ねて読む 無料
- 論文解説: ゲーム開発を「検証できる軌跡データ工場」にする — RLHEV と AWoMo ★ 会員 arXiv:2608.25518
- 【実装】蒸留を自作する — 100行で小さなモデルを育てる ★ 会員 arXiv:1503.02531
- 蒸留データの設計 — 教師に何を答えさせるか ★ 会員 arXiv:2501.12948
- 蒸留モデルの評価 — 「教師に近い」は良い指標か ★ 会員 arXiv:2305.15717
- 蒸留が失敗するとき — 容量ギャップと過信の伝染 ★ 会員 arXiv:1503.02531
- エージェントを蒸留する — 長い軌跡をどう圧縮するか ★ 会員 arXiv:2210.03629
- 蒸留の数学 — なぜ「柔らかい答え」から学べるのか 無料 arXiv:1503.02531
- 蒸留レシピ図鑑 — logit・feature・attention・self をどう使い分けるか ★ 会員 arXiv:1503.02531
- 蒸留・量子化・枝刈りの使い分け — 小さくする3つの道 ★ 会員 arXiv:1503.02531
- 論文解説: FrontierChallenge — 科学の仕事を「最後まで納品できたか」で測る ★ 会員 arXiv:2608.24979
- オンポリシー蒸留 — 生徒自身の出力で教わる ★ 会員 arXiv:2306.13649
- 論文解説 WarpSAC: 強化学習の「安定化装置」は、データが潤沢になると足枷に変わる ★ 会員 arXiv:2608.24479
- 論文解説: VoiceMem — 音声対話に「左脳と右脳」の記憶を、遅延ゼロで ★ 会員 arXiv:2608.26005
- エージェント評価 — ベンチとハーネスの作法 ★ 会員 arXiv:2310.06770
- エージェントの記憶設計 — 短期・長期・エピソード ★ 会員 arXiv:2310.08560
- アライメント概説 — RLHFからConstitutional AIまで ★ 会員 arXiv:2203.02155
- AlphaGoを1から — 探索と学習の結婚 ★ 会員 "doi:10.1038/nature16961
- 論文解説: Apodex 1.1 — 「完了した仕事」を単位にエージェントをスケールさせる ★ 会員 arXiv:2608.23283
- 論文解説: ASI-Bench — 手引きを1枚ずつ剥がして、AIの「自力」を測る ★ 会員 arXiv:2608.17271
- 音楽・音声生成を1から — トークン化された音 ★ 会員 arXiv:2306.05284
- 音の表現 — メルスペクトログラムとトークン化 ★ 会員 arXiv:2106.07447
- エンコーダとデコーダ — BERTとGPTの分岐点 ★ 会員 arXiv:1810.04805
- 【実装】エージェントループを自作する — ツール呼び出しの最小形 ★ 会員 arXiv:2210.03629
- 【実装】拡散モデルを自作する — MNISTからはじめる ★ 会員 arXiv:2006.11239
- 【実装】ミニGPTを自作する — 300行の言語モデル ★ 会員 arXiv:1706.03762
- 【実装】BPEトークナイザを自作する — マージ規則を学習し、日本語で殴られる ★ 会員 arXiv:1508.07909
- 【実装】ベクトルDBを自作する — 線形走査からHNSWへ ★ 会員 arXiv:1603.09320
- 継続学習と破滅的忘却 — 学び続けるモデルの難しさ ★ 会員 arXiv:1612.00796
- 教師なし学習を1から — クラスタリングと次元削減 ★ 会員 arXiv:1802.03426
- DPOとその後 — RLHFを単純化する系譜 ★ 会員 arXiv:2305.18290
- 論文解説: Embodied-Navigator(TAMP-Nav) — VLMに「指を差させる」と、ナビゲーションは速く強くなる ★ 会員 "arXiv:2608.17512
- FlashAttentionを1から — 計算を増やして速くする逆説 ★ 会員 arXiv:2205.14135
- 論文解説: FreeToken — 手元のPCを「一台の推論基盤」として使い切る帯域適応型MoEサービング ★ 会員 arXiv:2608.16157
- GNNを1から — つながりを学ぶネットワーク ★ 会員 arXiv:1609.02907
- GPUメモリ不足サバイバル — OOMの原因と対処の全パターン ★ 会員 arXiv:1604.06174
- ハルシネーションはなぜ起きる — 仕組みと現実的な対策 無料 arXiv:2202.03629
- ハイパーパラメータ探索 — 勘・グリッド・ベイズ最適化 ★ 会員 JMLR 2012
- 画像生成の実務地図 — SD・ControlNet・LoRA適用 無料 arXiv:2112.10752
- ImageNetの瞬間 — 深層学習が勝った日 無料 arXiv:1409.0575
- 知識蒸留を1から — 大きなモデルを小さく写す ★ 会員 arXiv:1503.02531
- LLM評価を1から — ベンチマークの読み方と汚染問題 ★ 会員 arXiv:2009.03300
- LLMサービングを1から — vLLM・連続バッチングで、GPUを遊ばせない 無料 arXiv:2309.06180
- 長文脈LLMの技術 — RoPE補間からリング注意まで ★ 会員 arXiv:2306.15595
- マルチエージェント設計パターン — 分担・討論・検証 ★ 会員 arXiv:2305.14325
- RAG評価の実務 — 「なんとなく良い」を数字にする ★ 会員 arXiv:2309.15217
- スケーリング懐疑論 — 「大きくするだけ」批判の系譜 ★ 会員 arXiv:2001.08361
- 拡散モデルの数学 — スコアとSDEで見る生成 ★ 会員 arXiv:1907.05600
- 自己教師あり学習 — ラベルなしデータが宝になった日 ★ 会員 arXiv:2002.05709
- 構造化出力と制約デコーディング — JSONを壊さない仕組み ★ 会員 arXiv:2307.09702
- 論文解説: SWE-bench Science — コーディングエージェントは「科学のコード」を直せるか ★ 会員 arXiv:2608.19799
- 記号主義vs接続主義 — 60年論争の現在地 ★ 会員
- 推論時スケーリング — 「長く考える」モデルの原理 ★ 会員 arXiv:2201.11903
- 3D生成のいま — NeRFからGaussian Splattingまで ★ 会員 arXiv:2003.08934
- 学習が壊れた時の診断学 — loss発散・NaN・停滞の切り分け 無料 arXiv:1211.5063
- 動画理解を1から — フレームの束から時間の理解へ ★ 会員 arXiv:2102.05095
- 論文解説: WeMM-Embedding — 文も画像も動画も「同じ物差し」に載せるWeChatの埋め込みモデル ★ 会員 arXiv:2608.24053
- データセット構築の実務 — 集める・洗う・混ぜる ★ 会員 arXiv:2212.10560
- 文書理解とOCRのいま — 帳票をLLMが読むまで ★ 会員 arXiv:1912.13318
- GraphRAGを1から — 知識グラフと検索の融合 ★ 会員 arXiv:2404.16130
- 事前学習データの作り方 — Webから教科書品質へ ★ 会員 arXiv:2101.00027
- Transformer完全解剖 — 埋め込みから出力まで一気通貫 無料 arXiv:1706.03762
- 音声合成を1から — テキストから声まで ★ 会員 arXiv:1609.03499
- 活性化関数を1から — なぜ非線形が必要なのか 無料 arXiv:1502.01852
- 決定木と勾配ブースティング — 表データ最強の座は今も 無料 arXiv:1603.02754
- 時系列異常検知 — 監視の現場で動いている数学 ★ 会員 arXiv:0710.3742
- 重みの初期化と正則化 — 学習が始まる条件・続く条件 ★ 会員 PMLR v9
- 論文解説 Large Discovery Models — LLMに「次に何を試すべきか」を教える価値信号 ★ 会員 arXiv:2608.15669
- 論文解説: Agentic ESOpt — 逆伝播をやめて「モデルを揺らす」だけで、長丁場のLLMエージェントを鍛える ★ 会員 arXiv:2608.17310
- Attentionの変種図鑑 — MQA・GQA・スライディング窓・線形注意 ★ 会員 arXiv:1911.02150
- 論文解説: Co-RL — 正解ラベルなしでも、群れの多様性から推論が立ち上がる ★ 会員 arXiv:2608.17253
- 論文解説: Agent Skillsはなぜ効くのか、そしてどこで壊れるのか ★ 会員 arXiv:2608.14036
- 論文解説: EnvHarness — 練習場を作り直さず、外から「治具」をかぶせてエージェントを鍛える ★ 会員 arXiv:2608.19880
- 論文解説: FACET — 指示・環境・解答・採点を「同じ実行状態」に接地させる課題合成 ★ 会員 arXiv:2608.18580
- Flow Matchingを1から — 拡散の次に来た「まっすぐ運ぶ」生成 ★ 会員 arXiv:2210.02747
- GANの栄枯盛衰 — 敵対で学ぶ発明と、拡散に負けた理由 ★ 会員 arXiv:1406.2661
- 学習率スケジュール — warmupとcosineの理由 ★ 会員 arXiv:1706.03762
- 混合精度学習 — fp16/bf16/fp8で壊れずに速くする ★ 会員 arXiv:1710.03740
- 正規化レイヤー全史 — BatchNormからRMSNormまで ★ 会員 arXiv:1502.03167
- 論文解説: OmniScientist — 生データを直接「見る」AI科学者。36ケースを1つのエンジンで走らせる ★ 会員 arXiv:2608.13558
- 推薦システムと埋め込み — RAGと同じ数学、違う目的 ★ 会員 arXiv:1205.2618
- CFGとサンプラー — 生成AIの「強さ」パラメータの正体 ★ 会員 arXiv:2207.12598
- 論文解説 SemaPLC — 「できました」と言わせない検証ゲート型エージェント ★ 会員 "arXiv:2608.18565
- 論文解説: StateM — モデルの重みを1gも動かさず、Terminal-Bench 2.1で95.3%・実行費15ドルへ ★ 会員 "arXiv:2608.15089
- 時系列にTransformerは効くのか — 論争と実務の答え ★ 会員 arXiv:2205.13504
- トークナイザを1から — LLMが世界を切り刻む単位 無料 arXiv:1508.07909
- 論文解説: Zetta ζ — 方策を凍結したまま、ロボットが実行中に自分を直す「閉ループ・ハーネス」 ★ 会員 arXiv:2608.16590
- 論文解説: SA-MRPO — 満点の科目を勉強し続けるな。飽和した報酬から勾配を引きはがす ★ 会員 "arXiv:2608.16072
- 論文解説: 危機映像のAI捏造は見抜けるか — RA-Benchが暴いた検出器の実力 ★ 会員 "arXiv:2608.14391
- 論文解説: ABSeeker — 答えから逆算して「良い一手」を採点する、長距離検索エージェントの訓練法 ★ 会員 arXiv:2608.05102
- CNNアーキテクチャの系譜 — AlexNetからResNet・EfficientNetまで ★ 会員 arXiv:1409.1556
- 論文解説: 共進化するエージェント系 — 人間の設計を超えた自己進化への三段階 ★ 会員 arXiv:2608.10299
- 論文解説: ComBodied Agents — エージェントの「作用対象」を人そのものに置き直す ★ 会員 arXiv:2608.10915
- 埋め込み(Embedding)を1から理解する — word2vecの直感から文脈化埋め込みまで 無料 arXiv:1301.3781
- End-to-End運転を1から — 認識から制御までを1つのネットワークで ★ 会員 arXiv:1604.07316
- 論文解説: Frontis-MA1 — 「AIを作るAI」を鍛える。MLエンジニアリングで再帰的自己改善に一歩迫るOpenMLE ★ 会員 arXiv:2607.28568
- 論文解説: Interpretable MEG Decoding of Perceived Speech — 脳磁図から「聞いた音声」を当てるAIの中身を、脳地図として読む ★ 会員 arXiv:2608.01481
- 論文解説: LongHorizon-Harness — 長時間タスクは「実行」ではなく「状態管理」で解く ★ 会員 arXiv:2608.01964
- 論文解説: Mental World Modeling — 物理だけでなく「心」まで遷移させるワールドモデル ★ 会員 arXiv:2607.27201
- 論文解説: MerchantBench — LLMエージェントは1年間ネットショップを経営できるか。人間の27.3%しか稼げない理由 ★ 会員 arXiv:2607.28956
- 論文解説: Metis — 記憶を外付けせず、モデルの中に住まわせる「Memory Foundation Model」 ★ 会員 arXiv:2607.26760
- 物体検出を1から解説(YOLO・DETRまで) ★ 会員 arXiv:2005.12872
- 論文解説: 正解も強い教師もなしで伸びる — u-OPSD が使う「自分の多数決」 ★ 会員 arXiv:2608.06296
- 論文解説: OSReward — AIの「採点者」は信用できるか。コンピュータ操作エージェントの報酬を測り直す ★ 会員 arXiv:2607.28609
- 論文解説: PhiZero — 映像を描く前に「物理の言葉」で考える世界モデル ★ 会員 arXiv:2607.28624
- 論文解説: Qwen-UI-Agent — スマホもPCも操る「実世界基準」のGUIエージェントはこう作られた ★ 会員 arXiv:2607.28227
- 論文解説: Recursive Synthesis — 検証済みタスクを「増築」して、長時間ターミナル課題を4万件量産する ★ 会員 arXiv:2608.05466
- スケーリング則を1から解説 — なぜ大きくすると賢くなるのか ★ 会員 arXiv:2203.15556
- 論文解説: SwanTale — 参照音声なしで「言葉から声をデザインする」統合音声・オーディオ生成 ★ 会員 arXiv:2608.02023
- 論文解説: ToolArtist — 検索するか、描くか、描き直すか。それも自分で決める画像生成エージェント ★ 会員 arXiv:2608.04436
- 論文解説: TurboVLA — LLMを追い出したロボット方策が、RTX 4090・VRAM 1GB未満で32Hzを叩き出す ★ 会員 arXiv:2607.27205
- 論文解説: Video-DeepResearch — 動画を「見て、調べ尽くす」次世代マルチモーダル・エージェント ★ 会員 arXiv:2608.03979
- VLMの成立と現在 — 視覚エンコーダとLLMをどう繋ぐか ★ 会員 arXiv:2103.00020
- 論文解説: AgentOPSD — 「どのターンが勝敗を分けたか」をベイズ信念の再帰更新で見つけるエージェントRL ★ 会員 arXiv:2608.05987
- 論文解説: Alpamayo — 自動運転の推論モデル ★ 会員 arXiv:2511.00088
- 論文解説: AskChem — 検索の単位を「論文」から「出典付きクレーム」に変える文献インフラ ★ 会員 arXiv:2607.28618
- 論文解説: BDH-CQ — 言葉にせずに考えるAI。再帰メモリ×潜在推論がARCのコスト効率を塗り替えた ★ 会員 arXiv:2608.09888
- BEV表現を1から — 複数カメラを俯瞰図に統合する ★ 会員 "arXiv:2008.05711
- 論文解説: CodeNib — コーディングエージェントにリポジトリの文脈を「配膳」する多ビューデータシステム ★ 会員 arXiv:2607.25431
- 論文解説: DAPD — 蒸留の教師が持つ「カンニングペーパーの幻想」を二重アンカーで断つ ★ 会員 arXiv:2608.01735
- 論文解説: EnvACE — 環境まで自分で演じる「world rehearsal」がエージェントRLの環境不足を解く ★ 会員 arXiv:2608.06197
- Gemma系を1から解説 — 系譜・特徴・使いどころ ★ 会員 arXiv:2403.08295
- 論文解説: Macaron-V1 — 凍結ベース×LoRA混合で「出荷後も育つ」エージェントモデルを作る ★ 会員 arXiv:2608.09819
- Mixture of Experts (MoE) を1から解説 — Switch Transformerのルーティングと負荷分散 ★ 会員 arXiv:2101.03961
- 投機的デコーディングを1から解説 — 小さな下書きモデルで、出力を一切変えずにLLMを速くする ★ 会員 arXiv:2211.17192
- 論文解説: SWE-Bench ProMax — 多言語・大規模リファクタリングでコーディングエージェントの本当の実力を測る ★ 会員 arXiv:2608.09802
- 論文解説: The Personalization Mirage — LLMは「あなた」を勝手に作り上げ、自己申告は逆を指す ★ 会員 "arXiv:2608.04570
- 論文解説: WorldClaw — テキスト1文から「歩ける・編集できる」3Dオープンワールドをエージェントが建設する ★ 会員 arXiv:2608.05248
- 論文解説: CLIP — 言葉と画像を同じ地図に置く ★ 会員 arXiv:2103.00020
- 拡散モデルを1から理解する — ノイズを足して、引く ★ 会員 arXiv:2006.11239
- Instruction Tuning と RLHF を1から解説 — 指示に従うモデルはどう作られるか ★ 会員 arXiv:2203.02155
- LLMエージェントを1から解説 — ツール使用とループの設計 ★ 会員 arXiv:2210.03629
- プロンプトエンジニアリングの科学 — 何が実証され、何が迷信か 無料 arXiv:2201.11903
- 論文解説: Whisperはなぜ頑健なのか — 大規模弱教師あり学習 ★ 会員 arXiv:2212.04356
- 論文解説: ViT — 画像を単語のように扱う ★ 会員 arXiv:2010.11929
- 位置エンコーディングを1から理解する(絶対位置からRoPEまで) 無料 arXiv:1706.03762
- 論文解説 Attention Is All You Need — 再帰を捨てたモデルは何を証明したのか ★ 会員 arXiv:1706.03762
- 論文解説 LoRA: Low-Rank Adaptation of Large Language Models — なぜ低ランクで足りるのか ★ 会員 arXiv:2106.09685