JA EN

#model-families

5 記事

01 ·モデル系統図鑑·★ 会員·13分で読めます オープンvsクローズド — 重み公開の経済学と安全論争 なぜ企業は巨費をかけて訓練した重みを無料で配るのか。オープンウェイトとオープンソースの決定的な違い、実際に事故になるライセンス条項、そして「公開すべきか」を巡る両陣営の言い分と意外な収束点を、前提知識ゼロから解説する。 02 ·モデル系統図鑑·★ 会員·13分で読めます GPT系譜 — GPT-1から現在までの設計思想 GPT-1からGPT-4o・推論モデルまで、各世代で「何を変え、何を変えなかったのか」を追う。設計の中心にあるのは一貫して『次の一語を当てる』だけの機械で、変わったのは規模・学習の順序・出力の躾け方だった。 03 ·モデル系統図鑑·無料·12分で読めます DeepSeek系を1から — MoEと蒸留で殴り込んだ系譜 MoE・MLA・GRPO・蒸留という4つの道具でオープンLLMの勢力図を塗り替えたDeepSeekの系譜を、V2/V3/R1の設計判断に沿って前提知識ゼロから解説。話題になった学習コストの数字の読み方と、蒸留モデルの正しい使いどころまで。 04 ·モデル系統図鑑·★ 会員·10分で読めます Qwen系を1から解説 — HuggingFace DL数トップ勢の実力 Hugging Faceのダウンロード数上位の常連、Alibaba CloudのQwen。Qwen2.5の「全サイズ×用途別」カタログ戦略からQwen3の思考モードとMoEまで、系譜・多言語とコードに強い理由・実務の落とし穴を前提知識ゼロから解説する。 05 ·モデル系統図鑑·★ 会員·11分で読めます Llama系を1から解説 — オープンLLMの本流 MetaのLlamaはなぜオープンLLMの本流になったのか。Llama 1の逆張り設計からLlama 3.xまでの系譜、llama.cpp・GGUF・Ollamaのエコシステム、そして商用利用前に必ず読むべきライセンスの罠を、前提知識ゼロから解説する。