PaperLens
紙
学生版
社会人版
JA
EN
◐
Googleでログイン
ログイン
読む
ホーム
論文精読
新着
教科書
深める
体系
ラボ
業界地図
みんなの貢献
用語集
自分
探す
読み放題
マイページ
#function-calling
3 記事
01
2026-09-03
·
推論・高速化
·
★ 会員
·
論文
·
18分で読めます
論文解説: 本番トラフィックから事後学習へ — 社内200アプリを1つの自前LLMに寄せる
From Production Traffic to Post-Training: Building a Self-Hosted LLM That Covers the Corporate Request Mix
データ所在地の制約で自前ホストせざるを得ない企業が、増え続けるモデル群を1つに畳む方法。本番の失敗を人手で分類し、弱い3軸それぞれにGRPO専門家を作り、SLERPで重みを混ぜる。3種類の報酬ハッキングの実例つき。
02
2026-08-27
·
推論・高速化
·
★ 会員
·
論文
·
15分で読めます
構造化出力と制約デコーディング — JSONを壊さない仕組み
Efficient Guided Generation for Large Language Models
「JSONで返して」とお願いする代わりに、文法的に許されないトークンを出す前に確率ゼロへ落とす — 制約デコーディングの仕組みを、logitマスクから語彙のインデックス化、function callingの裏側、そして「構文は守れても中身は守れない」限界まで1から解説する。
03
2026-08-27
·
エージェント
·
★ 会員
·
論文
·
12分で読めます
【実装】エージェントループを自作する — ツール呼び出しの最小形
ReAct: Synergizing Reasoning and Acting in Language Models
「AIエージェント」の中心はwhile文ひとつです。JSON関数呼び出しの形、ReActが残した設計、そして事故のほとんどが集まる停止条件までを、フレームワークを使わない40行のコードとして1から組み上げます。