学習の道筋
論文を読む
新しい仕組みを、実験できる理解に変える。
2026-10-04教科書
RESEARCH · 入門 → 実践
AI論文を実装判断へ翻訳する読み方:主張、条件、再現、失敗
論文の改善率を鵜呑みにせず、課題、比較条件、仕組み、トレードオフ、実装演習へ分解して読むための教科書。
6 分↗
2026-10-04教科書
RESEARCH · 中級 → 実践
DeepSeek-R1を読む:推論RLは何を変え、何を約束しないか
DeepSeek-R1の2025年論文を、報酬設計、蒸留、評価条件、再現実験、実運用の限界まで分解して読む。
6 分↗
2026-10-04教科書
RESEARCH · 中級 → 実践
s1を読む:少ないデータで推論を伸ばす時、何を測るか
2025年のs1論文を、test-time scaling、budget forcing、データ選別、再現と限界の観点から実装判断へ翻訳する。
6 分↗
2026-10-04教科書
RESEARCH · 中級 → 実践
DAPOを読む:LLM強化学習をアルゴリズムだけで見ない
DAPOの2025年論文を、報酬、長さバイアス、非同期・システム設計、再現実験と報酬ハッキングの観点から読む。
6 分↗
2026-10-04更新
RESEARCH · 論文ノート
2025年以降の推論RL・効率化論文を実装へ読む
推論時の計算配分、RLの学習効率、短い推論、動的な長さ制御を扱う2025年の四論文を、主張と制約を分けて読む。
7 分↗