JA EN

#co-evolution

2 記事

01 ·評価と審判·★ 会員·論文·16分で読めます 自己改善するAI — 共進化・自己対戦・カリキュラム生成の系譜 Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm 外から教師データを足さずにモデルが強くなる、という現象がどういう条件で成立するのかを1から分解する。AlphaZeroの自己対戦が成立した三つの条件を取り出し、それが言語モデルでどこから壊れるか、共進化とカリキュラム生成がその穴をどう埋めようとしているか、そして自己改善の主張をどう評価すべきかまでを扱う。 02 ·エージェント·★ 会員·論文·11分で読めます 論文解説: 共進化するエージェント系 — 人間の設計を超えた自己進化への三段階 Co-Evolution in Agentic Systems: Toward Self-Directed Evolution Beyond Human Design 「デプロイ後も賢くなり続けるエージェント」はなぜ頭打ちになるのか。相手・環境・進化の仕組みそのものを順に動かしていく三段階の分類を、サーベイ論文の本文から1から解説する。定義の式、各段階の代表手法、評価と安全の未解決点まで。