TAG / TOPIC

自己改善

「自己改善」に関するAIニュースと解説記事の一覧です。

03 STORIES

LATEST STORIES

自己改善の新着記事

タグ一覧

RESEARCH / 04

エージェント改善法「RRSI」 — 自己改善ハーネスのテスト暗記を正則化で抑え、OODでも最大4.7ポイント向上

arXiv:2609.24972「RRSI: Regularized Recursive Self-Improvement of Agent Harnesses」(2026年9月21日公開、v2は9月23日)を一次情報に基づき整理。自己改善の過学習問題、提案・選択への正則化(時間的アニーリング予算・critic・pruner)、8ベンチマークでの評価結果とコード公開を扱う。

RESEARCH / 04

Google DeepMindらが「Dream-RSI」を公開 — 履歴を“夢”の世界に変え、エージェントの探索政策を自己改善

Google・Google DeepMind・メリーランド大学・バージニア大学の研究チームが技術レポート「Dream-RSI: Recursive Self-Improvement through Evolving Worlds」を公開。探索履歴をリプレイシミュレータに変え、探索政策だけをオフラインで改善する再帰的自己改善ループを提案する。

AGENTS / 02

DarwinX — 自然選択でエージェントの「ハーネス」を進化させ、4ベンチマーク平均+17pt(arXiv)

arXiv 2608.07545。モデルを凍結したままエージェントのハーネス(プロンプト・ツール・スキル・制御フロー)の集団を自然選択で進化させる手法「DarwinX」。退行なくカバレッジを拡張する変異のみ採用するpreserve-and-extend契約と、代替系統を保持するアーカイブにより、単一系統探索の局所最適を回避。Terminal-Bench 2.1 83.2%、TerminalWorldホールドアウト68.3%、WebArena-Infinity pass@1 43.5%→93.0%など4ベンチマークで平均+17pt。