TAG / TOPIC

arXiv

「arXiv」に関するAIニュースと解説記事の一覧です。

11 STORIES

LATEST STORIES

arXivの新着記事

タグ一覧

RESEARCH / 04

エージェント改善法「RRSI」 — 自己改善ハーネスのテスト暗記を正則化で抑え、OODでも最大4.7ポイント向上

arXiv:2609.24972「RRSI: Regularized Recursive Self-Improvement of Agent Harnesses」(2026年9月21日公開、v2は9月23日)を一次情報に基づき整理。自己改善の過学習問題、提案・選択への正則化(時間的アニーリング予算・critic・pruner)、8ベンチマークでの評価結果とコード公開を扱う。

RESEARCH / 04

NVIDIA・MITら、コーディングエージェントのトークン消費を半減させるハーネス「SoL-Pi」を公開 — 自動研究ループで発見

NVIDIA・NTU・MITが2026年9月17日にarXivで公開したSoL-Pi(arXiv:2609.20519)を一次情報に基づき整理。再帰的自己改善に着想を得たハーネス層の自動研究、選抜された4機構、51タスクEdgeBenchでの評価結果、NVlabsの公開コードを扱う。査読前のプレプリントである点に注意。

RESEARCH / 04

長期タスクではスキルを「読み込む」より「サブエージェントに投げる」方が強い? — 再利用知識の実行方式を比較

Wasu Top Piriyakulkij、Rachel Lawrence、Alicia Curthらが長期エージェントタスクにおける再利用知識の実行方式を比較した論文(arXiv:2609.09233)を公開。スキル指示を文脈に載せる方式は長期化で脆くなり、サブタスクごとに fresh な文脈を立てるサブエージェント起動が優位と報告。

RESEARCH / 04

コンテキスト圧縮でユーザー指示が平均83%消失 — Penn Stateが「Lost in Compaction」で実測、90%超を保持する抽出器も提案(arXiv)

arXiv:2608.11242。ペンシルベニア州立大学のZhiqi Wang氏らが、LLMシステムがコンテキストを圧縮(コンパクション)する際に「セッション制約(Session Constraints, SC)」が消失する問題を定量化した研究。3つの長期コンテキストシナリオ(マルチターンチャット・エージェント軌跡・長時間研究)で12種のコンパクタを評価した結果、注入したSCの平均保持率は17%で、多くのケースで圧縮なしより悪化した。SC認識抽出器(Qwen3.5-9Bベース)をコンパクタと並置するだけで全シナリオで90%超の保持率を記録した。評価スイートと実装はGitHubで公開。

RESEARCH / 04

LLMにも脳と同じ「機能モジュール」構造が現れる——46タスクの回路解析で確認(arXiv)

arXiv 2608.13567。Pengrui Han氏・Jacob Andreas氏・Evelina Fedorenko氏・Andrea Gregor de Varda氏(MIT)。attribution patchingによる回路解析を言語・形式的推論・物理推論・社会的推論の46タスクで実施し、同じ認知領域に属するタスクはLLM内でも同じニューロン群を共有する(領域内オーバーラップ12.9% vs 領域間3.0%、約4.3倍)ことを確認。ドメイン別ニューロンの切除で当該領域だけ精度が25.9%低下(領域間切除は2.5%)と因果的にも特異的。6つのインストラクションチューニング済みLLM(24B〜123B・4ファミリ)すべてで同構造が出現し、能力の不十分なGPT-2では構造が現れない。

RESEARCH / 04

AIエージェントはオープンエンドなAI研究を遂行できるか — 論文著者が採点する「シャドウ評価」で2件とも不合格(arXiv)

arXiv 2607.27191。AIエージェントによるオープンエンドなAI研究の遂行能力を測る「シャドウ評価」を提案。未発表論文の中核研究課題をエージェントに与え、原著者が採点する。NeurIPS 2026投稿2件での実験では、エージェントはエンジニアリングを全て完了したが研究課題への実質的進展はなく、両方とも不合格。5つの失敗パターン(出版基準の判断不足、研究デザイン欠陥への非創造的対応、デッドエンドからの非効率な切り返し、リソース認識の不足、指示ドリフト)を特定した。

AGENTS / 02

DarwinX — 自然選択でエージェントの「ハーネス」を進化させ、4ベンチマーク平均+17pt(arXiv)

arXiv 2608.07545。モデルを凍結したままエージェントのハーネス(プロンプト・ツール・スキル・制御フロー)の集団を自然選択で進化させる手法「DarwinX」。退行なくカバレッジを拡張する変異のみ採用するpreserve-and-extend契約と、代替系統を保持するアーカイブにより、単一系統探索の局所最適を回避。Terminal-Bench 2.1 83.2%、TerminalWorldホールドアウト68.3%、WebArena-Infinity pass@1 43.5%→93.0%など4ベンチマークで平均+17pt。

RESEARCH / 04

「共同科学者」としてのLLMの研究誠実性を測る「IntegrityBench」— ピーク圧力下で約3回に1回、誠実性に関わる判断を誤る

arXiv:2608.12345で公開された「Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists」を、アブストラクトの一次情報に基づいて整理する。IntegrityBenchの設計(36対タスク・5段階圧力プロトコル・3領域・4研究段階)、18モデルでの評価結果、3側面の乖離とデプロイリスクを解説する。

RESEARCH / 04

「アライメント手法は意図せず検閲の道具箱になり得る」— ICML 2026最優秀ポジションペーパー受賞論文が問うデュアルユース性

ICML 2026(韓国・ソウル開催)でOutstanding Position Paper Awardを受賞した「Position: The Alignment Community is Unintentionally Building a Censor's Toolkit」を取り上げる。アライメント手法のデュアルユース性という主張、想定される悪用経路、論文が提案する対策、受賞後の反響を一次情報(ICML Blog・arXiv)に基づいて整理する。