研究UPDATE

AREX、回答を検証して再調査する自己改善型リサーチエージェントを提案

AREXは暫定回答を条件ごとに監査し、未解決の主張に対して対象を絞った追加調査を行います。

2026/07/241 件の情報源を確認
クイック要約
  • 内側のループが証拠と暫定回答を作り、外側のループが未解決の主張を監査します。
  • 学習したコンテキスト更新ツールが長い履歴を検証済み証拠と残条件へ圧縮します。
  • 4Bと122B-A10B MoEモデルが複数の検索・推論ベンチマークで同規模基準を上回ったと報告されています。
WHAT HAPPENED

何が起きたのか?

AREXは暫定回答を条件ごとに監査し、未解決の主張に対して対象を絞った追加調査を行います。

候補の検証は発見より容易な場合があるという非対称性を構造へ反映しています。合成学習やベンチマークを越え、変化するWeb、矛盾する情報源、アクセス制限下での独立評価が必要です。

WHY IT MATTERS

なぜ重要なのか?

単に検索時間を延ばすのではなく、主張ごとの検証を反復して長期調査エージェントの精度と効率を高める試みです。

WHO SHOULD CARE

誰にとって重要か?

AI研究者検索サービス開発者知識労働者
AIZIGOO VIEW

AIZIGOOの見解

2026年7月23日投稿のプレプリントで、ベンチマーク値は著者報告です。