CoBa検索・リサーチ確認済み

arXiv論文:CoBa、精度を保ち計算量指標を58.9%削減

回答生成、簡易確認、強い確認、終了のどこへ計算を配るかを選び、推論時の費用対効果を高める方式を提案した。

  • 2026-08-11
  • 最終確認日 2026-08-11
自分にどう関係する?

AIに考えさせる量を増やす時、候補数だけでなく、安い確認と強い確認の配分で費用を抑えられる可能性があります。

ニュースをやさしく解説

結論から言うと、難しい質問でAIに何度も答えを作らせるだけでなく、候補作成と確認へ計算を振り分ける方式「CoBa」が提案された。2026年8月7日にarXivのcs.AIへ投稿された未査読論文だ。回答精度を上げる「推論時スケーリング」では、候補数を増やす、思考を長くする、強い評価器で確認する、といった方法がある。しかし予算が決まっていれば、すべてを最大にはできない。

CoBaはまず少数の候補を作り、安い確認を広く行い、不確実または価値が高い候補だけを強い確認へ回す。数学や記号処理を含む3129組の評価で、強い確認を選別する構成はマクロ正答率85.13%だった。自己評価付き投票の85.20%と統計上同等で、モデル規模を加味したトークン量は49.1%少なかった。

16候補の多数決とも差は0.01ポイント以内で、同じ指標のトークン量を58.9%減らした。ただし対応のある検定では、高い費用を使う16候補多数決に小さな優位が残った。ローカルAIや利用枠の限られた環境では、候補をむやみに増やさず「どの答えを詳しく確認するか」を選ぶ設計が役立つ可能性がある。

一方、結果は数学・記号課題中心の査読前実験で、トークン指標は実料金、時間、消費電力そのものではない。一般会話や日本語でも同じ効果になるか確認が必要だ。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(cs.AI、未査読)を開く