BDH-CQ検索・リサーチ確認済み

arXiv論文:150Mの小型AI、ARC-AGI-1で29.5%——1問0.0007ドル相当の推論を報告

例題を記憶へ取り込み、文章化しない内部反復で解くBDH-CQが、ARC-AGI-1の費用対精度で新しい効率点を示した。

  • 2026-08-11
  • 最終確認日 2026-08-11
自分にどう関係する?

小型AIでも、例題の記憶と内部反復を工夫すれば、推論費用を抑えて抽象問題を解ける可能性が示されました。

ニュースをやさしく解説

結論から言うと、非常に大きな言語モデルで長い思考文を出さなくても、例題から規則を学び、内部で反復計算する小型AIが、抽象推論の費用対精度を更新したとする研究が出た。2026年8月10日にarXivのcs.NEへ投稿された未査読論文は「BDH-CQ」を提案した。入力された例は推論時に再帰的な記憶を更新し、その後の問題を高次元の内部空間で繰り返し計算して解く。

途中の推論を文章として生成しない点が特徴だ。研究チームは、色や図形の例から変換規則を見つける公開評価ARC-AGI-1と、規則の学び方を調べる制御課題で検証した。150Mパラメータ版は公開評価セットでpass@2が29.5%となり、計算上の推論費用は1課題0.0007ドルだった。

著者らは、従来報告されたARC-AGI-1の費用と精度の両立範囲を上回り、同評価で新しい最高の費用効率になったと説明する。小さなモデルを端末や大量処理へ使いたい人には、モデル規模だけでなく、記憶の更新方法と内部反復が効率に関わると分かる。ただし0.0007ドルは計算に基づく推定で、クラウド料金、端末の電力、開発費を含む実請求額ではない。

ARC-AGI-1の成績も日常会話や業務全般の能力を保証せず、arXivの査読前結果なので追試が必要だ。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(cs.NE、未査読)を開く