arXiv論文:知識を重みに詰め込まない「Co-LMLM」——360M規模で40倍データ学習モデルより低いperplexityを報告
7月8日投稿のarXiv論文が、知識をモデル内部に暗記させず、外部知識ベースから必要な時に取り出すContinuous-Query Limited Memory Language Modelsを提案。360M規模で、40倍多いデータで事前学習したモデルより低perplexityと報告。
AIが古い知識を重みの中に抱え込むと更新が難しくなります。Co-LMLMは、人間が読める外部知識を取り出して答える方向で、事実確認や知識更新に関係します。
ニュースをやさしく解説
結論から言うと、AIに事実を全部暗記させるのではなく、必要な時に外部の知識を取り出させる研究が進んでいます。2026年7月8日にarXivへ投稿された論文「Co-LMLM: Continuous-Query Limited Memory Language Models」は、Limited Memory Language Modelという考え方を発展させました。
通常のLLMは多くの事実を重みの中に覚えますが、知識が古くなった時に更新しにくく、どの根拠で答えたかも見えづらい問題があります。Co-LMLMでは、事前学習中から知識ベースを外部に置き、生成時に必要な情報を取り出します。新しい点は、従来のような関係データベース風の問い合わせではなく、連続値のキーと文章の知識を組み合わせ、柔軟なベクトル問い合わせを低コストで作ることです。
論文はWikipediaとFineWeb-Eduで複数サイズを試し、従来型LMLMや通常LLMよりperplexityと事実精度で良い結果を示したと報告しています。360M規模では、40倍多いデータで事前学習したモデルより低いperplexityになり、SimpleQA検証ではgpt-4o-mini相当、Claude Sonnet 4.5より高い水準としています。
私たちに関係するのは、AIの答えを更新しやすく、根拠を確認しやすくする可能性です。ただしarXivの未査読論文で、商用大規模モデルでの再現性は今後の確認が必要です。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon本評価順で探す ↗Amazon|AI論文・機械学習の入門書を評価順で探すAIニュースや論文ニュースを背景から理解したい人向け機械学習、深層学習、論文読みの入門書をレビュー評価順で探せます。数式レベルと対象読者を確認してください。
- Amazon評価順で探す ↗Amazon|NotebookLM・Perplexityなど調査AIの本を評価順で探す資料調査・要約・比較をAIで速くしたい人向けNotebookLM、Perplexity、AIリサーチ、情報整理に近い本をレビュー評価順で確認できます。仕事・学習の目的に合わせて確認してください。
- 検索AI楽天で見る ↗対話型検索エンジンPerplexity仕事術出典つき検索と調査を仕事で使いたい人向けPerplexityで調査・要約・比較を進めるための仕事術。検索リサーチカテゴリと相性が高い教材です。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。