CAIS / Scale AI Labs検索・リサーチ確認済み

「AIは実務でどこまで使える?」新指標Remote Labor Indexで、Claude Fable 5が公開モデル首位の16.1%

AI安全性研究のCAISとScale AI Labsが7月1日、実際の在宅業務でAIがどこまで通用するかを測る『Remote Labor Index』の最新結果を公開。23分野・240件の実務で、AnthropicのClaude Fable 5が公開モデル首位の16.1%を記録しました。

  • 2026-07-01
  • 最終確認日 2026-07-03
自分にどう関係する?

AIに丸ごと任せられる仕事はまだ限られる、という現実が数字で見えてきます。過度に期待せず、成果物は人が確認する前提で使うのが安全です。

ニュースをやさしく解説

結論から言うと、『AIは実際の仕事(リモートワーク)をどこまで任せられるか』を測る新しい指標の最新結果が出て、Anthropicの『Claude Fable 5』が一般公開モデルの中で首位になりました。この指標は、AIの安全性を研究するCAISとScale AI Labsが作った『Remote Labor Index(リモート労働指数)』です。

2026年7月1日に更新結果が公開され、Fable 5は23分野・240件の実際の在宅業務プロジェクトで16.1%のスコアを記録し、公開モデルのトップに立ちました。この指標が注目されるのは、単なるクイズやテストではなく、『依頼主がその成果物を本物の納品物として受け取れるか』という現実的な基準で採点している点です。

つまり、AIが人の仕事の代わりに使えるかを、より実務に近い形で確かめています。16.1%という数字は、まだAIが人間の仕事の大部分をこなせるわけではないことも示していますが、少し前より大きく前進したと受け止められています。私たちに関係するのは、AIに任せられる作業と、まだ人が確認すべき作業の線引きが、こうした指標で少しずつ見えてくることです。

注意点として、これは特定のテスト条件での結果であり、あなたの実務にそのまま当てはまるとは限りません。導入時は自分の業務で小さく試すのが安全です。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

CAIS(Center for AI Safety)を開く