Gemini(Google)仕事・自動化確認済み

Gemini APIでComputer Useが公開プレビュー。ブラウザ・モバイル・デスクトップ操作に対応

Googleは2026年6月24日のGemini API更新で、Gemini 3.5 Flash向けComputer Useツールの公開プレビューを開始。画面を見てクリックや入力などの操作を返すエージェントを作れます。

  • 2026-06-24
  • 最終確認日 2026-06-27
自分にどう関係する?

AIエージェントが画面を見て操作する業務自動化を作りやすくなります。

ニュースをやさしく解説

結論から言うと、GoogleはGemini APIで、画面を見て操作するエージェントを作るためのComputer Useを広げました。2026年6月24日の公式リリースノートでは、Gemini 3.5 Flash向けComputer Useツールが公開プレビューになったと記載されています。

具体的には、ブラウザ、モバイル、デスクトップ環境を対象にでき、モデルがスクリーンショットを見てクリック、入力、キーボード操作などのUIアクションを返します。今回の更新では、意図を含む簡略化されたアクション、設定できる安全ポリシー、プロンプトインジェクション検出も示されています。

API利用者は、Geminiが返した操作を自分の実行環境で動かし、結果の画面をまたモデルに渡して次の操作を決めます。私たちに関係するのは、予約フォームの確認、社内画面の入力補助、Web上の反復作業などを、AIが人の画面操作に近い形で助けられる可能性です。ただし公開プレビューなので、本番運用にそのまま入れる段階ではありません。

Google自身もComputer Useでは実行環境を開発者側で用意すると説明しており、顧客データや決済を扱う作業では、人の確認、権限制限、操作ログを必ず組み合わせるべきです。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

Google AI for Developersを開く