OpenAIGemini2026/06/24 16:00

Introducing computer use in Gemini 3.5 Flash

要点だけを先に読めるように短く再構成したセクションです。

元記事

Quick Digest

要約

要点だけを先に読めるように短く再構成したセクションです。

openaijamodel: gpt-5-mini-2025-08-07

Gemini 3.5 FlashにおけるComputer Useの導入

Key Points

  • 3.5 Flashに統合
  • マルチ環境での操作
  • 企業向け安全機能

Summary

Gemini 3.5 FlashにComputer useがネイティブ統合され、ブラウザ・モバイル・デスクトップ上での観察・推論・操作が可能になりました。従来は独立モデル(Gemini 2.5)だった機能が3.5 Flashの標準ツールになり、長期ワークフローやエンタープライズ向け自動化(継続的ソフトウェアテスト、プロフェッショナルアプリのナレッジワーク等)での信頼性と性能が向上します。利用はGemini APIおよびGemini Enterprise Agent Platformを通じて開始できます。デモはBrowserbaseで確認可能です。

Key Points

  • 統合: Computer useがGemini 3.5 Flashにネイティブ実装。以前のGemini 2.5単体モデルから移行。
  • 対応範囲: ブラウザ、モバイル、デスクトップ環境での画面認識・操作が可能。
  • ユースケース: 継続的テスト、エンタープライズ自動化、ドキュメント監査(例: アクセシビリティ検査)。
  • 利用開始: Gemini API / Gemini Enterprise Agent Platform、Browserbaseデモ、リファレンス実装とドキュメントを参照。
  • セキュリティ: 標的的敵対訓練でプロンプト注入リスクを低減。企業向けオプションとして「敏感・不可逆操作の明示的確認」や「間接的プロンプト注入検出時の自動タスク停止」を提供。
  • 推奨対策: サンドボックス化、人間による検証(HITL)、厳格なアクセス制御と組み合わせた防御層(defense-in-depth)。

For Engineers

  • すぐに試す: Browserbaseデモで挙動を確認。
  • 開発: Gemini APIとEnterprise Agent Platformのリファレンス実装を基にエージェントを作成。
  • 安全設計: 重要操作には明示確認を実装し、監査ログと停止条件を組み込む。公式ベストプラクティスを参照して運用ポリシーを整備する。

Full Translation

翻訳

原文の流れを保ったまま読める翻訳セクションです。

openaijamodel: gpt-5-mini-2025-08-07

Gemini 3.5 Flash における computer use の導入

概要

発行日: 2026-06-24T16:00:00.000Z
著者: Mateo Quiros, Product Manager, Google DeepMind

このコンテンツは Google AI によって生成されています。Generative AI は実験的な技術です。

computer use は、Gemini 3.5 Flash にネイティブで組み込まれたツールとして利用可能になり、エージェントがプラットフォーム間でやり取りできる能力の構築において、これまでで最高の性能を提供します。以前はスタンドアロンの Gemini 2.5 の computer use モデルとしてのみ提供されていましたが、今回 main Gemini Flash モデルに統合されました。

Gemini は既に function calling や Search、Maps といった組み込みツールによるグラウンディングに優れています。組み込みの computer use 機能により、開発者は3.5 Flash を使って、ブラウザ、モバイル、デスクトップ環境にまたがって「見る・推論する・行動する」カスタムエージェントを確実に構築できるようになります。これにより、継続的なソフトウェアテストや、プロ向けアプリケーションにまたがるナレッジワークなどの長期的・企業向け自動化タスクでのパフォーマンスが向上します。

主なユースケースと実例

  • 3.5 Flash は computer use を使って Gemini アプリを解析し、機能をカテゴリ分けした一覧を返します。
  • 3.5 Flash は computer use を使って自らのドキュメントを監査し、アクセシビリティ上の問題を検出します。

利用開始方法

  • Try it now: Browserbase がホストするデモ環境で機能をテストできます。
  • Start building: Gemini APIGemini Enterprise Agent Platform を通じたリファレンス実装とドキュメントを参照してください。

3.5 Flash における安全対策

live 環境で動作するエージェントが直面するプロンプトインジェクションのリスクを軽減するために、Gemini 3.5 Flash の computer use ではターゲットを絞った逆境訓練(targeted adversarial training)を採用しています。

さらに、企業向けに任意で有効化できる 2 つの保護システムを公開します。これらにより、企業は次のことが可能になります:

  • 敏感または取り消し不能な操作に対して、明示的なユーザー確認を要求する。
  • 間接的なプロンプトインジェクションが識別された場合にタスクを自動停止する。

「深層防御(defense-in-depth)」のアプローチとして、開発者にはこれらの機能を以下と組み合わせることを推奨します:

  • セキュアなサンドボックス化
  • human-in-the-loop(人間による検証)
  • 厳格なアクセス制御

追加のセーフティ情報はベストプラクティスのドキュメントで確認できます。

エンタープライズでの利用と導入効果

企業顧客は既に computer use を活用して価値を創出しています。以下は一部のフィードバックです:

  • 継続的なテストワークフローへの統合による自動化の向上
  • プロフェッショナルアプリケーション間での知識作業の効率化

その他

  • 本機能は Gemini 3.5 Flash に統合されており、従来の Gemini 2.5 のスタンドアロン提供からの移行が行われています。
  • お知らせや関連ストーリーは Google のニュースレターで受け取れます(購読は Google のプライバシーポリシーに従って処理されます)。

カテゴリ: Gemini models