Google AI Studioの「Live」機能でGeminiと画面をリアルタイム共有し、高度な対話を実現
本記事は、AIとの対話において、スクリーンショットを撮影して貼り付ける手間を解消する新しい方法として、Google AI Studioの「Live」機能の活用法を解説しています。この機能を利用することで、ユーザーは自身の画面をリアルタイムで共有しながら、大規模言語モデルGeminiと対話することが可能になります。
具体的な手順として、まず「Google AI Studio」にアクセスし、モデル選択欄から「Live」モデルを選択することが求められます。使用するモデルとしては、「Gemini 3.1 Flash Live Preview」が推奨されています。最も重要なステップは「Share Screen」機能の利用であり、これによりユーザーは共有したい画面をタブ単位やウィンドウ単位で細かく範囲指定できます。実際に試された事例では、学術論文「Attention Is All You Need」の画面を共有し、「Abstractの内容を日本語にしてください」というプロンプトを送信したところ、Geminiがその内容を正確に翻訳したことが報告されています。
この機能の利点は、単なるテキスト入力に留まらず、音声入力にも対応している点です。そのため、共有画面の内容を見ながら、音声で質問を投げかけるといった、より自然で直感的なワークフローの構築が可能です。これにより、専門的な資料の分析や、視覚情報に基づいた質問応答の効率が飛躍的に向上することが期待されます。
背景
従来のAIとの対話では、参照資料を質問に含める際、スクリーンショットを撮って貼り付けるという手間が発生していました。本ニュースは、この「入力の手間」というワークフロー上のボトルネックを解消するため、AIのインターフェースと画面共有機能を統合した新しい利用方法を提案しています。
重要用語解説
- Google AI Studio: Googleが提供する、AIモデル(Geminiなど)を開発・実験するためのプラットフォームです。プロンプトのテストやAPI連携の準備を行う開発者向けの環境を提供します。
- Gemini 3.1 Flash Live Preview: Googleが開発した高性能な大規模言語モデルの一つです。特に「Live」環境でのプレビュー版であり、リアルタイムの対話や、共有された画面の内容を理解する能力に優れています。
- Live機能: Google AI Studioにおける、リアルタイムの対話や画面共有を可能にする機能です。これにより、ユーザーは視覚的なコンテキストをAIに直接提供し、より高度な質問応答を実現します。
今後の影響
このリアルタイム画面共有機能は、学術研究、データ分析、専門的な資料の翻訳など、視覚情報とテキスト情報が混在する分野のワークフローを劇的に改善します。AIが単なるチャットボットから、作業プロセスに深く組み込まれる「共同作業者」としての役割を果たす可能性を示唆しています。