Googleは7月29日(米国時間)、macOS版「Gemini」アプリに音声機能を追加しました。
音声による文章の作成、編集、要約に加え、画像生成や編集にも対応します。
全ユーザーを対象に英語で順次提供し、対応言語は今後拡大します。
記事の概要
Googleは7月29日(米国時間)、macOS版「Gemini」アプリに新機能を追加しました。
全ユーザーを対象に英語で順次提供し、対応言語は今後拡大します。
Fnキーを長押しして話すと、開いているウィンドウ内で音声入力を利用できます。
発話中の「えー」や「あー」といったフィラーを取り除き、途中の言い直しも反映します。
整形された文章は、カーソル位置に挿入されます。
Geminiの推論機能を有効にすると、画面上の内容を認識した処理にも対応します。
デスクトップ上のローカルファイル、画像、ドキュメントを選び、内容の抽出や要約を音声で指示できます。
文章の書き換えや文体変更のほか、デスクトップ上の画像を参照した画像生成や編集も可能です。
記事のポイント
- 音声で文章を入力: Fnキーを長押しして話すと、フィラーや言い直しを処理した文章をカーソル位置へ挿入できます。
- 画面内容を音声処理: 画面上のローカルファイルや画像、ドキュメントを選び、内容の抽出や要約を音声で指示できます。
- 画像生成にも対応: 選択した文章の書き換えや文体変更に加え、画像の生成や編集も音声で指示できます。
詳しい記事の内容はこちらから(引用元)
Googleは29日(米国時間)、macOS版「Gemini」アプリに、音声で文章の作成、編集、要約を行なえる新機能を追…
https://www.watch.impress.co.jp/docs/news/2129302.html