OpenAIは10月9日、ChatGPTで音声ファイルを扱える機能の提供を始めました。
音声の文字起こしや要約、内容に関する質問に対応します。
有料プランとワークスペースで利用でき、会議やインタビューの記録整理に活用できます。
記事の概要
音声ファイルをチャットに添付すると、文字起こしを作成できます。
録音内容の要約や、内容に関する質問にも対応します。
会議やインタビュー、講義などの録音を処理できます。
録音から構造化されたメモやメールの下書きを作成する用途を想定しています。
対応形式はWAV、MP3/MPEG、OGG/OGA、WebM、PCM、FLAC、AAC、M4A、MP4です。
アップロードできるファイルの上限は512MBです。
WebMとMP4は、動画として識別される場合は対象外です。
長時間の録音は分割処理されることがあり、タイムアウトする場合もあります。
記事のポイント
- 音声をチャットで処理: 音声ファイルを添付すると、文字起こしや要約、録音内容への質問ができます。
- 対応形式と容量: WAVやMP3、FLAC、M4Aなどに対応し、最大512MBのファイルを扱えます。
- 長時間音声の制約: 長時間の録音は分割処理されることがあり、処理がタイムアウトする場合もあります。
このニュースがもたらす影響
- 導入を検討する企業: 会議やインタビューの録音を文字起こしから要約、メモ、メール作成まで一つの対話画面で処理できるため、記録整理の手順を見直す契機になりそうです。
- 音声業務ツール企業: 文字起こし単体ではなく、録音内容への質問や文書化までを含む使い方が広がることで、議事録・取材記録など周辺機能との連携や差別化が求められそうです。
- 企業の管理部門: 有料プランとワークスペースで扱える一方、音声には会議やインタビューの情報が含まれます。利用範囲や保存・共有の運用を事前に整理する必要がありそうです。
このニュースの背景
音声ファイルは、文字起こしだけでなく要約や内容への質問、構造化されたメモやメールの作成まで処理対象になっています。
会議やインタビュー、講義など、録音後に記録を整理する業務が主な利用場面として想定されています。
有料プランとワークスペースで利用でき、最大512MBまで対応する一方、長時間音声では分割処理やタイムアウトが起きる場合があります。
関連するニュース
詳しい記事の内容はこちらから(引用元)
OpenAIは、ChatGPTで音声ファイルをアップロードし、文字起こしや要約、内容に関する質問などを行なえる機能を提供…
https://www.watch.impress.co.jp/docs/news/2147136.html