フリットジャパンは、AI向け教師データとして利用できる日本語対話音声データの提供を始めました。
第一弾として、話者本人の同意を得て収録した対話データ約100時間分を確保しています。
品質確認用のサンプルを、FlittoグループのAI学習用データマーケットプレイスで公開しました。
記事の概要
フリットジャパンは、権利処理済みの日本語対話音声データを提供開始しました。
収録には、自社が保有する日本語話者ネットワークと協力会社を活用しています。
音声の検収は、コンテンツローカライズの進行管理で培ったノウハウを応用しています。
第一弾として、対話データ約100時間分を確保し、契約締結後すみやかに提供します。
データは話者本人の同意を得て新たに収録しており、権利関係を整理しています。
個人情報の取り扱いでは、プライバシーマークをはじめとした認証を取得しています。
品質確認用のサンプルは、Flitto本社が運営する「Data Marketplace」で公開しています。
用途に応じたカスタムデータの構築・納品にも対応します。
記事のポイント
- 約100時間を確保: 第一弾として、契約締結後すみやかに提供できる対話音声データ約100時間分を確保しています。
- 同意取得と品質管理: 話者本人の同意を得て収録し、独自の品質基準に基づく検収を実施しています。
- サンプルを公開: Data Marketplaceで音声サンプルを公開し、企業が品質を確認して調達先を検討できます。
このニュースがもたらす影響
- 導入を検討する企業: 話者本人の同意や品質検収の条件を確認できるため、調達前に権利・品質の確認項目を具体化し、モデル開発のデータ調達を進めやすくなると考えられます。
- 音声データ提供事業者: サンプル公開とカスタム対応まで示されたことで、音声データ提供事業者には、量だけでなく権利処理の説明と品質を見せる販売設計が求められそうです。
- 音声AI開発企業: 日本語の対話音声を必要な量で調達する選択肢が増えれば、開発企業や研究機関は収録体制を自前で整える前提を見直し、用途別データの外部調達を検討しやすくなる可能性があります。
このニュースの背景
生成AIや音声認識モデルの開発競争を背景に、学習用データは音声を含む多様な種類で需要が拡大しています。
音声は文字起こしや品質検証にも専門性が必要で、日本語では話者ネットワークや検証体制の構築にも時間を要します。
さらに権利処理が不十分なデータは、モデル開発・提供側のリスクになり得ます。
今回の取り組みは、これらの調達上の課題に対応するものです。
関連するニュース
- バベルメソッドはJapriseにAI評価支援を導入し、結果返却を最短2営業日に短縮します。
- フリットジャパンが、渋谷ヒカリエ ヒカリエホールにAI同時通訳サービスを導入しました。
- Meshclass株式会社が、日本語学校向けにAI会話や自動採点を備えた学習アプリを正式提供しました。
詳しい記事の内容はこちらから(引用元)
フリットジャパン株式会社のプレスリリース(2026年10月8日 10時00分)フリットジャパン、権利処理済みの日本語対話…
https://prtimes.jp/main/html/rd/p/000000067.000028944.html