
フリットジャパン、権利処理済み日本語対話音声データをAI向けに提供開始
公開日:
フリットジャパン株式会社は10月8日、AI学習向けの日本語対話音声データの提供開始を発表しました。第一弾として約100時間分を確保し、契約締結後に提供します。話者本人の同意を得て新たに収録したデータで、同社独自の基準による検収を行っています。Flittoの「Data Marketplace」で、台本を使わない対話のサンプルを確認できます。
注目ポイント
- 1AI学習向けに約100時間分の日本語対話音声を整備し、契約締結後に提供
- 2話者本人の同意を得て新たに収録し、独自の基準に基づいてデータを検収
- 3台本を使わない対話サンプルを公開し、用途に応じたカスタム構築にも対応
日本語音声データの調達課題に応える
音声認識や生成AIのモデル開発では、収録音声のほか、文字起こしや品質確認を含めた学習データの準備が必要です。日本語の話者を確保し、必要な量を集める作業も発生します。
フリットジャパンは、こうした調達に向けて日本語の対話音声データを整備しました。整備済みのデータをサンプルで確認してから、調達先を検討できます。
権利処理済みの対話音声データを整備
第一弾として約100時間分の対話音声を確保しており、契約締結後に提供します。7年間の翻訳・ローカライズ・データ事業で築いた日本語話者のネットワークに加え、協力会社と連携して収録しました。
収録音声は、同社独自の品質基準で検収しています。コンテンツのローカライズで培った進行管理の方法を、データの検収・品質管理に応用したと説明しています。
権利リスクを抑えたデータ調達を可能に
同社によると、話者本人の同意を得て新たに収録した音声を提供します。権利処理済みの学習データとして紹介されています。
個人情報の取り扱いについて、同社はプライバシーマークなどの認証取得を説明しています。調達時には利用目的と契約上の利用範囲を確認する必要があり、権利処理済みという説明だけで、すべての用途における法的リスクがなくなるわけではありません。
Data Marketplaceでサンプルを公開
整備したデータの品質を実際に確認できるよう、その一部をサンプルとして「Data Marketplace」に公開しました。「Data Marketplace」は、Flitto本社が運営する、データを提供したい企業とデータを必要とする企業をつなぐためのプラットフォームです。データの調達を希望する企業は、サンプルでデータの品質を確かめたうえで、調達先を検討できます。今回公開したサンプルは、台本を用いない一般的な対話をマルチターン形式で収録したものです。
今後の展開
整備済みデータの提供に加え、ヒアリングを経て利用企業の用途に合わせたカスタムデータの構築・納品にも対応します。日本語ネイティブの音声データを順次拡充することは、今後の計画として示しています。
Q&A
Q. フリットジャパンの日本語対話音声データとは何ですか?
A. AI学習向けに整備した日本語の対話音声データです。話者本人の同意を得て新たに収録し、第一弾として約100時間分を提供します。
Q. 品質はどこで確認できますか?
A. FlittoのData Marketplaceでサンプルを公開しています。台本を使わない一般的な対話を、複数ターンの形式で収録しています。
Q. 提供を受けるための条件はありますか?
A. 整備済みデータは契約締結後に提供します。利用企業へのヒアリングを経て、用途に合わせたカスタムデータの構築・納品にも対応します。
関連リンク

O!Productニュース編集部からのコメント
台本を使わない対話のサンプルが、音声モデル用のデータを選ぶ際に役立ちそうです。契約前に会話の形式や品質を確認する手がかりになります。
引用元:PR TIMES
この記事の著者
O!Productニュース編集部
