音声

日本語・2話者・接客/電話予約対話音声データセット(プロ声優・LR分離)

日本語・2話者・接客/電話予約対話音声データセット(プロ声優・LR分離)

日本人のプロ声優20名が、予約窓口などのオペレーターとお客様を演じた日本語の対話音声データセットです。ホテル・レストラン・タクシー・電車・病院・観光地の6シーンの電話予約を想定した自然な対話を、話者ごとに別ブースでスタジオ収録し、左右のチャンネルに分離しています。郵便番号・電話番号などの数字を含む発話や、片側の話者にノイズを付与した音声条件も収録しています。音声認識・話者分離・コールセンターAI・音声対話エージェントの学習用途に活用いただけます。

データ件数

77

データ概要

被写体・内容:日本人のプロ声優20名(20代〜70代、男性10名・女性10名、2名1組×10組)によるオペレーター役・お客様役の電話予約対話音声:930ファイル・約76.8時間(1ファイル約0.7〜7.1分、平均約4.7分)
シナリオ:6シーン(ホテル・レストラン・タクシー・電車・病院・観光地)×各5パターン+個人情報確認の計33テーマ。郵便番号・電話番号等の数字を含む発話あり
収録形態:スタジオ収録(ディレクター指示のもと、話者ごとに別ブースで収録)
属性:音声条件3種(ノイズなし約25.9時間/オペレーター側にノイズ付与約25.4時間/お客様側にノイズ付与約25.4時間)
音声仕様:wav(リニアPCM)・16kHz・16bit、2ch LR分離(ch1 お客様/ch2 オペレーター)

ライセンス

提供するデータは、適法・適正に取得したものであり、著作権を保有または権利者から利用許諾を受けていることを、提供契約で保証します。AI学習を含む利用の用途・範囲は、ライセンス規約で事前にご確認いただけます。

備考

収録機材等のメタ情報を提供します。

FAQ

Q. このデータセットは商用のAIモデル学習に利用できますか?

A. ご利用の可否・範囲はライセンス規約に基づき事前にご確認いただけます。詳細は https://qleandataset.visual-bank.co.jp/legal/terms-and-conditions をご覧ください。

Q. どのようなシーンの対話が収録されていますか?
A. ホテル・レストラン・タクシー・電車・病院・観光地の6シーンの電話予約を想定した対話を、各5パターン収録しています。郵便番号・電話番号などの数字を含む個人情報確認のやり取りも含みます。

Q. 雑音環境下での音声認識の学習・評価に使えますか?
A. ノイズなしの音声に加え、オペレーター側・お客様側それぞれにノイズを付与した音声(いずれもノイズなしの音声を編集して付与)を収録しています。

Q. トランスクリプトは付属しますか?
A. 現時点ではトランスクリプトは付属しません。書き起こしの要否を含め、要件をお聞かせください。

Q. サンプルは請求できますか?

A. サンプルはこのページ内のフォームからご請求ください。

79730f9f-4c66-4ce5-96a6-fd17e4041950

true

プレビュー

FREE SAMPLE

サンプルデータの

お申し込み

音声 AIデータレシピ

株式会社アマナイメージズ

Visual Bank株式会社


© amanaimages inc.