音声

日本語・地域の方言音声データセット(対話・独り語り)

日本語・地域の方言音声データセット(対話・独り語り)

日本各地の方言を収録した音声データセットです。2話者による日常会話形式の対話音声と、1話者による独り語り形式の音声の両方を収録しており、広島弁・大阪弁・関西弁・岡山弁・伊予弁・土佐弁など、方言の種類は随時拡充中です。音声認識・方言判定・音声合成などのAI学習用途に活用いただけます。

データ件数

20

被写体属性

被写体・内容:日本人(20代〜60代男女)による方言音声。以下の2系統で構成
①対話形式(2話者):約10時間、トランスクリプトなし
②独り語り形式(1話者):約10時間、トランスクリプトあり
収録形態:スタジオ収録(台本に基づきつつ自然な発話リズムを含む構成)
属性:方言の種類(広島弁・大阪弁・関西弁・岡山弁・伊予弁・土佐弁等、随時拡充)/音声レート(44.1kHz・48kHz、16・24bit)

ライセンス

提供するデータは、適法・適正に取得したものであり、著作権を保有または権利者から利用許諾を受けていることを、提供契約で保証します。AI学習を含む利用の用途・範囲は、ライセンス規約で事前にご確認いただけます。

備考

独り語り形式(1話者)のデータにはトランスクリプトが付属し、対話形式(2話者)は音声のみでの提供となります。音声のビットレート等のメタ情報もあわせて提供可能です。

FAQ

Q. このデータセットは商用のAIモデル学習に利用できますか?

A. ご利用の可否・範囲はライセンス規約に基づき事前にご確認いただけます。詳細は https://qleandataset.visual-bank.co.jp/legal/terms-and-conditions をご覧ください。

Q. どの方言が収録されていますか?
A. 広島弁・大阪弁・関西弁・岡山弁・伊予弁・土佐弁などを収録しており、対応方言は随時拡充中です。ご希望の方言がある場合はご相談ください。

Q. トランスクリプトは付属しますか?
A. 独り語り形式(1話者)のデータにはトランスクリプトが付属します。対話形式(2話者)は音声のみでの提供となります。

Q. 対話形式・独り語り形式のどちらか一方だけを入手できますか?
A. はい、それぞれ収録データセットの単位で分かれています。ご希望の形式に近いデータセットをご案内しますので、要件をお聞かせください。

Q. サンプルは請求できますか?

A. サンプルはこのページ内のフォームからご請求ください。

2827a38c-b8f1-4b18-826e-96368b6e1dc5

FREE SAMPLE

サンプルデータの

お申し込み

音声 AIデータレシピ

株式会社アマナイメージズ

Visual Bank株式会社


© amanaimages inc.