2025.11.20

Qlean Dataset、「日本語・1話者・伝統芸能音声コーパスデータセット」を提供開始

〜GENIAC採択企業のVisual Bank、音声認識AI・自然発話理解・生成AI基盤モデルの開発を支援〜

Visual Bank株式会社(東京都港区、代表取締役CEO 永井真之、以下「Visual Bank」)は、傘下の株式会社アマナイメージズを通じて展開するAI学習用データソリューション『Qlean Dataset(キュリンデータセット)』において、『日本語・1話者・伝統芸能音声コーパスデータセット』の提供を開始しました。

本データセットは、落語家による実演音声を収録した1話者構成の音声データセットです。冒頭の出囃子を含む一連の語りを約15〜30分の長尺で収録し、落語特有のリズム・間・抑揚、さらに会場における笑い声・拍手などの環境音をそのまま含む構成が特徴です。音声認識(Automatic Speech Recognition、以下ASR)、自然発話理解、音声生成モデルなどの研究・開発における学習および検証データとして活用いただけます。

実演環境で収録された自然音声データであるため、AIモデルの汎化性能評価や実運用を想定した音声処理技術の検証に適しています。研究用途から産業利用、教育・文化領域まで幅広い場面で活用可能であり、日本語音声理解AIの高度化を支援するデータとしてご利用いただけます。

今回提供を開始する「日本語・1話者・伝統芸能音声コーパスデータセット」の概要

データ種別

音声

被写体属性

伝統芸能をされている方

データ形式

mp3

収録時間

計約500時間(1音声15分〜30分ほど)

収録環境

屋内(会場)

対象のシーン

伝統芸能の高座における実演場面(古典落語・新作落語など複数の演目ジャンルを含む)

サンプルページ

https://qleandataset.visual-bank.co.jp/lineup/pn-021

「日本語・1話者・伝統芸能音声コーパスデータセット」ユースケースイメージ

 【1. 音声認識・自然発話理解AIの開発】 

  • 自然発話に対応した音声認識(ASR)モデルの学習 

    長尺の語り、話速の揺れ、間の取り方、抑揚の変化など、伝統芸能特有の自然発話を含むため、実運用環境に近い条件でASRモデルの精度向上に活用できます。
    笑い声や拍手などの環境音を含むことから、ノイズロバスト性の検証にも適しています。

  • 長尺音声の文脈理解モデルの開発 

    約15〜30分の連続した語り構造を収録しているため、長尺音声のセグメンテーション、ストーリー理解、音声要約モデルの学習・検証に有効です。
    物語構造に沿った発話を対象とするため、自然言語処理(Natural Language Processing、以下NLP)領域の文脈把握モデルの評価にも適用できます。

 【2. 音響・コミュニケーション解析AIの研究】 

  • 音響イベント検知・環境音解析 

    会場の笑い声や拍手など複数の音響イベントが含まれるため、音響イベント分類、環境音検知、音源識別モデルの基礎データとして利用できます。

  • 発話スタイル・プロソディ(韻律)解析 

    伝統芸能特有の“間”、“テンポの緩急”、“抑揚”が収録されており、音声プロソディ分析、話者スタイル推定、音声特徴量の時系列解析研究に活用できます。

 【3. 音声生成・表現AIへの応用】 

  • 音声合成(TTS)・音声スタイル変換の学習 

    出囃子による導入から語りが進行する構成や、抑揚・強弱の多様な変化を含むため、自然で豊かな表現力を持つ音声生成モデルの学習素材として適しています。

  • 表現力の強い音声データを対象とした生成AI基盤研究 

    朗読とは異なるリズムや演じ分けが含まれており、多様な音声表現を必要とする生成AIの学習・評価に活用できます。

 【4. 文化・教育領域での応用】 

  • 日本語教育・リスニング教材の開発 

    明瞭な語り口調と豊かな抑揚を含むため、日本語教育におけるリスニング教材、発話特徴理解教材の開発にも利用可能です。

  • 演芸・舞台アーカイブの自動解析 

    高座における実演音声としてアーカイブ価値が高く、自動タグ付け・構造化処理・演目分類研究などの文化データ解析に活用できます。

 【5. 実環境データを用いたAI応用・社会実装】 

  • ノイズ環境下での音声処理AIの検証 

    会場環境音を含むため、音声強調、ノイズリダクション、音源分離などの技術検証に適しています。

  • デジタルアーカイブ検索・音声インデックスモデルの評価 

    長尺音声に対するキーワード検索、構造化処理、メタデータ生成など、情報アクセス技術の評価にも利用できます。

『Qlean Dateset(キュリンデータセット)』について

『Qlean Dataset』は、Visual Bank傘下の株式会社アマナイメージズが提供する商用利用可能なAI学習用データソリューションです。
画像・動画・音声・3D・テキストなど、多様な形式のデータに対応し、研究・商用いずれの用途でも安全に利用できる環境を整備しています。

また、株式会社千葉ロッテマリーンズや株式会社東洋経済新報社をはじめとするデータパートナーとの協業を通じ、業界特化・最新トレンドに即したデータラインナップ「AIデータレシピ」を継続的に拡充しています。

Qlean Datasetは、AI開発現場におけるデータ収集・整備の負荷を軽減し、権利クリアで法的リスクのないAI開発環境の構築を支援します。

▶ Qlean Datasetサイト:https://qleandataset.visual-bank.co.jp/

▶ AIデータレシピ:https://qleandataset.visual-bank.co.jp/lineup

Qlean Datasetの特長 

  • すべての被写体から同意取得・国際法規(GDPR/CCPA)準拠 

  • 既存データは最短1日で納品可能 

  • カスタム撮影・収録・収集による独自データ構築にも対応

▶ お問い合わせ:https://qleandataset.visual-bank.co.jp/contact

Visual Bank株式会社

AI開発力を最大化する次世代型データインフラを構築・提供するスタートアップ企業として、「あらゆるデータの可能性を解き放つ」をミッションに掲げ事業活動を展開。漫画家の「もっと描きたい!」をサポートするAI補助ツールを提供する『THE PEN』の他、AI学習用データセット開発サービス『Qlean Dataset(キュリンデータセット)』を提供する株式会社アマナイメージズを100%子会社に持つ。

また、Visual Bankは国の研究開発プログラム「GENIAC」にも採択され、社会実装に向けた取り組みを加速させています。

代表取締役CEO:永井 真之
所在地:〒107-0062 東京都港区南青山7-1-7C-Cube南青山ビル6F
Visual Bank企業URL:https://visual-bank.co.jp/
アマナイメージズ企業URL: https://amanaimages.com/about/

  • 音声データセット

株式会社アマナイメージズ

Visual Bank株式会社


© amanaimages inc.