2025.11.12

Qlean Dataset、「日本語・2話者のリアルな日常会話音声コーパスデータセット」を提供開始

〜GENIAC採択企業のVisual Bank、日本語によるリアルな日常会話を収録し、音声認識AI・自然言語処理・対話AIの研究開発を支援〜

Visual Bank株式会社(東京都港区、代表取締役CEO 永井真之、以下「Visual Bank」)は、傘下の株式会社アマナイメージズを通じて展開するAI学習用データソリューション『Qlean Dataset(キュリンデータセット)』において、『日本語・2話者・日常会話音声コーパスデータセット』の提供を開始しました。

本データセットは、日本人の2者(家族や友人、職場の同僚など様々なシチュエーション)による実際の日常会話を収録した音声データセットです。収録音声は、自然なテンポや相づち、被り発話を含む構成で、ステレオLR収録(左右チャンネルに話者を割り当て)した高品質なWAV形式で提供します。
恋愛相談、ペット、地域、食べ物などに関する雑談をはじめとする多様な話題を含み、音声認識(Automatic Speech Recognition、以下ASR)や自然言語処理(Natural Language Processing、以下NLP)、会話理解モデルの学習データとして幅広くご活用いただけます。また、音声入力を含む生成AI基盤(マルチモーダルAI・音声LLMなど)の学習・検証データとしても有効にご利用いただけます。

今回提供を開始する「日本語・2話者・日常会話音声コーパスデータセット」の概要

被写体属性 

20代〜40代の男女

データ形式 

wav

収録時間

数100時間

音声条件

 LR分離

対象のシーン

家族・友人・職場の同僚など、身近な関係性の中で交わされる自然な日常会話を収録※台本なし

主な話題

恋愛相談、ペットの相談、食べ物や地方についての雑談 など

サンプル

https://qleandataset.visual-bank.co.jp/lineup/pn-022

「日本語・2話者・日常会話音声コーパスデータセット」ユースケースイメージ 

【1. 音声認識・自然会話理解AIの開発】 

  • 自然発話に対応した音声認識モデルの学習
    被り発話や相づち、イントネーションの揺れを含む自然な日常会話音声を用いることで、実環境に近い条件での音声認識(ASR)モデルの精度向上にご活用いただけます。
    スマートデバイスや音声アシスタントなど、実利用を前提とした会話音声認識の性能評価にも適しています。

  •  会話文脈理解・発話意図推定AIの開発
    台本なしのリアルな対話データをもとに、話題転換や省略表現を含む文脈理解モデルの検証が可能です。
    自然言語処理(NLP)領域での対話要約・会話要素抽出・発話意図推定などの研究に有効です。

 【2. 感情・コミュニケーション解析AIの研究】 

  • 感情認識・発話行動分析
    発話速度・抑揚・沈黙などの特徴を保持しており、感情推定や心理状態の分類を目的とした感情理解AIの研究に活用できます。
    また、笑い声や相づちのタイミングなど、人間的な会話の間合いを解析するコミュニケーション分析にも利用可能です。

  •  会話スキル評価・対話教育への応用
    発話内容と応答の流れを解析することで、対話能力評価やスピーキング教育AIなど、言語学習支援システムの開発にも活用いただけます。

 【3. 実環境データを用いたAI応用・社会実装】 

  • 会話要約・自動議事録生成AIの検証
    家庭・職場・友人など多様な会話内容を含むため、対話の要約・構造化・情報抽出を行うモデルの検証データとして利用可能です。
    カスタマーサポートやコールログ解析などの業務AIにも応用いただけます。

  •  ヒューマン・インタラクション研究
    発話タイミングや応答傾向を分析し、人間同士の会話特性を再現するインタラクションモデルの開発に活用できます。
    ソーシャルロボティクスや教育支援AIなど、人とAIの自然な対話設計にも有用です。

『Qlean Dataset(キュリンデータセット)』について

『Qlean Dataset』は、Visual Bank傘下の株式会社アマナイメージズが提供する商用利用可能なAI学習用データソリューションです。
画像・動画・音声・3D・テキストなど、多様な形式のデータに対応し、研究・商用いずれの用途でも安全に利用できる環境を整備しています。
また、株式会社千葉ロッテマリーンズや株式会社東洋経済新報社をはじめとするデータパートナーとの協業を通じ、業界特化・最新トレンドに即したデータラインナップ「AIデータレシピ」を継続的に拡充しています。
Qlean Datasetは、AI開発現場におけるデータ収集・整備の負荷を軽減し、権利クリアで法的リスクのないAI開発環境の構築を支援します。
▶ Qlean Datasetサイト:https://qleandataset.visual-bank.co.jp/
▶ AIデータレシピ:https://qleandataset.visual-bank.co.jp/lineup

Qlean Datasetの特長 

  • すべての被写体から同意取得・国際法規(GDPR/CCPA)準拠 

  • 既存データは最短1日で納品可能 

  • カスタム撮影・収録・収集による独自データ構築にも対応

▶ お問い合わせ:https://qleandataset.visual-bank.co.jp/contact

Visual Bank株式会社

AI開発力を最大化する次世代型データインフラを構築・提供するスタートアップ企業として、「あらゆるデータの可能性を解き放つ」をミッションに掲げ事業活動を展開。漫画家の「もっと描きたい!」をサポートするAI補助ツールを提供する『THE PEN』の他、AI学習用データセット開発サービス『Qlean Dataset(キュリンデータセット)』を提供する株式会社アマナイメージズを100%子会社に持つ。

また、Visual Bankは国の研究開発プログラム「GENIAC」にも採択され、社会実装に向けた取り組みを加速させています。

代表取締役CEO:永井 真之
所在地:〒107-0062 東京都港区南青山7-1-7C-Cube南青山ビル6F
Visual Bank企業URL:https://visual-bank.co.jp/
アマナイメージズ企業URL: https://amanaimages.com/about/

  • 音声データセット

株式会社アマナイメージズ

Visual Bank株式会社


© amanaimages inc.