Hugging Face公式アカウント開設および日本語音声対話データセット公開のお知らせ

株式会社イングクラウドは、AI・機械学習分野におけるデータ収集・データセット作成の取り組みをご紹介するため、Hugging Faceに公式アカウントを開設し、日本語音声対話データセットのサンプルを公開しました。

今回公開したデータセットには、2名による日本語対話の音声データに加え、話者ごとに分離した音声データ、ELAN(.eaf)形式の時間情報付き書き起こしデータが含まれています。書き起こしおよびアノテーションは人手で作成しています。

現在、以下の2種類を公開しています。

Japanese Travel Agency Multimodal Dialogue Corpus

旅行代理店での相談場面を想定し、スタッフ役と顧客役によるロールプレイ形式で収録した日本語対話データセットです。

  • 2話者のミックス音声
  • 話者ごとの分離音声
  • ELAN形式の時間情報付き書き起こし
  • 全10対話

データセットを見る

Japanese Themed Casual Conversation Corpus

あらかじめ設定したテーマについて、2名の参加者が会話する形式で収録した日本語雑談対話データセットです。日常的な話題から知識に関する話題まで、さまざまなテーマの対話を収録しています。

  • 2話者のミックス音声
  • 話者ごとの分離音声
  • ELAN形式の時間情報付き書き起こし
  • 現在6対話を公開(全10対話を順次公開予定)

データセットを見る

これらは、当社が対応可能な日本語音声データの収集、収録、書き起こし、アノテーションおよびデータセット作成のサンプルとして公開しているものです。

株式会社イングクラウドでは、研究・開発の目的や仕様に合わせた音声、対話、画像、動画、テキスト等のデータ収集から、アノテーション、品質管理、納品用データセットの作成まで一貫して対応しています。

大学・研究機関における学術研究や、企業におけるAI・機械学習モデルの研究開発など、用途に応じたデータ制作についてお気軽にご相談ください。

IngCrowd公式Hugging Faceアカウント