Khmer Conversational Speech Dataset – Approx. 1,500 Hours

なし
評価:なし
  • ETHOM TECH・
  • Masataka Saito / saito@ethomtech.com / +855 92 528 375

さんをブラックリストに追加

概要

Khmer Conversational Speech Dataset – Approx. 1,500 Hours(さん)のメインイメージ

カンボジアで2023年以降に実際のECカスタマーサービス業務を通じて蓄積された、クメール語を中心とする自然発話・非台本型の顧客-カスタマーサービス会話音声データセット。推定約1,500時間、顧客話者約30,000人。商品問い合わせ、注文、使用方法、トラブルシューティング等の実会話を含み、顧客/CSの話者役割と会話順序を保持。クメール語・英語の自然なコードスイッチングを含む。

データの属性

フィールド 値
データセット名 Khmer Conversational Speech Dataset – Approx. 1,500 Hours
連絡先 Masataka Saito / saito@ethomtech.com / +855 92 528 375
作成者 ETHOM TECH
タグ Khmer, Speech, Conversational Speech, Audio, Customer Service, Cambodia, AI Training Data
作成日 2023
リリース日 2026年9月29日
作成頻度 Continuously collected since 2023
最終更新日 2026年9月29日

お問い合わせには会員登録とログインが必要です。


※サンプルのリクエストもこちら

対象地域

  • 全国

データ調査年数

著作権

コピーライト ETHOM TECH

価格

データ提供元

提供組織名 ETHOM TECH
提供組織が所属する国 日本以外

提供方法

提供方法

ライセンス契約成立後、クラウドストレージ等を利用して提供。音声ファイル、会話単位の構造、TSV/JSONL形式のマニフェスト、メタデータ、利用可能な文字起こしを提供可能。評価用サンプルあり。

データ形式

Audio (MP4/OGG etc.), TSV, JSONL, TXT

用途

AI学習、音声認識(ASR)、Speech AI、Conversational AI、Voice Agent、言語モデル・音声モデルの学習・評価等。

データカテゴリー

  • IT・サイエンス

関連データセット

よくあるQ&A

お問い合わせ
※サンプルのリクエストもこちら

Entry

今すぐ無料ではじめる

Flow

ご利用の流れ

1.会員登録

任意のIDとパスワードを設定し、DataMartの新規会員登録を行う。

2.データセット検索

カテゴリ一覧もしくはフィルタを利用してデータセットを探す。

3.購入前に

求めるデータセットの一部サンプルを確認し、データセットの使用用途を記述し、リクエストを送る。

4.購入

リクエストが承認されると、希望のデータセットを購入する。