概要

カンボジアで2023年以降に実際のECカスタマーサービス業務を通じて蓄積された、クメール語を中心とする自然発話・非台本型の顧客-カスタマーサービス会話音声データセット。推定約1,500時間、顧客話者約30,000人。商品問い合わせ、注文、使用方法、トラブルシューティング等の実会話を含み、顧客/CSの話者役割と会話順序を保持。クメール語・英語の自然なコードスイッチングを含む。
データの属性
| フィールド | 値 |
|---|---|
| データセット名 | Khmer Conversational Speech Dataset – Approx. 1,500 Hours |
| 連絡先 | Masataka Saito / saito@ethomtech.com / +855 92 528 375 |
| 作成者 | ETHOM TECH |
| タグ | Khmer, Speech, Conversational Speech, Audio, Customer Service, Cambodia, AI Training Data |
| 作成日 | 2023 |
| リリース日 | 2026年9月29日 |
| 作成頻度 | Continuously collected since 2023 |
| 最終更新日 | 2026年9月29日 |
対象地域
データ調査年数
著作権
| コピーライト | ETHOM TECH |
|---|
価格
データ提供元
| 提供組織名 | ETHOM TECH |
|---|---|
| 提供組織が所属する国 | 日本以外 |
提供方法
提供方法
ライセンス契約成立後、クラウドストレージ等を利用して提供。音声ファイル、会話単位の構造、TSV/JSONL形式のマニフェスト、メタデータ、利用可能な文字起こしを提供可能。評価用サンプルあり。データ形式
Audio (MP4/OGG etc.), TSV, JSONL, TXT用途
AI学習、音声認識(ASR)、Speech AI、Conversational AI、Voice Agent、言語モデル・音声モデルの学習・評価等。データカテゴリー
関連データセット
今すぐ無料ではじめる
ご利用の流れ
任意のIDとパスワードを設定し、DataMartの新規会員登録を行う。
カテゴリ一覧もしくはフィルタを利用してデータセットを探す。
求めるデータセットの一部サンプルを確認し、データセットの使用用途を記述し、リクエストを送る。
リクエストが承認されると、希望のデータセットを購入する。