「Datatang株式会社」は現在「Nexdata」のブランドとして事業を展開しています。本サイトより最新のAIデータサービスとソリューションをご案内いたします。

jp

Please fill in your name

Mobile phone format error

Please enter the telephone

Please enter your company name

Please enter your company email

Please enter the data requirement

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

The data requirement cannot be less than 5 words and cannot be pure numbers

300時間フランス語金融音声データセット

フランス語金融音声データセット
フランス語ASR教師データ
金融専門用語コーパス
ドメイン特化フランス語音声データ

弊社では、金融・医療・カスタマーサポートなど、あらゆる業界の実環境音声データに加え、感情認識・多言語対応・多モーダルデータまで幅広く対応いたします。すべて商用利用可能で、モデル学習の初期段階からそのままご活用いただけます。本データセットは、300時間のフランス語金融分野音声データです。マクロ経済・ミクロ経済など、金融専門用語を包括的に収録。窓口対話・電話相談・モノローグなど、実世界の金融インタラクションを口語化コーパスで忠実に反映しています。アノテーションは単語精度98%超を保証。転写テキストに加え、タイムスタンプ・話者分離・性別・環境ノイズ・機密情報ラベルまで詳細に付与。モデルの学習効率と認識精度の最大化に貢献します。収録条件は低ノイズ環境。16kHz/16bit・WAV・モノラル形式で提供するため、前処理負荷を最小限に抑え、ディープラーニングの本質的な特徴抽出を可能にします。さらにGDPR・CCPA・PIPLなどの厳格なデータ保護規制に完全準拠。企業規模のAI開発にも安心してご導入いただけます。さらに、音声データ収集に特化した専門チームとプロジェクト管理チームが在籍。フランス語をはじめ、多言語・多業界に対応したカスタム収集・アノテーションプロジェクトを柔軟に請け負います。納品データは前処理不要で、すぐにモデル訓練へ投入可能。AI開発の効率化と商用化を、ワンストップでサポートいたします。

有料データセット
このデータセットは、商用利用や研究目的などに役立つ有償のデータセットです。著作権ありの既製データセットは、AIプロジェクトの飛躍的なスタートに役立ちます。
仕様データ仕様
フォーマット
16k Hz, 16 bit, wav, モノラルチャンネル
収録条件
低背景ノイズ
言語(地域)コード
fr-FR
アノテーション
書き起こしテキスト、タイムスタンプ、話者識別、性別、ノイズ、機密情報
コンテンツカテゴリ
マクロ経済・ミクロ経済・銀行業務・投資用語など、金融専門用語を包括的に収録。窓口対話・電話相談・モノローグなど、実世界の金融インタラクションを口語化コーパスで忠実に反映。
フランス(FRA)
精度
単語精度率(WAR)98%以上
サンプル サンプル
  • Audio

    Tarifaire pour commencer tout de suite, allez Lionel, je euh, me tourne euh, vers vous.

  • Audio

    Anti-suroptimisation fiscale, le Conseil constitutionnel.[N]

  • Audio

    Pour le programme du jour si on a le temps aussi, on parlera aussi, de l'implication des entreprises.

おすすめデータセットおすすめデータセット
300時間日本語金融自然対話音声データセット

弊社では、会議シーン・金融窓口・カスタマーサポートなど、あらゆる実環境の音声データに加え、感情認識・動作認識・マルチモーダルデータまで幅広く対応いたします。すべて商用利用可能で、モデル学習の初期段階からそのままご活用いただけます。 本データセットは、実世界の金融シーンの多様性を反映した日本語音声データです。窓口対応・電話相談・オンライン対話などの実際のインタラクションを口語化コーパスで収録。金融特有の専門用語や複雑な文脈を自然に含み、ASR・NLPモデルのロバスト性と汎化性能を大幅に向上させます。 アノテーションは98%超の高精度を保証。転写テキストに加え、タイムスタンプ・話者分離・環境ノイズ・機密情報ラベルまで詳細に付与。モデルの学習効率と認識精度の最大化に貢献します。 収録条件は低ノイズ環境。16kHz/16bitのWAVフォーマットで提供するため、前処理負荷を最小限に抑え、ディープラーニングの本質的な特徴抽出を可能にします。さらにGDPR・CCPAなどの厳格なデータ保護規制に完全準拠。企業規模のAI開発にも安心してご導入いただけます。 さらに、音声データ収集に特化した専門チームとプロジェクト管理チームが在籍。金融分野をはじめ、業界固有の用語・シナリオ・言語に対応したカスタム収集・アノテーションプロジェクトを柔軟に請け負います。納品データは前処理不要で、すぐにモデル訓練へ投入可能。AI開発の効率化と商用化を、ワンストップでサポートいたします。

音声認識データセット 日本語音声認識データ 金融分野音声データセット 金融音声データ 金融チャットボット音声データ ドメイン特化日本語音声コーパス
48kHz・579時間高音質・話者分離日本語自然会話音声データセット

本データは、フルデュプレックス(全二重)対話を前提に収録した高品質な日本語音声データセットです。半二重方式では再現が難しい同時発話や重なり発話、自然な相槌や割込みを含み、双方向に同時進行する対話を再現した同時双方向音声データセットとして、リアルタイム対話AIや次世代ASRの研究開発に適しています。本セットは、提示されたトピックリストから収録者が複数の得意分野を選択し、自然な流れで会話を展開して収録した日本語自然会話音声データセットです。日本各地のネイティブ話者による多様な対話を含み、高音質収録によりASRの音響・言語モデル学習、声紋識別、対話システム評価など幅広い研究用途に活用できます。データは各種プライバシー保護規制に準拠して管理されています。当社の全二重音声データセットシリーズは、日本語をはじめ、英語、韓国語など多言語に対応し、書き起こしテキスト、発話タイムスタンプ、話者ID、性別などの詳細アノテーションを標準搭載しています。また、話者ごとの独立音声を含む話者分離音声データセットとしても利用可能で、収録条件や話者属性、ラベル仕様のカスタマイズ収集・作成にも柔軟に対応します。

日本語音声データ 話者分離音声データ 全二重音声データセット 同時双方向音声データセット 日本語自然会話音声データ
423時間フィリピン英語話者分離・自然会話音声データセット

本データは、フルデュプレックス(全二重)対話を前提に収録した高品質なフィリピン英語音声データセットです。半二重方式では再現が難しい同時発話や重なり発話、自然な相槌や割込みを含み、双方向に同時進行する対話を再現した同時双方向音声データセットとして、リアルタイム対話AIや次世代ASRの研究開発に適しています。本セットは、提示されたトピックリストから収録者が複数の得意分野を選択し、自然な流れで会話を展開して収録したフィリピン英語自然会話音声データセットです。約800名のフィリピン現地ネイティブスピーカーによる多様な対話を含み、高音質収録によりASRの音響・言語モデル学習、声紋識別、対話システム評価など幅広い研究用途に活用できます。データは各種プライバシー保護規制に準拠して管理されています。当社の全二重音声データセットシリーズは、日本語をはじめ、英語、韓国語など多言語に対応し、書き起こしテキスト、発話タイムスタンプ、話者ID、性別などの詳細アノテーションを標準搭載しています。また、話者ごとの独立音声を含む話者分離音声データセットとしても利用可能で、収録条件や話者属性、ラベル仕様のカスタマイズ収集・作成にも柔軟に対応します。

英語自然会話音声データセット フィリピン英語音声データ フィリピン英語話者分離音声データ
172時間話者分離アメリカ英語自然会話音声データセット

本データは、フルデュプレックス(全二重)対話を前提にスマートフォンで収録した高品質な英語(米国)の音声データセットです。半二重方式では再現が難しい同時発話や重なり発話、自然な相槌や割込みを含み、双方向に同時進行する対話を再現した同時双方向音声データセットとして、リアルタイム対話AIや次世代ASRの研究開発に適しています。本セットは、提示されたトピックリストから収録者が複数の得意分野を選択し、自然な流れで会話を展開して収録した英語(米国)の自然会話音声データセットです。米国内の多様な地域・文化背景を持つネイティブ話者による対話を含み、スマートフォン収録による実使用環境に近い音声として、ASRの音響・言語モデル学習、声紋識別、対話システム評価など幅広い研究用途に活用できます。データは各種プライバシー保護規制に準拠して管理されています。当社の全双工音声シリーズは、多言語に対応した全二重音声データセットとして提供され、書き起こしテキスト、発話タイムスタンプ、話者ID、性別などの詳細アノテーションを標準搭載しています。また、話者ごとの独立音声を含む話者分離音声データセットとしても利用可能で、収録条件や話者属性、ラベル仕様のカスタマイズにも柔軟に対応します。

英語音声データセット アメリカ英語音声会話データ 話者分離音声データセット 全二重音声データセット
200時間韓国語話者分離・自然会話音声データセット

本データは、フルデュプレックス(全二重)対話を前提に収録した高品質な韓国語音声データセットです。半二重方式では再現が難しい同時発話や重なり発話、自然な相槌や割込みを含み、双方向に同時進行する対話を再現した同時双方向音声データセットとして、リアルタイム対話AIや次世代ASRの研究開発に適しています。本セットは、提示されたトピックリストから収録者が複数の得意分野を選択し、自然な流れで会話を展開して収録した韓国語自然会話音声データセットです。約200名の韓国ネイティブスピーカーによる多様な対話を含み、高音質収録によりASRの音響・言語モデル学習、声紋識別、対話システム評価など幅広い研究用途に活用できます。データは各種プライバシー保護規制に準拠して管理されています。当社の全二重音声データセットシリーズは、日本語をはじめ、英語、韓国語など多言語に対応し、書き起こしテキスト、発話タイムスタンプ、話者ID、性別などの詳細アノテーションを標準搭載しています。また、話者ごとの独立音声を含む話者分離音声データセットとしても利用可能で、収録条件や話者属性、ラベル仕様のカスタマイズ収集・作成にも柔軟に対応します。

韓国語音声データセット 韓国語自然会話音声データ 韓国語話者分離音声データ 韓国語音声認識データ
205時間話者分離日本語自然会話音声データセット

本データは、フルデュプレックス(全二重)対話を前提に収録した高品質な日本語音声データセットです。有効時間205時間。半二重方式では再現が難しい同時発話や重なり発話、自然な相槌や割込みを含み、双方向に同時進行する対話を再現した同時双方向音声データセットとして、リアルタイム対話AIや次世代ASRの研究開発に適しています。そして、本セットは提示されたトピックリストから収録者が複数の得意分野を選択し、自然な流れで会話を展開して収録した日本語自然会話音声データセットです。日本各地のネイティブ話者による多様な対話を含み、高音質収録によりASRの音響・言語モデル学習、声紋識別、対話システム評価など幅広い研究用途に活用できます。データは各種プライバシー保護規制に準拠して管理されています。 当社の全二重音声データセットシリーズは、日本語をはじめ、英語、韓国語など多言語に対応し、書き起こしテキスト、発話タイムスタンプ、話者ID、性別などの詳細アノテーションを標準搭載しています。また、話者ごとの独立音声を含む話者分離音声データセットとしても利用可能で、収録条件や話者属性、ラベル仕様のカスタマイズ収集・作成にも柔軟に対応します。

日本語音声データ 話者分離音声データ 全二重音声データセット 同時双方向音声データセット 日本語自然会話音声データ
ご要望をご相談ください

プロジェクトの成熟度

初期検討段階(具体的な仕様は未定)
目標は明確だが、専門的な支援が必要
開発中または最適化フェーズ
データ/アノテーションの専門チーム(明確な仕様あり)

プライバシー保護 に同意する

よくあるご質問

日本語の音声認識データにはどのようなバリエーションがありますか?

子どもの日常会話、モノローグ、講義、バラエティなど幅広いジャンルを含むリアルな対話音声が収録されており、話者 ID、性別、年齢、アクセントなどもアノテーションされています。

データの多様性は実際のユースケースに役立ちますか?

はい、リアルな対話と幅広い話者属性を収録しており、日本のさまざまな環境での音声認識モデルに対応可能です。

納品までのスピードはどの程度ですか?

既製データセットは最短1日で納品可能で、カスタム収集・アノテーションも迅速対応可能です。

8b9cc1af-c033-4ddc-ba02-d864548b7b45

a15b6ef3-1434-42c9-ae41-43d41c694f8b