音声データセット

ドグリ データセット

AI および音声モデル向けの高品質な Dogri 一般会話および TTS データセット

ドグリ データセット

概要

  • 言語ドグリ
  • データセットの種類一般会話、TTS
  • India

詳細説明

台本なしの合成電話会話(「話者1」と「話者2」の間)、音声の長さ(目安)は5~15分。

データセットのハイライト

  • 言語ドグリ
  • サンプリング速度16kHz/44kHz
  • 合計時間250時間
  • チャネルMono
  • 期間範囲5~15分

適用例

  • 政治
  • 時事
  • ローカルニュース
  • 宗教
  • 経済と金融
  • と観光

サンプルデータセットの仕様

データセットのタイプ一般的な会話TTS
サンプリング・レート44kHz16kHz
チャネルMonoMono
合計時間50時間200時間

主なメリット

  • 多様性と代表性包括的で実践的なAIに関する幅広い講演者による解説。
  • 高品質のオーディオモデルの性能を確実に引き出すために、クリアでバランスの取れた録音を実現します。
  • AI/ML対応準備完了シームレスな統合のために、構造化され、注釈が付けられています。
  • 柔軟かつ拡張性のあるサービス設計お客様のニーズに合わせて、複数の期間、講演者、分野をご用意しています。

技術仕様

  • レコーディングプラットフォームモバイルアプリ
  • オーディオ形式wavファイル
  • 音声文字変換フォーマット.json
  • WER(%)5
  • 年齢層18-50

注目のクライアント

世界中の主要なAIチームや企業から信頼されています。

  • Microsoft
  • Amazon Webサービス
  • グーグル

探しているものが見つかりませんか?

新しい既製のデータセットがすべてのデータ タイプにわたって収集されています

オーディオ/スピーチトレーニングデータ収集の心配を手放すために今すぐお問い合わせください

  • このフィールドは、検証目的のためであり、不変のままにする必要があります。
  • 登録することで、Shaipに同意します プライバシーポリシー (NAIST) と 利用規約 ShaipからB2Bマーケティングコミュニケーションを受け取ることに同意します。