Conjunto de datos de voz

Conjunto de datos telugu

తెలుగు డేటాసెట్‌లు

Conjunto de datos de alta calidad de centros de llamadas en telugu, conversaciones generales, monólogos con guion y medios (pódcast) para modelos de IA y voz.

Conjunto de datos telugu

Resumen

  • Idiomatelugu
  • Tipos de conjuntos de datosCentro de llamadas, conversación general, podcast, monólogo con guion
  • PaísIndia

Mareas Ideales para Lecciones

Este conjunto de datos incluye conversaciones sintéticas sin guión entre agente y cliente (5 a 15 minutos), conversaciones telefónicas naturales entre humanos (15 a 60 minutos) y datos multimedia con transcripciones, que ofrecen diversos datos de habla para entrenar y evaluar tecnologías de habla y lenguaje.

Aspectos destacados del conjunto de datos

  • Idiomatelugu
  • Frecuencia de muestreo16kHz/24kHz/8kHz
  • Horas totales3083:04:59
  • Speakers:3,327+
  • CanalesDoble / Mono
  • Rango de duración5 - 60 minutos

Casos de uso

  • ASR (Reconocimiento automático de voz)
  • Asistentes virtuales y chatbots
  • AI conversacional
  • Speech Analytics
  • TTS (Texto a voz)
  • Modelado del lenguaje

Especificaciones del conjunto de datos de muestra

Tipo de conjunto de datosCall CenterConversacion generalDatos de mediosMonólogo guionado
Tasa de muestreo8 kHz8 kHz16 kHz24 kHz
Speakers:2 Oradores2 OradoresVarios altavocesAltavoz individual
ChannelDual Dual MonoMono
Horas totales62:32:27654:08:03666:24:291,700:00:00
Número total de oradores4961,6011,230Bajo Demanda

Beneficios principales

  • Diversidad y representatividadAmplia cobertura de ponentes para una IA inclusiva y aplicada al mundo real.
  • Audio de alta calidadGrabaciones nítidas y equilibradas para un rendimiento fiable del modelo.
  • Preparado para IA/MLEstructurado y anotado para una integración perfecta.
  • Escalable y flexibleDisponemos de múltiples duraciones, ponentes y ámbitos para adaptarnos a sus necesidades.

Clientes destacados

Cuenta con la confianza de los principales equipos y empresas de IA de todo el mundo.

  • Microsoft
  • Amazon Web Services
  • Google

¿No encuentras lo que estás buscando?

Se recopilan nuevos conjuntos de datos listos para usar en todos los tipos de datos

Contáctenos ahora para dejar de lado sus preocupaciones sobre la recopilación de datos de entrenamiento de audio/voz

  • Este campo es para fines de validación y debe dejarse sin cambios.
  • Al registrarme, estoy de acuerdo con Shaip Política de privacidad y Términos de Servicio y dar mi consentimiento para recibir comunicaciones de marketing B2B de Shaip.