Conjunto de datos de voz

Conjunto de datos coreano

한국어 데이터셋

Conjunto de datos de alta calidad de centros de llamadas coreanos, monólogos con guion y medios (pódcast) para modelos de IA y voz.

Conjunto de datos coreano

Resumen

  • IdiomaCoreano
  • Tipos de conjuntos de datosCentro de llamadas, podcast, monólogo con guion
  • PaísKorea

Mareas Ideales para Lecciones

Este conjunto de datos incluye conversaciones telefónicas sintéticas sin guión entre agente y cliente (5 a 15 minutos), archivos de audio y video de dominio público con licencia, como entrevistas y podcasts con 1 a 5 participantes (15 a 60 minutos), y monólogos con guión que presentan a un solo orador que ofrece contenido predefinido para el entrenamiento de modelos de habla y lenguaje.

Aspectos destacados del conjunto de datos

  • IdiomaCoreano
  • Frecuencia de muestreo16 kHz / 24 kHz / 48 kHz / 8 kHz
  • Horas totales2761:14:49
  • Speakers:1,641+
  • CanalesDoble / Mono
  • Rango de duración5 - 60 minutos

Casos de uso

  • ASR (Reconocimiento automático de voz)
  • Asistentes virtuales y chatbots
  • AI conversacional
  • Speech Analytics
  • TTS (Texto a voz)
  • Modelado del lenguaje

Especificaciones del conjunto de datos de muestra

Tipo de conjunto de datosCall CenterDatos de mediosMonólogo guionadoMonólogo guionado
Tasa de muestreo8 kHz16 kHz24 kHz48 kHz
Speakers:2 OradoresVarios altavocesAltavoz individualAltavoz individual
ChannelDual MonoMonoMono
Horas totales102:27:55203:46:54500:00:001,955:00:00
Número total de oradores1,244397Bajo DemandaBajo Demanda

Beneficios principales

  • Diversidad y representatividadAmplia cobertura de ponentes para una IA inclusiva y aplicada al mundo real.
  • Audio de alta calidadGrabaciones nítidas y equilibradas para un rendimiento fiable del modelo.
  • Preparado para IA/MLEstructurado y anotado para una integración perfecta.
  • Escalable y flexibleDisponemos de múltiples duraciones, ponentes y ámbitos para adaptarnos a sus necesidades.

Clientes destacados

Cuenta con la confianza de los principales equipos y empresas de IA de todo el mundo.

  • Microsoft
  • Amazon Web Services
  • Google

¿No encuentras lo que estás buscando?

Se recopilan nuevos conjuntos de datos listos para usar en todos los tipos de datos

Contáctenos ahora para dejar de lado sus preocupaciones sobre la recopilación de datos de entrenamiento de audio/voz

  • Este campo es para fines de validación y debe dejarse sin cambios.
  • Al registrarme, estoy de acuerdo con Shaip Política de privacidad y Términos de Servicio y dar mi consentimiento para recibir comunicaciones de marketing B2B de Shaip.