Saltar al contenido principal
AIDive
ES
Iniciar sesión
Volver al glosario

Qué es el reconocimiento automático del habla (ASR)

Procesamiento del lenguaje natural

Tecnología que convierte el habla en texto mediante procesamiento de audio y modelos de lenguaje.

Definición

El reconocimiento automático del habla (ASR) se usa en subtitulado, asistentes de voz, dictado, análisis de llamadas, actas de reuniones y accesibilidad del contenido. El sistema debe procesar el sonido, separar el habla del ruido, reconocer las palabras y unirlas en un texto con sentido.

Ejemplo

Después de una reunión en línea, el servicio crea automáticamente una transcripción de la conversación y un breve resumen.

Por qué importa

El término es importante para quienes buscan herramientas de transcripción, dictado por voz, análisis de llamadas o subtitulado.

Cómo funciona

El sistema analiza la señal de audio, extrae características del habla, las compara con palabras probables y usa el contexto para seleccionar la frase más plausible.

Dónde se usa

  • transcripción
  • subtítulos
  • asistentes de voz y centros de llamadas

Limitaciones

La calidad depende del idioma, el acento, el ruido, el micrófono, las voces superpuestas y la terminología especializada.

FAQ

¿Por qué es útil conocer “Automatic Speech Recognition (ASR)”?

El término es importante para usuarios que buscan herramientas de transcripción, escritura por voz, análisis de llamadas o creación de subtítulos.