💬

Servicios de Lenguaje Natural

Servicios de AWS para procesamiento de lenguaje natural

⏱️ Tiempo estimado de lectura: 20 minutos

Amazon Comprehend

Servicio de procesamiento de lenguaje natural (NLP) que usa ML para extraer insights de texto.

Capacidades Principales



Análisis de Sentimientos


- Determina si el texto es positivo, negativo, neutral o mixto
- Puntuación de confianza para cada sentimiento
- Útil para análisis de opiniones de clientes

Extracción de Entidades


Identifica y categoriza entidades:
- Personas: Nombres de individuos
- Lugares: Ubicaciones geográficas
- Organizaciones: Empresas, instituciones
- Fechas: Referencias temporales
- Cantidades: Números, porcentajes
- Eventos: Acontecimientos

Detección de Idioma


- Identifica el idioma principal del texto
- Soporta más de 100 idiomas

Extracción de Frases Clave


- Identifica términos y frases importantes
- Útil para resúmenes y categorización

Análisis de Sintaxis


- Part-of-speech tagging (verbos, sustantivos, etc.)
- Análisis gramatical

Modelado de Temas


- Descubre temas en colecciones de documentos
- Agrupa documentos por tema

Clasificación de Documentos


- Predefinida: Categorías estándar
- Personalizada: Entrena con tus propias categorías

Detección de PII (Información Personal Identificable)


- Encuentra datos sensibles:
- Nombres
- Direcciones
- Números de tarjetas de crédito
- SSN, pasaportes
- Opción de redacción automática

Amazon Comprehend Medical



Especializado en textos médicos:
- Extrae información médica
- Identifica condiciones, medicamentos, dosis
- Detecta datos protegidos por HIPAA
- Comprende ontologías médicas (ICD-10, RxNorm)

Casos de Uso


- Análisis de feedback de clientes
- Categorización automática de tickets
- Análisis de redes sociales
- Búsqueda inteligente en documentos
- Cumplimiento y privacidad de datos
- Análisis de registros médicos

Puntos Clave

  • Comprehend es útil para análisis rápido de texto sin entrenar modelos personalizados
  • Verificar detección de idioma y adaptar tokenizers/vocabularios para idiomas específicos
  • Usar Comprehend Medical para datos clínicos y cumplir regulaciones
  • Medir precisión de extracción de entidades en textos reales del dominio
  • Combinar servicios (Transcribe -> Comprehend -> Translate) para pipelines multilingües

Amazon Lex y Servicios Conversacionales

Servicio para construir interfaces conversacionales (chatbots) usando voz y texto.

Características



Reconocimiento de Voz (ASR)


- Convierte voz en texto
- Misma tecnología que Alexa

Comprensión de Lenguaje Natural (NLU)


- Interpreta la intención del usuario
- Extrae información relevante (slots)

Gestión de Diálogos


- Mantiene contexto de conversación
- Maneja múltiples turnos
- Confirmaciones y aclaraciones

Integración


- AWS Lambda para lógica de negocio
- Amazon Connect para centros de contacto
- Múltiples canales (web, móvil, Slack, Facebook)

Conceptos Clave



Intents (Intenciones):
- Acciones que el usuario desea realizar
- Ejemplo: ReservarVuelo, ConsultarSaldo

Utterances (Expresiones):
- Frases que los usuarios dicen
- Ejemplo: 'Quiero reservar un vuelo'

Slots:
- Variables a extraer del usuario
- Ejemplo: ciudad_origen, ciudad_destino, fecha

Fulfillment:
- Lógica para cumplir la intención
- Típicamente una función Lambda

Casos de Uso


- Chatbots de servicio al cliente
- Asistentes virtuales empresariales
- Automatización de centros de contacto
- Sistemas de reservas
- FAQ automatizadas

Amazon Lex V2



Mejoras recientes:
- Mejor comprensión contextual
- Soporte para conversaciones más complejas
- Streaming de audio
- Precios más predecibles

Puntos Clave

  • Lex es adecuado para flujos conversacionales estructurados; Bedrock/LLMs son mejores para respuestas abiertas
  • Integrar Lambda para fulfillment y lógica de negocio segura
  • Probar con conversaciones reales y manejar estados y contextos largos
  • Gestionar escalabilidad y costos de llamadas simultáneas
  • Medir experiencia de usuario (turns-to-resolution, tasa de fallback)

Servicios de Voz y Traducción

Amazon Polly



Conversión de texto a voz (TTS)

Características:


- Voces neuronales de alta calidad
- Soporte para 60+ idiomas
- Voces estándar y neuronales
- SSML (Speech Synthesis Markup Language)
- Control de pronunciación
- Pausas, énfasis, velocidad
- Efectos de audio

Casos de uso:


- Aplicaciones de lectura
- Asistentes virtuales
- Accesibilidad
- E-learning
- IVR (sistemas telefónicos)
- Narración de contenido

Características Avanzadas:


- Newscaster style: Estilo de presentador de noticias
- Brand Voice: Voces personalizadas para empresas
- Lexicons: Pronunciación personalizada

Amazon Transcribe



Conversión de voz a texto (STT)

Características:


- Reconocimiento automático de voz
- Identificación de hablantes
- Timestamping automático
- Vocabularios personalizados
- Filtrado de vocabulario (palabras prohibidas)
- Redacción automática de PII

Transcribe Medical:


- Especializado en terminología médica
- Transcripción de consultas médicas
- Cumplimiento HIPAA

Transcribe Call Analytics:


- Análisis de llamadas de centros de contacto
- Detección de sentimiento
- Identificación de problemas
- Métricas de conversación

Casos de uso:


- Subtítulos para videos
- Transcripción de reuniones
- Análisis de llamadas
- Documentación médica
- Búsqueda en contenido de audio

Amazon Translate



Traducción neuronal automática

Características:


- Traducción en tiempo real
- Soporte para 75+ idiomas
- Traducción de documentos completos
- Terminología personalizada
- Traducción por lotes

Active Custom Translation:


- Entrena modelos con tus propios datos
- Terminología específica del dominio
- Mejor calidad para casos especializados

Casos de uso:


- Localización de aplicaciones
- Traducción de contenido web
- Comunicación multilingüe
- Traducción de documentos
- Atención al cliente internacional

Integración de Servicios



Ejemplo de pipeline completo:
1. Transcribe: Convierte audio a texto
2. Comprehend: Analiza sentimiento y entidades
3. Translate: Traduce a otros idiomas
4. Polly: Convierte respuesta a voz

Este pipeline permite crear experiencias conversacionales multilingües completas.

Puntos Clave

  • Polly y Transcribe permiten construir aplicaciones accesibles y multilingües
  • Usar lexicons y estilos de voz para consistencia de marca
  • Transcribe Call Analytics aporta métricas accionables para centros de contacto
  • Ajustar vocabularios personalizados para terminología de dominio
  • Combinar con Comprehend para análisis post-transcripción