Decisiones de IA Arquitectura y tecnología
Agentes de voz con IA vs IVR: ¿cuándo debe una conversación sustituir al menú?
Una IVR enruta las llamadas con menús fijos y es predecible, barata por llamada y fácil de auditar; un agente de voz con IA entiende el habla libre, resuelve peticiones actuando sobre tus sistemas y pasa la llamada a una persona con el contexto. Elige IVR para un enrutado sencillo y estable y para flujos con guion obligatorio, y un agente de voz cuando las necesidades de quien llama son variadas y el objetivo es resolver, no enrutar. En la UE, el agente de voz debe decir que es una IA, y las grabaciones de llamadas están sujetas al RGPD.
Las opciones
IVR
Respuesta de voz interactiva: un sistema telefónico que guía a quien llama por menús grabados, con teclado u órdenes de voz sencillas, y después enruta la llamada o completa tareas básicas.
Agente de voz con IA
Un sistema conversacional que entiende el habla natural, mantiene un diálogo, usa herramientas para actuar sobre los sistemas de negocio y transfiere a una persona cuando hace falta.
Comparativa
| Criterio | IVR | Agente de voz con IA |
|---|---|---|
| Interacción | Menús, teclado o palabras clave | Conversación natural, con interrupciones y reformulaciones |
| Alcance | Enrutado y unas pocas tareas de autoservicio con guion | Diagnóstico, transacciones y peticiones de varios pasos dentro de unos límites definidos |
| Previsibilidad | Totalmente determinista | Probabilística: necesita salvaguardas, pruebas y monitorización |
| Integración | Telefonía y consultas simples | Telefonía, CRM, base de conocimiento y APIs transaccionales |
| Traspaso a una persona | Transferencia a una cola, a menudo sin contexto | Transferencia con resumen, intención y datos ya recogidos |
| Hacer cambios | Volver a grabar locuciones y rediseñar menús | Actualizar conocimiento, políticas y herramientas; pruebas de regresión antes de publicar |
| Coste por llamada | Bajo | Mayor (reconocimiento de voz, modelo, síntesis de voz), a compensar con la resolución |
| Idiomas y acentos | Un guion por idioma | Multilingüe, pero hay que validar la precisión con acentos y ruido reales |
| Cumplimiento en la UE | RGPD para grabaciones y datos personales | RGPD más la transparencia del AI Act (decir que es una IA) y límites a la inferencia de emociones |
Elige IVR cuando…
- La mayoría de las llamadas solo necesita llegar al equipo correcto y el menú es corto.
- El flujo tiene un guion legal (verificación de identidad, avisos obligatorios) que no puede variar.
- El volumen o los márgenes no soportan un coste por llamada mayor.
- Tus sistemas no están expuestos mediante APIs que un agente pueda usar.
Elige Agente de voz con IA cuando…
- Quien llama describe problemas variados con sus palabras y los menús le mandan al sitio equivocado.
- Muchas llamadas son peticiones repetitivas que podrían resolverse de principio a fin con acceso a los sistemas.
- Quieres que las personas de tu equipo reciban las llamadas con contexto, no empezando de cero.
- Necesitas atender fuera del horario de oficina o en varios idiomas.
- Puedes invertir en pruebas, monitorización y una política de escalado clara.
Cuándo combinarlas
Un camino habitual y seguro es el híbrido: mantener la telefonía y la IVR para la autenticación, los guiones obligatorios y el enrutado urgente, y poner delante un agente de voz que capte la intención y resuelva peticiones bien acotadas, con una persona siempre a un paso. Amplía el alcance del agente intención a intención, midiendo la resolución y la calidad de las transferencias, en lugar de cambiar toda la línea de golpe.
Errores típicos
- Sustituir la IVR por un agente de voz sin acceso a los sistemas, que puede hablar pero no resolver.
- Esconder el camino hacia una persona. Quien no consigue hablar con alguien pierde la confianza, y algunas normas nacionales de atención a la clientela exigen esa opción.
- No avisar al principio de la llamada de que se está hablando con una IA.
- Grabar y reutilizar llamadas para entrenar modelos sin base jurídica, sin política de conservación y, cuando toca, sin EIPD.
- Probar en una sala silenciosa en lugar de con acentos, ruido de fondo e interrupciones reales.
Cómo lo enfoca Thinkia
Empezamos por las llamadas, no por la tecnología: qué intenciones entran, cuáles se pueden resolver con acceso a los sistemas y cuáles deben quedarse en manos de personas. Muchas veces la respuesta es un híbrido y lo diseñamos como tal. El objetivo no es atender más llamadas, sino atenderlas mejor, con contexto y continuidad.
AI Contact Experience es el producto que usamos para esto: agentes configurados por rol, voz e idioma; enrutado por intención o sentimiento; transferencias a agentes humanos sobre tu telefonía actual (BYOC o SIP trunking); sincronización con el CRM en tiempo real, y resumen y analítica de cada interacción. Los agentes humanos reciben el contexto y los supervisores, los datos.
El cumplimiento forma parte del diseño. El agente se identifica como IA al empezar la llamada, la grabación y la conservación siguen tu base jurídica del RGPD y tu EIPD, y la precisión del reconocimiento de voz se valida en tus condiciones reales antes de escalar. Desplegamos por intenciones con una persona siempre localizable y definimos la analítica con tu equipo jurídico: inferir emociones de los empleados en el trabajo es una práctica prohibida por el AI Act, así que la analítica se centra en la interacción, no en vigilar a las personas.
Productos de Thinkia implicados
Soluciones de IA relacionadas
- Atención al cliente con IATus clientes reciben respuesta al momento. Tus agentes atienden lo que de verdad importa.
- Operaciones de soporte: de piloto a producciónDe piloto a producción con IA gobernada
- Reducción del coste de soporteBaja el coste de atender rediseñando el proceso con IA.
- Asistente de paciente y ciudadano con IASiempre disponible. Siempre preciso. Creado para interacciones de alto riesgo.
Preguntas frecuentes
¿Hay que decir a quien llama que está hablando con una IA?
Sí. El Reglamento Europeo de IA (AI Act) exige informar a las personas de que interactúan con un sistema de IA, salvo que resulte evidente por el contexto, y con una voz natural casi nunca lo es. Estas obligaciones de transparencia del artículo 50 se aplican desde agosto de 2026, y el Digital Omnibus on AI, en vigor desde el 27 de julio de 2026, no las ha modificado. Verifica el texto consolidado en EUR-Lex o en el AI Act Service Desk, y dilo al principio de la llamada con palabras claras.
¿Podemos grabar las llamadas que atiende un agente de voz con IA?
Sí, con la misma disciplina que cualquier grabación bajo el RGPD: informar, tener base jurídica, limitar la conservación, restringir el acceso y hacer una EIPD cuando el tratamiento pueda ser de alto riesgo. Reutilizar las grabaciones para entrenar o mejorar modelos es una finalidad distinta que necesita su propia justificación. Si usas la voz para identificar a las personas, pasa a ser un dato biométrico con reglas más estrictas.
¿Un agente de voz es un sistema de alto riesgo según el AI Act?
No por defecto. Un agente de voz de atención al cliente suele estar sujeto a obligaciones de transparencia, no al régimen de alto riesgo. La clasificación puede cambiar si se usa para fines del Anexo III, como evaluar y clasificar llamadas de emergencia, valorar el derecho a servicios públicos esenciales o evaluar la solvencia de personas físicas. Tras el Digital Omnibus on AI, las obligaciones de alto riesgo del Anexo III se aplican desde diciembre de 2027; verifica el texto consolidado en EUR-Lex o en el AI Act Service Desk. Revisa cada caso de uso; esto no es asesoramiento legal.
¿Podemos analizar emociones en las llamadas?
Con cuidado. Desde el 2 de febrero de 2025, el AI Act prohíbe los sistemas que infieren las emociones de las personas en el lugar de trabajo, salvo por motivos médicos o de seguridad, así que usar analítica de voz para vigilar las emociones de tus propios agentes queda descartado. El reconocimiento de emociones aplicado a clientes no está prohibido, pero conlleva obligaciones de transparencia y puede elevar la clasificación de riesgo. Valida el diseño con tu equipo jurídico.
¿La gente acepta hablar con una IA?
Acepta que le resuelvan. Lo que rompe la confianza es un agente que no puede actuar, que da vueltas o que impide llegar a una persona. Mide la resolución, la calidad de las transferencias y las reclamaciones desde el primer piloto, y mantén visible el camino hacia una persona.
¿Cómo sabemos si el agente de voz funciona?
Mide la resolución sin transferencia, la calidad de las transferencias (si la persona recibió el contexto), el tiempo hasta la resolución, las llamadas repetidas por el mismo motivo y la satisfacción del cliente, segmentado por intención. Compáralo con la línea base de la IVR para las mismas intenciones.
Para seguir explorando
Decisiones relacionadas
- IA agéntica vs chatbots generativos: ¿tu caso de uso necesita un agente o un buen asistente?
- Agentes de IA o RPA: ¿cuál debe automatizar tu proceso y cuándo conviene combinarlos?
- Construir o comprar agentes de IA: ¿qué agentes conviene tener en propiedad y cuáles alquilar?
- Proveedor o implantador en el Reglamento Europeo de IA: ¿qué papel tienes y qué te toca?
Sectores donde aparece esta decisión
- Telecom y Medios
- Seguros
- Retail y eCommerce
- Viajes y Hospitalidad
- Sector Público y Ciudades Inteligentes
Términos clave
Artículos de Thinkia
- El sonido de la resiliencia: por qué los LLM de audio robustos son la próxima frontera de la IA empresarial
- Domar las alucinaciones de LLM: un enfoque basado en la confianza para lograr experiencias precisas del cliente
- IA con supervisión humana: un plan práctico para industrias reguladas
- Agentes de IA empresarial: guía para la alta dirección sobre costes operativos