Destacado
Google incorpora razonamiento a su IA de voz en tiempo real, abriendo la puerta a agentes telefónicos más capaces
Google DeepMind lanzó Gemini 3.8 Live y Live Extended Thinking, sumando un modo de razonamiento a su API de voz/vídeo en tiempo real. Los agentes de voz construidos sobre esta base ahora pueden detenerse a resolver solicitudes de varios pasos —como diagnósticos técnicos o agendamientos con condiciones— antes de responder, en lugar de depender de flujos guionizados de un solo turno.
Qué cambia en operaciones — Para una empresa B2B de 10 a 200 personas que opera soporte telefónico o una línea de calificación de ventas mediante IA de voz, esto cierra la brecha más grande de los agentes de voz actuales: manejar algo más allá de una consulta de un solo turno. Una llamada de soporte que requiere verificar el estado de un pedido, luego aplicar una regla de reembolso condicional y después confirmar con el cliente, antes necesitaba derivarse a un humano o seguir un árbol de decisión guionizado. Extended Thinking permite que el agente razone esa secuencia en vivo, durante la llamada, lo que se traduce en menos escalamientos y un tiempo medio de gestión más corto para la cola de primer nivel. Los equipos que evalúan o ya operan bots de voz para soporte entrante o calificación saliente deberían tomar esto como el momento de volver a probar la latencia y precisión con sus guiones de llamada reales: los modos de razonamiento suelen añadir tiempo de procesamiento, por lo que el equilibrio entre profundidad y velocidad de respuesta debe medirse antes de incorporarlo a una cola en producción, no asumirse.