Destaque
Google Adiciona Raciocínio à Sua IA de Voz em Tempo Real, Abrindo Caminho para Agentes Telefônicos Mais Inteligentes
O Google DeepMind lançou o Gemini 3.8 Live e o Live Extended Thinking, adicionando um modo de raciocínio à sua API de voz/vídeo em tempo real. Agentes de voz construídos sobre ele agora podem pausar para resolver solicitações de múltiplas etapas — como solução de problemas ou agendamentos com condições — antes de responder, em vez de depender de fluxos roteirizados de turno único.
O que muda na operação — Para uma empresa B2B de 10 a 200 funcionários que opera suporte telefônico ou uma linha de qualificação de vendas por IA de voz, isso fecha a maior lacuna dos agentes de voz atuais: lidar com qualquer coisa além de uma consulta de turno único. Uma ligação de suporte que exige verificar o status de um pedido, depois aplicar uma regra condicional de reembolso, depois confirmar com o cliente, antes precisava de transferência para um humano ou de uma árvore de decisão roteirizada. O Extended Thinking permite que o agente raciocine essa sequência ao vivo, durante a ligação, o que significa menos escalonamentos e menor tempo médio de atendimento na fila de primeiro nível. Equipes que avaliam ou já operam bots de voz para suporte inbound ou qualificação outbound devem tratar isso como o momento de retestar latência e precisão nos scripts reais de suas ligações — modos de raciocínio geralmente adicionam tempo de processamento, então o equilíbrio entre profundidade e velocidade de resposta precisa ser medido antes de colocá-lo em uma fila ao vivo, não presumido.