AWS Machine Learning Blog desde operaciones
Todo lo que hemos publicado en AWS Machine Learning Blog, leído desde operaciones: qué cambia para una empresa B2B de 10 a 200 personas.
AWS enseña cómo reducir el costo de tokens en RAG sobre Bedrock filtrando contexto irrelevante
Si tu bot de soporte, asistente de ventas o buscador de conocimiento interno corre sobre un pipeline de generación aumentada por recuperación a través de Bedrock (o una arquitectura similar), la factura de tokens crece según cuánto contexto irrelevante se mete en cada prompt: documentos largos, texto repetitivo y pasajes casi duplicados que se recuperan 'por las dudas'. La compresión consciente de la consulta ataca ese problema filtrando los fragmentos recuperados contra la pregunta real antes de que lleguen al modelo, que es exactamente la palanca que determina si el asistente de IA de un equipo de soporte de 20 personas cuesta 200 o 2.000 dólares al mes a escala. Los equipos que ya corren RAG en producción deberían tratar esto como un ítem concreto de reducción de costos, no como una mejora futura: no requiere cambiar de modelo, solo insertar un paso de compresión en el pipeline existente de recuperación a generación.
AWS introduce controles de acceso para agentes de IA que llaman herramientas externas
Si tu empresa ha conectado un agente de IA a tu CRM, sistema de tickets o APIs internas para automatizar la prospección de ventas o la clasificación de soporte, es probable que ese agente tenga más acceso del necesario y que no exista un rastro de auditoría de lo que realmente hizo. AgentCore Gateway permite fijar permisos por herramienta (por ejemplo, que un agente pueda leer registros de clientes pero no modificar la facturación) y obtener un registro de cada llamada, algo que importa en el momento en que un cliente pregunta qué datos tocó la IA o una revisión de seguridad plantea la misma pregunta. Para una empresa de 10 a 200 personas sin equipo de seguridad dedicado, esto convierte la gobernanza de agentes en una configuración que se activa, en lugar de un desarrollo a medida hecho a última hora, siempre que ya se opere sobre AWS o se esté dispuesto a enrutar el tráfico de los agentes a través de Bedrock.
AWS permite a los creadores de agentes limitar la búsqueda web a fuentes aprobadas y recientes
Para una empresa B2B de 10 a 200 empleados que opera un agente de soporte o ventas que recurre a resultados web en vivo para responder preguntas de clientes, esto cierra una brecha real: hasta ahora, un agente basado en búsqueda web abierta podía mostrar con la misma facilidad una publicación de blog de hace tres años o la página de un competidor que su propia documentación. Los equipos que construyen sobre AgentCore ahora pueden restringir la búsqueda a una lista blanca (docs.tuempresa.com, sitios de socios confiables, organismos de estándares del sector) y exigir contenido publicado dentro de una ventana temporal determinada, algo relevante para todo lo relacionado con precios, cumplimiento normativo o especificaciones de producto que cambian con frecuencia. También le da a los equipos de operaciones y legal un control concreto que mostrar cuando un cliente o auditor pregunta cómo decidió el agente qué citar, en lugar de un inverificable 'buscó en la web'.
AWS suma enrutamiento entre regiones para GPT-5.6 en Bedrock
Si tu bot de soporte, agente de calificación de leads o automatización de operaciones llama a GPT-5.6 a través de Amazon Bedrock, esto elimina un dolor de cabeza operativo real: saturaciones de capacidad en una sola región que provocan respuestas perdidas o retrasadas en horas pico. En lugar de escribir y mantener tu propia lógica de reintentos y conmutación entre regiones, ahora Bedrock se encarga de ese enrutamiento, lo que significa menos alertas a las 3 de la madrugada cuando un flujo de IA de cara al cliente empieza a saturarse. Los equipos que operan con estructuras reducidas (10-200 personas) rara vez tienen tiempo de ingeniería sobrante para construir infraestructura de resiliencia por su cuenta, así que este es un caso en el que el proveedor de la nube absorbe esa complejidad, lo cual representa una ganancia directa, aunque modesta, para la disponibilidad de cualquier canal de ventas o soporte impulsado por IA construido sobre Bedrock.
Diagnóstico gratuito
Quince minutos, sin correo. Sale un mapa de a dónde se va el trabajo y el orden de lo que conviene automatizar primero.
Hacer el diagnóstico gratuitoEmpieza al momento, en el navegador.
- Precio
- Gratis
- Duración
- 15 minutos
La lista ordenada de candidatos se queda contigo en cualquier caso.