Destacado
Bedrock incorpora caché de prompts y reduce drásticamente el costo de las herramientas de soporte con IA
AWS añadió caché de prompts a Amazon Bedrock, permitiendo que las aplicaciones reutilicen segmentos de prompt ya procesados (instrucciones de sistema, contexto extenso, ejemplos) en lugar de reprocesarlos en cada llamada. AWS reporta hasta 90% menos costo en tokens de entrada y hasta 85% menos latencia en modelos compatibles, reduciendo directamente el costo operativo de agentes y chats de IA construidos sobre Bedrock.
Qué cambia en operaciones — Si tu chatbot de soporte, asistente interno de conocimiento o copiloto de ventas corre sobre Bedrock y envía el mismo prompt de sistema o documentación de producto en cada solicitud —como hacen la mayoría de las herramientas con recuperación aumentada—, esto reduce el costo por consulta y acelera los tiempos de respuesta sin cambiar el modelo en sí. Los equipos que manejan automatización de soporte de alto volumen (cientos o miles de tickets diarios) deberían ver la caché aplicada automáticamente o configurarla de forma explícita, ya que AWS señala que funciona mejor cuando una parte importante del prompt —como un fragmento de base de conocimiento o definiciones de herramientas— permanece idéntica entre llamadas. Para una empresa de 10 a 200 personas que ya paga por token en flujos de soporte o ventas con IA sobre Bedrock, esto es una palanca de costo directa que vale la pena revisar este trimestre, no una consideración a futuro.