Grok 4.6 de xAI ya está disponible en Amazon Bedrock, según reporta el AWS Machine Learning Blog, con lanzamiento en la plataforma el 18 de agosto de 2026 como el segundo modelo de xAI allí, después de Grok 4.3. El modelo ofrece una ventana de contexto de 500K tokens y cuatro niveles configurables de esfuerzo de razonamiento — low, medium, high y uno nuevo, xhigh — que se configuran mediante los parámetros de la API de Bedrock en lugar de un campo dedicado a razonamiento.
Grok 4.6 amplía su presencia respecto del lanzamiento anterior de Grok: funciona tanto en el endpoint bedrock-mantle (compatible con OpenAI) como en bedrock-runtime, y admite la Converse API junto con Chat Completions y Responses, incluido streaming. El soporte de funciones difiere según el endpoint. bedrock-mantle cubre llamadas a herramientas del lado del cliente, salidas estructuradas, prompt caching, streaming de respuestas y detección de abuso. bedrock-runtime cubre razonamiento, prompt caching, streaming de respuestas, registros de invocación y, nuevo en este lanzamiento, Amazon Bedrock Guardrails — filtros de contenido, temas denegados, redacción de PII y políticas de palabras evaluadas tanto sobre el prompt como sobre la respuesta. Las salidas estructuradas y el uso de herramientas del lado del servidor no están disponibles en bedrock-runtime.
Grok 4.6 no se ofrece para inferencia dentro de la región en bedrock-runtime; las solicitudes se enrutan en cambio a través de perfiles de inferencia entre regiones. Un perfil Geo mantiene el tráfico dentro de regiones de EE. UU. por residencia de datos, mientras que un perfil Global enruta a nivel mundial a través de una lista más larga que abarca EE. UU., Canadá, Europa, Asia Pacífico, Medio Oriente, África y Sudamérica. Global también es más barato: 2,00 USD por millón de tokens de entrada frente a 2,20 USD para Geo. En bedrock-mantle, la inferencia dentro de la región solo está disponible en US West (Oregón).
El precio incluye tres niveles de servicio construidos como multiplicadores sobre las tarifas estándar: Priority a 1,75x para procesamiento más rápido, y Flex a 0,5x para trabajo que no es urgente. xAI lista el precio de Grok 4.6 desde 2 USD por millón de tokens de entrada y 6 USD por millón de tokens de salida, con una variante más rápida al doble de esa tarifa. La entrada en caché se factura a aproximadamente un cuarto de la tarifa estándar de entrada, lo cual el post señala que importa para agentes que reenvían un system prompt o documento extenso en cada turno.
Las cifras de benchmark reportadas para Grok 4.6 High, publicadas por xAI el 12 de agosto de 2026, incluyen un AA Intelligence Index de 61, una puntuación GDPVal-AA v2 de 1753 y un 69,9% en CursorBench v3.2, entre otras citadas en el post.