Skip to content

Infraestructura y precios desde operaciones

Todo lo que hemos publicado en Infraestructura y precios, leído desde operaciones: qué cambia para una empresa B2B de 10 a 200 personas.

  1. Destacado

    Liquid AI lanza LFM2.5-DSpark con inferencia hasta 3,2 veces más rápida

    Liquid AI lanzó LFM2.5-DSpark, una actualización de modelo que ejecuta inferencia hasta 3,2 veces más rápido que la generación anterior LFM2.5, según una publicación de la compañía en el blog de Hugging Face. La mejora proviene de cambios arquitectónicos que Liquid AI describe pero no ha detallado públicamente en profundidad, orientados a despliegues donde la velocidad de respuesta y el coste de cómputo son prioritarios.

    Qué cambia en operacionesPara una empresa B2B que ejecuta un agente de chat con IA, un bot de triaje de tickets o un asistente de calificación de ventas sobre un modelo pequeño, autoalojado o desplegado en el borde, una aceleración de inferencia de 3,2x se traduce en menor latencia por respuesta y menos horas de GPU por conversación, es decir, facturas de alojamiento más bajas con el mismo volumen, o la posibilidad de ejecutar un modelo más capaz al mismo coste. Los equipos actualmente limitados por SLA de tiempo de respuesta en chat en vivo o soporte por voz, donde cada segundo de latencia del modelo se traduce en tiempo de espera del cliente, obtienen el beneficio más inmediato; los equipos que usan modelos API alojados por proveedores importantes no verán ningún cambio a menos que esos proveedores adopten técnicas similares.

  1. Reordenar tareas, no comprar chips: así se ganaron 33 puntos de uso en un clúster GPU

    La mayoría de las empresas B2B de 10 a 200 personas no operan sus propios clústeres de GPU, así que esto no es una tarea directa para ellas — pero es un dato útil cuando un proveedor dice que escalar una función de IA requiere una costosa actualización de infraestructura. Si solo reordenar tareas puede liberar 33 puntos de utilización en el mismo hardware, vale la pena preguntarle a cualquier proveedor que cotice "más cómputo" si ya optimizó lo que tiene antes de facturar hardware adicional. El ángulo aquí es palanca de negociación y escrutinio de proveedores, no un cambio operativo interno — casi nadie entre los lectores tocará un scheduler, pero sí pagará por uno indirectamente a través de los costos de inferencia o fine-tuning.

Siguiente paso

Diagnóstico gratuito

Quince minutos, sin correo. Sale un mapa de a dónde se va el trabajo y el orden de lo que conviene automatizar primero.

Hacer el diagnóstico gratuito

Empieza al momento, en el navegador.

Precio
Gratis
Duración
15 minutos

La lista ordenada de candidatos se queda contigo en cualquier caso.