Salesforce, en una publicación de la compañía, presentó Koa, descrito como su primer modelo de razonamiento de IA optimizado para trabajo empresarial y construido para funcionar dentro del perímetro de confianza de Salesforce. Koa es una versión post-entrenada de Nemotron 3 Super de NVIDIA, un modelo abierto de 120.000 millones de parámetros; Salesforce afirma que los pesos abiertos y los datos de entrenamiento publicados permiten verificar qué entró en el modelo en lugar de confiar en la palabra de un proveedor.
El argumento de Salesforce es que un modelo general de frontera aplica el mismo razonamiento amplio a una política de reembolso, un problema de física y un plan de viaje, trabajando cada uno desde primeros principios y llegando a veces a una respuesta distinta para la misma tarea repetida. Koa, en cambio, fue entrenado mediante aprendizaje por refuerzo sobre flujos de trabajo empresariales simulados que abarcan más de 14 industrias —manufactura, servicios financieros, salud, viajes— con clientes sintéticos que muestran distintos estados de ánimo y un juez que puntúa si el problema quedó realmente resuelto. Ningún entrenamiento usó datos reales de clientes.
Se destaca un comportamiento entrenado en particular: cuando no está disponible la herramienta correcta para una solicitud, Koa debe detenerse, decirle al cliente qué no puede hacer, pedir lo que necesita y derivar a un humano, en lugar de llamar a una herramienta de nombre parecido o confirmar una acción que nunca ocurrió.
Koa convive con otros modelos especializados construidos por Salesforce —HyperClassifier, TextEval, Moirai—, donde Koa se encarga del razonamiento de varios pasos mientras esos otros manejan tareas más acotadas como clasificación de intención y reordenamiento de búsquedas.
Koa ya funciona en los flujos de trabajo internos de empleados de Salesforce, y la compañía dice que ahora avanza hacia pilotos con clientes en servicio, ventas y comercio, incluidas industrias reguladas como servicios financieros, salud, viajes y contabilidad. Salesforce reporta que en pruebas iniciales sobre tareas específicas de CRM —actualizar una oportunidad, enrutar un caso, programar un seguimiento— supera a modelos de propósito general, aunque se trata de un benchmarking propio de Salesforce aún no verificado de forma independiente. La compañía también declara que los datos de clientes y los rastros de interacción nunca salen del control del cliente y no se usan para seguir entrenando el modelo.