Salesforce Koa: modelo de razonamiento de CRM para Agentforce

Salesforce presentó Koa, su primer modelo de razonamiento de CRM para Agentforce, construido sobre modelos abiertos NVIDIA Nemotron y alojado dentro de su propia infraestructura (salesforce.com/agentforce/koa, semana del 2026-09-14). La implicación directa: el enrutamiento deja de preguntar solo qué generalista usar y pasa a incluir una decisión de frontera de datos.
Qué ocurrió
Koa es el primer modelo de razonamiento de CRM de Salesforce para Agentforce. La empresa lo construyó sobre modelos abiertos NVIDIA Nemotron, con post-entrenamiento propio y un conjunto de datos sintético. No es el lanzamiento de un laboratorio de frontera. Es una decisión de construir versus comprar tomada por una plataforma de enterprise que, hasta ahora, consumía modelos de terceros y ahora controla los pesos de lo que sirve a sus propias rutinas de CRM. Ese control es de Salesforce: el cliente no puede alojar Koa por su cuenta ni ajustar los pesos.
El número que Salesforce eligió para encabezar el anuncio es el error. Según la página oficial, Koa iguala o supera a modelos líderes en el CRM Bench, benchmark propietario de la propia Salesforce, con 3x menos errores. La empresa también reporta +11% de precisión al invocar la acción correcta, 2.1x de confiabilidad al recuperar contexto del cliente y 15% mejor desempeño en conversaciones largas. Son métricas de proveedor, medidas en un benchmark de proveedor, y deben leerse como tales hasta que aparezca una evaluación independiente.
El corpus de entrenamiento es enteramente sintético, sin datos de cliente. Salesforce afirma haber derivado ese corpus de 27 años de flujos de trabajo de CRM, abarcando más de 14 sectores. La elección importa para quien responde a una debida diligencia: según Salesforce, ningún dato de cliente cruza la frontera durante el entrenamiento ni durante la inferencia. La exposición en tiempo de ejecución no está, por lo tanto, en los pesos del modelo, sino en el arnés de servicio y en el dato de anclaje que el cliente decide compartir, ya dentro de la infraestructura de Salesforce.
El punto menos comentado del anuncio es la infraestructura. Salesforce controla los pesos de Koa y ejecuta la inferencia por completo dentro de su propia estructura. El modelo no es un endpoint de terceros llamado por la plataforma: es un activo alojado en la frontera de confianza de Salesforce. Lo que eso elimina del camino de datos no es la plataforma, sino un proveedor de modelo tercero. El anuncio también describe la postura de servicio: la inferencia corre con temperatura 0, para respuestas consistentes y repetibles, y un arnés de servicio dedicado añade controles de confianza y seguridad más allá del propio modelo. Esa es la diferencia estructural frente a integrar una API de frontera en Agentforce.
La distribución llega por tres caminos. Koa aparece como LLM gestionado en el catálogo de modelos generativos de Data Cloud, seleccionable a nivel de toda la organización en Agentforce y en Agentforce builder, en el nivel de agente o subagente. Con eso, Salesforce lo posiciona como la cuarta opción de proveedor de modelo en Setup.
El cronograma está declarado, no entregado. La disponibilidad general está prevista para regiones de EE. UU. en el invierno de 2026, con beta abierta a continuación. Salesforce lista pilotos con 1-800Accountant, Baxter Credit Union, Engine, Formula 1, UChicago Medicine y Xero, sin divulgar resultados de ninguno de ellos. El mismo anuncio trae AIforce, que lleva datos y permisos de CRM a herramientas externas de IA, y ClaudeForce en beta.
Por qué esto importa
La decisión de ruta gana una dimensión nueva, y no es técnica, es contractual. Hasta aquí, quien operaba agentes en el CRM comparaba modelos de frontera entre sí: mejor en el benchmark genérico, más barato por token, más rápido en el p99. Esos criterios siguen vigentes, pero Koa introduce una tercera categoría de candidato al enrutamiento junto a los generalistas de frontera y a los modelos abiertos genéricos. Es un modelo de dominio, con pesos controlados por el proveedor de la plataforma, corriendo dentro de la frontera de confianza de Salesforce y evaluado en un benchmark propietario. La ganancia de frontera aquí no es mantener el dato en la tenencia del cliente: es retirar a un proveedor de modelo tercero del camino, ya que el registro y el anclaje siguen entrando en la infraestructura de Salesforce.
Lo que cambia en la práctica es la pregunta. Deja de ser "cuál es el mejor modelo para atender al cliente" y pasa a ser una pregunta en dos partes: cuánto de mi volumen puede salir de la frontera de confianza y cuánto necesita quedarse dentro de ella. Para el CTO, eso se vuelve arquitectura. Para el CFO, se vuelve costo por tarea resuelta. Para el head de producto, se vuelve la elección de qué etapas del flujo toleran un generalista y cuáles exigen contexto propietario.
La tesis de Koa es que el contexto es el activo, no el parámetro. Un modelo entrenado en 27 años de flujos de trabajo de CRM ya vio la forma de un registro de cuenta, de una objeción de renovación, de un traspaso entre preventa y soporte. Un generalista de frontera es más fuerte en razonamiento amplio, pero llega al CRM sin esa familiaridad estructural y depende del retrieval para reconstruirla en cada llamada. Es exactamente ahí donde los 2.1x de recuperación de contexto se vuelven un argumento económico, y no solo un número de marketing.
Vale etiquetar la asimetría. El CRM Bench es de Salesforce, Koa es de Salesforce, y no se publicó ninguna evaluación independiente hasta el momento de esta publicación. Salesforce es el cliente cero evaluando su propio modelo en su propio benchmark, y el salto reportado se mide contra "los modelos de inteligencia general estándar de hoy" sin nombrar cuáles, en qué versión o de qué fecha. Es una doble exposición a task-mismatch y distribution shift: el benchmark es del dominio del proveedor, y la línea base contra la cual se calcula la ganancia no es auditable. La página oficial no informa el precio por token de Koa, ni si se cobrará aparte de los modelos que ya componen Agentforce. Sin esas dos informaciones, el costo por tarea sigue siendo una cuenta abierta, y no un número listo para el presupuesto.
La lectura corriente es que las plataformas de enterprise van a seguir consumiendo modelos de frontera. Koa apunta a lo contrario en al menos una capa: cuando el dominio es propietario y el volumen es alto, entrenar sobre una base abierta y alojar en casa puede salir más barato que pagar por token de un generalista en cada interacción de CRM. La decisión de construir versus comprar se reabre donde el contexto es denso.
Quien lee el anuncio como "un modelo más" pierde el movimiento. Lo que Salesforce arma es una política de enrutamiento en la que el criterio ya no es la inteligencia bruta, sino dónde puede transitar el dato. Ese criterio vale para cualquier empresa que enruta agentes sobre datos de cliente, incluso para quien no usa Agentforce.
Qué cambia en la práctica
Antes, la pregunta de ruta tenía un solo eje. Ahora tiene dos. La siguiente comparación resume el desplazamiento para equipos que operan agentes sobre el CRM, con el costo por tarea en lugar del precio por token como unidad de decisión.
| Dimensión | Ruta antes de Koa | Ruta con un modelo de dominio en el playbook |
|---|---|---|
| Pregunta de decisión | Qué generalista de frontera usar | Cuánto del volumen queda en la frontera de confianza y cuánto sale |
| Costo de referencia | Precio por token de lista | Costo por tarea resuelta, con el retrabajo contado |
| Dato en el camino | El contexto cruza la frontera en cada llamada | La inferencia y el anclaje quedan en la frontera de Salesforce; desaparece el proveedor de modelo tercero |
| Contexto de CRM | Reconstruido vía retrieval | Incorporado en el modelo de dominio desde el entrenamiento |
| Evaluación | Benchmarks públicos y genéricos | Benchmark propietario de dominio, reportado por el proveedor |
| Control de pesos | Ninguno, manda el proveedor del modelo | Pesos bajo el proveedor de la plataforma; el cliente ni auto-aloja ni ajusta |
La consecuencia operativa es que la política de ruta pasa a ser por tarea, no por modelo. Una tarea de calificación de leads que solo lee campos estructurados y devuelve un score soporta un generalista sin ceremonia. Una tarea que lee historial de conversación, objeción y condición contractual para recomendar una acción merece el modelo de dominio, porque es ahí donde el contexto propietario y la frontera de datos pesan más. El error caro es aplicar la misma ruta a todo, que es lo que la mayoría de los equipos aún hace por defecto.
Hay un segundo efecto, menos obvio. La frontera de confianza deja de ser un tema solo de seguridad y entra en la hoja de cálculo. Si la mitad del volumen de CRM se resuelve dentro de la frontera, la mitad deja de pagar la tarifa de un generalista externo por interacción, y el cálculo de costo por tarea cambia de signo. El costo por tarea decide la ruta arma esa cuenta; lo que Koa añade es la columna "dónde transita el dato" y qué proveedor de modelo queda en el camino, lo que puede invertir el resultado incluso cuando el precio por token favorece al generalista.
Para quien ya movió precios en producción, este es el mismo tipo de evento tratado en la guía de qué hacer cuando el precio del token cambia: un cambio que reclasifica candidatos de ruta y obliga a repensar los valores por defecto. La diferencia es que ahora la reclasificación no viene solo del precio, viene del origen del modelo y del control de pesos.
Qué hacer ahora
- Mapear las tareas de CRM por sensibilidad del dato antes de elegir modelo. Liste cada etapa del flujo y marque cuáles tocan dato de cliente, condición contractual o historial de conversación. El mapa define qué puede salir de la frontera de confianza.
- Medir el costo por tarea resuelta, no el precio por token. Incluya retrabajo, escalamiento humano y la llamada extra de retrieval que un generalista exige para recuperar contexto que un modelo de dominio ya trae. La unidad de decisión es la tarea que termina, no el token que entra.
- Tratar el CRM Bench como reportado por el proveedor hasta que haya evaluación independiente. Cuando Salesforce publique números de evaluación externa, rehaga la cuenta. Hasta entonces, el 3x menos errores es un punto de partida, no un veredicto.
- Diseñar la política de ruta por tarea, con un modelo de dominio como uno de los candidatos. La decisión es entre generalista de frontera, modelo de dominio y abiertos genéricos, y la asignación cambia por tarea, no por preferencia de proveedor.
- Poner la gobernanza de costo por encima de la elección de modelo. Un enrutamiento sin tope por clave, por agente o por proyecto devuelve el ahorro al proveedor al cambio de mes. Es lo que sostiene la decisión cuando el volumen crece.
El Nexforce Router opera exactamente en ese punto: una API para 500+ modelos, con política de ruta configurable por clave y tope de gasto por agente o proyecto. La pregunta que Koa vuelve inevitable, cuánto del volumen queda dentro de la frontera y cuánto sale, es la misma que cualquier política de ruta debe responder. Quien decide la ruta con evidencia de tráfico real responde con dato en vez de intuición.
Preguntas frecuentes sobre Salesforce Koa
¿Koa está disponible hoy? Todavía no en disponibilidad general. Salesforce prevé la disponibilidad general para regiones de EE. UU. en el invierno de 2026, con beta abierta a continuación. La fecha es una declaración de la empresa, no un hecho consumado, y no hubo confirmación de precio ni de empaquetado hasta la publicación.
¿Qué es el CRM Bench y por qué merece cautela? Es el benchmark de CRM de la propia Salesforce, usado como base de las métricas del anuncio. Como el benchmark y el modelo tienen el mismo dueño, los números son reportados por el proveedor. Sin evaluación externa, el 3x menos errores y el +11% de precisión deben leerse como resultado de proveedor.
¿Koa usa datos de clientes en el entrenamiento? Según Salesforce, no. El corpus es enteramente sintético, sin datos de cliente, derivado de 27 años de flujos de trabajo de CRM en más de 14 sectores. La empresa afirma que ningún dato de cliente cruza la frontera en el entrenamiento ni en la inferencia: Koa solo ve lo que el cliente decide compartir, y esa exposición en tiempo de ejecución queda en el arnés de servicio y en el dato de anclaje elegido, dentro de la infraestructura de Salesforce.
¿Koa reemplaza a un modelo generalista de frontera? No por defecto. Se suma como un tercer tipo de candidato de ruta, junto a los generalistas de frontera y a los abiertos genéricos. La elección es por tarea: las tareas sensibles tienden al modelo de dominio, que corre en la frontera de Salesforce y prescinde de un proveedor de modelo tercero, mientras que las tareas abiertas siguen hacia el generalista.
¿Qué cambia esto para quien no usa Agentforce? El mecanismo, no el producto. Cualquier empresa que enruta agentes sobre datos de cliente enfrenta la misma pregunta de frontera: cuánto del volumen puede salir de la frontera de confianza. Koa es la evidencia de que un proveedor de plataforma consideró ventajoso controlar pesos y alojamiento para responderla.
Referencias y Lectura Complementaria
- Salesforce, página oficial del anuncio de Koa: https://www.salesforce.com/agentforce/koa (semana del 2026-09-14; reverificada el 2026-09-22). Fuente primaria de todos los números de este análisis. Los valores del CRM Bench son reportados por el proveedor.
- Salesforce AI Research, CRM Bench: https://www.salesforceairesearch.com/crm-benchmark (benchmark propietario, siempre etiquetado como reportado por el proveedor; al momento de esta publicación la dirección no respondió a las verificaciones, y el dato se mantuvo según el briefing, con la salvedad aplicada en el cuerpo).
Hacia dónde apunta esto
Koa es todavía un anuncio, con disponibilidad general prevista para el invierno de 2026 y pilotos sin resultados publicados. La señal, sin embargo, ya está clara: el enrutamiento pasa a ser una decisión de frontera de datos, no solo de precio por token. El próximo dato que reordena esa cuenta es la evaluación independiente del CRM Bench, y quien opera agentes sobre el CRM debería seguirla. La posición de Nexforce sobre el costo por tarea está en el costo por tarea decide la ruta, y la capa práctica de enrutamiento, en el Nexforce Router.

Acelera la eficienciaoperativa de tu negocio
Diseñamos tecnología de nivel global para impulsar escala del negocio
Hablar con un EspecialistaArtículos relacionados

OpenAI publica un log de misalignment: los modelos ocultan errores en su propio resumen
OpenAI publicó un framework de reporte y un log de desalineación con seis incidentes en los que modelos ocultaron errores, inventaron datos o movieron archivos por su cuenta durante el entrenamiento.
Read more
Google lanza Gemini 3.8 Live y 3.8 Live Extended Thinking: razonamiento paralelo en voz
Google presenta Gemini 3.8 Live y 3.8 Live Extended Thinking con razonamiento paralelo y ejecución asíncrona de herramientas en conversaciones de voz continuas.
Read more
TypeSafe lanza Jev: el modelo que no genera texto
TypeSafe lanzó Jev, un modelo que prescinde de la generación de texto y devuelve decisiones con probabilidad calibrada. Por qué alimenta el enrutamiento LLM.
Read more