Salesforce Koa parte de pesos abertos mas sai fechado
A Salesforce diz que o Koa comete três vezes menos erros no seu próprio CRM Bench, mas os pesos são proprietários e o modelo só roda na infraestrutura dela.
3 min de leitura

A Salesforce anunciou o Koa em 15 de setembro de 2026, o seu primeiro modelo de raciocínio feito em casa, construído sobre o Nemotron, o modelo de pesos abertos da Nvidia. A própria página da Salesforce acrescenta depois o detalhe que decide se algo disso é utilizável por você: os pesos são proprietários e o modelo só roda dentro da infraestrutura da Salesforce.
Ou seja, uma base de pesos abertos gerou um produto fechado. É esse padrão que merece atenção, mais do que o modelo em si.
O que a Salesforce diz que ele faz
O Koa é voltado ao trabalho corporativo em vendas, marketing e atendimento, com eficiência de tokens como objetivo declarado. O TechCrunch informa que ele foi pós-treinado com dados sintéticos que simulam cenários de atendimento e de vendas, e não com dados reais de clientes.
Há um número de referência publicado. A Salesforce diz que o Koa comete três vezes menos erros no CRM Bench do que os modelos de ponta em tarefas reais de CRM.
Vale ler com cuidado. O CRM Bench é o teste da própria Salesforce, e os modelos comparados não são nomeados na página. Um fornecedor que pontua o seu próprio modelo no seu próprio teste contra rivais sem nome entrega uma afirmação, não uma medição que você possa reproduzir.
A Salesforce também formula a virada com as próprias palavras. O raciocínio "sempre foi algo para o qual dependíamos dos fornecedores de modelos de ponta. Até agora", diz a empresa.
Como você realmente obteria
O modo de entrega é a parte que a maior parte da cobertura pulou.
| Pergunta | O que a Salesforce diz |
|---|---|
| Pesos | Proprietários, sem download |
| Onde roda | Apenas na infraestrutura da Salesforce |
| Como é implantado | Via Data Cloud como LLM gerenciado, escolhido no Agentforce Setup |
| Disponível agora | Clientes-piloto selecionados |
| Disponibilidade geral | Prevista para o inverno de 2026, regiões dos EUA |
| Beta aberto | Planejado após a disponibilidade geral |
Um vice-presidente da Nvidia descreveu os objetivos de projeto como "sovereign AI, time to first token, efficient reasoning, for the tokenomics of it all". O interesse técnico está nessa última parte. O Nemotron foi construído para inferência eficiente, e é isso que torna um modelo menor e específico mais barato de operar que um de ponta.
A Salesforce anunciou outra coisa no mesmo dia: o ClaudeForce, uma parceria que coloca o Claude, da Anthropic, dentro da infraestrutura da Salesforce. Construir o próprio modelo e revender o de outro na mesma manhã não é contradição. É uma proteção.
O que isso significa para desenvolvedores
Verifique as condições de implantação antes do teste de desempenho. Um modelo que você não pode baixar, e que só roda na infraestrutura de um fornecedor, é um serviço gerenciado com um modelo dentro. Avalie como serviço: latência, disponibilidade por região, preço por unidade de trabalho e o que acontece quando você quiser sair.
Não planeje em cima do Koa neste trimestre, a menos que já seja cliente-piloto. A disponibilidade geral está prevista para o inverno de 2026 e, naquele momento, limitada a regiões dos EUA, com beta aberto só depois. Se o seu produto precisa disso na Europa, não há data.
Trate a alegação de três vezes menos erros como uma hipótese a testar com os seus próprios dados. Testes de fornecedor servem para saber para o que um modelo foi ajustado, aqui claramente o trabalho de CRM. Não servem para prever os seus resultados, e este site já fez esse ponto sobre lançamentos de pesos abertos cujas licenças acabam mais estreitas do que a palavra sugere.
A leitura estratégica é a que vale levar. A Nvidia entrega um modelo base capaz, e uma empresa com canal de distribuição o pós-treina para um domínio e vende o acesso. Espere mais disso: os pesos abertos são a entrada, não o produto. Se o seu plano depende de rodar um modelo você mesmo, verifique se aquilo que te empolga é de fato a parte que está sendo aberta.
Fontes
- Salesforce and Nvidia's new reasoning model is everything the AI labs should fear - TechCrunch
- Salesforce Koa - Salesforce
Artigos relacionados

Mistral capta 3 bi de euros a 21 bi, com liderança da Samsung
A Mistral captou 3 bilhões de euros com avaliação de 21 bilhões, quase o dobro da rodada anterior. Planeja 1 GW de computação europeia até 2030.

Qwen3.5-9B gasta 32 KB por token no cache KV
O Qwen3.5-9B usa atenção completa em apenas 8 das suas 32 camadas, então o cache KV custa 32 KB por token. Essa proporção decide se ele cabe em 8 GB.

O código de conduta de IA da Microsoft é um rascunho
A Microsoft publicou em 14 de setembro de 2026 restrições absolutas para seus modelos MAI e depois disse que os modelos atuais ainda não são treinados com o documento.