Ollama 0.33 deixa o Claude Desktop rodar Qwen, DeepSeek e Kimi localmente
O Ollama 0.33.0 adiciona um proxy local que troca o modelo por trás do app Claude Desktop, da Anthropic, por um modelo aberto. Uma tentativa na primavera falhou em checagens de ID de modelo.
3 min de leitura

O Ollama lançou uma forma de rodar modelos abertos dentro do app Claude Desktop, da Anthropic. A versão 0.33.0 adiciona um proxy local que encaminha as requisições do app para um modelo da sua escolha, relatou o dev.ua em 27 de agosto de 2026. O resultado é a interface da Anthropic com Qwen, DeepSeek, Kimi ou GLM respondendo por trás dela. Para desenvolvedores, isso significa um único app familiar para testar vários modelos, incluindo alguns que nunca saem da sua máquina.
O Ollama é uma ferramenta gratuita para baixar e rodar modelos de linguagem de pesos abertos no seu próprio computador. Pesos abertos significa que os arquivos do modelo são publicados, então você pode rodá-los sem uma conta de API. O Claude Desktop é o app oficial de desktop da Anthropic para seus modelos Claude.
Como o proxy funciona
O truque é uma troca, não um plugin. Você ativa a integração dentro do Ollama. O The New Stack explica que o Ollama então "configura o Claude Desktop para que as consultas possam ser passadas aos modelos via Ollama". Você mantém a interface da Anthropic. O Ollama muda qual modelo de fato responde.
Este é trabalho do Ollama, não da Anthropic. A integração vive no Ollama e foi construída para ficar entre o app e o modelo. O blog do Ollama descreve o Claude Desktop como um provedor de gateway de terceiros para seus modelos abertos. O mesmo blog observa que o Ollama agora fala tanto o formato de API da OpenAI quanto o da Anthropic. Essa compatibilidade é o que permite que ferramentas feitas para a API da Anthropic, incluindo o Claude Code, conversem com um modelo do Ollama em vez disso.
| Família de modelos | Feita por |
|---|---|
| Qwen | Alibaba |
| DeepSeek | DeepSeek |
| Kimi | Moonshot AI |
| GLM | Z.ai |
Por que a primeira tentativa falhou
Esta é a segunda tentativa do Ollama. O The New Stack relata que um esforço anterior travou. O dev.ua dá o motivo: na primavera, o Claude Desktop rejeitava identificadores de modelo que não fossem os da própria Anthropic, então a integração quebrou. O novo proxy foi desenhado para passar por essa checagem.
Essa história importa mais que o recurso. Ela diz que a integração funciona por causa de como o Claude Desktop valida modelos hoje, não porque a Anthropic construiu um gancho para isso.
O que isso significa para desenvolvedores
Use isso para o que ele faz bem: teste de modelos lado a lado em uma janela. O dev.ua enquadra o benefício como experimentar modelos diferentes a partir de um único aplicativo, em vez de trocar de serviço. Rode o mesmo prompt no Claude, depois mude para Qwen ou DeepSeek, e compare. Isso é mais rápido do que fazer malabarismo com quatro apps e quatro contas.
Não construa um fluxo de trabalho em cima disso. A versão da primavera morreu quando o Claude Desktop apertou uma checagem de ID de modelo, e nada nos relatos sugere que a Anthropic aprovou esta. Uma atualização do app de desktop poderia quebrá-la de novo sem aviso. Mantenha sua configuração real de modelos locais na própria CLI ou API do Ollama, onde você controla as duas pontas.
Entenda a fronteira de privacidade com precisão. Com um modelo local do Ollama selecionado, o prompt fica na sua máquina. Isso vale para a chamada ao modelo. Não diz o que o próprio Claude Desktop registra ou envia para casa, porque os relatos não cobrem isso. Se você precisa de uma garantia, verifique o tráfego de rede você mesmo antes de colar qualquer coisa sensível.
A mudança maior é a compatibilidade de API por baixo. O Ollama agora aceitar requisições no formato da Anthropic significa que o Claude Code, o agente de linha de comando, também pode apontar para um modelo local. Para times que não podem enviar código a uma API na nuvem, essa é a porta mais útil que este lançamento abre. O truque do Claude Desktop é a demonstração. O shim de API é a ferramenta.
Fontes
Artigos relacionados

Project Zenith da Microsoft é um modo do Windows para IA local
Project Zenith é uma experiência do Windows 11 voltada a desenvolvedores, feita para rodar localmente modelos com mais de 30 bilhões de parâmetros em PCs com 64 GB de memória.

Novos Mac mini e Mac Studio apostam em banda de memória para IA local
A Apple anunciou novos Mac mini e Mac Studio em 25 de agosto de 2026, com entrega em 22 de setembro. Para rodar modelos local, o teto de memória pesa mais que os multiplicadores de IA.

Pesos do GLM-5.3 saem com licença própria e exigem oito GPUs
Os pesos do modelo principal GLM-5.3 da Z.ai estão no Hugging Face após atraso por revisão de segurança. A licença não é MIT e o modelo precisa de pelo menos oito GPUs de ponta.