Ollama 0.33 permite a Claude Desktop ejecutar Qwen, DeepSeek y Kimi en local
Ollama 0.33.0 añade un proxy local que cambia el modelo detrás de la app Claude Desktop de Anthropic por uno abierto. Un intento en primavera fracasó por las comprobaciones del ID de modelo.
3 min de lectura

Ollama ha lanzado una forma de ejecutar modelos abiertos dentro de la app Claude Desktop de Anthropic. La versión 0.33.0 añade un proxy local que dirige las peticiones de la app a un modelo que tú eliges, informó dev.ua el 27 de agosto de 2026. El resultado es la interfaz de Anthropic con Qwen, DeepSeek, Kimi o GLM respondiendo detrás. Para los desarrolladores eso significa una app familiar para probar varios modelos, incluidos algunos que nunca salen de tu máquina.
Ollama es una herramienta gratuita para descargar y ejecutar modelos de lenguaje de pesos abiertos en tu propio ordenador. Pesos abiertos significa que los archivos del modelo están publicados, así que puedes ejecutarlos sin una cuenta de API. Claude Desktop es la app de escritorio oficial de Anthropic para sus modelos Claude.
Cómo funciona el proxy
El truco es un intercambio, no un plugin. Activas la integración dentro de Ollama. The New Stack explica que Ollama entonces «configura Claude Desktop para que las consultas puedan pasarse a los modelos a través de Ollama». Conservas la interfaz de Anthropic. Ollama cambia qué modelo responde en realidad.
Este es trabajo de Ollama, no de Anthropic. La integración vive en Ollama y está construida para situarse entre la app y el modelo. El blog de Ollama describe Claude Desktop como un proveedor de pasarela de terceros para sus modelos abiertos. También señala que Ollama ahora habla tanto el formato de API de OpenAI como el de Anthropic. Esa compatibilidad es lo que permite que las herramientas construidas para la API de Anthropic, incluido Claude Code, hablen en su lugar con un modelo de Ollama.
| Familia de modelos | Creada por |
|---|---|
| Qwen | Alibaba |
| DeepSeek | DeepSeek |
| Kimi | Moonshot AI |
| GLM | Z.ai |
Por qué fracasó el primer intento
Este es el segundo intento de Ollama. The New Stack informa de que un esfuerzo anterior se estancó. Dev.ua da la razón: en primavera, Claude Desktop rechazaba los identificadores de modelo que no eran los propios de Anthropic, así que la integración se rompió. El nuevo proxy está diseñado para superar esa comprobación.
Esa historia importa más que la función. Te dice que la integración funciona por cómo valida Claude Desktop los modelos hoy, no porque Anthropic haya construido un gancho para ella.
Qué significa esto para los desarrolladores
Úsalo para lo que sirve: probar modelos lado a lado en una sola ventana. Dev.ua plantea el beneficio como probar distintos modelos desde una sola aplicación en lugar de cambiar de servicio. Pasa el mismo prompt por Claude, luego cambia a Qwen o DeepSeek, y compara. Eso es más rápido que hacer malabares con cuatro apps y cuatro cuentas.
No construyas un flujo de trabajo sobre esto. La versión de primavera murió cuando Claude Desktop endureció una comprobación del ID de modelo, y nada en los informes sugiere que Anthropic haya aprobado esta. Una actualización de la app de escritorio podría romperla otra vez sin aviso. Mantén tu configuración real de modelos locales en la propia CLI o API de Ollama, donde controlas ambos extremos.
Entiende con precisión el límite de la privacidad. Con un modelo local de Ollama seleccionado, el prompt se queda en tu máquina. Eso es cierto para la llamada al modelo. No te dice qué registra o envía a casa la propia Claude Desktop, porque los informes no cubren eso. Si necesitas una garantía, revisa tú mismo el tráfico de red antes de pegar nada sensible.
El cambio mayor es la compatibilidad de API que hay debajo. Que Ollama acepte ahora peticiones en formato Anthropic significa que Claude Code, el agente de línea de comandos, también puede apuntar a un modelo local. Para los equipos que no pueden enviar código a una API en la nube, esa es la puerta más útil que abre esta versión. El truco de Claude Desktop es la demo. La capa de compatibilidad de API es la herramienta.
Fuentes
Artículos relacionados

Project Zenith de Microsoft es un modo de Windows para IA local
Project Zenith es una experiencia de Windows 11 para desarrolladores, pensada para ejecutar modelos de más de 30 mil millones de parámetros en local, en PC con 64 GB de memoria.

Los nuevos Mac mini y Mac Studio apuestan por el ancho de banda de memoria
Apple anunció nuevos Mac mini y Mac Studio el 25 de agosto de 2026, con envíos el 22 de septiembre. Para trabajar con modelos en local, el techo de memoria pesa más que los multiplicadores de IA.

Los pesos de GLM-5.3 llegan con licencia propia y piden ocho GPU
Los pesos del modelo estrella GLM-5.3 de Z.ai están en Hugging Face tras un retraso por revisión de seguridad. La licencia no es MIT y el modelo necesita al menos ocho GPU de gama alta.