Ollama 0.33 fait tourner Qwen, DeepSeek et Kimi en local dans Claude Desktop
Ollama 0.33.0 ajoute un proxy local qui remplace le modèle derrière l'application Claude Desktop d'Anthropic par un modèle ouvert. Une tentative au printemps a échoué sur la vérification des identifiants de modèle.
3 min de lecture

Ollama a livré un moyen de faire tourner des modèles ouverts dans l'application Claude Desktop d'Anthropic. La version 0.33.0 ajoute un proxy local qui achemine les requêtes de l'application vers un modèle de votre choix, a rapporté dev.ua le 27 août 2026. Le résultat est l'interface d'Anthropic avec Qwen, DeepSeek, Kimi ou GLM qui répond derrière. Pour les développeurs, cela signifie une seule application familière pour tester plusieurs modèles, y compris certains qui ne quittent jamais votre machine.
Ollama est un outil gratuit pour télécharger et exécuter des modèles de langage à poids ouverts sur votre propre ordinateur. Poids ouverts signifie que les fichiers du modèle sont publiés, vous pouvez donc les exécuter sans compte API. Claude Desktop est l'application de bureau officielle d'Anthropic pour ses modèles Claude.
Comment fonctionne le proxy
L'astuce est une substitution, pas un plugin. Vous activez l'intégration dans Ollama. The New Stack explique qu'Ollama « configure alors Claude Desktop pour que les requêtes puissent être transmises aux modèles via Ollama ». Vous gardez l'interface d'Anthropic. Ollama change le modèle qui répond réellement.
C'est le travail d'Ollama, pas celui d'Anthropic. L'intégration vit dans Ollama et est conçue pour se placer entre l'application et le modèle. Le blog d'Ollama décrit Claude Desktop comme un fournisseur de passerelle tiers pour ses modèles ouverts, et note qu'Ollama parle désormais les deux formats d'API, celui d'OpenAI et celui d'Anthropic. C'est cette compatibilité qui permet aux outils bâtis pour l'API d'Anthropic, y compris Claude Code, de parler à la place à un modèle Ollama.
| Famille de modèles | Fabriquée par |
|---|---|
| Qwen | Alibaba |
| DeepSeek | DeepSeek |
| Kimi | Moonshot AI |
| GLM | Z.ai |
Pourquoi la première tentative a échoué
C'est le deuxième essai d'Ollama. The New Stack rapporte qu'un effort antérieur s'est enlisé. Dev.ua en donne la raison : au printemps, Claude Desktop rejetait les identifiants de modèle qui n'étaient pas ceux d'Anthropic, et l'intégration s'est cassée. Le nouveau proxy est conçu pour passer cette vérification.
Cet historique compte plus que la fonctionnalité. Il vous dit que l'intégration fonctionne grâce à la façon dont Claude Desktop valide les modèles aujourd'hui, pas parce qu'Anthropic a construit un point d'accroche pour elle.
Ce que cela signifie pour les développeurs
Utilisez-le pour ce qu'il fait bien : tester des modèles côte à côte dans une seule fenêtre. Dev.ua présente l'avantage ainsi : essayer différents modèles depuis une seule application au lieu de changer de service. Passez le même prompt dans Claude, puis basculez vers Qwen ou DeepSeek, et comparez. C'est plus rapide que de jongler entre quatre applications et quatre comptes.
Ne bâtissez pas un flux de travail dessus. La version du printemps est morte quand Claude Desktop a resserré une vérification d'identifiant de modèle, et rien dans les articles ne suggère qu'Anthropic a validé celle-ci. Une mise à jour de l'application de bureau pourrait la casser de nouveau sans préavis. Gardez votre vraie configuration de modèles locaux dans la CLI ou l'API d'Ollama, où vous contrôlez les deux bouts.
Comprenez précisément la frontière de confidentialité. Avec un modèle Ollama local sélectionné, le prompt reste sur votre machine. C'est vrai pour l'appel au modèle. Cela ne vous dit pas ce que Claude Desktop lui-même journalise ou renvoie à ses serveurs, car les articles ne couvrent pas ce point. Si vous avez besoin d'une garantie, vérifiez vous-même le trafic réseau avant de coller quoi que ce soit de sensible.
Le changement plus profond est la compatibilité d'API en dessous. Le fait qu'Ollama accepte désormais des requêtes au format Anthropic signifie que Claude Code, l'agent en ligne de commande, peut aussi pointer vers un modèle local. Pour les équipes qui ne peuvent pas envoyer de code à une API cloud, c'est la porte la plus utile qu'ouvre cette version. L'astuce Claude Desktop est la démo. La couche de compatibilité d'API est l'outil.
Sources
Articles liés

Project Zenith de Microsoft, un mode Windows pour l'IA locale
Project Zenith est une expérience Windows 11 pensée pour les développeurs, faite pour exécuter localement des modèles de plus de 30 milliards de paramètres sur des PC à 64 Go de mémoire.

Les nouveaux Mac mini et Mac Studio misent sur la bande passante mémoire
Apple a annoncé de nouveaux Mac mini et Mac Studio le 25 août 2026, livrés le 22 septembre. Pour le travail local sur modèles, le plafond mémoire compte plus que les multiplicateurs IA.

Les poids de GLM-5.3 arrivent sous licence maison et exigent huit GPU
Les poids du modèle phare GLM-5.3 de Z.ai sont sur Hugging Face après un retard dû à une revue de sûreté. La licence n'est pas MIT, et le modèle réclame au moins huit GPU haut de gamme.