Skip to content
Tech AI Wire

Ollama 0.33 fait tourner Qwen, DeepSeek et Kimi en local dans Claude Desktop

Ollama 0.33.0 ajoute un proxy local qui remplace le modèle derrière l'application Claude Desktop d'Anthropic par un modèle ouvert. Une tentative au printemps a échoué sur la vérification des identifiants de modèle.

Par Tech AI Wire Team

3 min de lecture

XLinkedIn
The Claude Desktop app with its model picker open, showing a locally served Ollama model selected.

Ollama a livré un moyen de faire tourner des modèles ouverts dans l'application Claude Desktop d'Anthropic. La version 0.33.0 ajoute un proxy local qui achemine les requêtes de l'application vers un modèle de votre choix, a rapporté dev.ua le 27 août 2026. Le résultat est l'interface d'Anthropic avec Qwen, DeepSeek, Kimi ou GLM qui répond derrière. Pour les développeurs, cela signifie une seule application familière pour tester plusieurs modèles, y compris certains qui ne quittent jamais votre machine.

Ollama est un outil gratuit pour télécharger et exécuter des modèles de langage à poids ouverts sur votre propre ordinateur. Poids ouverts signifie que les fichiers du modèle sont publiés, vous pouvez donc les exécuter sans compte API. Claude Desktop est l'application de bureau officielle d'Anthropic pour ses modèles Claude.

Comment fonctionne le proxy

L'astuce est une substitution, pas un plugin. Vous activez l'intégration dans Ollama. The New Stack explique qu'Ollama « configure alors Claude Desktop pour que les requêtes puissent être transmises aux modèles via Ollama ». Vous gardez l'interface d'Anthropic. Ollama change le modèle qui répond réellement.

C'est le travail d'Ollama, pas celui d'Anthropic. L'intégration vit dans Ollama et est conçue pour se placer entre l'application et le modèle. Le blog d'Ollama décrit Claude Desktop comme un fournisseur de passerelle tiers pour ses modèles ouverts, et note qu'Ollama parle désormais les deux formats d'API, celui d'OpenAI et celui d'Anthropic. C'est cette compatibilité qui permet aux outils bâtis pour l'API d'Anthropic, y compris Claude Code, de parler à la place à un modèle Ollama.

Famille de modèlesFabriquée par
QwenAlibaba
DeepSeekDeepSeek
KimiMoonshot AI
GLMZ.ai

Pourquoi la première tentative a échoué

C'est le deuxième essai d'Ollama. The New Stack rapporte qu'un effort antérieur s'est enlisé. Dev.ua en donne la raison : au printemps, Claude Desktop rejetait les identifiants de modèle qui n'étaient pas ceux d'Anthropic, et l'intégration s'est cassée. Le nouveau proxy est conçu pour passer cette vérification.

Cet historique compte plus que la fonctionnalité. Il vous dit que l'intégration fonctionne grâce à la façon dont Claude Desktop valide les modèles aujourd'hui, pas parce qu'Anthropic a construit un point d'accroche pour elle.

Ce que cela signifie pour les développeurs

Utilisez-le pour ce qu'il fait bien : tester des modèles côte à côte dans une seule fenêtre. Dev.ua présente l'avantage ainsi : essayer différents modèles depuis une seule application au lieu de changer de service. Passez le même prompt dans Claude, puis basculez vers Qwen ou DeepSeek, et comparez. C'est plus rapide que de jongler entre quatre applications et quatre comptes.

Ne bâtissez pas un flux de travail dessus. La version du printemps est morte quand Claude Desktop a resserré une vérification d'identifiant de modèle, et rien dans les articles ne suggère qu'Anthropic a validé celle-ci. Une mise à jour de l'application de bureau pourrait la casser de nouveau sans préavis. Gardez votre vraie configuration de modèles locaux dans la CLI ou l'API d'Ollama, où vous contrôlez les deux bouts.

Comprenez précisément la frontière de confidentialité. Avec un modèle Ollama local sélectionné, le prompt reste sur votre machine. C'est vrai pour l'appel au modèle. Cela ne vous dit pas ce que Claude Desktop lui-même journalise ou renvoie à ses serveurs, car les articles ne couvrent pas ce point. Si vous avez besoin d'une garantie, vérifiez vous-même le trafic réseau avant de coller quoi que ce soit de sensible.

Le changement plus profond est la compatibilité d'API en dessous. Le fait qu'Ollama accepte désormais des requêtes au format Anthropic signifie que Claude Code, l'agent en ligne de commande, peut aussi pointer vers un modèle local. Pour les équipes qui ne peuvent pas envoyer de code à une API cloud, c'est la porte la plus utile qu'ouvre cette version. L'astuce Claude Desktop est la démo. La couche de compatibilité d'API est l'outil.

Sources

  1. Claude Desktop can now easily run Qwen, DeepSeek and Kimi models - after Ollama's first effort stalled - The New Stack
  2. Ollama has allowed DeepSeek, Qwen and Kimi to run in Claude Desktop. Why is this necessary? - dev.ua
  3. Ollama Blog - Ollama

Articles liés