Partager ce rapport :
TL;DR
- Claude Desktop accepte Ollama comme passerelle tierce, modèles ouverts utilisables dans Claude [1]
- EVE Online entame sa migration vers Python 3, après 16 ans sous Stackless Python 2.7 [5]
- llm-anthropic 0.27 sort, compatible avec la lib anthropic v1.0.0 qui passe de httpx à httpx2 [6]
Les 3 signaux
🔌 Interopérabilité — Claude Desktop se configure désormais avec Ollama comme fournisseur de passerelle tiers [1]. Les modèles ouverts tournent dans l’interface Claude. Le blog Ollama publie la procédure. Aucun détail technique supplémentaire fourni.

Pourquoi ça compte : vous pouvez garder l’UI Claude Desktop pour vos workflows tout en exécutant des modèles locaux, sans passer par l’API Anthropic.
🐍 Migration legacy — EVE Online, sous Stackless Python 2.7 depuis 2010, lance sa migration vers Python 3 [5]. Le jeu tourne sur Stackless Python depuis 2003, soit plus de 20 ans de dette technique accumulée. La dernière montée de version majeure date de 16 ans.
Pourquoi ça compte : si vous maintenez un gros codebase Python legacy, cette migration est un cas d’école sur la stratégie de sortie d’une version EOL à grande échelle.
📦 Compatibilité API — llm-anthropic 0.27 aligne le plugin LLM avec la lib anthropic v1.0.0, qui remplace httpx par httpx2 [6]. OpenAI a fait le même changement dans sa v3.0.0 il y a deux semaines. La migration guide est disponible.
Pourquoi ça compte : si vous utilisez les SDK OpenAI ou Anthropic, le passage à httpx2 impacte votre code de transport HTTP, pas juste les appels de chat.
À retenir
- 16 ans — temps écoulé depuis la dernière montée de version Python d’EVE Online (2.7 en 2010), migration vers Python 3 en cours [5]
- httpx2 — la lib anthropic v1.0.0 y migre, comme OpenAI v3.0.0 il y a deux semaines ; llm-anthropic 0.27 suit [6]
- SELF — application ID SQLite (4 octets, offset 68) qui permet d’exécuter une base de données comme binaire Linux [7]
🛠 Tuto du jour
Tuto / Outil : Claude Desktop support with Ollama [1] Ce qu’on installe : Configuration de Claude Desktop pour utiliser Ollama comme passerelle vers des modèles ouverts. Prérequis hardware & commande : Non spécifiés dans la source ; installation via la configuration du provider dans Claude Desktop [1].
💻 Matos & Infra local
Sujet Matos/Infra : Quantization-Aware Healing, modèle 4-bit surpassant l’original full-precision [2] Constat technique : Un modèle compressé en 4-bit dépasse les performances de sa version non quantifiée, ce qui réduit l’empreinte mémoire et la VRAM requise pour l’inférence locale. Recommandation dev : Évaluer cette approche de quantification pour les déploiements sur GPU à mémoire limitée. Sujet Matos/Infra : Exploitation des moteurs d’inférence [14] Constat technique : Un essai détaille comment des LLMs pourraient contrôler leur machine hôte via les moteurs d’inférence, un vecteur de risque pour l’infrastructure locale. Recommandation dev : Auditer les permissions et l’isolation des processus des moteurs d’inférence locaux.
🎯 Fine-Tuning & Quantiz
Technique / Outil : Quantization-Aware Healing, modèle 4-bit compressé [2] Apport : Performance supérieure au modèle original en pleine précision [2] Impact pratique : Permet de déployer un modèle compressé sans perte, voire avec gain, par rapport à la référence non quantifiée [2]
Technique / Outil : Support de Claude Desktop via Ollama [1] Apport : Intégration de modèles ouverts dans Claude Desktop [1] Impact pratique : Configuration d’Ollama comme passerelle tierce pour utiliser des modèles ouverts [1]
🧠 RAG & Agents Locaux
Architecture / Outil : Crase [18] Cas d’usage : Recherche documentaire savante avec exploration de graphe de citations, entièrement locale et bornée [18] Clé de voûte : Élagage des arêtes de citation sans support d’implication, puis classement pour une recherche profonde inspectable [18]
📊 Track Record
Ce qu’on disait le 2026-08-12 : « NVIDIA Nemotron 3.5 Lightning (30B, 3B actifs) disponible sur Ollama pour agents multi-étapes » [5] Verdict aujourd’hui : partiellement tenu. L’intégration d’Ollama comme passerelle tierce pour Claude Desktop est confirmée [1], mais aucune mise à jour spécifique sur Nemotron 3.5 Lightning n’est apparue dans les éléments du jour. La disponibilité initiale est validée, sans preuve de progression ou d’adoption notable.
🔗 Sources (18) — vérifiées le 26/08/2026 05:00 UTC
- Claude Desktop support with Ollama — Ollama · 2026-08-25
- Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original — Hugging Face · 2026-08-25
- Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses — arXiv · 2026-08-25
- Strictly Causal Streaming Video Anomaly Detection with a Theoretically-Grounded State-Space Core — arXiv · 2026-08-25
- EVE Online: The Move to Python 3 Begins! — Simon Willison · 2026-08-25
- llm-anthropic 0.27 — Simon Willison · 2026-08-24
- Your executable is a SQLite database — Simon Willison · 2026-08-24
- WeMM-Embedding: WeChat Multi-Modal Embedding Technical Report — HF Papers
- TorchMorph: CUDA-accelerated Morphological Transforms — HF Papers
- AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces — HF Papers
- Meta^n: Recursive Self-Improvement through Emergent Depth — HF Papers
- The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models — HF Papers
- The Laws of Context Allocation: Causal Measurement and Closed-Loop Orchestration in Generative Search — HF Papers
- LLMs could control their host machines by exploiting inference engines — Hacker News · 2026-08-24
- SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL — arXiv · 2026-08-25
- Improving Cross-Problem Vehicle Routing with Locally Augmented Preferences and Representation Disentanglement — arXiv · 2026-08-25
- BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes — arXiv · 2026-08-25
- Structurally-bounded Agentic Graph Exploration for Evidence-Grounded Scholarly DeepSearch — arXiv · 2026-08-25
V3ille — Sources : arXiv, GitHub Trending, Hugging Face Daily Papers, OpenAI, DeepMind, Google AI, IEEE Spectrum, The Robot Report.