Partager ce rapport :
TL;DR
- ZCode, présenté comme « Claude Code from the Makers of GLM », publié par l’équipe GLM, 412 points HN [2][4]
- Senior SWE-Bench lancé : benchmark open-source qui évalue des agents comme des ingénieurs seniors [1]
- Weave Robotics lance Isaac 1, robot domestique à 7 999 $, livraisons automne 2026 [8]
Les 3 signaux
🤖 Agents de code : ZCode et Senior SWE-Bench ZCode, décrit comme « Claude Code from the Makers of GLM », atteint 412 points sur Hacker News [2]. Une page dédiée (zcode.z.ai/en) le présente comme un harnais pour GLM-5.2 [2]. La version chinoise cumule 274 points supplémentaires [4]. Parallèlement, Senior SWE-Bench sort : un benchmark open-source qui évalue les agents comme des ingénieurs seniors, 100 points HN [1]. Un papier examine si les benchmarks d’optimisation de performance mesurent correctement les agents de codage [16].
🏠 Robotique domestique : Isaac 1 à 7 999 $ Weave Robotics lance Isaac 1, un robot domestique à 7 999 $, livraisons annoncées pour l’automne 2026, 188 points HN et 277 commentaires [8]. Un article du Robot Report affirme que la robustesse n’est plus optionnelle en robotique : l’autonomie sortant des environnements contrôlés impose une conception ruggedisée [6]. FurnitureVLA, un modèle Vision-Language-Action, démontre l’assemblage bimanuel de meubles à échelle réelle [15].
🧠 Recherche : séparation état-prédiction et mémoire comme compétence Un papier formule l’hypothèse de séparation état-prédiction : dissocier les deux rôles dans les Transformers améliore la modélisation du langage [14]. AutoMem traite la gestion de mémoire comme une compétence cognitive entraînable, promouvant les opérations sur fichiers en actions de première classe [12]. Theoria propose un vérificateur d’acceptabilité de réécriture sur des états de raisonnement informels [13]. Un autre papier mesure l’écart entre idées de recherche humaines et celles générées par LLM [9].
À retenir
- 412 points HN pour ZCode, présenté comme « Claude Code from the Makers of GLM » [2]
- 7 999 $ prix d’Isaac 1, robot domestique avec livraisons automne 2026 [8]
- 2 rôles (prédiction et état) séparés dans une variante Transformer [14]
🔗 Sources (18) — vérifiées le 02/07/2026 11:15 UTC
- Senior SWE-Bench: open-source benchmark that assesses agents as senior engineers — Hacker News · 2026-07-02
- ZCode – Harness for GLM-5.2 — Hacker News · 2026-07-01
- OpenWiki: CLI that writes and maintains agent documentation for your codebase — Hacker News · 2026-07-01
- ZCode: Claude Code from the Makers of GLM — Hacker News · 2026-07-01
- Democrats Pick Up the Global Digital ID Agenda in Project 2029 — Hacker News · 2026-07-01
- In Robotics, Ruggedization Is No Longer Optional — The Robot Report · 2026-07-01
- The latest AI news we announced in June 2026 — Google AI · 2026-07-01
- Weave Robotics launches Isaac 1, a $7,999 home robot with Fall 2026 deliveries — Hacker News · 2026-07-01
- Measuring the Gap Between Human and LLM Research Ideas — arXiv · 2026-07-01
- Is One Layer Enough? Training A Single Transformer Layer Can Match Full-Parameter RL Training — arXiv · 2026-07-01
- Language-Critique Imitation Learning from Suboptimal Demonstrations — arXiv · 2026-07-01
- AutoMem: Automated Learning of Memory as a Cognitive Skill — arXiv · 2026-07-01
- Theoria: Rewrite-Acceptability Verification over Informal Reasoning States — arXiv · 2026-07-01
- The State-Prediction Separation Hypothesis — arXiv · 2026-07-01
- FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model — arXiv · 2026-07-01
- Are Performance-Optimization Benchmarks Reliably Measuring Coding Agents? — arXiv · 2026-07-01
- Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation — arXiv · 2026-07-01
- TiRex-2: Generalizing TiRex to Multivariate Data and Streaming — arXiv · 2026-07-01
V3ille — Sources : arXiv, GitHub Trending, Hugging Face Daily Papers, OpenAI, DeepMind, Google AI, IEEE Spectrum, The Robot Report.