Aller au contenu

Je cherche une alternance en développement web pour l’année scolaire 2026-2027

Me contacter
Veille

Veille IA dev : Claude Haiku 5.5, Mistral Large 4, sandboxing Copilot et défi Codex (6–8 oct. 2026)

Anthropic lance Claude Haiku 5.5, très bon marché, Mistral ouvre la preview de Large 4 et Reflection annonce Beam (501B). Copilot généralise son sandboxing local, Cursor pilote ses agents depuis l'iPhone et Codex enchaîne améliorations et resets.

Par Léo FRANZ 12 min de lecture

Trois jours chargés côté modèles : Anthropic lance Claude Haiku 5.5, déjà disponible dans Copilot, Cursor et Claude Code, Mistral ouvre la preview de Mistral Large 4 et Reflection annonce Beam, un modèle open-weight de 501 milliards de paramètres. Côté outils, Copilot passe son sandboxing local en disponibilité générale, Cursor pilote les agents locaux depuis l'iPhone et OpenAI enchaîne les annonces de son défi « 28 jours » pour Codex. Voici l'essentiel du 6 au 8 octobre 2026, avec quelques annonces du soir du 5 octobre parues après le précédent récap.

Lignes de code colorées sur un écran sombre
Lignes de code colorées sur un écran sombre

Photo : Ilya Pavlov (Unsplash), via Wikimedia Commons, domaine public CC0 1.0.

Nouveaux modèles#

Claude Haiku 5.5 : le petit modèle d'Anthropic devient très bon marché (7 octobre)#

Anthropic a publié Claude Haiku 5.5 (claude-haiku-5-5), pensé pour les tâches rapides et répétées : classification, routage, résumés, compaction de contexte et sous-agents de code aux côtés d'Opus 5.5 ou Sonnet 5.5. Il offre un contexte d'1 million de tokens, 128 000 tokens en sortie et, pour la première fois sur un Haiku, un réglage d'effort. Attention : son tokenizer compte environ 30 % de tokens de plus que celui de Haiku 4.5.

Prix par million de tokensPrompts ≤ 100 000 tokensPrompts > 100 000 tokens
Entrée0,10 $0,50 $
Sortie0,50 $2,50 $
Lecture de cache0,01 $0,05 $

Selon Anthropic, il coûte en moyenne environ 75 % de moins que Haiku 4.5. Sur Terminal-Bench 4.0, il obtient 39,2 %, contre 70,6 % pour Sonnet 5.5, qui reste préférable pour le code complexe. Anthropic divise aussi par deux le prix des lectures de cache de Sonnet 5.5 (0,10 $ au lieu de 0,20 $), soit environ 20 % d'économie sur la plupart des tâches agentiques, et ajoute un crédit API mensuel pour les abonnés Max et Team. Haiku 5.5 est disponible dans GitHub Copilot (offres payantes, déploiement progressif) et dans Cursor (48,4 % sur CursorBench en effort max).

👉 Annonce Anthropic · Documentation · GitHub Changelog · Cursor

Mistral Large 4 en preview publique (6 octobre)#

Mistral a ouvert la preview de Mistral Large 4 (surnommé « Le Chonk ») sur son API, via Mistral Studio. C'est un modèle Mixture-of-Experts nativement multimodal d'environ 1 000 milliards de paramètres, dont 49 milliards actifs par token (52 milliards en comptant les couches d'embedding et de sortie), avec un contexte d'1 million de tokens. Mistral annonce les poids ouverts « d'ici la fin du mois » ; la page Hugging Face prévoit une sortie le 31 octobre. En code, Mistral annonce 61,7 % sur DeepSWE v1.1. Pendant la preview, l'API est à moitié prix : 0,68 $ par million de tokens en entrée et 2,09 $ en sortie (au lieu de 1,36 $ et 4,18 $).

👉 Introducing Mistral Large 4 · Documentation · Hugging Face

Reflection annonce Beam, un modèle open-weight de 501B (5 octobre)#

Reflection présente Beam, son premier modèle open-weight : un MoE de 501 milliards de paramètres dont 23 milliards actifs, conçu pour le code, le raisonnement et les agents. Reflection revendique 80,9 sur SWE-Bench Verified, un chiffre qu'aucun tiers n'a encore reproduit. Pour l'instant, l'accès se fait sur liste d'attente. Les poids (sous licence Apache 2.0), le rapport technique et la fiche du modèle sont promis pour plus tard en octobre.

👉 Introducing Beam — Reflection

EmbeddingGemma 2 : des embeddings multimodaux en local (6 octobre)#

Google DeepMind publie EmbeddingGemma 2, un modèle d'embeddings de 740 millions de paramètres sous licence Apache 2.0. Il place le texte, le code, les images, l'audio et la vidéo dans un même espace vectoriel. Modulaire (270 millions de paramètres suffisent pour le texte seul), il gagne près de 10 points sur MTEB Code (78,68), de quoi indexer un dépôt en local ou alimenter la recherche d'un agent de code. Il fonctionne avec transformers, llama.cpp, Ollama ou vLLM.

👉 Blog Google · Hugging Face

Liquid AI ouvre ses modèles de décision d1 (7 octobre)#

Liquid AI publie en open-weight d1-3B et d1-omni-600M, deux « modèles de décision ». Ils ne génèrent pas de texte : ils rendent une réponse (classification, routage, modération, garde-fou) en une seule passe. Selon Liquid AI, d1-3B répond en 8 ms sur une RTX 4090. Les deux modèles sont sur Hugging Face et compatibles llama.cpp.

👉 Open d1 — Liquid AI

GitHub Copilot#

Le sandboxing local de Copilot en disponibilité générale (7 octobre)#

Le sandboxing local est désormais disponible pour tous dans Copilot CLI, l'application GitHub Copilot et les sessions VS Code qui utilisent l'Agent Host. Les commandes lancées par Copilot ont un accès restreint aux fichiers, au réseau et aux identifiants Git et GitHub CLI, selon une politique définie par le développeur ou l'organisation. Le moteur, Microsoft eXecution Container (MXC), traduit cette politique en contrôles natifs sous Windows, macOS et Linux. Les entreprises peuvent l'imposer, et c'est inclus sans surcoût. Dans la CLI, la version 1.0.93 (7 octobre) la rend accessible à tous via /sandbox et --sandbox.

👉 GitHub Changelog · Documentation

Copilot CLI : réglages en ligne de commande et modèles locaux Ollama (5 et 7 octobre)#

La 1.0.92 (5 octobre) ajoute la commande copilot config, qui permet de lister, lire, modifier et supprimer les réglages. Avant le premier message, Ctrl+E ouvre un sélecteur pour lancer la session en local ou dans le cloud. À partir de la préversion 1.0.94-0 (7 octobre), /model détecte aussi les modèles d'une instance Ollama locale. On l'ajoute à la session sans redémarrer ; il doit gérer l'appel d'outils et le streaming. Attention : utiliser un modèle local n'active pas le mode hors ligne (COPILOT_OFFLINE=true).

👉 Changelog Copilot CLI · GitHub Changelog — modèles locaux

Claude Code#

Claude Code 2.1.290 à 2.1.294 (6 au 8 octobre)#

Cinq versions en trois jours :

  • 2.1.290 (nuit du 5 au 6) : nouvelles données pour les mods (serverToolUses, agentId dans tool.check), claude attach et claude logs acceptent une partie du nom de session. WebFetch ne coupe plus silencieusement les pages au-delà de 100 000 caractères.
  • 2.1.291 (6 octobre) : corrige deux régressions, dont des réponses aux demandes de permission perdues dans les sessions cloud.
  • 2.1.292 (6 octobre) : claude plugin install --marketplace <source> ajoute la marketplace puis installe le plugin. L'outil Agent accepte un paramètre effort pour lancer un sous-agent au niveau d'effort voulu. Plus plusieurs correctifs de sécurité.
  • 2.1.293 (7 octobre) : Haiku 5.5 devient le modèle Haiku par défaut sur l'API Anthropic.
  • 2.1.294 (8 octobre) : les hooks prompt et agent rédigés comme des consignes (« Bloque les commandes qui… ») pouvaient laisser passer ce qu'ils devaient bloquer. C'est corrigé.

👉 Release 2.1.292 · Release 2.1.293 · CHANGELOG officiel

Cursor#

Personne tenant un smartphone devant un ordinateur portable
Personne tenant un smartphone devant un ordinateur portable

Photo : Alejandro Escamilla (Unsplash), via Wikimedia Commons, domaine public CC0 1.0.

Piloter ses agents locaux depuis l'iPhone (6 octobre)#

Avec Remote control, l'application Cursor pour iOS affiche les agents qui tournent sur votre ordinateur : on peut suivre leur travail et leur envoyer des messages. Les agents restent sur la machine, l'application s'y connecte seulement. L'ordinateur doit rester allumé et en ligne (une option « Keep this computer awake » empêche la mise en veille). La fonction est activée par défaut, sauf pour les organisations Enterprise, où un administrateur doit l'activer.

👉 Changelog Cursor

OpenAI Codex#

Le défi des « 28 jours » : vitesse, Auto-review gratuit et réinitialisations (5 au 8 octobre)#

Le 4 octobre, Thibault Sottiaux (Codex et ChatGPT Work chez OpenAI) s'est engagé à livrer, chaque jour pendant 28 jours, soit une amélioration utile au plus grand nombre, soit une réinitialisation complète des limites d'usage. Bilan des trois premiers jours :

JourDateAnnonce
15 oct.GPT-6 Astra et GPT-6.1 Sol environ 50 % plus rapides via l'abonnement, y compris chez les partenaires « Sign in with ChatGPT » (OpenCode, Pi, Amp, Devin…)
26 oct.Auto-review (« Approve for me ») gratuit pour les comptes ChatGPT, plus trois autres nouveautés dont la Decisions API ; après un vote, une réinitialisation a aussi été accordée
37 oct.GPT-6 dans le Chat de ChatGPT et une réinitialisation « mise de côté » chargée sur tous les comptes payants (confirmée le 8 octobre)

Le 8 octobre, en « bonus » du jour 3, Thibault Sottiaux annonce avoir « discrètement relancé » Codex cloud, qui sait aussi se connecter aux ressources d'un réseau Tailscale (intégration détaillée par Tailscale le 6 octobre).

👉 Jour 1 (X) · Jour 2 (X) · Jour 3 (X) · Codex cloud (X) · Tailscale

Codex CLI 0.161.0 (7 octobre)#

GPT-6.1 Sol devient le modèle par défaut, y compris dans le catalogue Amazon Bedrock. La commande /mcp login permet de se connecter à un serveur MCP en cours de session, et plusieurs problèmes de permissions et de reprise de session sont corrigés.

👉 Changelog Codex

En bref#

OpenAI et GitHub

  • OpenAI Decisions API (6 octobre) : API en bêta publique, basée sur GPT-6 Luna. Elle répond à des questions fermées (vrai/faux, choix, score) sur du texte ou des images, jusqu'à 10 fois plus vite que l'API Responses, pour 0,10 $ par million de tokens en entrée. 👉 Forum OpenAI
  • GPT-6 et « Intelligent UI » dans ChatGPT (7 octobre) : les réponses peuvent intégrer graphiques, formulaires, boutons et petits outils interactifs. Les modèles de Codex et de Work ne changent pas. 👉 OpenAI
  • GitHub stacked pull requests en GA (6 octobre) : découper une grosse modification en PR empilées, revues séparément et fusionnées ensemble, avec l'extension gh stack. 👉 GitHub Changelog
  • Détection de secrets par IA chez GitHub (7 octobre) : un modèle dédié repère les identifiants sans format reconnaissable, y compris les mots de passe. Il équipe déjà les alertes de secret scanning, la push protection l'utilise en préversion privée et /security-review (Copilot CLI et app) suivra. 👉 GitHub Changelog

Modèles et outils open source

  • GLM 5.3 sur Amazon Bedrock (5 octobre) : le modèle open-weight de Z.ai (753 milliards de paramètres, environ 40 milliards actifs, contexte 1M) est disponible pour les clients entreprise éligibles. 👉 AWS
  • Perplexity pplx-embed-v2-late (7 octobre) : deux modèles d'embeddings multimodaux de type ColBERT (0,6B et 9B), sous licence MIT. 👉 MarkTechPost · Hugging Face
  • LiteLLM publie Moyai en open source (7 octobre) : un agent de code cloud auto-hébergé qui reçoit une tâche depuis Slack ou le navigateur et ouvre une PR. Il fait tourner Claude Code, Codex ou OpenCode via LiteLLM. 👉 LiteLLM · GitHub

À retenir#

  • Les petits modèles rapides deviennent un levier d'économie concret : Haiku 5.5 et les modèles de décision (d1, Decisions API) sont faits pour les sous-agents, le routage et la classification, pendant que les gros modèles gardent les tâches difficiles.
  • L'open-weight lourd revient : Mistral Large 4 et Reflection Beam promettent leurs poids d'ici fin octobre. À vérifier à la sortie : licence, matériel nécessaire et benchmarks indépendants.
  • La sécurité des agents se standardise : sandboxing local en GA chez Copilot, Auto-review gratuit chez Codex, correctifs de hooks et de sandbox dans Claude Code.
  • Les agents se pilotent à distance : Cursor depuis l'iPhone, Codex cloud relancé, Moyai en auto-hébergé.

Sources#

Nouveaux modèles

GitHub Copilot

Claude Code et Cursor

OpenAI Codex

En bref

Crédits images#

Sur le même thème