L'essentiel
Un mois de modèles : Anthropic sort Fable 5.1 (et Mythos 5.1, réservé à la cybersécurité défensive), OpenAI lance GPT-6 Astra puis GPT-6 Sol et Luna, Google Gemini 3.8 Flash, xAI Grok 4.7, et DeepSeek publie V4.1 Flash en poids ouverts sous licence MIT.
Tendance nette : chez Anthropic, OpenAI et Google, les capacités « cyber » passent derrière des programmes d'accès de confiance (Mythos, Astra, Flash Cyber).
Côté produit, Claude fusionne le chat et Cowork, ajoute Docs et Slides, met Claude Design dans toute conversation et ouvre un Marketplace de plus de 2 000 connecteurs.
Le milieu de gamme devient très bon et très bon marché (Luna à 0,10 $ / 0,50 $ le million de tokens) : l'arbitrage entre modèles devient un vrai sujet.
Trois modèles de transcription en streaming en trois semaines (Meta, Microsoft, xAI) : la reconnaissance vocale bouge vite.
🎯 Pour toi
Maquetter la page d'accueil d'une nouvelle identité dans Claude Design, sans changer d'outil
Depuis le 16/09, Claude Design fonctionne dans n'importe quelle conversation Claude au lieu d'un espace à part ; ça accompagne la fusion du chat et de Cowork. Niveau de preuve : officiel, mais le déploiement est progressif sur Pro et Max « dans les semaines à venir ».
Chez toi : une refonte d'identité visuelle est en cours, avec une charte déjà écrite et un logo en SVG ; il reste la page d'accueil du futur site. Avec Design dans la conversation, tu maquettes la page à partir de la charte, tu itères sur place, puis Claude Code reproduit proprement la version retenue. Pour une interface qui doit sortir du lot, le premier tour doit varier la structure des pages, pas seulement les couleurs.
Pour l'essayer : ouvrir claude.ai, vérifier que l'interface unifiée est arrivée, donner la charte et le logo, demander trois structures de page réellement différentes. Coût : inclus dans l'abonnement, une heure.
Source : claude.com/blog/cowork-is-now-claude
Prendre un modèle de transcription cloud comme étalon, pas comme remplaçant
Meta (Muse Voice Transcribe, 01/09), Microsoft (MAI-Transcribe-2, 03/09) et xAI (Grok Voice Transcribe 2.0, 18/09) ont sorti des modèles de transcription en streaming. xAI revendique la première place sur 32 modèles du classement Artificial Analysis, à 0,10 $ l'heure d'audio en lot. Niveau de preuve : annonces officielles, mais les chiffres de précision viennent des éditeurs, et rien ne dit qu'ils tiennent en français.
Chez toi : ta transcription tourne en local, sur un modèle Whisper, justement pour que les enregistrements confidentiels ne sortent pas de la machine : aucun de ces modèles n'y change rien. Mais ton choix de modèle local n'a jamais été confronté à l'état de l'art. Pour quelques centimes, un de ces modèles te dit si le local te coûte de la qualité, ou pas.
Pour l'essayer : prendre un enregistrement sans rien de confidentiel, le passer dans ton outil local puis dans l'API de xAI ou de Microsoft, et comparer à la main, en particulier les chiffres et les noms propres. Coût : quelques centimes, une heure.
Source : annonces des trois éditeurs ; classement Artificial Analysis.
Des sous-agents avec un modèle par rôle, pour ménager ta limite d'usage
En septembre, le milieu de gamme est devenu très bon marché : GPT-6 Luna à 0,10 $ / 0,50 $ et Sol à 2 $ / 10 $ le million de tokens (22/09), Gemini 3.8 Flash à 0,75 $ / 3,75 $ (02/09), DeepSeek V4.1 Flash en poids ouverts (10/09). GitHub Copilot en tire la conséquence le 18/09 avec une sélection automatique du modèle en trois niveaux : efficacité, équilibre, intelligence. Niveau de preuve : officiel ; les comparaisons de benchmarks entre éditeurs sont à prendre avec prudence.
Chez toi : sur un abonnement, le prix au token ne te touche pas ; ce qui te touche, c'est la limite d'usage sur 5 heures, qui compte tous les modèles Claude ensemble. Les sous-agents que tu prévois de monter par projet sont l'endroit où poser ce que Copilot automatise : Haiku pour le mécanique (inventaire, reformatage, vérifications), Opus pour le raisonnement. Franchement, sur l'arbitrage lui-même, Copilot et Cursor sont en avance : ils routent vers plusieurs éditeurs, alors que les sous-agents de Claude Code restent dans la famille Claude.
Pour l'essayer : au montage du premier agent, mettre model: haiku et un effort bas dans son frontmatter, puis comparer /usage avant et après une tâche type. Coût : nul.
Sources : openai.com · github.blog
Cursor Projects fait nativement ce que ton fichier de reprise fait à la main
Le 02/09, Cursor a ouvert en bêta « Projects », un espace de travail pour les chantiers longs : il garde le contexte sur plusieurs mois, délègue à des agents dans le cloud et réagit à des signaux extérieurs (Slack, planning, pull requests). Le même jour, « My Machines » permet de garder l'exécution des outils sur sa propre machine. Niveau de preuve : officiel (changelog Cursor), mais c'est une bêta, sans prix ni limites connus.
Chez toi : ta continuité d'une session à l'autre repose sur une discipline : un fichier de reprise par projet, un protocole avant chaque compactage, une mémoire synchronisée entre tes machines. Ça fonctionne, mais c'est toi qui déclenches, et rien ne réagit seul à un événement. Sur ce point précis, Cursor est devant Claude Code, et il vaut mieux le savoir, même si changer d'outil n'aurait pas de sens pour une architecture entièrement bâtie sur Claude Code.
Pour l'essayer : rien à installer ; lire le changelog de Cursor et noter ce que Projects fait que ton protocole ne fait pas. Coût : un quart d'heure.
Source : cursor.com/changelog
Tour d'horizon
Anthropic / Claude
- Claude Fable 5.1 et Claude Mythos 5.1 (01/09) — Un même modèle avec deux niveaux de garde-fous. Fable 5.1 est ouvert à tous (API, AWS, Google Cloud, Azure, identifiant
claude-fable-5-1) ; Mythos 5.1 est réservé aux programmes d'accès de confiance, pour la cybersécurité défensive et la recherche en sciences de la vie, à 10 $ / 50 $ le million de tokens. Anthropic annonce aussi une baisse de 75 % du coût des lectures de cache pour Fable. Pour toi : la baisse du cache concerne la facturation API ; je ne sais pas si elle change quoi que ce soit au quota d'un forfait Max. source - Claude Marketplace (23/09) — Un catalogue unique en trois volets : plus de 2 000 connecteurs et plugins construits sur MCP et les Agent Skills (Atlassian, Google, Microsoft, Notion, Salesforce…), des produits partenaires construits sur Claude (Cursor, Lovable, Snowflake…) payables sur un budget Anthropic déjà engagé, et des cabinets de conseil (Accenture, BCG, Deloitte). Disponible dès l'annonce. Pour toi : plus de choix, pas plus de confiance ; ton analyse de risque passe avant chaque connecteur. Pour un projet d'ERP en cours, une recherche dans le catalogue vaut le coup. source
- Chat et Cowork fusionnés, arrivée de Claude Docs et Claude Slides (16/09) — Une seule interface choisit le mode selon la tâche ; Docs et Slides arrivent ; Claude Design fonctionne dans toute conversation. Déploiement progressif sur Pro et Max (web, desktop, mobile), puis Free et Team. (Design : voir 🎯) Pour toi : pour un document à partager sans exigence Word, Docs peut t'éviter une chaîne de génération Word maison ; pour un
.docxsoigné, elle reste la référence. source - Claudeforce (26/08) — Salesforce et Anthropic annoncent l'intégration de Claude dans Agentforce, le volet agents du CRM de Salesforce. Communiqué sans date de disponibilité ni détail technique. source
- Claude ferait un quart de la R&D de son successeur (rapporté le 18/09) — Anthropic affirme qu'en août, Claude a réalisé environ un quart du travail de recherche et développement du modèle suivant. C'est une déclaration de l'entreprise sur ses propres méthodes, sans méthodologie indépendante, et la source primaire n'a pas été retrouvée. Niveau de preuve : communication d'entreprise. Source : reprise par Spectrum News, URL non fournie par la collecte.
OpenAI
- GPT-6 Astra (03/09) — Le nouveau modèle phare (
gpt-6-astra), contexte d'un million de tokens, prix 2,5 fois celui de GPT-5.6 Sol. Les capacités jugées sensibles en cybersécurité restent derrière un programme d'accès de confiance. Source : annonce OpenAI reprise par CNBC, URL non fournie par la collecte. - GPT-6 Sol et GPT-6 Luna (22/09) — Sol pour le code et l'agentique, Luna pour le volume à faible latence, dans ChatGPT Work et Codex, Luna aussi en gratuit sur l'app desktop ; prix divisés par deux (voir 🎯). source
- GPT-5.3-Codex-Spark retiré (14/09) — Plus disponible dans l'app desktop ChatGPT, le CLI Codex ni l'extension IDE ; aucun remplaçant direct précisé. Source : notes de version Codex, URL non fournie par la collecte.
- Gemini 3.8 Flash et 3.8 Flash Cyber (02/09) — Troisième Flash en six semaines, même prix que 3.7 Flash (0,75 $ / 3,75 $) pour de meilleurs résultats selon Google (voir 🎯). La variante Cyber, pour la découverte autonome de vulnérabilités, est réservée aux testeurs du nouveau « Fairwind Program ». Source : annonce Google DeepMind reprise par The Register et 9to5Google, URL non fournie par la collecte.
- Gemini 3.8 Live et Live Extended Thinking (15/09) — Deux modèles de dialogue vocal en direct, sur l'API Gemini, AI Studio, Gemini Live, Search Live et Workspace, présentés comme meilleurs pour raisonner à voix haute sur des tâches complexes. Source : annonce Google, URL non fournie par la collecte.
- AI Studio Build limité aux modèles Flash (courant septembre, jour non confirmé) — Le mode Build n'accepte plus que les Flash ; les Pro restent dans le Playground. Rapporté sur le forum des développeurs, sans justification officielle. source
Autres labos
- Meta Muse Spark 1.3 (02/09) — Modèle à poids fermés, contexte d'un million de tokens, 1,25 $ / 4,25 $ le million de tokens. Aucune disponibilité en UE signalée. Source : annonce Meta, URL non fournie par la collecte.
- xAI Grok 4.7 (21/09) — Nouveau modèle de base, 2 100 milliards de paramètres selon xAI, présenté comme son meilleur pour le code et le travail de connaissance, avec une pile de garde-fous reconstruite. 46,3 % sur CursorBench 4.0 contre 40,4 % pour Grok 4.6 (chiffres de l'éditeur). Même prix que 4.6 (2 $ / 6 $). Disponible dans Cursor, Grok Build et l'API. Source : annonce xAI, URL non fournie par la collecte.
- DeepSeek V4.1 Flash (10/09) — Mixture-of-experts de 552 milliards de paramètres (8 milliards actifs en entrée, 16 en sortie), poids ouverts sous licence MIT, multimodal, cache clé-valeur fortement réduit. Depuis le 14/09, les appels à
deepseek-v4-prosont routés vers lui en attendant un V4.1-Pro. Pour toi : malgré peu de paramètres actifs, il faut charger les 552 milliards : hors de portée d'un PC de bureau en local, seulement par l'API. source
Outils de développement IA
- Cursor : Projects et My Machines (02/09) — Espace de travail bêta pour les chantiers longs, et exécution des outils gardée sur sa propre machine ou sur un pool d'équipe (voir 🎯). source
- GitHub Copilot, semaine du 14/09 (18/09) — Claude Opus 5.5 disponible pour le code agentique, sélection automatique du modèle en trois niveaux (voir 🎯), revue de code qui résout seule les commentaires traités et suggère les messages de commit, agents dans des Dev Containers locaux depuis la fenêtre Agents de VS Code. Dépréciation de plusieurs modèles le 19/10. Pour toi : les Dev Containers supposent Docker, absent de ton stack. source
- Codex dans l'app desktop ChatGPT : discussion rapide (rapporté le 01/09) — Lancement d'une discussion depuis les contrôles flottants,
@pour ajouter du contexte,$pour choisir une compétence, meilleure dictée. Rapporté par un fil de communauté, pas par une note de version. source
Agents & automatisation
Rien de notable sur la période : ni n8n, Make ou Zapier, ni les frameworks multi-agents. Spécification MCP toujours à 2026-07-28, serveurs de référence à 2026.8.31. Le seul mouvement est le Marketplace (voir Anthropic).
IA locale & modèles ouverts
- Ollama v0.34.4 passe en stable (23/09) — Sorties structurées en une seule passe sur les modèles de réflexion, fin des erreurs « modèle non trouvé » sur les grosses bibliothèques, Gemma 4 qui choisit seul la résolution d'image, mises à jour de llama.cpp, MLX et XGrammar. Pour toi : aucun LLM local chez toi aujourd'hui ; si tu testes un jour ce que tient une carte graphique de 8 Go, ce serait la version de départ. source
- DeepSeek V4.1 Flash, en poids ouverts sous licence MIT : voir Autres labos.
Voix, image, vidéo
- Trois modèles de transcription en streaming (01/09, 03/09, 18/09) — Meta Muse Voice Transcribe, Microsoft MAI-Transcribe-2, xAI Grok Voice Transcribe 2.0 (voir 🎯). Source : annonces des éditeurs, URL non fournie par la collecte.
- GPT Image 2.5 (08/09) — Fonction « Sketch » qui transforme un dessin en image générée, latence divisée par deux. Source : annonce OpenAI, URL non fournie par la collecte.
- Fin de l'API Sora 2 (24/09) — L'accès par l'API s'arrête aujourd'hui ; Sora resterait disponible dans son app, à vérifier. Source : documentation OpenAI, URL non fournie par la collecte.
Création web & design assisté
- Figma Weave relié à Figma Design (mi-septembre, jour non confirmé) — Un frame se colle directement dans un flux Weave, l'outil de génération d'images de Figma, en gardant polices et styles ; des flux réutilisables sont partagés par la communauté. Pour toi : ça produit des visuels à partir d'une maquette, pas un site ; utile pour décliner les visuels d'une charte, pas pour la landing elle-même. source
- Claude Design dans toute conversation : voir 🎯.
Productivité & apps grand public
- Amazon Quick en disponibilité générale (09/09) — L'assistant professionnel d'Amazon arrive sur desktop (macOS, Windows) et mobile, relié aux applications et aux données de l'entreprise. source
- Siri AI en bêta avec iOS 27 (14/09) — Siri refondu, avec compréhension du contexte personnel et actions entre applications. Ni le modèle sous-jacent ni les pays ne sont précisés. Pour toi : tu es sur Android, sans objet. Source : annonce Apple, URL non fournie par la collecte.
Réglementation, marché & société
Rien de fiable sur la période. La collecte signalait l'adoption en Californie du SB 1047 avec une décision du gouverneur au 30/09 : je l'ai écarté, la chronologie ressemble trait pour trait à celle de 2024 (voir ⚪ et 🔧).
💡 Tu ne savais peut-être pas que ça existe
MCP Apps : un serveur MCP peut afficher une vraie interface dans la conversation. Depuis la révision 2026-07-28 de la spécification MCP, un serveur peut fournir une interface HTML interactive, affichée par l'hôte dans un cadre isolé, au lieu d'un simple échange de texte. Développé avec OpenAI, ça fonctionne dans Claude, ChatGPT, Goose et VS Code ; Asana, Box, Canva, Figma, Slack et Salesforce étaient partenaires de lancement. Tout ce que tu fais passer par MCP aujourd'hui te revient en texte : le jour où un serveur que tu utilises l'adopte, tu pourrais avoir un tableau ou des boutons directement dans la conversation. Rien n'indique encore que les serveurs MCP que tu utilises le prévoient. source
Autre candidat, plus court : Managed Agents de l'API Gemini (préversion publique depuis le 26/05), des agents à état qui tournent dans des bacs à sable Linux hébergés par Google. Ça touche la contrainte « tout dépend d'un PC qui doit rester allumé », mais la collecte n'a trouvé aucun chiffre de coût. Source : annonce Google I/O, URL non fournie par la collecte.
🌍 Angle critique
L'économie du secteur jugée intenable, par Ed Zitron et Gary Marcus. Dans une analyse d'août 2026, Zitron reprend la formule qu'il attribue à Marcus, « OpenAI, le WeWork de l'IA », pour soutenir que le financement de l'infrastructure n'est pas soutenable : abonnements déficitaires, besoin de liquidités sans fin, risque d'un « moment Lehman Brothers ». Marcus ajoute que les problèmes techniques de fond des grands modèles ne sont pas résolus malgré des investissements de l'ordre du millier de milliards. Niveau de preuve : opinion argumentée de deux critiques déclarés, sans chiffre d'entreprise ni calcul détaillé dans les reprises. Ça reste un bon contrepoids ce mois-ci, où les baisses de prix se succèdent : un prix qui baisse chez un acteur qui perd de l'argent n'est pas forcément un prix durable, et c'est une raison de plus pour ne pas bâtir ton outillage sur un seul tarif promotionnel. source
En complément, Arvind Narayanan (AI Snake Oil, Princeton) rappelle que sa critique vise d'abord l'IA prédictive, celle du recrutement, du crédit ou de la justice, avec des précisions parfois sous 70 %, et qu'elle ne s'applique pas en bloc à l'IA générative. Une bonne règle de lecture pour les deux camps. source
⚪ Écarté
- SB 1047 (Californie), décision du gouverneur au 30/09 : chronologie suspecte, probablement un article de 2024 daté à tort (voir 🔧).
- Plus de 30 jours : Gemini 3.6 Flash et 3.5 Flash-Lite (21/07), Qwen3.8-Max (03/08), NotebookLM devenu Gemini Notebook (08/06), Gemini in Chrome sur Android (18/08), llama.cpp v0.3.0 (25/08, pile à la limite), procès contre Meta (14/07) et plainte de la Floride contre OpenAI (01/06), jalons de l'AI Act européen (juin et 02/08).
- Bruit selon tes règles : participation de Samsung dans Mistral (levée de fonds), classements Kimi K3 et GLM-5.1/5.2 (benchmarks), rachat de Groq par Nvidia (date non confirmée), « antigravity-preview-09-2026 » (rumeur à source unique).
- Sans date précise : retrait de GPT-5.5 au 14/10 (date d'annonce inconnue), Meta Muse pour Mac, délégation de tâches Copilot Cowork sur mobile, JetBrains AI Assistant pour VS Code.
- Doublon : l'étude comparative sur cinq agents de code (arXiv), déjà traitée dans un brief précédent.