Veille IA · exemple anonymisé

Brief du jeudi 24 septembre 2026

Du 25 août au 24 septembre 2026 (fenêtre de 30 jours) · 24 items sur 11 domaines · ~5 min pour l'essentiel, ~15 min en tout de lecture

Ce que tu regardes : un vrai brief de ma veille IA quotidienne, celui du 24 septembre 2026, qui rattrapait les 30 derniers jours. Chaque matin, une routine Claude Code dans le cloud fait le tour de l'actualité IA, puis Claude Code en local croise tout ça avec mes projets et rédige cette page.

La rubrique « 🎯 Pour toi » est anonymisée : dans l'original, elle cite mes projets réels, mes fichiers et mes habitudes de travail. Ici, elle garde la même logique avec un profil générique. Le reste est tel quel.

L'essentiel

Un mois de modèles : Anthropic sort Fable 5.1 (et Mythos 5.1, réservé à la cybersécurité défensive), OpenAI lance GPT-6 Astra puis GPT-6 Sol et Luna, Google Gemini 3.8 Flash, xAI Grok 4.7, et DeepSeek publie V4.1 Flash en poids ouverts sous licence MIT.

Tendance nette : chez Anthropic, OpenAI et Google, les capacités « cyber » passent derrière des programmes d'accès de confiance (Mythos, Astra, Flash Cyber).

Côté produit, Claude fusionne le chat et Cowork, ajoute Docs et Slides, met Claude Design dans toute conversation et ouvre un Marketplace de plus de 2 000 connecteurs.

Le milieu de gamme devient très bon et très bon marché (Luna à 0,10 $ / 0,50 $ le million de tokens) : l'arbitrage entre modèles devient un vrai sujet.

Trois modèles de transcription en streaming en trois semaines (Meta, Microsoft, xAI) : la reconnaissance vocale bouge vite.

🎯 Pour toi

Maquetter la page d'accueil d'une nouvelle identité dans Claude Design, sans changer d'outil

Depuis le 16/09, Claude Design fonctionne dans n'importe quelle conversation Claude au lieu d'un espace à part ; ça accompagne la fusion du chat et de Cowork. Niveau de preuve : officiel, mais le déploiement est progressif sur Pro et Max « dans les semaines à venir ».

Chez toi : une refonte d'identité visuelle est en cours, avec une charte déjà écrite et un logo en SVG ; il reste la page d'accueil du futur site. Avec Design dans la conversation, tu maquettes la page à partir de la charte, tu itères sur place, puis Claude Code reproduit proprement la version retenue. Pour une interface qui doit sortir du lot, le premier tour doit varier la structure des pages, pas seulement les couleurs.

Pour l'essayer : ouvrir claude.ai, vérifier que l'interface unifiée est arrivée, donner la charte et le logo, demander trois structures de page réellement différentes. Coût : inclus dans l'abonnement, une heure.

Source : claude.com/blog/cowork-is-now-claude

Prendre un modèle de transcription cloud comme étalon, pas comme remplaçant

Meta (Muse Voice Transcribe, 01/09), Microsoft (MAI-Transcribe-2, 03/09) et xAI (Grok Voice Transcribe 2.0, 18/09) ont sorti des modèles de transcription en streaming. xAI revendique la première place sur 32 modèles du classement Artificial Analysis, à 0,10 $ l'heure d'audio en lot. Niveau de preuve : annonces officielles, mais les chiffres de précision viennent des éditeurs, et rien ne dit qu'ils tiennent en français.

Chez toi : ta transcription tourne en local, sur un modèle Whisper, justement pour que les enregistrements confidentiels ne sortent pas de la machine : aucun de ces modèles n'y change rien. Mais ton choix de modèle local n'a jamais été confronté à l'état de l'art. Pour quelques centimes, un de ces modèles te dit si le local te coûte de la qualité, ou pas.

Pour l'essayer : prendre un enregistrement sans rien de confidentiel, le passer dans ton outil local puis dans l'API de xAI ou de Microsoft, et comparer à la main, en particulier les chiffres et les noms propres. Coût : quelques centimes, une heure.

Source : annonces des trois éditeurs ; classement Artificial Analysis.

Des sous-agents avec un modèle par rôle, pour ménager ta limite d'usage

En septembre, le milieu de gamme est devenu très bon marché : GPT-6 Luna à 0,10 $ / 0,50 $ et Sol à 2 $ / 10 $ le million de tokens (22/09), Gemini 3.8 Flash à 0,75 $ / 3,75 $ (02/09), DeepSeek V4.1 Flash en poids ouverts (10/09). GitHub Copilot en tire la conséquence le 18/09 avec une sélection automatique du modèle en trois niveaux : efficacité, équilibre, intelligence. Niveau de preuve : officiel ; les comparaisons de benchmarks entre éditeurs sont à prendre avec prudence.

Chez toi : sur un abonnement, le prix au token ne te touche pas ; ce qui te touche, c'est la limite d'usage sur 5 heures, qui compte tous les modèles Claude ensemble. Les sous-agents que tu prévois de monter par projet sont l'endroit où poser ce que Copilot automatise : Haiku pour le mécanique (inventaire, reformatage, vérifications), Opus pour le raisonnement. Franchement, sur l'arbitrage lui-même, Copilot et Cursor sont en avance : ils routent vers plusieurs éditeurs, alors que les sous-agents de Claude Code restent dans la famille Claude.

Pour l'essayer : au montage du premier agent, mettre model: haiku et un effort bas dans son frontmatter, puis comparer /usage avant et après une tâche type. Coût : nul.

Sources : openai.com · github.blog

Cursor Projects fait nativement ce que ton fichier de reprise fait à la main

Le 02/09, Cursor a ouvert en bêta « Projects », un espace de travail pour les chantiers longs : il garde le contexte sur plusieurs mois, délègue à des agents dans le cloud et réagit à des signaux extérieurs (Slack, planning, pull requests). Le même jour, « My Machines » permet de garder l'exécution des outils sur sa propre machine. Niveau de preuve : officiel (changelog Cursor), mais c'est une bêta, sans prix ni limites connus.

Chez toi : ta continuité d'une session à l'autre repose sur une discipline : un fichier de reprise par projet, un protocole avant chaque compactage, une mémoire synchronisée entre tes machines. Ça fonctionne, mais c'est toi qui déclenches, et rien ne réagit seul à un événement. Sur ce point précis, Cursor est devant Claude Code, et il vaut mieux le savoir, même si changer d'outil n'aurait pas de sens pour une architecture entièrement bâtie sur Claude Code.

Pour l'essayer : rien à installer ; lire le changelog de Cursor et noter ce que Projects fait que ton protocole ne fait pas. Coût : un quart d'heure.

Source : cursor.com/changelog

Tour d'horizon

Anthropic / Claude

OpenAI

Google

Autres labos

Outils de développement IA

Agents & automatisation

Rien de notable sur la période : ni n8n, Make ou Zapier, ni les frameworks multi-agents. Spécification MCP toujours à 2026-07-28, serveurs de référence à 2026.8.31. Le seul mouvement est le Marketplace (voir Anthropic).

IA locale & modèles ouverts

Voix, image, vidéo

Création web & design assisté

Productivité & apps grand public

Réglementation, marché & société

Rien de fiable sur la période. La collecte signalait l'adoption en Californie du SB 1047 avec une décision du gouverneur au 30/09 : je l'ai écarté, la chronologie ressemble trait pour trait à celle de 2024 (voir ⚪ et 🔧).

💡 Tu ne savais peut-être pas que ça existe

MCP Apps : un serveur MCP peut afficher une vraie interface dans la conversation. Depuis la révision 2026-07-28 de la spécification MCP, un serveur peut fournir une interface HTML interactive, affichée par l'hôte dans un cadre isolé, au lieu d'un simple échange de texte. Développé avec OpenAI, ça fonctionne dans Claude, ChatGPT, Goose et VS Code ; Asana, Box, Canva, Figma, Slack et Salesforce étaient partenaires de lancement. Tout ce que tu fais passer par MCP aujourd'hui te revient en texte : le jour où un serveur que tu utilises l'adopte, tu pourrais avoir un tableau ou des boutons directement dans la conversation. Rien n'indique encore que les serveurs MCP que tu utilises le prévoient. source

Autre candidat, plus court : Managed Agents de l'API Gemini (préversion publique depuis le 26/05), des agents à état qui tournent dans des bacs à sable Linux hébergés par Google. Ça touche la contrainte « tout dépend d'un PC qui doit rester allumé », mais la collecte n'a trouvé aucun chiffre de coût. Source : annonce Google I/O, URL non fournie par la collecte.

🌍 Angle critique

L'économie du secteur jugée intenable, par Ed Zitron et Gary Marcus. Dans une analyse d'août 2026, Zitron reprend la formule qu'il attribue à Marcus, « OpenAI, le WeWork de l'IA », pour soutenir que le financement de l'infrastructure n'est pas soutenable : abonnements déficitaires, besoin de liquidités sans fin, risque d'un « moment Lehman Brothers ». Marcus ajoute que les problèmes techniques de fond des grands modèles ne sont pas résolus malgré des investissements de l'ordre du millier de milliards. Niveau de preuve : opinion argumentée de deux critiques déclarés, sans chiffre d'entreprise ni calcul détaillé dans les reprises. Ça reste un bon contrepoids ce mois-ci, où les baisses de prix se succèdent : un prix qui baisse chez un acteur qui perd de l'argent n'est pas forcément un prix durable, et c'est une raison de plus pour ne pas bâtir ton outillage sur un seul tarif promotionnel. source

En complément, Arvind Narayanan (AI Snake Oil, Princeton) rappelle que sa critique vise d'abord l'IA prédictive, celle du recrutement, du crédit ou de la justice, avec des précisions parfois sous 70 %, et qu'elle ne s'applique pas en bloc à l'IA générative. Une bonne règle de lecture pour les deux camps. source

⚪ Écarté