À retenir
- Claude Fable 5.1 réduit le coût des lectures en cache de 75 % par rapport à Fable 5, à 0,25 dollar par million de tokens (VentureBeat, 1er septembre 2026).
- GLM-5.3-Flash coûte environ dix fois moins cher que Claude Opus 4.8 tout en dépassant son prédécesseur GLM-5.2 sur plusieurs benchmarks de codage (Z.ai, 26 août 2026).
- Kimi K3 atteint un Elo de 1 547 sur les évaluations privées d'Artificial Analysis, devant Claude Opus 4.8 Max et GPT-5.5 High (Moonshot AI, 16 juillet 2026).
- Le contrôle à l'export américain sur Claude Fable 5 et Mythos 5 a été levé le 30 juin 2026, après plusieurs semaines de suspension liées à la cybersécurité.
- Grok 4.6 gagne 5 points sur l'indice Artificial Analysis par rapport à Grok 4.5, mais son temps de réponse avant le premier token triple, passant de 14,5 à 43,8 secondes.
- 53 % de la population mondiale utilise l'intelligence artificielle générative en seulement trois ans, contre treize ans pour l'adoption du PC (Stanford AI Index 2026).
- DeepSeek V4-Pro compte 1,6 billion de paramètres pour 49 milliards actifs par token, mais son score Artificial Analysis ne dépasse que de 3 points celui de son propre modèle Flash, cinq fois plus léger.
Réponse rapide
Entre février et septembre 2026, au moins seize modèles d'intelligence artificielle générative ont été mis à jour par Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot AI et Z.ai. Les sorties les plus récentes sont Claude Fable 5.1 et Mythos 5.1 (1er septembre 2026), GPT-6 Astra (3 septembre 2026), GLM-5.3-Flash (26 août 2026), Gemini 3.7 Flash (13 août 2026), Grok 4.6 (12 août 2026), DeepSeek V4-Pro (12 août 2026), Qwen3.8-Max (3 août 2026) et Claude Opus 5 (24 juillet 2026). Les prix vont de 0,15 dollar à 50 dollars par million de tokens selon le modèle et le sens (entrée ou sortie).
Verdict en 30 secondes
Ignorez le bruit autour de chaque annonce. Les entreprises qui gagnent du temps ne changent pas de modèle toutes les deux semaines : elles standardisent sur un ou deux modèles adaptés à leur cas d'usage et révisent leur choix chaque trimestre, pas chaque lancement. Pour la majorité des TPE et PME françaises, un modèle milieu de gamme comme GLM-5.3-Flash ou DeepSeek V4-Flash couvre l'essentiel des besoins pour une fraction du prix des modèles premium. Réservez les modèles agentiques de pointe, comme GPT-6 Astra ou Claude Opus 5, aux usages qui justifient réellement leur coût et leur niveau de risque, et encadrez-les avant tout déploiement.
Combien de nouveaux modèles IA sont sortis en 2026 ?
Au moins seize modèles d'intelligence artificielle générative, LLM (large language model, modèle de langage de grande taille) et modèles agentiques ont été lancés ou mis à jour par les grands laboratoires entre le 11 février et le 3 septembre 2026. Voici la chronologie des sorties majeures, du plus ancien au plus récent :
- 11 février 2026 : GLM-5 (Z.ai)
- 30 juin 2026 : Claude Sonnet 5 (Anthropic) et levée des contrôles à l'export sur Claude Fable 5 et Mythos 5
- 9 juillet 2026 : famille GPT-5.6, Sol, Terra et Luna (OpenAI)
- 16 juillet 2026 : Grok 4.5 (xAI) et Kimi K3 (Moonshot AI)
- 24 juillet 2026 : Claude Opus 5 (Anthropic)
- 31 juillet 2026 : DeepSeek V4-Flash (DeepSeek)
- 3 août 2026 : Qwen3.8-Max (Alibaba)
- 12 août 2026 : Grok 4.6 (xAI) et DeepSeek V4-Pro (DeepSeek)
- 13 août 2026 : Gemini 3.7 Flash (Google)
- 26 août 2026 : GLM-5.3-Flash (Z.ai)
- 1er septembre 2026 : Claude Fable 5.1 et Mythos 5.1 (Anthropic)
- 3 septembre 2026 : GPT-6 Astra (OpenAI)
Sur la seule période du 24 juillet au 3 septembre 2026, dix modèles majeurs sont sortis, soit un rythme moyen d'une sortie tous les quatre jours. Ce calendrier est compilé par Studeria à partir des annonces officielles de chaque laboratoire, listées en source de chaque section ci-dessous.
GPT-6 Astra d'OpenAI : que change ce lancement du 3 septembre 2026 ?
GPT-6 Astra est le modèle qu'OpenAI a lancé le 3 septembre 2026, avec pour capacité phare le contrôle autonome d'ordinateur : remplir des formulaires, mettre à jour un CRM ou générer un site web sans intervention humaine directe. Il coûte 10 dollars par million de tokens en entrée et 50 dollars en sortie, environ 2,5 fois le tarif de GPT-5.6 Sol, son prédécesseur, et il est classé « Critical » sous le Preparedness Framework d'OpenAI en cybersécurité offensive. Studeria a consacré un article complet à ce lancement, benchmarks, prix et gouvernance compris : GPT-6 Astra d'OpenAI, tout savoir.
Claude Opus 5 et le duo Fable 5.1 / Mythos 5.1 : ce qu'Anthropic a changé cet été
Anthropic a publié trois mises à jour majeures en six semaines. Claude Opus 5, sorti le 24 juillet 2026 à 5 dollars et 25 dollars par million de tokens, est devenu le modèle par défaut des abonnés Claude Max : Studeria l'a détaillé dans son article dédié à Claude Opus 5. Claude Fable 5.1 et Mythos 5.1, publiés le 1er septembre 2026, réduisent de 75 % le coût des lectures en cache et font passer le score de Fable sur Terminal-Bench-Science 0.1 de 24,7 % à 52,6 %, comme détaillé dans l'article Studeria consacré à Fable 5.1 et Mythos 5.1. Les deux modèles avaient été suspendus par contrôle à l'export américain avant d'être rétablis le 30 juin 2026, un épisode qui illustre une tension propre à 2026 : plus un modèle est capable en cybersécurité défensive, plus son accès devient politiquement sensible.
Gemini 3.7 et 3.8 Flash de Google : pourquoi une telle cadence ?
Gemini 3.7 Flash est le modèle que Google a lancé le 13 août 2026, seulement trois semaines après Gemini 3.6 Flash. Selon 9to5Google, Google propose un tarif promotionnel jusqu'à fin 2026, à 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie. Logan Kilpatrick, responsable produit de Gemini chez Google, a résumé le rythme sur X : « notre troisième modèle Flash mis à jour en seulement six semaines », en évoquant des gains d'intelligence obtenus par améliorations algorithmiques plutôt que par un nouvel entraînement complet.
Cette cadence rapide, qui a vu apparaître Gemini 3.8 Flash quelques semaines plus tard avec un focus sur le code et la réduction des hallucinations, traduit une stratégie assumée chez Google : itérer vite sur le niveau Flash pendant que le niveau Pro évolue plus lentement. Pour une TPE ou une PME, cela veut dire que la version « la plus récente » n'est presque jamais la version stable de référence six mois plus tard.
Grok 4.5 et Grok 4.6 de xAI : qu'est-ce qui a vraiment changé ?
Grok 4.5, sorti le 16 juillet 2026 à 2 dollars et 6 dollars par million de tokens, s'est positionné sur le code et les tâches agentiques avec un score de 62,0 % sur DeepSWE 1.0, devant les 55,75 % de Claude Opus 4.8 : Studeria l'a analysé dans son article dédié à Grok 4.5. Grok 4.6, publié le 12 août 2026, garde exactement les mêmes tarifs et la même fenêtre de contexte de 500 000 tokens, mais fait progresser l'indice d'intelligence Artificial Analysis de 56 à 61 points grâce à un entraînement prolongé sur des données générées par le modèle lui-même.
Le revers de la médaille est net : le temps avant le premier token triple, passant d'environ 14,5 secondes à 43,8 secondes, et le coût moyen par tâche augmente de 12 % malgré des prix au token inchangés. Grok 4.6 est donc pensé pour des tâches en arrière-plan où la latence importe peu, pas pour un assistant conversationnel réactif.
DeepSeek V4-Flash et V4-Pro : combien coûte le modèle chinois le moins cher ?
DeepSeek V4-Flash, disponible depuis le 31 juillet 2026 sous licence MIT, compte 304 milliards de paramètres au total pour environ 13 milliards actifs par token, à 0,44 dollar en entrée et 1,32 dollar en sortie par million de tokens en heure de pointe. Studeria a détaillé ce modèle et le comparatif complet de la gamme DeepSeek dans son article dédié à DeepSeek V4-Flash et dans DeepSeek V4 open source, faut-il l'adopter en entreprise. DeepSeek V4-Pro, généralement disponible depuis le 12 août 2026 (build 0813), monte à 1,6 billion de paramètres avec 49 milliards actifs par token, mais son score Artificial Analysis de 53 ne dépasse que de 3 points celui de son propre modèle Flash malgré cinq fois plus de paramètres actifs.
Qwen3.8-Max et Kimi K3 : la Chine accélère aussi sur les modèles massifs
Qwen3.8-Max, dévoilé par Alibaba le 19 juillet 2026 à Shanghai puis lancé officiellement le 3 août 2026, embarque 2,4 billions de paramètres en architecture mixture-of-experts, dont environ 95 milliards actifs par token, pour un contexte d'un million de tokens en entrée, selon Alibaba Cloud. Le prix API est de 2 dollars par million de tokens en entrée et 6 dollars en sortie. Le modèle n'est que partiellement ouvert : une version Qwen3.8-27B est publiée sous licence Apache 2.0, mais le checkpoint complet de 2,4 billions de paramètres reste sous licence personnalisée, sans vision native.
Kimi K3, sorti par Moonshot AI le 16 juillet 2026, revendique 2,8 billions de paramètres et se présente comme le premier modèle ouvert de classe 3 000 milliards de paramètres, avec un Elo de 1 547 sur les évaluations privées d'Artificial Analysis, devant Claude Opus 4.8 Max et GPT-5.5 High. Studeria répond à la question de son adoption en entreprise dans son article dédié à Kimi K3.
GLM-5 et GLM-5.3-Flash de Z.ai : le pari du rapport qualité prix
GLM-5, sorti le 11 février 2026 par Z.ai (Zhipu), la première entreprise de fondation de modèles IA cotée en bourse à Hong Kong, est un modèle mixture-of-experts de 744 milliards de paramètres dont 40 milliards actifs par token. Il atteint 77,8 % sur SWE-bench Verified et se classait numéro un des modèles ouverts sur Artificial Analysis à sa sortie, pour un prix de 1 dollar en entrée et 3,20 dollars en sortie par million de tokens, soit 5 à 8 fois moins cher que Claude Opus 4.6.
GLM-5.3-Flash, publié le 26 août 2026 sous licence MIT selon MarkTechPost, réduit la taille à 320 milliards de paramètres dont 18 milliards actifs, avec un contexte d'un million de tokens. Sur Terminal-Bench 2.1, il obtient 84,3 points contre 85,0 pour Claude Opus 4.8, quasiment au même niveau, pour un dixième du prix : 0,15 dollar en entrée et 0,50 dollar en sortie par million de tokens.
Quel est le meilleur modèle IA en septembre 2026 ?
Il n'existe pas un seul « meilleur » modèle IA en septembre 2026 : le bon choix dépend du budget, du niveau de risque acceptable et du cas d'usage. Pour un usage agentique de pointe avec un budget confortable, GPT-6 Astra et Claude Opus 5 dominent sur les benchmarks. Pour un rapport qualité prix imbattable, GLM-5.3-Flash et DeepSeek V4-Flash couvrent l'essentiel des usages professionnels à un dixième du prix des modèles premium. Studeria a déjà comparé les options grand public dans son guide Quel modèle IA choisir en 2026 : ce nouvel article se concentre sur ce qui a changé depuis, et sur ce que ces sorties changent concrètement pour une entreprise française.
| Modèle | Éditeur | Sortie | Prix entrée / sortie (par M tokens) | Spécialité | Licence |
|---|---|---|---|---|---|
| GPT-6 Astra | OpenAI | 3 sept. 2026 | 10 $ / 50 $ | Agents, contrôle d'ordinateur | Propriétaire |
| Claude Opus 5 | Anthropic | 24 juil. 2026 | 5 $ / 25 $ | Codage, agents longue durée | Propriétaire |
| Claude Fable 5.1 | Anthropic | 1er sept. 2026 | 10 $ / 50 $ (cache 0,25 $) | Cybersécurité, agents persistants | Propriétaire, accès vérifié |
| Gemini 3.7 Flash | 13 août 2026 | 0,75 $ / 3,75 $ (promo) | Dev logiciel, web, connaissance | Propriétaire | |
| Grok 4.6 | xAI | 12 août 2026 | 2 $ / 6 $ | Tâches de fond, recherche X | Propriétaire |
| DeepSeek V4-Pro | DeepSeek | 12 août 2026 | 1,32 $ / 3,96 $ (pic) | Rapport performance / prix | MIT (open) |
| Qwen3.8-Max | Alibaba | 3 août 2026 | 2 $ / 6 $ | Multimodal, contexte 1M | Partiellement ouvert |
| Kimi K3 | Moonshot AI | 16 juil. 2026 | 3 $ / 15 $ | Code frontend, raisonnement | Open-weight (annoncé) |
| GLM-5.3-Flash | Z.ai | 26 août 2026 | 0,15 $ / 0,50 $ | Rapport qualité / prix, code | MIT (open) |
Quel choix selon votre profil ?
Professionnels en évolution ou reconversion
Ne courez pas après chaque sortie. Ce qui compte pour rester employable, c'est de comprendre les grandes familles de modèles (agentique, codage, rapport qualité prix) et de savoir choisir l'outil adapté à une tâche donnée, pas de mémoriser quinze noms de version.
Indépendants et experts
Les capacités agentiques de GPT-6 Astra et Grok 4.6 ouvrent un nouveau marché : automatiser des tâches de bureau entières pour des clients TPE et PME qui ne suivent pas ce rythme de sortie. C'est un levier business direct pour qui sait structurer une offre autour de ces modèles.
TPE et PME en structuration
Le rapport qualité prix de GLM-5.3-Flash ou DeepSeek V4-Flash permet de faire plus avec moins sans exploser le budget IA. Inutile de payer 50 dollars par million de tokens en sortie pour automatiser une tâche répétitive de facturation ou de support client.
ETI et grands groupes
Les modèles à haut risque cybersécurité comme Mythos 5.1 ou Astra exigent une gouvernance IA formalisée avant tout déploiement : revue humaine, traçabilité, et infrastructure de monitoring dédiée, comme le permettent les Enterprise Frontier Safeguards d'Anthropic.
Choisir un modèle ne s'arrête pas au tableau ci-dessus. Encore faut-il l'intégrer dans des workflows métier réels, former les équipes à l'utiliser correctement et éviter les pièges les plus courants observés par nos formateurs sur le terrain, détaillés dans la section suivante.
Quels sont les pièges à éviter face à ce rythme de sorties ?
- Changer de modèle à chaque annonce. Un gain de quelques points sur un benchmark ne justifie presque jamais une migration complète de vos prompts et intégrations.
- Comparer uniquement le prix au token. Grok 4.6 garde le même tarif que Grok 4.5 mais son coût par tâche augmente de 12 % à cause d'un temps de traitement plus long : c'est le coût par tâche qui compte, pas le prix affiché.
- Confondre open-weight et open source libre. Qwen3.8-Max n'est que partiellement ouvert, avec un checkpoint complet sous licence personnalisée, contrairement à DeepSeek V4 ou GLM-5.3-Flash, sous licence MIT.
- Ignorer les enjeux de gouvernance. Les modèles à capacités cybersécurité critiques, comme Mythos, peuvent voir leur accès suspendu du jour au lendemain pour des raisons réglementaires, comme cela a été le cas en juin 2026.
- Déployer un modèle agentique en production sans cadre. Un modèle qui contrôle un ordinateur en autonomie, comme GPT-6 Astra, exige une supervision humaine sur les actions sensibles avant toute mise en production.
Ce que Studeria retient
Le marché des modèles IA n'a jamais bougé aussi vite qu'à l'été 2026, et cette vitesse profite d'abord à ceux qui ont une méthode, pas à ceux qui testent chaque nouveauté. La bonne question n'est pas « quel est le dernier modèle sorti », mais « quel modèle correspond à mon cas d'usage, mon budget et mon niveau de risque acceptable, aujourd'hui ». Studeria recommande de fixer une revue de modèles trimestrielle plutôt qu'une veille permanente, et de former les équipes à évaluer un modèle sur des critères stables : coût par tâche réelle, licence, et niveau de gouvernance requis.
Pour aller plus loin
FAQ article
Quel est le dernier modèle IA sorti en septembre 2026 ?
Combien coûte GPT-6 Astra par rapport à GPT-5.6 ?
Claude Opus 5 ou Claude Fable 5.1 : lequel choisir pour une entreprise ?
Quel est le modèle IA open source le moins cher en 2026 ?
Pourquoi Google sort autant de versions de Gemini Flash en si peu de temps ?
Les modèles chinois comme DeepSeek, Qwen ou Kimi sont-ils fiables pour une PME française ?
Faut-il changer de modèle IA à chaque nouvelle sortie ?
4,9/5
Boostez vos compétences
+5000 apprenants formés
Nos parcours s’adaptent à vos objectifs, à votre rythme et à votre niveau.

4,7/5
sur 171 avis

+200 entreprises formées à l’IA
De la startup au grand groupe, nos parcours sont pensées pour déployer des solutions performantes avec l’IA .

Prêt à te former ?
Trois parcours selon ton objectif : apprendre, te certifier, ou lancer ton activité.
Parcours Incubateur IA
Comprenez l’IA, gagnez du temps au quotidien et valorisez votre profil professionnel
Parcours Accélérateur IA
Implémentez l’IA grâce à un accompagnement stratégique et opérationnel pour structurer, automatiser et scaler votre business
Parcours Implémentation & Agent IA
TPE, PME, ETI : Un parcours stratégique pour former vos équipes et implémenter les bons outils IA dans votre entreprise.
Du dimanche 5 avril au jeudi 9 avril 2026
Le sommet IA 2026
Cinq soirées de démonstrations live, de conseils actionnables et d'échanges avec certains des entrepreneurs et experts les plus influents de France, le tout sans écrire une seule ligne de code.

Du dimanche 28 Juin au jeudi 2 Juillet 2026
Le sommet IA 2026
Cinq soirées de démonstrations live, de conseils actionnables et d'échanges avec certains des entrepreneurs et experts les plus influents de France, le tout sans écrire une seule ligne de code.









