Français · 7 min de lecture
Veille des sorties de modèles IA : ce qui est vraiment confirmé pour la fin 2026
Gemini 4, OpenAI Astra, Grok 4.7, GLM-5.5, Claude Fable 5.1. Lesquels ont réellement été annoncés par les labos, lesquels relèvent de la rumeur, et ce qu'une entreprise doit prévoir. Mis à jour à chaque sortie.
La réponse courte : sur les cinq modèles à venir dont on parle le plus, deux sont officiellement annoncés (Astra d'OpenAI, Gemini 4 de Google), un a été annoncé par le fondateur de l'entreprise sans spécifications publiées (Grok 4.7), et deux n'ont aucune annonce officielle (GLM-5.5, Claude Fable 5.1) alors qu'on en parle comme de produits datés. Ne réorganisez pas vos dépenses IA autour d'aucun d'entre eux.
Compilé le 14 août 2026. Cette page suit des annonces, pas des prédictions. Nous ne publions ni scores de benchmark attendus, ni prix attendus, ni dates de sortie attendues pour des modèles qui n'en ont pas — ces chiffres n'existent pas, et les inventer est la meilleure façon de rendre une page incitable. Chaque entrée ci-dessous est étiquetée avec la nature réelle de la source.
Comment nous classons
| Étiquette | Signification |
|---|---|
| Confirmé | Le labo lui-même l'a publié ou déclaré, officiellement |
| Annoncé par un dirigeant | Un fondateur ou un dirigeant l'a déclaré publiquement, mais le labo n'a publié ni fiche de modèle, ni documentation, ni tarif |
| Rapporté | Des médias ou analystes crédibles le rapportent ; le labo ne l'a pas confirmé |
| Rumeur | Communauté, fuites ou publications sur les réseaux uniquement. Aucune source institutionnelle |
Un modèle peut être Confirmé comme existant et n'offrir malgré tout rien sur quoi bâtir un plan. C'est la situation de la plupart de cette liste.
OpenAI Astra — Confirmé
OpenAI a révélé Astra le 1er août 2026, en le décrivant comme son « prochain grand modèle ». L'annonce est arrivée de façon inhabituelle : à l'intérieur d'un billet sur les mathématiques, présentant dix solutions revendiquées à des problèmes ouverts de longue date en mathématiques et en informatique théorique, avec manuscrits, certificats Lean et récits de découverte. Les problèmes couvraient la géométrie en grande dimension, la théorie des codes, la théorie des groupes, la complexité quantique, la cryptographie sur réseaux et la combinatoire extrémale — plusieurs n'avaient pas bougé depuis une décennie ou plus.
OpenAI a ensuite suspendu certaines activités internes impliquant Astra après qu'une évaluation interne a constaté des avancées significatives en codage agentique et en cybersécurité.
Non annoncés : date de sortie, tarif, fenêtre de contexte, disponibilité via API, benchmarks publics.
Ce que ça signifie pour une entreprise : rien d'opérationnel pour l'instant. Un modèle dont le propre labo a suspendu les travaux internes en attendant une revue de sécurité n'est pas une décision d'achat. Les résultats mathématiques sont un signal de capacité, pas un produit.
Google Gemini 4 — Confirmé, mais mince
Google a déclaré le 21 juillet 2026 avoir « déjà lancé notre run de pré-entraînement le plus ambitieux à ce jour, pour Gemini 4 ». Sundar Pichai l'a décrit comme un modèle de frontière nettement plus grand, et a indiqué que Google entend passer à une cadence de sortie quasi mensuelle avec Gemini 4 comme référence.
Non annoncés : date de sortie, architecture, fenêtre de contexte, tarif, le moindre benchmark.
Notez ce que signifie « le pré-entraînement a commencé » : c'est le début de la partie coûteuse, pas la fin. Une préversion fin 2026 est plausible ; elle n'est pas programmée. Les marchés prédictifs ont valorisé une sortie en 2026 avec optimisme, mais un prix de marché mesure ce que croient les traders, pas ce que Google a dit.
Ce que ça signifie pour une entreprise : si vous êtes déjà sur Gemini, la cadence mensuelle annoncée est une nouvelle plus actionnable que Gemini 4 lui-même.
xAI Grok 4.7 — Annoncé par un dirigeant
Elon Musk a décrit publiquement une cadence rapide : Grok 4.6 suivi quelques semaines plus tard de Grok 4.7, caractérisé comme un modèle de 2,1 billions de paramètres, meilleur que 4.6 « à tous les égards » mais légèrement plus lent à servir, avec une meilleure efficacité en tokens. Le calendrier pointait vers fin août ou début septembre 2026. Grok 4.5 est sorti le 8 juillet ; Grok 4.6 a suivi.
La réserve qui compte : le nombre de paramètres et les affirmations de capacité viennent du fondateur, pas d'une fiche de modèle, d'une page de documentation ou d'une évaluation. xAI a livré à peu près à cette cadence ces derniers temps, ce qui rend le calendrier crédible ; cela ne rend pas les spécifications vérifiées.
Ce que ça signifie pour une entreprise : Grok 4.6 est réel, tarifé et disponible maintenant. C'est celui-là qu'il faut évaluer. Traitez 4.7 comme probable-bientôt, pas comme une fiche technique.
Z.ai GLM-5.5 — Rapporté, pas annoncé
Z.ai n'a pas annoncé GLM-5.5. Pas de fiche de modèle, pas de benchmarks, pas de tarif, pas de nom confirmé.
Ce qui existe : une fenêtre de lancement en août 2026 rapportée par Reuters et CGTN le 30 juin 2026, citant une note de recherche de JPMorgan, et une estimation de plus de 1 000 milliards de paramètres issue de cette même note et du média chinois spécialisé en IA AIBase (23 juin). Des discussions communautaires mi-juillet évoquaient une fenêtre de contexte de 1M de tokens reprise de GLM-5.2, des poids ouverts et une orientation vers les agents de code longue durée — cette partie n'est pas sourcée.
Contexte pertinent : Z.ai vient bien de livrer GLM-5.3 le 14 août — en réutilisant le modèle de base de GLM-5.2, avec tous les gains issus du post-entraînement, et des poids promis sous deux semaines. Un labo qui vient de livrer une version purement post-entraînement, et qui n'en a pas encore publié les poids, n'est manifestement pas à deux semaines d'un nouveau modèle de base de mille milliards de paramètres.
Ce que ça signifie pour une entreprise : une note d'analyste n'est pas une feuille de route. Évaluez GLM-5.2, qui est publié, tarifé et open weights.
Anthropic Claude Fable 5.1 — Rumeur
Anthropic n'a pas annoncé Claude Fable 5.1. Au 12 août 2026, il n'y a ni billet de lancement, ni fiche de modèle, ni identifiant de modèle d'API, ni entrée sur la page tarifaire. Le catalogue d'Anthropic et les notes de version développeur listent Claude Fable 5.
Les affirmations qui circulent — modèle terminé en interne, attendu en août, à un tarif inchangé de 10 $/50 $ par million, orienté raisonnement à long horizon et workflows d'agents, calé face à la prochaine sortie d'OpenAI — remontent à deux publications X datées du 26 juillet 2026, émanant d'observateurs du secteur.
Ce que ça signifie pour une entreprise : traitez « Fable 5.1 » comme un nom que des gens emploient, pas comme un produit. Prévoyez sur Fable 5.
Le schéma qu'il faut remarquer
Quatre de ces cinq modèles sont positionnés autour du codage agentique et de l'autonomie à long horizon, pas de la qualité de conversation. Deux d'entre eux — Astra et GLM-5.3 — ont vu leur capacité restreinte ou échelonnée derrière une revue de sécurité et de cybersécurité. C'est nouveau. C'est désormais une raison normale pour qu'un lancement arrive sans poids ni API.
La conséquence pratique : le délai entre annonce et disponibilité s'allonge. Qu'un modèle soit annoncé vous en dit moins sur le moment où vous pourrez l'utiliser qu'il y a un an. Budgétez sur ce qui est livré et tarifé aujourd'hui.
Ce que nous ne publions pas
Nous ne mettons pas de scores attendus dans un tableau. Nous ne faisons pas la moyenne de prix rumorés. Nous ne donnons pas de date de sortie à un modèle non annoncé parce qu'un marché prédictif en suggère une. Quand l'un de ces modèles publiera de vrais chiffres, il aura une vraie entrée dans notre suivi des modèles, et un score indépendant le fera entrer sur notre page de benchmarks.
Si vous voulez que votre choix de modèle soit tranché par ce qui est mesurablement disponible plutôt que par des calendriers de lancement, un Business AI Plan (99 $ une fois, 29 $/mois en option pour le maintenir à jour) fait exactement cela. Le chercheur de plan IA gratuit en 2 minutes est le premier passage rapide.
Sources : annonce d'OpenAI Astra (1er août 2026) et couverture de la suspension qui a suivi ; déclaration de Google sur le pré-entraînement de Gemini 4 (21 juillet 2026) ; déclarations publiques de Musk sur la cadence Grok 4.6/4.7 ; Reuters/CGTN citant JPMorgan (30 juin 2026) et AIBase (23 juin 2026) sur GLM-5.5 ; catalogue de modèles et notes de version d'Anthropic au 12 août 2026.