09/2026SpaceXAI
Grok 4.7
à confirmerAnnonce d'Elon Musk le 2 septembre, pour une sortie 10 jours plus tard, avec des données de SpaceX ajoutées en fin d'entraînement. La date annoncée est passée. Au 14 septembre, xAI n'a publié ni fiche technique ni tarif, et le modèle le plus récent de son interface de programmation reste Grok 4.6.
Raisonnement avancéProgrammationTemps réel
Impact. Rien n'est vérifiable pour l'instant. Les chiffres qui circulent viennent des messages de Musk, pas du laboratoire, et ils n'entrent donc pas dans ce relevé.
09/2026DeepSeek
DeepSeek V4.1-Flash
Sorti le 10 septembre, le plus petit modèle de la nouvelle génération. 552 milliards de paramètres en mélange d'experts, dont 8 milliards actifs à la lecture de la demande et 16 milliards à l'écriture de la réponse, 1 million de tokens de contexte, poids publiés sous licence MIT. Il lit les images nativement, grâce à un encodeur visuel entraîné par le laboratoire.
Raisonnement avancéProgrammationOpen-weightLong contexteVision
Impact. DeepSeek l'annonce meilleur que son propre V4-Pro en performance, en coût et en vitesse. Les demandes envoyées à V4-Pro basculent vers lui dès le 14 septembre, au tarif Flash. Le haut de gamme d'août devient l'entrée de gamme de septembre.
09/2026OpenAI
GPT-6 Astra
Premier modèle de la génération 6, lancé le 3 septembre, avec une variante Astra Pro le lendemain. OpenAI le présente comme le meilleur modèle du marché pour piloter un ordinateur, remplir un tableur ou un formulaire et naviguer entre des pages. Contexte de 1,05 million de tokens. Le tarif est de 10 et 50 dollars par million de tokens, et au-delà de 272 000 tokens en entrée, l'entrée double et la sortie augmente de moitié.
Raisonnement avancéProgrammationAgents autonomesOrdinateur pilotéLong contexteDéploiement entreprise
Impact. Déplace la promesse du texte vers l'action. Le modèle ne rédige plus une marche à suivre, il l'exécute dans les logiciels du poste de travail.
09/2026Google DeepMind
Gemini 3.8 Flash et 3.8 Flash Cyber
Troisième version Flash en 6 semaines, publiée le 2 septembre. Contexte de 1 million de tokens, en texte, image, audio, vidéo et PDF. Le tarif d'introduction reste de 0,75 et 3,75 dollars par million de tokens, jusqu'au 31 décembre 2026. La variante Cyber est réservée à la recherche de failles par des défenseurs agréés, États, opérateurs d'infrastructures critiques et mainteneurs de logiciels.
MultimodalitéLong contexteProgrammationAgents autonomesDéploiement entreprise
Impact. Google sort une version toutes les 3 semaines en tenant son tarif d'introduction. La gamme se spécialise, avec une variante réservée aux équipes de sécurité.
09/2026Meta
Muse Spark 1.3
Mise à jour publiée le 2 septembre, disponible le jour même. Meta revendique le niveau des meilleurs modèles fermés, avec 89,2% sur Terminal-Bench 2.1, un test de référence en programmation. Ses chiffres les plus élevés viennent d'une configuration plus lourde, annoncée mais pas encore livrée.
Raisonnement avancéProgrammationAgents autonomesMultimodalité
Impact. Meta revient dans la course de tête avec un modèle fermé, alors que sa réputation s'était bâtie sur les poids ouverts de Llama. Une version à poids ouverts est promise, sans date.
09/2026Qwen
Qwen3.8-Max-0902
Réentraînement du modèle phare, annoncé le 2 septembre. 2 400 milliards de paramètres, contexte de 1 million de tokens, tarif inchangé de 2 et 6 dollars par million de tokens. Le score gagne 22 points sur CodeArena, un classement public des modèles de programmation, et passe en tête.
Raisonnement avancéProgrammationAgents autonomesVisionLong contexte
Impact. Alibaba reprend la tête sur le codage par un simple réentraînement, sans nouvelle génération ni hausse de prix.
09/2026Anthropic
Claude Fable 5.1 et Mythos 5.1
Mise à jour du 1er septembre pour le codage agentique et les tâches longues, avec le coût du contexte déjà lu réduit de 75%. Mythos 5.1 est une variante aux garde-fous assouplis, réservée à des organisations vérifiées en cybersécurité et en sciences du vivant.
Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise
Impact. Le contexte relu coûte 4 fois moins cher, ce qui change l'économie des agents qui reprennent les mêmes documents à chaque étape.
08/2026Qwen
Qwen3.8-Flash et Flash-Next
2 modèles économiques publiés le 26 août. Flash est disponible via API, avec 1 million de tokens de contexte. Flash-Next préfigure l'architecture Qwen4, avec des poids ouverts et un coût d'entraînement environ 9 fois inférieur à celui de Qwen3.7-Plus.
ProgrammationLong contexteOpen-weightMultilingue
Impact. L'efficacité devient un argument de vente. La question n'est plus la taille du modèle, c'est ce qu'il coûte à entraîner et à faire tourner.
08/2026Google DeepMind
Gemini 3.7 Flash
Sortie le 13 août, 3 semaines après la 3.6. Affinage de la version précédente plutôt que nouveau modèle de base, Elle obtient 65,3% sur DeepSWE 1.1. Le tarif d'introduction est de 0,75 dollar par million de tokens en entrée.
ProgrammationAgents autonomesLong contexteMultimodalité
Impact. Le cycle de sortie passe sous le mois. Une version est remplacée avant d'avoir eu le temps d'être évaluée.
08/2026DeepSeek
DeepSeek V4-Pro
Version définitive ouverte à tous les développeurs le 13 août, avec ses poids publiés sous licence MIT. 1 700 milliards de paramètres en mélange d'experts, dont 49 milliards actifs par token, et 1 million de tokens de contexte.
Raisonnement avancéProgrammationOpen-weightLong contexte
Impact. Un modèle de premier plan téléchargeable et installable sur ses propres serveurs, pour un coût par tâche environ 15 fois inférieur à celui du concurrent américain sorti le même jour.
08/2026SpaceXAI
Grok 4.6
Publié dans la nuit du 12 au 13 août, sur la même base que Grok 4.5 et au même prix de 2 et 6 dollars par million de tokens, qui passe au double au-delà de 200 000 tokens envoyés. Contexte de 500 000 tokens, connaissances arrêtées au 1er février 2026.
Raisonnement avancéProgrammationAgents autonomesTemps réel
Impact. Sorti le même jour que DeepSeek V4-Pro, il installe un écart de prix inédit entre deux modèles de qualité comparable.
08/2026Meta
Muse Spark 1.2 et Muse Code
Troisième version du modèle, publiée le 5 août avec Muse Code, un agent de programmation qui s'utilise en ligne de commande.
ProgrammationAgents autonomesMultimodalité
Impact. Meta rejoint le terrain des agents de codage en ligne de commande, où tous ses concurrents étaient déjà installés.
07/2026Anthropic
Claude Opus 5
Successeur d'Opus 4.8 pour le codage agentique et le travail d'entreprise. La réflexion est active par défaut et le contexte de 1 million de tokens devient la norme, au tarif inchangé de 5 et 25 dollars par million de tokens.
Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise
Impact. Amène le haut de gamme agentique sans hausse de prix, à moitié moins cher que le modèle le plus capable de la maison.
07/2026Google DeepMind
Gemini 3.6 Flash
Modèle de volume à 1 million de tokens de contexte, pensé pour le coût, à 1,50 et 7,50 dollars par million de tokens. Publié avec Gemini 3.5 Flash-Lite, pendant que la version Pro reste en test.
MultimodalitéLong contexteProgrammationDéploiement entreprise
Impact. Google déplace la bataille sur le rapport coût-performance plutôt que sur le seul sommet des classements.
07/2026OpenAI
GPT-5.6 (Luna, Terra, Sol)
Gamme segmentée en 3 niveaux. Luna pour les usages rapides et peu coûteux, Terra pour le travail courant, Sol pour le codage et les agents les plus lourds.
Raisonnement avancéProgrammationAgents autonomesDéploiement entreprise
Impact. Officialise l'abandon du modèle unique au profit d'une gamme, chaque niveau visant un budget différent.
07/2026Qwen
Qwen3.8-Max
Modèle multimodal de 2 400 milliards de paramètres, dévoilé en avant-première à la conférence mondiale de l'IA de Shanghai.
Raisonnement avancéMultimodalitéProgrammationMultilingue
Impact. Alibaba bascule vers de très grands modèles fermés, après des années de stratégie ouverte.
07/2026xAI
Grok 4.5
Nouvelle version du modèle de xAI, suivie quelques semaines plus tard d'un modèle de reconnaissance vocale maison.
Raisonnement avancéProgrammationMultimodalitéTemps réel
Impact. xAI tient son rythme de sortie rapide et étend sa gamme au-delà du texte.
07/2026Moonshot AI
Kimi K3
2 800 milliards de paramètres et 1 million de jetons de contexte, avec un mode raisonnement permanent. Poids publiés sur Hugging Face sous licence MIT modifiée.
Raisonnement avancéAgents autonomesVisionLong contexteOpen-weightProgrammation
Impact. Plus grand modèle ouvert jamais publié, au niveau des meilleurs modèles fermés américains.
07/2026Sber
GigaChat 3.5 Ultra
Modèle phare de 432 milliards de paramètres dont 28 milliards actifs à chaque requête, sur une architecture mixte qui alterne attention classique et attention linéaire. Poids publiés sous licence MIT. Environ 40% plus compact que le GigaChat 3.1 Ultra qu'il remplace, tout en faisant mieux en code, en mathématiques et en tâches d'agent.
Raisonnement avancéProgrammationAgents autonomesLong contexteOpen-weightMultilingue
Impact. Une banque russe publie librement un modèle de premier plan, téléchargeable et installable ailleurs. C'est la première fois dans cette frise.
06/2026Anthropic
Claude Fable 5 et Mythos 5
Le modèle le plus capable d'Anthropic, pour le raisonnement le plus exigeant et les tâches longues. La réflexion est permanente et son détail n'est jamais restitué, seulement résumé.
Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise
Impact. Nouveau sommet de capacité, assorti de garde-fous renforcés en biologie et en cybersécurité.
06/2026Anthropic
Claude Sonnet 5
Niveau intermédiaire qui atteint une qualité proche du haut de gamme sur le codage et les agents, avec 1 million de tokens de contexte et un nouveau découpage du texte.
Raisonnement avancéProgrammationAgents autonomesLong contexte
Impact. Réduit encore l'écart entre le milieu et le haut de gamme, à 3 et 15 dollars par million de tokens.
06/2026ByteDance
Doubao-Seed 2.1 Pro
Version phare présentée le 23 juin 2026 à la conférence Force de Volcano Engine, déclinée en Pro et Turbo. ByteDance annonce des résultats proches de GPT-5.5, de Claude Opus 4.7 et de Gemini 3.1 Pro sur plusieurs tests de référence.
Raisonnement avancéMultimodalitéProgrammationAgents autonomes
Impact. Place un modèle chinois au niveau annoncé des modèles occidentaux de pointe, sur le marché le plus peuplé du monde.
05/2026Anthropic
Claude Opus 4.8
Orchestration native de nombreux sous-agents en parallèle dans une même session, pour des tâches à l'échelle d'une base de code entière. Contexte de 1 million de tokens.
ProgrammationAgents autonomesRaisonnement avancéLong contexteDéploiement entreprise
Impact. Étape clé vers l'autonomie à grande échelle, avec un modèle qui pilote lui-même une équipe de sous-agents.
05/2026Moonshot AI
Kimi K2.6
Modèle vision-langage de 1 000 milliards de paramètres capable de piloter 300 agents en parallèle sur plusieurs milliers d'étapes.
Agents autonomesVisionRaisonnement avancéProgrammationOpen-weight
Impact. Prend la tête des modèles ouverts, au coude à coude avec Qwen et DeepSeek.
05/2026Yandex
Alice AI LLM Flash
Modèle léger publié le 28 mai 2026, avec une fenêtre de 128 000 tokens et un mode de raisonnement par chaîne de pensée. Yandex annonce une inférence 2,5 fois plus rapide que YandexGPT 4 Pro.
Raisonnement avancéLong contexteMultilingue
Impact. Donne à la Russie un modèle rapide et local, sur un marché que les acteurs américains ont quitté.
04/2026DeepSeek
DeepSeek V4 (Pro et Flash)
2 modèles ouverts sous licence MIT, de 1 600 et 284 milliards de paramètres, avec 1 million de tokens de contexte. Une nouvelle attention compressée divise le coût de service par 10 face à la version précédente.
Raisonnement avancéProgrammationAgents autonomesLong contexteOpen-weightMultilingue
Impact. Relance la pression sur les prix, avec des capacités de pointe distribuées librement.
04/2026OpenAI
GPT-5.5
Étape intermédiaire de la ligne GPT-5, avant la segmentation en 3 niveaux arrivée en juillet.
Raisonnement avancéProgrammationAgents autonomes
Impact. Confirme la cadence rapide d'OpenAI, avec 3 versions majeures sur le premier semestre.
04/2026Mistral
Mistral Medium 3.5
128 milliards de paramètres, 256 000 tokens de contexte, et un niveau de raisonnement réglable requête par requête.
Raisonnement avancéProgrammationLong contexteMultilingueSouveraineté
Impact. Mistral mise sur le réglage fin du coût par requête plutôt que sur la course à la taille.
03/2026OpenAI
GPT-5.4
Première version majeure de l'année pour la ligne GPT-5.
Raisonnement avancéProgrammationAgents autonomes
Impact. Ouvre une année à cadence soutenue chez OpenAI.
03/2026Mistral
Small 4, Voxtral TTS et Forge
6 sorties dans le même mois, du petit modèle à la synthèse vocale, plus des outils de développement et un partenariat avec NVIDIA.
ProgrammationMultilingueOpen-weightSouveraineté
Impact. Mistral élargit son offre au-delà du modèle de langage, vers une gamme d'outils complète.
03/2026Sber
GigaChat Ultra
Modèle phare doté d'un mode de raisonnement, présenté en mars 2026 au-dessus de la génération GigaChat 2.0.
Raisonnement avancéMultimodalitéMultilingue
Impact. Installe une banque parmi les concepteurs de modèles, cas unique dans ce classement.
02/2026Google DeepMind
Gemini 3.1 Pro
Mise à jour du haut de gamme Gemini, sortie en avant-première quelques mois après la génération 3.
Raisonnement avancéMultimodalitéLong contexteAgents autonomes
Impact. Google resserre son rythme de mise à jour sur le segment le plus visible.
02/2026ByteDance
Doubao-Seed 2.0
Famille lancée le 14 février 2026, avec 3 modèles d'agent généralistes, Pro, Lite et Mini, plus un modèle dédié au code.
Agents autonomesProgrammationMultilingue
Impact. Structure l'offre par usage plutôt que par taille, et porte l'assistant le plus utilisé de Chine, 382 millions de personnes par mois.
01/2026Moonshot AI
Kimi K2.5
Première refonte d'architecture, avec une vision native portée par l'encodeur MoonViT et une fenêtre de 256 000 jetons.
VisionRaisonnement avancéAgents autonomesLong contexteOpen-weight
Impact. Fait passer Kimi du texte seul au multimodal, sans quitter l'open-weight.
04/2026Meta
Muse Spark
Annoncé le 8 avril, premier modèle des Superintelligence Labs, et surtout premier modèle propriétaire de Meta. Usage d'outils, chaîne de pensée visuelle et orchestration de plusieurs agents. La version 1.1 suit le 9 juillet.
Raisonnement avancéMultimodalitéAgents autonomesProgrammation
Impact. Rupture stratégique. Meta quitte l'open-weight qui faisait sa marque pour affronter OpenAI sur son terrain.