2026, l'ère des agents autonomes
Après le raisonnement, la course se déplace vers l'autonomie. Des modèles qui planifient sur la durée, enchaînent des dizaines d'outils et exécutent des tâches de plusieurs heures sans supervision. Le modèle ne répond plus, il travaille. Trois mouvements de fond marquent l'année. Les gammes se segmentent en niveaux de prix chez presque tous les acteurs, le contexte de 1 million de tokens devient la norme et non plus l'exception, et la course à la taille cède la place à la course à l'efficacité. Ce dernier point est passé du laboratoire à l'industrie en mars, quand une méthode de compression de la mémoire d'exécution publiée par Google Research a fait reculer les fabricants de puces en bourse. Année en cours, relevé arrêté fin juillet 2026.
07/2026Anthropic
Claude Opus 5
Successeur d'Opus 4.8 pour le codage agentique et le travail d'entreprise. La réflexion est active par défaut et le contexte de 1 million de tokens devient la norme, au tarif inchangé de 5 et 25 dollars par million de tokens.
Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise
Impact. Amène le haut de gamme agentique sans hausse de prix, à moitié moins cher que le modèle le plus capable de la maison.
07/2026Google DeepMind
Gemini 3.6 Flash
Modèle de volume à 1 million de tokens de contexte, pensé pour le coût, à 1,50 et 7,50 dollars par million de tokens. Publié avec Gemini 3.5 Flash-Lite, pendant que la version Pro reste en test.
MultimodalitéLong contexteProgrammationDéploiement entreprise
Impact. Google déplace la bataille sur le rapport coût-performance plutôt que sur le seul sommet des classements.
07/2026OpenAI
GPT-5.6 (Luna, Terra, Sol)
Gamme segmentée en 3 niveaux. Luna pour les usages rapides et peu coûteux, Terra pour le travail courant, Sol pour le codage et les agents les plus lourds.
Raisonnement avancéProgrammationAgents autonomesDéploiement entreprise
Impact. Officialise l'abandon du modèle unique au profit d'une gamme, chaque niveau visant un budget différent.
07/2026Qwen
Qwen3.8-Max
Modèle multimodal de 2 400 milliards de paramètres, dévoilé en avant-première à la conférence mondiale de l'IA de Shanghai.
Raisonnement avancéMultimodalitéProgrammationMultilingue
Impact. Alibaba bascule vers de très grands modèles fermés, après des années de stratégie ouverte.
07/2026xAI
Grok 4.5
Nouvelle version du modèle de xAI, suivie quelques semaines plus tard d'un modèle de reconnaissance vocale maison.
Raisonnement avancéProgrammationMultimodalitéTemps réel
Impact. xAI tient son rythme de sortie rapide et étend sa gamme au-delà du texte.
07/2026Moonshot AI
Kimi K3
2 800 milliards de paramètres et 1 million de jetons de contexte, avec un mode raisonnement permanent. Poids publiés sur Hugging Face sous licence MIT modifiée.
Raisonnement avancéAgents autonomesVisionLong contexteOpen-weightProgrammation
Impact. Plus grand modèle ouvert jamais publié, au niveau des meilleurs modèles fermés américains.
06/2026Anthropic
Claude Fable 5 et Mythos 5
Le modèle le plus capable d'Anthropic, pour le raisonnement le plus exigeant et les tâches longues. La réflexion est permanente et son détail n'est jamais restitué, seulement résumé.
Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise
Impact. Nouveau sommet de capacité, assorti de garde-fous renforcés en biologie et en cybersécurité.
06/2026Anthropic
Claude Sonnet 5
Niveau intermédiaire qui atteint une qualité proche du haut de gamme sur le codage et les agents, avec 1 million de tokens de contexte et un nouveau découpage du texte.
Raisonnement avancéProgrammationAgents autonomesLong contexte
Impact. Réduit encore l'écart entre le milieu et le haut de gamme, à 3 et 15 dollars par million de tokens.
06/2026ByteDance
Doubao-Seed 2.1 Pro
Version phare présentée le 23 juin 2026 à la conférence Force de Volcano Engine, déclinée en Pro et Turbo. ByteDance annonce des résultats proches de GPT-5.5, de Claude Opus 4.7 et de Gemini 3.1 Pro sur plusieurs tests de référence.
Raisonnement avancéMultimodalitéProgrammationAgents autonomes
Impact. Place un modèle chinois au niveau annoncé des modèles occidentaux de pointe, sur le marché le plus peuplé du monde.
05/2026Anthropic
Claude Opus 4.8
Orchestration native de nombreux sous-agents en parallèle dans une même session, pour des tâches à l'échelle d'une base de code entière. Contexte de 1 million de tokens.
ProgrammationAgents autonomesRaisonnement avancéLong contexteDéploiement entreprise
Impact. Étape clé vers l'autonomie à grande échelle, avec un modèle qui pilote lui-même une équipe de sous-agents.
05/2026Moonshot AI
Kimi K2.6
Modèle vision-langage de 1 000 milliards de paramètres capable de piloter 300 agents en parallèle sur plusieurs milliers d'étapes.
Agents autonomesVisionRaisonnement avancéProgrammationOpen-weight
Impact. Prend la tête des modèles ouverts, au coude à coude avec Qwen et DeepSeek.
05/2026Yandex
Alice AI LLM Flash
Modèle léger publié le 28 mai 2026, avec une fenêtre de 128 000 tokens et un mode de raisonnement par chaîne de pensée. Yandex annonce une inférence 2,5 fois plus rapide que YandexGPT 4 Pro.
Raisonnement avancéLong contexteMultilingue
Impact. Donne à la Russie un modèle rapide et local, sur un marché que les acteurs américains ont quitté.
04/2026DeepSeek
DeepSeek V4 (Pro et Flash)
2 modèles ouverts sous licence MIT, de 1 600 et 284 milliards de paramètres, avec 1 million de tokens de contexte. Une nouvelle attention compressée divise le coût de service par 10 face à la version précédente.
Raisonnement avancéProgrammationAgents autonomesLong contexteOpen-weightMultilingue
Impact. Relance la pression sur les prix, avec des capacités de pointe distribuées librement.
04/2026OpenAI
GPT-5.5
Étape intermédiaire de la ligne GPT-5, avant la segmentation en 3 niveaux arrivée en juillet.
Raisonnement avancéProgrammationAgents autonomes
Impact. Confirme la cadence rapide d'OpenAI, avec 3 versions majeures sur le premier semestre.
04/2026Mistral
Mistral Medium 3.5
128 milliards de paramètres, 256 000 tokens de contexte, et un niveau de raisonnement réglable requête par requête.
Raisonnement avancéProgrammationLong contexteMultilingueSouveraineté
Impact. Mistral mise sur le réglage fin du coût par requête plutôt que sur la course à la taille.
03/2026OpenAI
GPT-5.4
Première version majeure de l'année pour la ligne GPT-5.
Raisonnement avancéProgrammationAgents autonomes
Impact. Ouvre une année à cadence soutenue chez OpenAI.
03/2026Mistral
Small 4, Voxtral TTS et Forge
6 sorties dans le même mois, du petit modèle à la synthèse vocale, plus des outils de développement et un partenariat avec NVIDIA.
ProgrammationMultilingueOpen-weightSouveraineté
Impact. Mistral élargit son offre au-delà du modèle de langage, vers une gamme d'outils complète.
03/2026Sber
GigaChat Ultra
Modèle phare doté d'un mode de raisonnement, présenté en mars 2026 au-dessus de la génération GigaChat 2.0.
Raisonnement avancéMultimodalitéMultilingue
Impact. Installe une banque parmi les concepteurs de modèles, cas unique dans ce classement.
02/2026Google DeepMind
Gemini 3.1 Pro
Mise à jour du haut de gamme Gemini, sortie en avant-première quelques mois après la génération 3.
Raisonnement avancéMultimodalitéLong contexteAgents autonomes
Impact. Google resserre son rythme de mise à jour sur le segment le plus visible.
02/2026ByteDance
Doubao-Seed 2.0
Famille lancée le 14 février 2026, avec 3 modèles d'agent généralistes, Pro, Lite et Mini, plus un modèle dédié au code.
Agents autonomesProgrammationMultilingue
Impact. Structure l'offre par usage plutôt que par taille, et porte l'assistant le plus utilisé de Chine, 382 millions de personnes par mois.
01/2026Moonshot AI
Kimi K2.5
Première refonte d'architecture, avec une vision native portée par l'encodeur MoonViT et une fenêtre de 256 000 jetons.
VisionRaisonnement avancéAgents autonomesLong contexteOpen-weight
Impact. Fait passer Kimi du texte seul au multimodal, sans quitter l'open-weight.
2026Meta
Muse Spark
à confirmerPremier modèle des Superintelligence Labs, et surtout premier modèle propriétaire de Meta. Usage d'outils, chaîne de pensée visuelle et orchestration de plusieurs agents.
Raisonnement avancéMultimodalitéAgents autonomesProgrammation
Impact. Rupture stratégique. Meta quitte l'open-weight qui faisait sa marque pour affronter OpenAI sur son terrain.