Accueil
Metabacklinks
  • Accueil
  • Prestations

    Site Web auto-géré

    Un site premium qui se met à jour seul.

    Site e-commerce

    Vendez en ligne, sans y penser.

    Acquisition de leads

    Vos visiteurs deviennent des contacts.

    Référencement SEO / GEO

    Soyez trouvé sur Google et les IA.

    Campagnes publicitaires

    De la pub qui rapporte, pilotée pour vous.

    Contre-expertise

    Nous vérifions le travail des autres.

    Refonte & maintenance

    Nous refaisons votre site, puis nous veillons dessus.

    Conseils et formations

    Nous vous formons au web et à l’IA.

  • Expertise

    Intelligence artificielle

    Comprendre l’IA, se former à ses usages et automatiser vos tâches du quotidien.

    Web & digital

    Votre présence en ligne pensée de bout en bout, du premier écran de votre site jusqu’à la vente.

    Logiciels métiers

    CRM et ERP connectés à votre activité, pour piloter vos clients et vos process au même endroit.

    Notre CRM

    Notre CRM

    Centralisez vos leads et vos clients, connecté à votre site et à vos agents.

  • Agents IA

    Agent Superviseur

    Véritable chef d’orchestre. Pilote l’équipe et vous informe des travaux en cours.

    Agent Webmaster

    Maintenance et sauvegardes. Code optimisé pour des sites rapides et en ligne.

    Agent SEO / GEO

    Audits, indexation et performances. Votre visibilité sur Google et dans les IA.

    Agent Rédactionnel

    Contenus optimisés et stratégie éditoriale.

    Agent Webmarketing & Leads

    Landing pages, tunnels de conversion et génération de leads clients.

    Agent Community Manager

    Réseaux sociaux, e-réputation et avis Google.

    Agent Conversationnel

    Accueil, qualification et prise de rendez-vous. Gère aussi les rappels.

    Agent Cybersécurité & Conformité

    Sécurité, monitoring et conformité RGPD. Applique les correctifs et réduit les risques.

    Agent Spécialiste SEA

    Google Ads, Meta Ads et LinkedIn Ads. Coûts ajustés à votre budget.

    Agent Traducteur

    Véritable linguiste. Traduction et adaptation en plusieurs langues.

    Agent Growth hacking

    Expérimentations et leviers de croissance. Capte les futurs leads.

    Agent Veille technique

    Veille sur les nouveautés web, IA et tendances. Journaliste d’investigation.

  • Secteurs

    Immobilier & Bâtiment

    Agences, promoteurs, architectes et BTP.

    Santé & médical

    Cabinets, cliniques, thérapeutes et libéraux de santé.

    Tourisme et gastronomie

    Hôtels, gîtes, restaurateurs, traiteurs et domaines.

    Éducation & formation

    Écoles privées et centres de formation.

    Secteur public & institutionnel

    Mairies, collectivités, associations et fédérations.

    Créateurs & Inventeurs

    Lancer son activité, son réseau ou son outil métier.

    Industrie & grands comptes

    Grandes entreprises, pharma, portails et extranets.

    Commerces & professions de proximité

    Garages, coiffeurs, avocats, notaires et artisans.

  • News & Tuto

    Tous les articles

    L’ensemble du blog, toutes rubriques.

    News & analyses

    Ce qui bouge, et ce que ça change.

    Tutoriels

    Des marches à suivre, pas à pas.

Nous contacter
Accueil
Metabacklinks

Menu

  • Accueil
    • Toutes les prestations
    • Site Web auto-géré
    • Site e-commerce
    • Acquisition de leads
    • Référencement SEO / GEO
    • Campagnes publicitaires
    • Contre-expertise
    • Refonte & maintenance
    • Conseils et formations
    • Toutes nos expertises
    • Intelligence artificielle
    • Web & digital
    • Logiciels métiers
    • Toute l’équipe
    • Agent Superviseur
    • Agent Webmaster
    • Agent SEO / GEO
    • Agent Rédactionnel
    • Agent Webmarketing & Leads
    • Agent Community Manager
    • Agent Conversationnel
    • Agent Cybersécurité & Conformité
    • Agent Spécialiste SEA
    • Agent Traducteur
    • Agent Growth hacking
    • Agent Veille technique
    • Tous les secteurs
    • Immobilier & Bâtiment
    • Santé & médical
    • Tourisme et gastronomie
    • Éducation & formation
    • Secteur public & institutionnel
    • Créateurs & Inventeurs
    • Industrie & grands comptes
    • Commerces & professions de proximité
    • Tous les articles
    • News & analyses
    • Tutoriels
Timeline IA

L'évolution des LLM, année après année

5 ans d'évolution des grands modèles de fondation, de 2022 à 2026. Comment l'intelligence artificielle est passée du simple assistant conversationnel à l'agent capable de travailler seul. Une frise de référence, laboratoire par laboratoire.

  • Explorer la timeline
  • Comparateur d’IA
Timeline des modèles d'intelligence artificielle
Ce qui a changé

Le modèle a peu bougé. Son environnement, beaucoup.

La frise ci-dessous raconte la course aux modèles. Elle ne raconte pas tout. Un modèle reste une mécanique simple, une question entre, une réponse sort. L’essentiel des progrès de ces dernières années vient de ce que nous construisons autour, en 3 étapes.

  • Le prompt.

    Tout se jouait dans la question posée. Donner un rôle, cadrer le résultat attendu, découper la demande. Le savoir-faire de l’époque tenait dans la façon d’écrire une consigne, et le modèle répondait avec ce qu’il avait appris.

  • Le contexte.

    Le modèle a reçu de quoi travailler. Documents, données maison, règles internes, fournis au moment même de la question. Les réponses inventées reculent, parce que le modèle ne devine plus, il consulte.

  • Le harnais.

    Autour du modèle viennent des outils, une mémoire, des compétences et des garde-fous. Il peut agir, vérifier son travail et recommencer jusqu’à ce que ce soit bon. C’est ce qui sépare un agent d’un assistant de rédaction.

2026, l'ère des agents autonomes

Après le raisonnement, la course se déplace vers l'autonomie. Des modèles qui planifient sur la durée, enchaînent des dizaines d'outils et exécutent des tâches de plusieurs heures sans supervision. Le modèle ne répond plus, il travaille. Trois mouvements de fond marquent l'année. Les gammes se segmentent en niveaux de prix chez presque tous les acteurs, le contexte de 1 million de tokens devient la norme et non plus l'exception, et la course à la taille cède la place à la course à l'efficacité. Ce dernier point est passé du laboratoire à l'industrie en mars, quand une méthode de compression de la mémoire d'exécution publiée par Google Research a fait reculer les fabricants de puces en bourse. Année en cours, relevé arrêté fin juillet 2026.

07/2026Anthropic

Claude Opus 5

Successeur d'Opus 4.8 pour le codage agentique et le travail d'entreprise. La réflexion est active par défaut et le contexte de 1 million de tokens devient la norme, au tarif inchangé de 5 et 25 dollars par million de tokens.

Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise

Impact. Amène le haut de gamme agentique sans hausse de prix, à moitié moins cher que le modèle le plus capable de la maison.

07/2026Google DeepMind

Gemini 3.6 Flash

Modèle de volume à 1 million de tokens de contexte, pensé pour le coût, à 1,50 et 7,50 dollars par million de tokens. Publié avec Gemini 3.5 Flash-Lite, pendant que la version Pro reste en test.

MultimodalitéLong contexteProgrammationDéploiement entreprise

Impact. Google déplace la bataille sur le rapport coût-performance plutôt que sur le seul sommet des classements.

07/2026OpenAI

GPT-5.6 (Luna, Terra, Sol)

Gamme segmentée en 3 niveaux. Luna pour les usages rapides et peu coûteux, Terra pour le travail courant, Sol pour le codage et les agents les plus lourds.

Raisonnement avancéProgrammationAgents autonomesDéploiement entreprise

Impact. Officialise l'abandon du modèle unique au profit d'une gamme, chaque niveau visant un budget différent.

07/2026Qwen

Qwen3.8-Max

Modèle multimodal de 2 400 milliards de paramètres, dévoilé en avant-première à la conférence mondiale de l'IA de Shanghai.

Raisonnement avancéMultimodalitéProgrammationMultilingue

Impact. Alibaba bascule vers de très grands modèles fermés, après des années de stratégie ouverte.

07/2026xAI

Grok 4.5

Nouvelle version du modèle de xAI, suivie quelques semaines plus tard d'un modèle de reconnaissance vocale maison.

Raisonnement avancéProgrammationMultimodalitéTemps réel

Impact. xAI tient son rythme de sortie rapide et étend sa gamme au-delà du texte.

07/2026Moonshot AI

Kimi K3

2 800 milliards de paramètres et 1 million de jetons de contexte, avec un mode raisonnement permanent. Poids publiés sur Hugging Face sous licence MIT modifiée.

Raisonnement avancéAgents autonomesVisionLong contexteOpen-weightProgrammation

Impact. Plus grand modèle ouvert jamais publié, au niveau des meilleurs modèles fermés américains.

06/2026Anthropic

Claude Fable 5 et Mythos 5

Le modèle le plus capable d'Anthropic, pour le raisonnement le plus exigeant et les tâches longues. La réflexion est permanente et son détail n'est jamais restitué, seulement résumé.

Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise

Impact. Nouveau sommet de capacité, assorti de garde-fous renforcés en biologie et en cybersécurité.

06/2026Anthropic

Claude Sonnet 5

Niveau intermédiaire qui atteint une qualité proche du haut de gamme sur le codage et les agents, avec 1 million de tokens de contexte et un nouveau découpage du texte.

Raisonnement avancéProgrammationAgents autonomesLong contexte

Impact. Réduit encore l'écart entre le milieu et le haut de gamme, à 3 et 15 dollars par million de tokens.

06/2026ByteDance

Doubao-Seed 2.1 Pro

Version phare présentée le 23 juin 2026 à la conférence Force de Volcano Engine, déclinée en Pro et Turbo. ByteDance annonce des résultats proches de GPT-5.5, de Claude Opus 4.7 et de Gemini 3.1 Pro sur plusieurs tests de référence.

Raisonnement avancéMultimodalitéProgrammationAgents autonomes

Impact. Place un modèle chinois au niveau annoncé des modèles occidentaux de pointe, sur le marché le plus peuplé du monde.

05/2026Anthropic

Claude Opus 4.8

Orchestration native de nombreux sous-agents en parallèle dans une même session, pour des tâches à l'échelle d'une base de code entière. Contexte de 1 million de tokens.

ProgrammationAgents autonomesRaisonnement avancéLong contexteDéploiement entreprise

Impact. Étape clé vers l'autonomie à grande échelle, avec un modèle qui pilote lui-même une équipe de sous-agents.

05/2026Moonshot AI

Kimi K2.6

Modèle vision-langage de 1 000 milliards de paramètres capable de piloter 300 agents en parallèle sur plusieurs milliers d'étapes.

Agents autonomesVisionRaisonnement avancéProgrammationOpen-weight

Impact. Prend la tête des modèles ouverts, au coude à coude avec Qwen et DeepSeek.

05/2026Yandex

Alice AI LLM Flash

Modèle léger publié le 28 mai 2026, avec une fenêtre de 128 000 tokens et un mode de raisonnement par chaîne de pensée. Yandex annonce une inférence 2,5 fois plus rapide que YandexGPT 4 Pro.

Raisonnement avancéLong contexteMultilingue

Impact. Donne à la Russie un modèle rapide et local, sur un marché que les acteurs américains ont quitté.

04/2026DeepSeek

DeepSeek V4 (Pro et Flash)

2 modèles ouverts sous licence MIT, de 1 600 et 284 milliards de paramètres, avec 1 million de tokens de contexte. Une nouvelle attention compressée divise le coût de service par 10 face à la version précédente.

Raisonnement avancéProgrammationAgents autonomesLong contexteOpen-weightMultilingue

Impact. Relance la pression sur les prix, avec des capacités de pointe distribuées librement.

04/2026OpenAI

GPT-5.5

Étape intermédiaire de la ligne GPT-5, avant la segmentation en 3 niveaux arrivée en juillet.

Raisonnement avancéProgrammationAgents autonomes

Impact. Confirme la cadence rapide d'OpenAI, avec 3 versions majeures sur le premier semestre.

04/2026Mistral

Mistral Medium 3.5

128 milliards de paramètres, 256 000 tokens de contexte, et un niveau de raisonnement réglable requête par requête.

Raisonnement avancéProgrammationLong contexteMultilingueSouveraineté

Impact. Mistral mise sur le réglage fin du coût par requête plutôt que sur la course à la taille.

03/2026OpenAI

GPT-5.4

Première version majeure de l'année pour la ligne GPT-5.

Raisonnement avancéProgrammationAgents autonomes

Impact. Ouvre une année à cadence soutenue chez OpenAI.

03/2026Mistral

Small 4, Voxtral TTS et Forge

6 sorties dans le même mois, du petit modèle à la synthèse vocale, plus des outils de développement et un partenariat avec NVIDIA.

ProgrammationMultilingueOpen-weightSouveraineté

Impact. Mistral élargit son offre au-delà du modèle de langage, vers une gamme d'outils complète.

03/2026Sber

GigaChat Ultra

Modèle phare doté d'un mode de raisonnement, présenté en mars 2026 au-dessus de la génération GigaChat 2.0.

Raisonnement avancéMultimodalitéMultilingue

Impact. Installe une banque parmi les concepteurs de modèles, cas unique dans ce classement.

02/2026Google DeepMind

Gemini 3.1 Pro

Mise à jour du haut de gamme Gemini, sortie en avant-première quelques mois après la génération 3.

Raisonnement avancéMultimodalitéLong contexteAgents autonomes

Impact. Google resserre son rythme de mise à jour sur le segment le plus visible.

02/2026ByteDance

Doubao-Seed 2.0

Famille lancée le 14 février 2026, avec 3 modèles d'agent généralistes, Pro, Lite et Mini, plus un modèle dédié au code.

Agents autonomesProgrammationMultilingue

Impact. Structure l'offre par usage plutôt que par taille, et porte l'assistant le plus utilisé de Chine, 382 millions de personnes par mois.

01/2026Moonshot AI

Kimi K2.5

Première refonte d'architecture, avec une vision native portée par l'encodeur MoonViT et une fenêtre de 256 000 jetons.

VisionRaisonnement avancéAgents autonomesLong contexteOpen-weight

Impact. Fait passer Kimi du texte seul au multimodal, sans quitter l'open-weight.

2026Meta

Muse Spark

à confirmer

Premier modèle des Superintelligence Labs, et surtout premier modèle propriétaire de Meta. Usage d'outils, chaîne de pensée visuelle et orchestration de plusieurs agents.

Raisonnement avancéMultimodalitéAgents autonomesProgrammation

Impact. Rupture stratégique. Meta quitte l'open-weight qui faisait sa marque pour affronter OpenAI sur son terrain.

2025, les modèles de raisonnement

Agrandir les modèles ne suffit plus. La nouveauté, c'est le raisonnement. Le modèle déroule une réflexion interne avant de répondre, ce qui débloque les maths, les sciences et le code complexe. Le choc de l'année vient de DeepSeek R1, qui rend ce raisonnement accessible en open-weight à bas coût.

12/2025Mistral

Mistral Large 3

675 milliards de paramètres au total dont 41 activés par token, 256 000 tokens de contexte, publié sous licence Apache 2.0 donc librement installable chez soi.

Raisonnement avancéProgrammationLong contexteOpen-weightMultilingueSouveraineté

Impact. Le champion européen place un modèle de tout premier plan en accès libre, sans coût par token.

11/2025Google DeepMind

Gemini 3 (Pro, Deep Think)

Génération orientée agents longue durée, avec un raisonnement de pointe et un contexte de 1 million de tokens, disponible dès le premier jour dans la recherche Google.

Raisonnement avancéProgrammationMultimodalitéAgents autonomesLong contexteDéploiement entreprise

Impact. Reprise de la course au raisonnement et pivot agentique de Google, à l'échelle de son moteur de recherche.

11/2025Anthropic

Claude Opus 4.5

Introduit un paramètre d'effort réglable pour arbitrer entre vitesse et qualité. Meilleur modèle de programmation d'Anthropic à cette date.

ProgrammationAgents autonomesRaisonnement avancéLong contexte

Impact. Installe le contrôle explicite de l'effort de calcul comme standard d'usage.

11/2025Moonshot AI

Kimi K2 Thinking

Ajoute des traces de raisonnement visibles et enchaîne jusqu'à 300 appels d'outils de suite sans intervention humaine.

Raisonnement avancéAgents autonomesProgrammationOpen-weight

Impact. Déplace la référence de l'agent autonome vers le camp des modèles ouverts.

11/2025Yandex

Alice AI

Nouvelle famille de modèles présentée à côté de YandexGPT, avec une fenêtre de 65 536 tokens. Elle fait tourner l'assistant Alice, intégré au navigateur du groupe.

Raisonnement avancéMultilingueAssistant grand public

Impact. Alice atteint 71 millions d'utilisateurs par mois et entre dans les 10 premiers produits d'IA mobile au monde.

10/2025Anthropic

Claude Haiku 4.5

Ramène le raisonnement étendu et l'usage d'ordinateur dans le modèle le plus rapide et le moins cher de la gamme.

ProgrammationAgents autonomesRaisonnement avancéDéploiement entreprise

Impact. Rend les capacités agentiques accessibles à grande échelle et à bas coût.

10/2025ByteDance

Doubao 1.6

Mise à jour qui introduit 4 durées de réflexion réglables nativement, accompagnée de nouveaux modèles de synthèse et de clonage vocal.

Raisonnement avancéSynthèse vocaleMultimodalité

Impact. Laisse l'utilisateur arbitrer entre vitesse et qualité de raisonnement, au lieu de choisir un modèle différent.

09/2025Anthropic

Claude Sonnet 4.5

Sessions agentiques prolongées sur plusieurs dizaines d'heures grâce à une meilleure gestion de la mémoire et du contexte.

ProgrammationAgents autonomesRaisonnement avancéLong contexte

Impact. Prouve qu'un modèle de milieu de gamme peut tenir un travail autonome quasi journalier.

08/2025OpenAI

GPT-5

Premier modèle unifié qui fusionne les modèles rapides et les modèles de raisonnement dans un seul système, avec un routeur automatique. Contexte de 400 000 tokens.

Raisonnement avancéProgrammationVisionMultimodalitéLong contexteAgents autonomes

Impact. Met fin à la séparation entre gammes GPT et o, un tournant pour toute la suite.

08/2025OpenAI

gpt-oss 120B et 20B

Premiers poids ouverts d'OpenAI depuis 2019, sous licence Apache 2.0, exécutables localement.

Raisonnement avancéProgrammationOpen-weightDéploiement entreprise

Impact. Retour d'OpenAI sur le terrain de l'open source face à Llama, Mistral et DeepSeek.

07/2025xAI

Grok 4

Raisonnement abstrait renforcé, appel d'outils natif et recherche en temps réel intégrée.

Raisonnement avancéAgents autonomesProgrammationLong contexteMultimodalité

Impact. Premier Grok à rivaliser frontalement avec les meilleurs modèles de raisonnement.

07/2025Moonshot AI

Kimi K2

Modèle à experts de 1 000 milliards de paramètres, dont 32 milliards activés par jeton, publié en poids ouverts sous licence MIT modifiée et taillé pour l'usage d'outils.

ProgrammationAgents autonomesOpen-weightLong contexteMultilingue

Impact. Premier modèle ouvert à rivaliser sérieusement avec les modèles fermés sur l'appel d'outils.

06/2025Mistral AI

Magistral

Premier modèle de raisonnement de Mistral, avec une chaîne de pensée traçable et multilingue, en open-weight.

Raisonnement avancéMultilingueOpen-weightDéploiement entreprise

Impact. Réponse européenne à la vague des modèles de raisonnement, avec un accent sur la transparence.

05/2025Anthropic

Claude Opus 4 et Sonnet 4

Génération Claude 4. Opus 4 est présenté comme le meilleur modèle de programmation au monde, capable de travail autonome soutenu sur plusieurs heures.

ProgrammationAgents autonomesRaisonnement avancéVisionLong contexte

Impact. Bascule d'Anthropic vers l'agent capable de tenir une tâche de développement complète.

04/2025OpenAI

o3 et o4-mini

Premiers modèles de raisonnement à manipuler des images dans leur chaîne de pensée et à utiliser des outils de façon autonome pendant la réflexion.

Raisonnement avancéVisionAgents autonomesProgrammation

Impact. Première fusion réelle entre raisonnement et usage d'outils multimodaux.

04/2025Meta

Llama 4 (Scout, Maverick)

Première famille Llama en Mixture-of-Experts, multimodale dès le pré-entraînement. Scout offre un contexte de 10 millions de tokens, record en open-weight.

Open-weightMultimodalitéLong contexteVisionMultilingueDéploiement entreprise

Impact. Repousse la limite du contexte en open source, malgré une controverse sur les benchmarks.

04/2025Alibaba

Qwen3

Raisonnement hybride dans un seul modèle, entre réflexion approfondie et réponse rapide. Toute la gamme sous licence Apache 2.0.

Raisonnement avancéProgrammationOpen-weightMultilingueLong contexte

Impact. Rapproche les modèles ouverts des modèles fermés sur le raisonnement.

03/2025Google DeepMind

Gemini 2.5 Pro

Premier Gemini explicitement conçu comme modèle de réflexion, avec une chaîne de pensée déroulée avant la réponse.

Raisonnement avancéProgrammationMultimodalitéLong contexteAgents autonomes

Impact. Installe le raisonnement délibératif natif comme standard de la gamme Gemini.

02/2025Anthropic

Claude 3.7 Sonnet

Premier modèle hybride au monde. Un seul modèle propose une réponse rapide et un mode de raisonnement étendu activable à la demande.

Raisonnement avancéProgrammationVisionLong contexte

Impact. Invente le format hybride que GPT-5 généralisera quelques mois plus tard.

02/2025xAI

Grok 3

Bond de calcul d'entraînement avec un cluster d'environ 200 000 GPU, et premier mode de raisonnement explicite chez xAI.

Raisonnement avancéProgrammationAgents autonomesVisionLong contexte

Impact. Rapproche xAI des standards de raisonnement de l'époque.

01/2025DeepSeek

DeepSeek R1

Démontre que le raisonnement en chaîne de pensée peut émerger par apprentissage par renforcement pur, publié en open-weight sous licence MIT.

Raisonnement avancéProgrammationOpen-weightMultilingue

Impact. Événement le plus disruptif de la période, qui démocratise le raisonnement de haut niveau et secoue les marchés.

01/2025Moonshot AI

Kimi k1.5

Premier modèle de Moonshot à raisonner par étapes explicites avant de répondre, avec un entraînement par renforcement sur des chaînes longues.

Raisonnement avancéVisionLong contexteMultilingue

Impact. Fait entrer un troisième laboratoire chinois dans la course au raisonnement, quelques jours après DeepSeek R1.

2025Sber

GigaChat 2.0

Génération multimodale dotée d'une fenêtre de 128 000 tokens, avec la génération d'images confiée à la famille Kandinsky.

MultimodalitéGénération d'imagesLong contexte

Impact. Couvre texte et image dans un même service, condition d'usage grand public sur le marché russe.

2024, la révolution multimodale

Les modèles apprennent à voir, entendre et parler. La multimodalité devient native et les fenêtres de contexte explosent, jusqu'au million de tokens. En fin d'année, un signal faible annonce la suite avec les premiers modèles de raisonnement.

12/2024DeepSeek

DeepSeek V3

671 milliards de paramètres en MoE, entraîné pour une fraction du coût des modèles occidentaux équivalents, en open-weight.

Raisonnement avancéProgrammationLong contexteOpen-weightMultilingueDéploiement entreprise

Impact. Choc économique, avec un modèle frontière ouvert entraîné pour quelques millions de dollars.

12/2024Google DeepMind

Gemini 2.0 Flash

Premier Gemini pensé pour l'ère agentique, avec sortie native image et audio, usage natif d'outils et planification d'actions.

MultimodalitéAudioVidéoAgents autonomesProgrammation

Impact. Pivot officiel de Google vers des agents capables d'agir dans un environnement numérique.

12/2024OpenAI

o1

Version généralisée du raisonnement par chaîne de pensée entraîné par renforcement.

Raisonnement avancéProgrammation

Impact. Confirme le raisonnement comme nouvel axe de progrès, au-delà de la taille des modèles.

10/2024Anthropic

Claude 3.5 Sonnet, usage d'ordinateur

Introduit l'usage d'ordinateur en bêta. Le modèle déplace la souris, clique, tape et lit l'écran pour accomplir des tâches.

Agents autonomesProgrammationVisionRaisonnement avancé

Impact. Premier pas concret vers des agents qui agissent sur un ordinateur comme un humain.

09/2024OpenAI

o1-preview

Premier modèle public à chaîne de pensée cachée entraînée par renforcement. Gains spectaculaires en maths, sciences et code.

Raisonnement avancéProgrammation

Impact. Naissance de la catégorie des modèles de raisonnement.

09/2024Alibaba

Qwen2.5

Refonte complète de la famille, pré-entraînement sur 18 000 milliards de tokens, gains marqués en code et en maths.

Raisonnement avancéProgrammationOpen-weightMultilingueLong contexte

Impact. Devient l'une des familles open-weight les plus utilisées au monde.

08/2024xAI

Grok 2

Raisonnement, usage d'outils et vision nettement améliorés, disponible via API.

Raisonnement avancéVisionProgrammationLong contexte

Impact. Premier Grok réellement compétitif face aux modèles propriétaires établis.

07/2024Meta

Llama 3.1 405B

Premier Llama à 405 milliards de paramètres, contexte de 128 000 tokens, présenté comme le premier modèle ouvert rivalisant avec les meilleurs modèles fermés.

Open-weightLong contexteMultilingueRaisonnement avancé

Impact. Tournant pour la crédibilité de l'open source face au propriétaire.

06/2024Anthropic

Claude 3.5 Sonnet

Dépasse Claude 3 Opus tout en étant moins cher et plus rapide, avec un bond notable en programmation.

ProgrammationRaisonnement avancéVisionLong contexte

Impact. Le modèle de milieu de gamme dépasse le haut de gamme de la génération précédente.

05/2024DeepSeek

DeepSeek V2

Architecture MoE avec attention latente multi-têtes, qui réduit fortement le coût d'inférence.

Raisonnement avancéLong contexteOpen-weightMultilingue

Impact. Première rupture technique majeure de DeepSeek et base de sa réputation d'efficacité.

05/2024OpenAI

GPT-4o

Premier modèle nativement multimodal en temps réel, texte, image et audio dans un seul réseau, avec une latence vocale proche de l'humain.

VisionAudioMultimodalitéMultilingueProgrammation

Impact. Premier assistant vocal en temps réel de qualité conversationnelle, rendu gratuit à grande échelle.

04/2024Meta

Llama 3

Entraîné sur plus de 15 000 milliards de tokens, avec un saut qualitatif en raisonnement et en code.

Open-weightProgrammationRaisonnement avancéMultilingue

Impact. Confirme Llama comme référence open-weight face aux modèles propriétaires.

03/2024Anthropic

Claude 3 (Opus, Sonnet, Haiku)

Première gamme à 3 tailles chez Anthropic, avec vision multimodale sur les 3 modèles et une quasi-parité avec GPT-4.

Raisonnement avancéVisionMultimodalitéLong contexteMultilingue

Impact. Fait entrer Anthropic dans la cour des modèles multimodaux de premier plan.

02/2024Google DeepMind

Gemini 1.5 Pro

Fenêtre de contexte inédite de 1 million de tokens, soit environ 1 heure de vidéo ou 700 000 mots, avec une architecture MoE.

Long contexteMultimodalitéVidéoAudioRaisonnement avancé

Impact. Établit le long contexte comme avantage compétitif différenciant.

02/2024Mistral AI

Mistral Large

Premier modèle propriétaire haut de gamme de Mistral, conçu pour rivaliser avec GPT-4.

Raisonnement avancéProgrammationMultilingueDéploiement entrepriseLong contexte

Impact. Premier pas de Mistral vers le marché entreprise avec un modèle frontière.

2023, les modèles généralistes

Après le choc ChatGPT, chaque grand acteur sort son modèle. On passe du chatbot amusant à l'outil de travail qui raisonne, code et analyse des documents. La fuite de LLaMA lance l'écosystème open source moderne.

12/2023Google DeepMind

Gemini 1.0

Premier modèle de Google nativement multimodal, conçu dès l'origine pour combiner texte, code, audio, image et vidéo, en 3 tailles.

MultimodalitéVisionAudioVidéoProgrammation

Impact. Entrée officielle de Google dans la compétition frontale avec GPT-4.

12/2023Mistral AI

Mixtral 8x7B

Premier Mixture-of-Experts open-weight de Mistral, avec une performance proche de GPT-3.5 pour un coût bien moindre.

Open-weightMultilingueProgrammationLong contexte

Impact. Démocratise l'architecture MoE en open source.

11/2023OpenAI

GPT-4 Turbo

Contexte de 128 000 tokens, coûts d'API fortement réduits et appel de fonctions amélioré.

Long contexteProgrammationDéploiement entrepriseMultilingue

Impact. Fait passer GPT-4 de prouesse technique à outil déployable en entreprise.

11/2023xAI

Grok-1

Premier modèle de xAI, architecture MoE de 314 milliards de paramètres, lié dès l'origine à la plateforme X.

Raisonnement avancéMultilingue

Impact. Entrée de xAI dans la course aux modèles de fondation.

11/2023DeepSeek

DeepSeek LLM et Coder

Premiers modèles du laboratoire, un généraliste et un dédié au code, en open-weight.

ProgrammationOpen-weightMultilingueRaisonnement avancé

Impact. Établit DeepSeek comme laboratoire crédible dès sa première année.

09/2023Mistral AI

Mistral 7B

Modèle fondateur du laboratoire, qui dépasse Llama 2 13B malgré sa taille réduite.

Open-weightMultilingueDéploiement entreprise

Impact. Lance la vague des modèles open-weight performants en Europe.

08/2023Alibaba

Qwen 1.0

Premier modèle de fondation d'Alibaba, publié en plusieurs tailles, lançant sa stratégie open-weight.

ProgrammationOpen-weightMultilingue

Impact. Point de départ de toute la lignée Qwen.

07/2023Meta

Llama 2

Premier Llama distribué avec une licence d'usage commercial, entraîné sur 2 000 milliards de tokens.

Open-weightMultilingue

Impact. Devient la base de milliers de modèles dérivés dans le monde.

07/2023Anthropic

Claude 2

Contexte de 100 000 tokens en standard et lancement de l'interface grand public claude.ai.

Long contexteProgrammationMultilingue

Impact. Premier Claude à toucher directement le grand public.

03/2023Anthropic

Claude 1

Premier modèle public d'Anthropic, bâti sur les principes de la Constitutional AI, avec un contexte long pour l'époque.

Long contexteMultilingue

Impact. Premier concurrent sérieux et indépendant à GPT, avec une identité fondée sur la sécurité.

03/2023OpenAI

GPT-4

Premier modèle multimodal d'OpenAI, texte et image, avec un gain massif de fiabilité et de raisonnement. Réussit des examens au niveau humain.

Raisonnement avancéVisionMultimodalitéMultilingue

Impact. Référence absolue du secteur pendant plus d'un an.

02/2023Meta

LLaMA 1

Première famille de modèles de fondation ouverts de Meta, de 7 à 65 milliards de paramètres.

Open-weightMultilingue

Impact. Sa fuite en mars 2023 déclenche l'explosion de l'écosystème open source moderne.

2022, la démocratisation des assistants

Les grands modèles existent déjà, mais restent réservés aux chercheurs. L'événement de l'année n'est pas technique mais d'usage. Un assistant conversationnel gratuit arrive entre les mains de tous, et l'IA générative devient un sujet de société.

11/2022OpenAI

GPT-3.5, lancement de ChatGPT

Première mise à disposition grand public d'un modèle conversationnel affiné par renforcement, via une interface de chat simple et gratuite.

MultilingueProgrammation

Impact. Déclenche l'explosion mondiale de l'IA générative grand public.

05/2022Meta

OPT-175B

Suite de modèles comparable à GPT-3, publiée avec son code d'entraînement, une transparence rare à cette taille.

Open-weightMultilingue

Impact. Premier grand geste d'ouverture de Meta, base culturelle qui mènera à Llama.

04/2022Google

PaLM

Modèle dense de 540 milliards de paramètres entraîné via le système Pathways, avec une efficacité d'entraînement record.

Raisonnement avancéProgrammationMultilingue

Impact. Démontre la capacité à passer à l'échelle, base technique qui mènera à Gemini.

Meta

Dirigé par Mark Zuckerberg, aux États-Unis. Meta se différencie par l'open-weight, en diffusant ses modèles Llama librement pour dominer par l'écosystème.

2026Meta

Muse Spark

à confirmer

Premier modèle des Superintelligence Labs, et surtout premier modèle propriétaire de Meta. Usage d'outils, chaîne de pensée visuelle et orchestration de plusieurs agents.

Raisonnement avancéMultimodalitéAgents autonomesProgrammation

Impact. Rupture stratégique. Meta quitte l'open-weight qui faisait sa marque pour affronter OpenAI sur son terrain.

04/2025Meta

Llama 4 (Scout, Maverick)

Première famille Llama en Mixture-of-Experts, multimodale dès le pré-entraînement. Scout offre un contexte de 10 millions de tokens, record en open-weight.

Open-weightMultimodalitéLong contexteVisionMultilingueDéploiement entreprise

Impact. Repousse la limite du contexte en open source, malgré une controverse sur les benchmarks.

07/2024Meta

Llama 3.1 405B

Premier Llama à 405 milliards de paramètres, contexte de 128 000 tokens, présenté comme le premier modèle ouvert rivalisant avec les meilleurs modèles fermés.

Open-weightLong contexteMultilingueRaisonnement avancé

Impact. Tournant pour la crédibilité de l'open source face au propriétaire.

04/2024Meta

Llama 3

Entraîné sur plus de 15 000 milliards de tokens, avec un saut qualitatif en raisonnement et en code.

Open-weightProgrammationRaisonnement avancéMultilingue

Impact. Confirme Llama comme référence open-weight face aux modèles propriétaires.

07/2023Meta

Llama 2

Premier Llama distribué avec une licence d'usage commercial, entraîné sur 2 000 milliards de tokens.

Open-weightMultilingue

Impact. Devient la base de milliers de modèles dérivés dans le monde.

02/2023Meta

LLaMA 1

Première famille de modèles de fondation ouverts de Meta, de 7 à 65 milliards de paramètres.

Open-weightMultilingue

Impact. Sa fuite en mars 2023 déclenche l'explosion de l'écosystème open source moderne.

05/2022Meta

OPT-175B

Suite de modèles comparable à GPT-3, publiée avec son code d'entraînement, une transparence rare à cette taille.

Open-weightMultilingue

Impact. Premier grand geste d'ouverture de Meta, base culturelle qui mènera à Llama.

OpenAI

Dirigé par Sam Altman, aux États-Unis. OpenAI veut rester le pionnier grand public de l'IA et le premier à viser une intelligence artificielle générale.

07/2026OpenAI

GPT-5.6 (Luna, Terra, Sol)

Gamme segmentée en 3 niveaux. Luna pour les usages rapides et peu coûteux, Terra pour le travail courant, Sol pour le codage et les agents les plus lourds.

Raisonnement avancéProgrammationAgents autonomesDéploiement entreprise

Impact. Officialise l'abandon du modèle unique au profit d'une gamme, chaque niveau visant un budget différent.

04/2026OpenAI

GPT-5.5

Étape intermédiaire de la ligne GPT-5, avant la segmentation en 3 niveaux arrivée en juillet.

Raisonnement avancéProgrammationAgents autonomes

Impact. Confirme la cadence rapide d'OpenAI, avec 3 versions majeures sur le premier semestre.

03/2026OpenAI

GPT-5.4

Première version majeure de l'année pour la ligne GPT-5.

Raisonnement avancéProgrammationAgents autonomes

Impact. Ouvre une année à cadence soutenue chez OpenAI.

08/2025OpenAI

GPT-5

Premier modèle unifié qui fusionne les modèles rapides et les modèles de raisonnement dans un seul système, avec un routeur automatique. Contexte de 400 000 tokens.

Raisonnement avancéProgrammationVisionMultimodalitéLong contexteAgents autonomes

Impact. Met fin à la séparation entre gammes GPT et o, un tournant pour toute la suite.

08/2025OpenAI

gpt-oss 120B et 20B

Premiers poids ouverts d'OpenAI depuis 2019, sous licence Apache 2.0, exécutables localement.

Raisonnement avancéProgrammationOpen-weightDéploiement entreprise

Impact. Retour d'OpenAI sur le terrain de l'open source face à Llama, Mistral et DeepSeek.

04/2025OpenAI

o3 et o4-mini

Premiers modèles de raisonnement à manipuler des images dans leur chaîne de pensée et à utiliser des outils de façon autonome pendant la réflexion.

Raisonnement avancéVisionAgents autonomesProgrammation

Impact. Première fusion réelle entre raisonnement et usage d'outils multimodaux.

12/2024OpenAI

o1

Version généralisée du raisonnement par chaîne de pensée entraîné par renforcement.

Raisonnement avancéProgrammation

Impact. Confirme le raisonnement comme nouvel axe de progrès, au-delà de la taille des modèles.

09/2024OpenAI

o1-preview

Premier modèle public à chaîne de pensée cachée entraînée par renforcement. Gains spectaculaires en maths, sciences et code.

Raisonnement avancéProgrammation

Impact. Naissance de la catégorie des modèles de raisonnement.

05/2024OpenAI

GPT-4o

Premier modèle nativement multimodal en temps réel, texte, image et audio dans un seul réseau, avec une latence vocale proche de l'humain.

VisionAudioMultimodalitéMultilingueProgrammation

Impact. Premier assistant vocal en temps réel de qualité conversationnelle, rendu gratuit à grande échelle.

11/2023OpenAI

GPT-4 Turbo

Contexte de 128 000 tokens, coûts d'API fortement réduits et appel de fonctions amélioré.

Long contexteProgrammationDéploiement entrepriseMultilingue

Impact. Fait passer GPT-4 de prouesse technique à outil déployable en entreprise.

03/2023OpenAI

GPT-4

Premier modèle multimodal d'OpenAI, texte et image, avec un gain massif de fiabilité et de raisonnement. Réussit des examens au niveau humain.

Raisonnement avancéVisionMultimodalitéMultilingue

Impact. Référence absolue du secteur pendant plus d'un an.

11/2022OpenAI

GPT-3.5, lancement de ChatGPT

Première mise à disposition grand public d'un modèle conversationnel affiné par renforcement, via une interface de chat simple et gratuite.

MultilingueProgrammation

Impact. Déclenche l'explosion mondiale de l'IA générative grand public.

Google

Dirigé par Demis Hassabis, au Royaume-Uni et aux États-Unis. Google DeepMind mise sur la recherche de pointe, la multimodalité et le contexte très long.

07/2026Google DeepMind

Gemini 3.6 Flash

Modèle de volume à 1 million de tokens de contexte, pensé pour le coût, à 1,50 et 7,50 dollars par million de tokens. Publié avec Gemini 3.5 Flash-Lite, pendant que la version Pro reste en test.

MultimodalitéLong contexteProgrammationDéploiement entreprise

Impact. Google déplace la bataille sur le rapport coût-performance plutôt que sur le seul sommet des classements.

02/2026Google DeepMind

Gemini 3.1 Pro

Mise à jour du haut de gamme Gemini, sortie en avant-première quelques mois après la génération 3.

Raisonnement avancéMultimodalitéLong contexteAgents autonomes

Impact. Google resserre son rythme de mise à jour sur le segment le plus visible.

11/2025Google DeepMind

Gemini 3 (Pro, Deep Think)

Génération orientée agents longue durée, avec un raisonnement de pointe et un contexte de 1 million de tokens, disponible dès le premier jour dans la recherche Google.

Raisonnement avancéProgrammationMultimodalitéAgents autonomesLong contexteDéploiement entreprise

Impact. Reprise de la course au raisonnement et pivot agentique de Google, à l'échelle de son moteur de recherche.

03/2025Google DeepMind

Gemini 2.5 Pro

Premier Gemini explicitement conçu comme modèle de réflexion, avec une chaîne de pensée déroulée avant la réponse.

Raisonnement avancéProgrammationMultimodalitéLong contexteAgents autonomes

Impact. Installe le raisonnement délibératif natif comme standard de la gamme Gemini.

12/2024Google DeepMind

Gemini 2.0 Flash

Premier Gemini pensé pour l'ère agentique, avec sortie native image et audio, usage natif d'outils et planification d'actions.

MultimodalitéAudioVidéoAgents autonomesProgrammation

Impact. Pivot officiel de Google vers des agents capables d'agir dans un environnement numérique.

02/2024Google DeepMind

Gemini 1.5 Pro

Fenêtre de contexte inédite de 1 million de tokens, soit environ 1 heure de vidéo ou 700 000 mots, avec une architecture MoE.

Long contexteMultimodalitéVidéoAudioRaisonnement avancé

Impact. Établit le long contexte comme avantage compétitif différenciant.

12/2023Google DeepMind

Gemini 1.0

Premier modèle de Google nativement multimodal, conçu dès l'origine pour combiner texte, code, audio, image et vidéo, en 3 tailles.

MultimodalitéVisionAudioVidéoProgrammation

Impact. Entrée officielle de Google dans la compétition frontale avec GPT-4.

04/2022Google

PaLM

Modèle dense de 540 milliards de paramètres entraîné via le système Pathways, avec une efficacité d'entraînement record.

Raisonnement avancéProgrammationMultilingue

Impact. Démontre la capacité à passer à l'échelle, base technique qui mènera à Gemini.

Doubao

Développé par ByteDance, la maison mère de TikTok, en Chine. Le groupe s'appuie sur son audience grand public pour imposer son assistant, devenu le plus utilisé du pays.

06/2026ByteDance

Doubao-Seed 2.1 Pro

Version phare présentée le 23 juin 2026 à la conférence Force de Volcano Engine, déclinée en Pro et Turbo. ByteDance annonce des résultats proches de GPT-5.5, de Claude Opus 4.7 et de Gemini 3.1 Pro sur plusieurs tests de référence.

Raisonnement avancéMultimodalitéProgrammationAgents autonomes

Impact. Place un modèle chinois au niveau annoncé des modèles occidentaux de pointe, sur le marché le plus peuplé du monde.

02/2026ByteDance

Doubao-Seed 2.0

Famille lancée le 14 février 2026, avec 3 modèles d'agent généralistes, Pro, Lite et Mini, plus un modèle dédié au code.

Agents autonomesProgrammationMultilingue

Impact. Structure l'offre par usage plutôt que par taille, et porte l'assistant le plus utilisé de Chine, 382 millions de personnes par mois.

10/2025ByteDance

Doubao 1.6

Mise à jour qui introduit 4 durées de réflexion réglables nativement, accompagnée de nouveaux modèles de synthèse et de clonage vocal.

Raisonnement avancéSynthèse vocaleMultimodalité

Impact. Laisse l'utilisateur arbitrer entre vitesse et qualité de raisonnement, au lieu de choisir un modèle différent.

Anthropic

Dirigé par Dario Amodei, aux États-Unis. Fondé par d'anciens d'OpenAI, Anthropic se différencie par la sécurité et la fiabilité, avec son approche de Constitutional AI.

07/2026Anthropic

Claude Opus 5

Successeur d'Opus 4.8 pour le codage agentique et le travail d'entreprise. La réflexion est active par défaut et le contexte de 1 million de tokens devient la norme, au tarif inchangé de 5 et 25 dollars par million de tokens.

Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise

Impact. Amène le haut de gamme agentique sans hausse de prix, à moitié moins cher que le modèle le plus capable de la maison.

06/2026Anthropic

Claude Fable 5 et Mythos 5

Le modèle le plus capable d'Anthropic, pour le raisonnement le plus exigeant et les tâches longues. La réflexion est permanente et son détail n'est jamais restitué, seulement résumé.

Raisonnement avancéProgrammationAgents autonomesLong contexteDéploiement entreprise

Impact. Nouveau sommet de capacité, assorti de garde-fous renforcés en biologie et en cybersécurité.

06/2026Anthropic

Claude Sonnet 5

Niveau intermédiaire qui atteint une qualité proche du haut de gamme sur le codage et les agents, avec 1 million de tokens de contexte et un nouveau découpage du texte.

Raisonnement avancéProgrammationAgents autonomesLong contexte

Impact. Réduit encore l'écart entre le milieu et le haut de gamme, à 3 et 15 dollars par million de tokens.

05/2026Anthropic

Claude Opus 4.8

Orchestration native de nombreux sous-agents en parallèle dans une même session, pour des tâches à l'échelle d'une base de code entière. Contexte de 1 million de tokens.

ProgrammationAgents autonomesRaisonnement avancéLong contexteDéploiement entreprise

Impact. Étape clé vers l'autonomie à grande échelle, avec un modèle qui pilote lui-même une équipe de sous-agents.

11/2025Anthropic

Claude Opus 4.5

Introduit un paramètre d'effort réglable pour arbitrer entre vitesse et qualité. Meilleur modèle de programmation d'Anthropic à cette date.

ProgrammationAgents autonomesRaisonnement avancéLong contexte

Impact. Installe le contrôle explicite de l'effort de calcul comme standard d'usage.

10/2025Anthropic

Claude Haiku 4.5

Ramène le raisonnement étendu et l'usage d'ordinateur dans le modèle le plus rapide et le moins cher de la gamme.

ProgrammationAgents autonomesRaisonnement avancéDéploiement entreprise

Impact. Rend les capacités agentiques accessibles à grande échelle et à bas coût.

09/2025Anthropic

Claude Sonnet 4.5

Sessions agentiques prolongées sur plusieurs dizaines d'heures grâce à une meilleure gestion de la mémoire et du contexte.

ProgrammationAgents autonomesRaisonnement avancéLong contexte

Impact. Prouve qu'un modèle de milieu de gamme peut tenir un travail autonome quasi journalier.

05/2025Anthropic

Claude Opus 4 et Sonnet 4

Génération Claude 4. Opus 4 est présenté comme le meilleur modèle de programmation au monde, capable de travail autonome soutenu sur plusieurs heures.

ProgrammationAgents autonomesRaisonnement avancéVisionLong contexte

Impact. Bascule d'Anthropic vers l'agent capable de tenir une tâche de développement complète.

02/2025Anthropic

Claude 3.7 Sonnet

Premier modèle hybride au monde. Un seul modèle propose une réponse rapide et un mode de raisonnement étendu activable à la demande.

Raisonnement avancéProgrammationVisionLong contexte

Impact. Invente le format hybride que GPT-5 généralisera quelques mois plus tard.

10/2024Anthropic

Claude 3.5 Sonnet, usage d'ordinateur

Introduit l'usage d'ordinateur en bêta. Le modèle déplace la souris, clique, tape et lit l'écran pour accomplir des tâches.

Agents autonomesProgrammationVisionRaisonnement avancé

Impact. Premier pas concret vers des agents qui agissent sur un ordinateur comme un humain.

06/2024Anthropic

Claude 3.5 Sonnet

Dépasse Claude 3 Opus tout en étant moins cher et plus rapide, avec un bond notable en programmation.

ProgrammationRaisonnement avancéVisionLong contexte

Impact. Le modèle de milieu de gamme dépasse le haut de gamme de la génération précédente.

03/2024Anthropic

Claude 3 (Opus, Sonnet, Haiku)

Première gamme à 3 tailles chez Anthropic, avec vision multimodale sur les 3 modèles et une quasi-parité avec GPT-4.

Raisonnement avancéVisionMultimodalitéLong contexteMultilingue

Impact. Fait entrer Anthropic dans la cour des modèles multimodaux de premier plan.

07/2023Anthropic

Claude 2

Contexte de 100 000 tokens en standard et lancement de l'interface grand public claude.ai.

Long contexteProgrammationMultilingue

Impact. Premier Claude à toucher directement le grand public.

03/2023Anthropic

Claude 1

Premier modèle public d'Anthropic, bâti sur les principes de la Constitutional AI, avec un contexte long pour l'époque.

Long contexteMultilingue

Impact. Premier concurrent sérieux et indépendant à GPT, avec une identité fondée sur la sécurité.

Qwen

Développé par Alibaba, le géant chinois fondé par Jack Ma. Le groupe mise sur une stratégie open-weight massive pour s'imposer comme la référence des modèles ouverts.

07/2026Qwen

Qwen3.8-Max

Modèle multimodal de 2 400 milliards de paramètres, dévoilé en avant-première à la conférence mondiale de l'IA de Shanghai.

Raisonnement avancéMultimodalitéProgrammationMultilingue

Impact. Alibaba bascule vers de très grands modèles fermés, après des années de stratégie ouverte.

04/2025Alibaba

Qwen3

Raisonnement hybride dans un seul modèle, entre réflexion approfondie et réponse rapide. Toute la gamme sous licence Apache 2.0.

Raisonnement avancéProgrammationOpen-weightMultilingueLong contexte

Impact. Rapproche les modèles ouverts des modèles fermés sur le raisonnement.

09/2024Alibaba

Qwen2.5

Refonte complète de la famille, pré-entraînement sur 18 000 milliards de tokens, gains marqués en code et en maths.

Raisonnement avancéProgrammationOpen-weightMultilingueLong contexte

Impact. Devient l'une des familles open-weight les plus utilisées au monde.

08/2023Alibaba

Qwen 1.0

Premier modèle de fondation d'Alibaba, publié en plusieurs tailles, lançant sa stratégie open-weight.

ProgrammationOpen-weightMultilingue

Impact. Point de départ de toute la lignée Qwen.

DeepSeek

Dirigé par Liang Wenfeng, en Chine. DeepSeek se différencie par une efficacité coût extrême, avec des performances de pointe en open-weight pour bien moins cher.

04/2026DeepSeek

DeepSeek V4 (Pro et Flash)

2 modèles ouverts sous licence MIT, de 1 600 et 284 milliards de paramètres, avec 1 million de tokens de contexte. Une nouvelle attention compressée divise le coût de service par 10 face à la version précédente.

Raisonnement avancéProgrammationAgents autonomesLong contexteOpen-weightMultilingue

Impact. Relance la pression sur les prix, avec des capacités de pointe distribuées librement.

01/2025DeepSeek

DeepSeek R1

Démontre que le raisonnement en chaîne de pensée peut émerger par apprentissage par renforcement pur, publié en open-weight sous licence MIT.

Raisonnement avancéProgrammationOpen-weightMultilingue

Impact. Événement le plus disruptif de la période, qui démocratise le raisonnement de haut niveau et secoue les marchés.

12/2024DeepSeek

DeepSeek V3

671 milliards de paramètres en MoE, entraîné pour une fraction du coût des modèles occidentaux équivalents, en open-weight.

Raisonnement avancéProgrammationLong contexteOpen-weightMultilingueDéploiement entreprise

Impact. Choc économique, avec un modèle frontière ouvert entraîné pour quelques millions de dollars.

05/2024DeepSeek

DeepSeek V2

Architecture MoE avec attention latente multi-têtes, qui réduit fortement le coût d'inférence.

Raisonnement avancéLong contexteOpen-weightMultilingue

Impact. Première rupture technique majeure de DeepSeek et base de sa réputation d'efficacité.

11/2023DeepSeek

DeepSeek LLM et Coder

Premiers modèles du laboratoire, un généraliste et un dédié au code, en open-weight.

ProgrammationOpen-weightMultilingueRaisonnement avancé

Impact. Établit DeepSeek comme laboratoire crédible dès sa première année.

Alice

Développé par Yandex, en Russie. Le groupe est un moteur de recherche, mais il conçoit ses propres modèles, la famille Alice AI et YandexGPT, qui font tourner son assistant.

05/2026Yandex

Alice AI LLM Flash

Modèle léger publié le 28 mai 2026, avec une fenêtre de 128 000 tokens et un mode de raisonnement par chaîne de pensée. Yandex annonce une inférence 2,5 fois plus rapide que YandexGPT 4 Pro.

Raisonnement avancéLong contexteMultilingue

Impact. Donne à la Russie un modèle rapide et local, sur un marché que les acteurs américains ont quitté.

11/2025Yandex

Alice AI

Nouvelle famille de modèles présentée à côté de YandexGPT, avec une fenêtre de 65 536 tokens. Elle fait tourner l'assistant Alice, intégré au navigateur du groupe.

Raisonnement avancéMultilingueAssistant grand public

Impact. Alice atteint 71 millions d'utilisateurs par mois et entre dans les 10 premiers produits d'IA mobile au monde.

Grok

Dirigé par Elon Musk, aux États-Unis. xAI se différencie par un accès en temps réel via le réseau X et un ton volontairement moins bridé.

07/2026xAI

Grok 4.5

Nouvelle version du modèle de xAI, suivie quelques semaines plus tard d'un modèle de reconnaissance vocale maison.

Raisonnement avancéProgrammationMultimodalitéTemps réel

Impact. xAI tient son rythme de sortie rapide et étend sa gamme au-delà du texte.

07/2025xAI

Grok 4

Raisonnement abstrait renforcé, appel d'outils natif et recherche en temps réel intégrée.

Raisonnement avancéAgents autonomesProgrammationLong contexteMultimodalité

Impact. Premier Grok à rivaliser frontalement avec les meilleurs modèles de raisonnement.

02/2025xAI

Grok 3

Bond de calcul d'entraînement avec un cluster d'environ 200 000 GPU, et premier mode de raisonnement explicite chez xAI.

Raisonnement avancéProgrammationAgents autonomesVisionLong contexte

Impact. Rapproche xAI des standards de raisonnement de l'époque.

08/2024xAI

Grok 2

Raisonnement, usage d'outils et vision nettement améliorés, disponible via API.

Raisonnement avancéVisionProgrammationLong contexte

Impact. Premier Grok réellement compétitif face aux modèles propriétaires établis.

11/2023xAI

Grok-1

Premier modèle de xAI, architecture MoE de 314 milliards de paramètres, lié dès l'origine à la plateforme X.

Raisonnement avancéMultilingue

Impact. Entrée de xAI dans la course aux modèles de fondation.

GigaChat

Développé par Sber, la première banque russe. Le départ des acteurs américains a ouvert un marché intérieur que Sber occupe avec ses propres modèles.

03/2026Sber

GigaChat Ultra

Modèle phare doté d'un mode de raisonnement, présenté en mars 2026 au-dessus de la génération GigaChat 2.0.

Raisonnement avancéMultimodalitéMultilingue

Impact. Installe une banque parmi les concepteurs de modèles, cas unique dans ce classement.

2025Sber

GigaChat 2.0

Génération multimodale dotée d'une fenêtre de 128 000 tokens, avec la génération d'images confiée à la famille Kandinsky.

MultimodalitéGénération d'imagesLong contexte

Impact. Couvre texte et image dans un même service, condition d'usage grand public sur le marché russe.

Kimi

Développé par Moonshot AI, jeune laboratoire pékinois soutenu par Alibaba. Il pousse l'open-weight à l'extrême, jusqu'au plus grand modèle ouvert jamais publié, et vise l'autonomie des agents sur des tâches longues.

07/2026Moonshot AI

Kimi K3

2 800 milliards de paramètres et 1 million de jetons de contexte, avec un mode raisonnement permanent. Poids publiés sur Hugging Face sous licence MIT modifiée.

Raisonnement avancéAgents autonomesVisionLong contexteOpen-weightProgrammation

Impact. Plus grand modèle ouvert jamais publié, au niveau des meilleurs modèles fermés américains.

05/2026Moonshot AI

Kimi K2.6

Modèle vision-langage de 1 000 milliards de paramètres capable de piloter 300 agents en parallèle sur plusieurs milliers d'étapes.

Agents autonomesVisionRaisonnement avancéProgrammationOpen-weight

Impact. Prend la tête des modèles ouverts, au coude à coude avec Qwen et DeepSeek.

01/2026Moonshot AI

Kimi K2.5

Première refonte d'architecture, avec une vision native portée par l'encodeur MoonViT et une fenêtre de 256 000 jetons.

VisionRaisonnement avancéAgents autonomesLong contexteOpen-weight

Impact. Fait passer Kimi du texte seul au multimodal, sans quitter l'open-weight.

11/2025Moonshot AI

Kimi K2 Thinking

Ajoute des traces de raisonnement visibles et enchaîne jusqu'à 300 appels d'outils de suite sans intervention humaine.

Raisonnement avancéAgents autonomesProgrammationOpen-weight

Impact. Déplace la référence de l'agent autonome vers le camp des modèles ouverts.

07/2025Moonshot AI

Kimi K2

Modèle à experts de 1 000 milliards de paramètres, dont 32 milliards activés par jeton, publié en poids ouverts sous licence MIT modifiée et taillé pour l'usage d'outils.

ProgrammationAgents autonomesOpen-weightLong contexteMultilingue

Impact. Premier modèle ouvert à rivaliser sérieusement avec les modèles fermés sur l'appel d'outils.

01/2025Moonshot AI

Kimi k1.5

Premier modèle de Moonshot à raisonner par étapes explicites avant de répondre, avec un entraînement par renforcement sur des chaînes longues.

Raisonnement avancéVisionLong contexteMultilingue

Impact. Fait entrer un troisième laboratoire chinois dans la course au raisonnement, quelques jours après DeepSeek R1.

Mistral

Dirigé par Arthur Mensch, en France. Mistral se pose en champion européen de l'IA, avec l'open-weight, la souveraineté et l'efficacité comme marque de fabrique.

04/2026Mistral

Mistral Medium 3.5

128 milliards de paramètres, 256 000 tokens de contexte, et un niveau de raisonnement réglable requête par requête.

Raisonnement avancéProgrammationLong contexteMultilingueSouveraineté

Impact. Mistral mise sur le réglage fin du coût par requête plutôt que sur la course à la taille.

03/2026Mistral

Small 4, Voxtral TTS et Forge

6 sorties dans le même mois, du petit modèle à la synthèse vocale, plus des outils de développement et un partenariat avec NVIDIA.

ProgrammationMultilingueOpen-weightSouveraineté

Impact. Mistral élargit son offre au-delà du modèle de langage, vers une gamme d'outils complète.

12/2025Mistral

Mistral Large 3

675 milliards de paramètres au total dont 41 activés par token, 256 000 tokens de contexte, publié sous licence Apache 2.0 donc librement installable chez soi.

Raisonnement avancéProgrammationLong contexteOpen-weightMultilingueSouveraineté

Impact. Le champion européen place un modèle de tout premier plan en accès libre, sans coût par token.

06/2025Mistral AI

Magistral

Premier modèle de raisonnement de Mistral, avec une chaîne de pensée traçable et multilingue, en open-weight.

Raisonnement avancéMultilingueOpen-weightDéploiement entreprise

Impact. Réponse européenne à la vague des modèles de raisonnement, avec un accent sur la transparence.

02/2024Mistral AI

Mistral Large

Premier modèle propriétaire haut de gamme de Mistral, conçu pour rivaliser avec GPT-4.

Raisonnement avancéProgrammationMultilingueDéploiement entrepriseLong contexte

Impact. Premier pas de Mistral vers le marché entreprise avec un modèle frontière.

12/2023Mistral AI

Mixtral 8x7B

Premier Mixture-of-Experts open-weight de Mistral, avec une performance proche de GPT-3.5 pour un coût bien moindre.

Open-weightMultilingueProgrammationLong contexte

Impact. Démocratise l'architecture MoE en open source.

09/2023Mistral AI

Mistral 7B

Modèle fondateur du laboratoire, qui dépasse Llama 2 13B malgré sa taille réduite.

Open-weightMultilingueDéploiement entreprise

Impact. Lance la vague des modèles open-weight performants en Europe.

Comparer

Lequel choisir aujourd’hui ?

Les 3 modèles les plus utilisés, et un quatrième que vous choisissez. Les versions se mettent à jour à chaque nouvelle sortie.

ComparerChatGPTGeminiClaudeLlama
Combien de gens l’utilisent1,1 milliard par mois900 millions sur l’application245 millions par mois1,2 milliard par mois, via Meta AI
Modèle du momentGPT-5.6 (Luna, Terra, Sol)Gemini 3.6 FlashClaude Opus 5Llama 4 (Scout, Maverick)
Ce qu’il fait le mieuxLa polyvalence et l’écosystème le plus richeL’intégration dans les outils Google du quotidienLa rédaction longue, l’analyse de documents et le codeLa liberté d’installation, sans facture à l’usage
Coût à l’usage€€€€€€€€€€€€€€€€
Mémoire de travailTrès étenduTrès étenduTrès étenduTrès étendu
LicenceFerméeFerméeFerméeOuverte, avec conditions
Où vont vos donnéesÉtats-UnisÉtats-UnisÉtats-UnisChez vous si vous l’installez
Pays du laboratoireÉtats-UnisÉtats-UnisÉtats-UnisÉtats-Unis

Llama

Combien de gens l’utilisent
1,2 milliard par mois, via Meta AI
Modèle du moment
Llama 4 (Scout, Maverick)
Ce qu’il fait le mieux
La liberté d’installation, sans facture à l’usage
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Ouverte, avec conditions
Où vont vos données
Chez vous si vous l’installez
Pays du laboratoire
États-Unis

ChatGPT

Combien de gens l’utilisent
1,1 milliard par mois
Modèle du moment
GPT-5.6 (Luna, Terra, Sol)
Ce qu’il fait le mieux
La polyvalence et l’écosystème le plus riche
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Fermée
Où vont vos données
États-Unis
Pays du laboratoire
États-Unis

Gemini

Combien de gens l’utilisent
900 millions sur l’application
Modèle du moment
Gemini 3.6 Flash
Ce qu’il fait le mieux
L’intégration dans les outils Google du quotidien
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Fermée
Où vont vos données
États-Unis
Pays du laboratoire
États-Unis

Doubao

Combien de gens l’utilisent
382 millions par mois
Modèle du moment
Doubao-Seed 2.1 Pro
Ce qu’il fait le mieux
Le volume et le prix, c’est l’assistant le plus utilisé de Chine
Coût à l’usage
€€€€
Mémoire de travail
Étendu
Licence
Fermée
Où vont vos données
Chine
Pays du laboratoire
Chine

Claude

Combien de gens l’utilisent
245 millions par mois
Modèle du moment
Claude Opus 5
Ce qu’il fait le mieux
La rédaction longue, l’analyse de documents et le code
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Fermée
Où vont vos données
États-Unis
Pays du laboratoire
États-Unis

Qwen

Combien de gens l’utilisent
167 millions par mois
Modèle du moment
Qwen3.8-Max
Ce qu’il fait le mieux
L’étendue de la gamme ouverte, du plus petit au plus grand
Coût à l’usage
€€€€
Mémoire de travail
Étendu
Licence
Ouverte
Où vont vos données
Chine
Pays du laboratoire
Chine

DeepSeek

Combien de gens l’utilisent
130 millions par mois
Modèle du moment
DeepSeek V4 (Pro et Flash)
Ce qu’il fait le mieux
Le meilleur rapport performance prix du marché
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Ouverte
Où vont vos données
Chine
Pays du laboratoire
Chine

Grok

Combien de gens l’utilisent
Non publié
Modèle du moment
Grok 4.5
Ce qu’il fait le mieux
L’accès à l’actualité en temps réel via X
Coût à l’usage
€€€€
Mémoire de travail
Étendu
Licence
Fermée
Où vont vos données
États-Unis
Pays du laboratoire
États-Unis

Kimi

Combien de gens l’utilisent
Non publié
Modèle du moment
Kimi K3
Ce qu’il fait le mieux
Les tâches longues menées seul, et le plus grand modèle ouvert
Coût à l’usage
€€€€
Mémoire de travail
Très étendu
Licence
Ouverte
Où vont vos données
Chine
Pays du laboratoire
Chine

Mistral

Combien de gens l’utilisent
Non publié
Modèle du moment
Mistral Medium 3.5
Ce qu’il fait le mieux
L’hébergement européen et la souveraineté des données
Coût à l’usage
€€€€
Mémoire de travail
Étendu
Licence
Ouverte selon les modèles
Où vont vos données
Europe
Pays du laboratoire
France

Les laboratoires sont classés du plus utilisé au moins utilisé. Utilisateurs actifs par mois, relevés de mai et juin 2026. Occident, données des éditeurs et de Sensor Tower. Chine, QuestMobile. Meta AI et Gemini sont intégrés à des services déjà installés, leur audience n’est pas toujours un choix de l’utilisateur.

Le coût est un ordre de grandeur, de € pour le plus économique à €€€€ pour le haut de gamme, et non un tarif. Les prix réels changent tous les mois et dépendent de la version choisie. Le nom du modèle se met à jour automatiquement à chaque nouvelle sortie, les autres informations ont été vérifiées en août 2026.

L’IA peut-elle vous servir ?

L’IA au travail.Pour vous.

Nous mettons l’intelligence artificielle au service concret de votre activité, des agents qui produisent aux outils qui automatisent. Pas de gadget, du temps gagné et des résultats mesurables. Dites-nous votre métier, nous trouvons les bons leviers.

🖐️ Prenons un moment pour en parler.
Fond dégradé Metabacklinks
Logo Metabacklinks

Partenaire Web & IA à Montpellier. On crée des sites auto-gérés par des agents IA. Vous gardez la main.

13 rue de Lavalette, 34830 Clapiers
Agglomération de Montpellier
06 68 34 12 84 · contact@metabacklinks.com

FacebookInstagramWhatsAppTelegramSMS
Prestations
  • Site Web auto-géré
  • Site e-commerce
  • Acquisition de leads
  • Référencement SEO
  • Campagnes publicitaires
  • Contre-expertise
  • Refonte & maintenance
  • Conseils et formations
Automatisation des tâches
  • Des réseaux qui s’animent seuls.
  • Du contenu neuf, en continu.
  • Chaque page, dans toutes les langues.
  • Cité par les IA. Trouvé sur Google.
  • Un carnet qui se remplit tout seul.
  • Un client accueilli, à toute heure.
  • Un site tenu à jour, tout seul.
  • Un site protégé, jour et nuit.
Derniers articles
  • Avis Google avec photo, pourquoi ce sont eux que Google montre9 août 2026
  • Faire relire son code par une IA, la revue de sécurité automatique9 août 2026
  • Fiche Apple Plans, la vitrine gratuite que presque personne ne réclame9 août 2026

© 2026 Metabacklinks · · Mentions légales· Glossaire· Emojis· Plan du site· Évolution des LLM· Partenaires· À propos· CRM