L’Ère des LLM
années 2020–Présent · La Renaissance de l’IA
Depuis 2020, les Grands Modèles de Langage (LLM) comme GPT et Claude ont émergé, accompagnés de nouvelles technologies comme les Agents IA et le MCP. C’est la « Renaissance » de l’IA — où les percées technologiques rencontrent l’esprit humaniste. L’IA n’est plus seulement un outil, elle commence à devenir un partenaire pour l’humanité.
L’émergence de technologies comme Claude Code, Agent et MCP signale que l’IA est en transition d’« outil » à « partenaire ». Tout cela est symbolisé par le nom du projet « Aphrodite » — une belle ère pleine d’esthétique, d’innovation et de possibilités infinies.
Les caractéristiques déterminantes de cette ère sont : des super modèles avec des centaines de milliards de paramètres, des capacités de compréhension multimodale, des systèmes Agents capables d’utiliser des outils, et des protocoles standard (MCP) pour connecter l’IA aux applications. L’IA change notre monde à un rythme sans précédent.
Jalons importants
Sortie de GPT-3
OpenAI a sorti GPT-3, un grand modèle de langage avec 175 milliards de paramètres. GPT-3 a démontré des capacités de génération de langage étonnantes, suscitant un large débat sur l’IA générale.
OpenAI
DALL-E et CLIP
OpenAI a sorti DALL-E (génération d’images) et CLIP (apprentissage contrastif image-texte). Ces modèles ont démontré la capacité de l’IA à comprendre et générer du contenu multimodal.
OpenAI
Codex et GitHub Copilot
OpenAI a sorti Codex, un modèle d’IA qui comprend et génère du code. GitHub Copilot est devenu le premier assistant de programmation IA largement utilisé.
OpenAI Codex
Sortie de ChatGPT
En novembre 2022, OpenAI a sorti ChatGPT, la première IA conversationnelle destinée au grand public. ChatGPT a atteint 100 millions d’utilisateurs en deux mois, devenant le produit grand public à la croissance la plus rapide de l’histoire.
OpenAI ChatGPT
Stable Diffusion en Open Source
Stability AI a publié Stable Diffusion, un modèle de génération d’images open source. L’activité de la communauté open source a rapidement popularisé la technologie de génération d’images.
Stability AI
Sortie de GPT-4
OpenAI a sorti GPT-4, un modèle multimodal capable de traiter des images et du texte. GPT-4 a montré des performances proches de celles des humains sur des benchmarks professionnels et académiques.
OpenAI
Sortie de Claude
Anthropic a sorti Claude, un assistant IA axé sur la sécurité et l’utilité. La conception de Claude reflète l’accent mis sur la sécurité de l’IA — l’IA doit être utile, inoffensive et honnête.
Anthropic Claude
LLaMA en Open Source
Meta a publié LLaMA, un grand modèle de langage sous licence de recherche non commerciale. Bien que LLaMA ait une taille de paramètres relativement petite, ses excellentes performances ont promu le développement des LLM à poids ouverts.e.
Meta
Montée du Concept d’Agent IA
Le concept d’Agent IA a commencé à recevoir une attention considérable. Les Agents sont des systèmes d’IA capables de planifier et d’exécuter de manière autonome des tâches complexes.
Industrie de l’IA
Gemini 1.5 et le contexte long
En février 2024, Google a présenté Gemini 1.5, doté d’une architecture à mélange d’experts et d’une fenêtre de contexte expérimentale allant jusqu’à un million de jetons.
Google DeepMind
Série Claude 3
Anthropic a sorti la série Claude 3, comprenant Opus, Sonnet et Haiku. Claude 3 Opus a été compétitif avec GPT-4 sur plusieurs benchmarks dont MMLU et GPQA, tout en restant en retrait sur d’autres.
Anthropic
Llama 3 en open source
Meta a sorti la famille Llama 3 avec des poids ouverts, incluant des modèles à 8 et 70 milliards de paramètres. Le Llama 3.1 405B ultérieur fut le premier modèle à poids ouverts à égaler les modèles closed-source de pointe sur les benchmarks courants.urrents closed source sur les benchmarks courants.
Meta
Loi européenne sur l’IA adoptée
L’Union européenne a adopté la loi sur l’IA, première régulation horizontale d’envergure de l’intelligence artificielle. La loi a établi une classification basée sur les risques et des exigences strictes pour les systèmes d’IA à haut risque.
Union européenne
Modèle OpenAI o1
OpenAI a sorti le modèle o1, un grand modèle doté de capacités de raisonnement. o1 obtient d’excellentes performances sur les tâches scientifiques et de programmation, démontrant une capacité de « réflexion ».
OpenAI
Bêta publique de computer use pour Claude
En octobre 2024, Anthropic a lancé la bêta publique de computer use pour une version améliorée de Claude 3.5 Sonnet, permettant aux développeurs de lui faire observer un écran, déplacer le curseur, cliquer et saisir du texte.
Anthropic Claude
Sortie du Protocole MCP
Anthropic a sorti le MCP (Model Context Protocol), un protocole standard ouvert pour connecter les modèles d’IA aux outils et sources de données externes. Le MCP devient le « USB-C » des applications IA.
Anthropic
Maturité de l’écosystème des agents
En 2025, les agents IA sont passés du démonstrateur de recherche à l’outil de production. Les agents de codage, les agents de navigation et les agents multi-étapes sont devenus des offres standard, avec OpenAI, Anthropic, Google et des projets open source livrant tous des systèmes compétents.
Industrie de l’IA
Sortie de DeepSeek R1
Le laboratoire chinois DeepSeek a sorti R1, un modèle de raisonnement open source dont les performances rivalisaient avec o1 d’OpenAI. Cette sortie a démontré que les capacités de pointe pouvaient être atteintes hors du giron de l’IA américaine et a déclenché une réévaluation mondiale de la concurrence en IA.
DeepSeek
Lancement du projet Stargate
OpenAI, Oracle, SoftBank et MGX des Émirats arabes unis ont annoncé conjointement un investissement de 500 milliards de dollars pour construire des infrastructures d’IA aux États-Unis. Le projet prévoit la construction de plusieurs grands centres de données sur quatre ans, le plus grand investissement du secteur privé dans l’histoire de l’IA.
OpenAI / Oracle / SoftBank
Sortie de Claude 3.7 Sonnet
Anthropic a sorti Claude 3.7 Sonnet, le premier modèle à prendre en charge le « raisonnement hybride »—les utilisateurs peuvent basculer entre réponses instantanées et réflexion approfondie dans le même modèle. Claude 3.7 marque le début de la consolidation des formes de produits d’IA pour le raisonnement.
Anthropic
Anthropic lève 3,5 milliards de dollars
En mars 2025, Anthropic a annoncé une levée de fonds de 3,5 milliards de dollars à une valorisation de 61,5 milliards de dollars, devenant l’une des startups d’IA les plus valorisées au monde et reflétant la concentration accrue du capital dans l’industrie de l’IA.
Anthropic
Sortie open source de Llama 4
Meta a publié les modèles multimodaux à poids ouverts Llama 4 Scout et Maverick, et présenté Behemoth, un modèle enseignant encore en cours d’entraînement et non publié.
Meta
Sortie de Claude 4
Anthropic a sorti la famille Claude 4 (Opus 4 et Sonnet 4), introduisant la capacité de « réflexion étendue » (Extended Thinking) avec des améliorations significatives en programmation, raisonnement et tâches de longue durée. Claude 4 a consolidé la position d’Anthropic sur le marché de l’IA en entreprise.
Anthropic
Début d’application des obligations GPAI de l’AI Act
Le 2 août 2025, les règles de gouvernance et les obligations visant les modèles d’IA à usage général sont devenues applicables. D’autres dispositions suivent des calendriers distincts : il ne s’agit pas du début global de toute l’exécution.
Bureau européen de l’IA
Sortie de GPT-5
OpenAI a sorti GPT-5, un modèle phare unifié intégrant les capacités de raisonnement de la série o avec les capacités conversationnelles de la série GPT. GPT-5 établit une nouvelle frontière en programmation, mathématiques et raisonnement, tout en supportant des contextes plus longs et l’utilisation d’outils.
OpenAI
OpenAI achève sa recapitalisation
OpenAI a achevé la recapitalisation de sa structure. L’activité à but lucratif est devenue une public benefit corporation nommée OpenAI Group PBC, et la OpenAI Foundation, entité à but non lucratif, continue de la contrôler avec la même mission. Selon OpenAI, la recapitalisation fait suite à près d’un an d’échanges avec les procureurs généraux de Californie et du Delaware.
OpenAI
Nature publie le système multi-agents Co-Scientist
Nature a publié Co-Scientist, un système multi-agents fondé sur Gemini qui formule des hypothèses de recherche inédites destinées à une vérification expérimentale. L’article rend compte d’une validation dans trois applications biomédicales : le repositionnement de médicaments, la découverte de nouvelles cibles et l’explication des mécanismes de résistance aux antimicrobiens. Les auteurs le présentent comme un assistant des chercheurs et non comme un remplaçant, ce qui en fait une preuve évaluée par les pairs d’une IA participant à la formulation d’hypothèses et non seulement à l’analyse.
Communauté scientifique
Meta commence à dénouer l’intégration de Manus
Selon un article du 11 juin 2026, Meta a commencé à dénouer l’intégration de son acquisition de Manus, en arrêtant le partage de données et en séparant les opérations. L’article relie cette décision à des exigences réglementaires chinoises ; le statut juridique et opérationnel ultérieur doit être vérifié dans les informations actualisées.
Meta / Manus
Claude Fable 5 et Mythos 5 suspendus puis redéployés
Anthropic a lancé le 9 juin 2026 Fable 5, doté de garde-fous pour le grand public, et Mythos 5 pour les partenaires contrôlés de Project Glasswing. Les contrôles américains du 12 juin imposant des restrictions aux ressortissants étrangers, Anthropic a suspendu les deux modèles dans le monde faute de pouvoir vérifier la nationalité en temps réel. Après la levée des contrôles le 30 juin, Fable 5 est revenu mondialement le 1er juillet et Mythos 5 d’abord auprès d’organisations américaines approuvées.
Anthropic
Enquête conjointe des procureurs généraux américains contre OpenAI
Le 13 juin 2026, une coalition de procureurs généraux d’États américains, conduite par celui de l’État de New York, a ouvert une enquête sur OpenAI et lui a adressé une assignation à comparaître. Celle-ci réclame des documents relatifs au placement publicitaire, à l’engagement et à la rétention des utilisateurs, à la tendance du modèle à la complaisance, au traitement des données de consommation et de santé, ainsi qu’à la protection des mineurs et des personnes âgées. OpenAI a déclaré coopérer avec les procureurs et souligné que ChatGPT offrait déjà des mécanismes de protection renforcés pour les mineurs. Il s’agit de la première investigation systématique engagée par des autorités étatiques américaines à l’encontre d’une grande entreprise d’IA.
Coalition des procureurs généraux des États américains
OpenAI limite le déploiement de GPT-5.6 à la demande du gouvernement américain
Le 26 juin 2026, à la demande du gouvernement américain, OpenAI a lancé un aperçu limité de GPT-5.6 Sol, Terra et Luna auprès de quelques partenaires de confiance. La famille GPT-5.6 est devenue généralement disponible le 9 juillet ; OpenAI a indiqué que cette procédure limitée ne devait pas devenir la norme.
OpenAI
Samsung et SK Hynix annoncent de grands plans pluriannuels pour la mémoire
Le 29 juin 2026, Samsung et SK Hynix ont annoncé des plans pluriannuels totalisant 800 000 milliards de wons et comprenant quatre fabs mémoire dans le sud-ouest coréen. La conversion en dollars varie avec le change, et le périmètre, les autorisations et l’exécution restent à suivre.
Samsung / SK Hynix
Gemini Spark arrive sur Mac comme assistant agentique
Le 1er juillet 2026, Google a lancé Gemini Spark — son assistant IA agentique 24h/24 — sur macOS, avec suivi en temps réel et une intégration applicative élargie. Spark agit de manière persistante sur la vie numérique de l’utilisateur, marquant la volonté de Google d’amener l’IA agentique sur le bureau grand public.
Google DeepMind
Moonshot publie les poids ouverts de Kimi K3
En juillet 2026, Moonshot AI a publié sur Hugging Face les poids ouverts de Kimi K3. La fiche du modèle indique 2 800 milliards de paramètres au total, dont 104 milliards activés, une fenêtre de contexte de 1 048 576 jetons et la licence Kimi K3. Il s’agit du plus grand modèle de langage librement téléchargeable publié à ce jour, et il place un laboratoire asiatique à la frontière des publications à poids ouverts.
Moonshot AI
Cloudflare classe les robots IA selon leur usage
Le 1er juillet 2026, Cloudflare a annoncé des contrôles séparés pour les usages Search, Agent et Training. Dès le 15 septembre, les nouveaux domaines bloqueront par défaut Training et Agent sur les pages publicitaires tout en autorisant Search ; les propriétaires peuvent modifier ces choix et la règle la plus stricte s’applique aux robots polyvalents.
Cloudflare
Microsoft lance une société de déploiement IA à 2,5 milliards de dollars
Le 2 juillet 2026, Microsoft a annoncé la création de Microsoft Frontier Company, une nouvelle activité opérationnelle dédiée au déploiement de l’IA en entreprise à partir des outils IA existants de Microsoft. Le projet bénéficie d’un investissement de 2,5 milliards de dollars de Microsoft et de 6 000 experts industriels et techniques — rejoignant Amazon et OpenAI dans la création d’une organisation dédiée au déploiement de l’IA.
Microsoft
Le règlement européen sur l’IA devient pleinement applicable
Le 2 août 2026, le règlement européen sur l’IA est devenu pleinement applicable, le Bureau de l’IA et les autorités nationales prenant en charge sa mise en œuvre, sa supervision et son exécution. La même révision a reporté les obligations à haut risque les plus lourdes : les systèmes autonomes de l’annexe III s’appliquent à partir du 2 décembre 2027 et l’IA intégrée aux produits réglementés à partir du 2 août 2028. Les pratiques interdites s’appliquaient déjà depuis le 2 février 2025 et les obligations relatives aux modèles à usage général depuis le 2 août 2025.
OCDE / G7
Les agents entrent dans les produits d’entreprise livrés
Au premier semestre 2026, les capacités agentiques sont sorties de la démonstration pour entrer dans les produits d’entreprise livrés : les agents de développement, de support et d’automatisation bureautique sont devenus des fonctions documentées, et l’infrastructure d’appel d’outils et de collaboration multi-agents a mûri autour d’eux. L’ampleur réelle de l’adoption n’est pas tranchée. Les enquêtes publiées donnent des taux de mise en production très différents parce qu’elles ne s’accordent pas sur ce qui compte comme un agent ; cette entrée consigne donc une direction et non un niveau.
Industrie de l’IA
Les modèles à poids ouverts publient à l’échelle de la frontière
Au premier semestre 2026, les publications à poids ouverts de DeepSeek, Alibaba Qwen, Moonshot, Zhipu et Meta ont atteint une échelle jusque-là réservée aux systèmes fermés, avec des poids et des fiches de modèle téléchargeables et non simplement décrits. Savoir si l’un d’eux égale la frontière fermée dépend de l’indice de référence retenu et de sa pondération ; cette entrée consigne donc ce qui a été publié et sous quelle licence, non un classement.
DeepSeek / Meta / Alibaba
Personnalités importantes
Sam Altman
PDG d’OpenAI
Altman dirige OpenAI dans l’avancement du développement des grands modèles de langage. La sortie de ChatGPT a fait de lui l’une des figures les plus influentes de l’ère de l’IA. Il œuvre pour l’IA générale tout en prenant en compte l’impact de l’IA sur la société.
Dario Amodei
PDG d’Anthropic
Amodei était anciennement vice-président de la recherche (2016–2021) chez OpenAI avant de fonder Anthropic. Il met l’accent sur la sécurité et l’utilité de l’IA — la conception de Claude reflète cette valeur : l’IA doit être utile, inoffensive et honnête.
Mark Zuckerberg
PDG de Meta
Zuckerberg a décidé de rendre LLaMA open source, favorisant la démocratisation de la technologie de l’IA. Il croit que l’open source bénéficie à la sécurité et au développement de l’IA, ayant un impact profond sur l’écosystème de l’IA.
Ilya Sutskever
Co-fondateur d’OpenAI, fondateur de Safe Superintelligence Inc.
Sutskever a co-fondé OpenAI et en a été le scientifique en chef. Il a dirigé l’équipe de modèles de l’ère GPT-4 et a été l’un des principaux architectes du paradigme de mise à l’échelle post-2023. En 2024, il a fondé Safe Superintelligence Inc., un laboratoire de recherche dédié à l’IA superintelligente sûre.
Demis Hassabis
Co-fondateur et PDG de DeepMind, prix Nobel de chimie 2024
Hassabis a co-fondé DeepMind et l’a dirigée vers des percées sur AlphaGo, AlphaFold et la recherche IA de pointe. En 2024, il a partagé le prix Nobel de chimie pour les contributions d’AlphaFold à la prédiction de la structure des protéines. Il continue de défendre que la contribution la plus profonde de l’IA sera dans la découverte scientifique.
Emily M. Bender
Linguiste computationnelle
Bender est professeure de linguistique à l’université de Washington et première autrice de On the Dangers of Stochastic Parrots, présenté à FAccT en 2021. L’article soutient qu’un modèle de langue assemble des suites de formes linguistiques sans référence au sens, et nomme les coûts environnementaux, documentaires et de responsabilité liés à l’agrandissement continu des modèles. Il reste l’analyse critique la plus citée de l’époque et un contrepoids durable aux récits de capacité.
Liang Wenfeng
Fondateur de DeepSeek
Liang a étudié à l’université du Zhejiang et appliqué l’apprentissage automatique à la finance quantitative, fondant le fonds High-Flyer en 2015. L’infrastructure de calcul bâtie là-bas a ensuite soutenu DeepSeek, qu’il crée en 2023. Son modèle R1, publié en 2025 sous licence MIT, fut le premier système à poids ouverts à montrer un raisonnement de niveau frontière, et il a changé ce qu’un laboratoire extérieur aux plus grandes entreprises occidentales était censé pouvoir publier.
Citations célèbres
Nous sommes maintenant convaincus de savoir comment construire l’AGI telle que nous l’avions traditionnellement comprise.
Je pense que dans cinq ans, il sera probablement capable de raisonner mieux que nous.
Je crois que l’open source est nécessaire pour un avenir positif de l’IA.
Je pense que cela pourrait arriver dès 2026, même s’il y a aussi des façons dont cela pourrait prendre beaucoup plus de temps.
Il existe un risque de préjudice grave, voire catastrophique, délibéré ou non, découlant des capacités les plus importantes de ces modèles d’IA.