actualite
Les nouveautés de l'IA en septembre 2026
Quatre grands modèles sont sortis en trois jours ce mois-ci. Je fais le tri et je vous explique ce que j'ai changé chez moi.
Par Nathan Knaebel
Publié le 5 octobre 2026 · 10 min de lecture
En septembre 2026, quatre grands modèles d'IA sont sortis en trois jours et un cinquième a fait le tour des réseaux avec des vidéos entièrement écrites en code. Le patron d'Anthropic a aussi demandé à toute l'industrie de ralentir. Microsoft et Salesforce ont de leur côté commencé à vendre des agents qui travaillent pendant que vous dormez. Pour une petite entreprise, la nouvelle la plus utile du mois est pourtant la plus discrète : le prix de ce qu'un agent relit a fondu.
Je fais ce tri tous les mois parce que je construis des agents pour des entreprises et que mon propre assistant tourne sur ces modèles du matin au soir. Je vous donne les faits avec leur source et ce que j'en ai fait chez moi.
Quatre modèles en trois jours
Anthropic a ouvert le bal le 1er septembre avec son nouveau modèle Claude Fable 5.1. Il sort avec un jumeau nommé Mythos 5.1 qui est le même modèle avec moins de garde-fous, réservé à des équipes vérifiées qui travaillent sur la cybersécurité ou les sciences du vivant. Fable 5.1 est ouvert à tous et garde le prix de son prédécesseur.
Le lendemain, Meta a publié Muse Spark 1.3 avec un tarif en deux paliers assez parlant. Le palier le moins cher coûte presque rien parce que Meta se sert de vos données pour entraîner ses produits, et le palier qui les garde privées coûte environ douze fois plus. Google a sorti le même jour Gemini 3.8 Flash. Ce modèle rapide et bon marché garde son prix d'appel jusqu'au 31 décembre avant de doubler au 1er janvier.
OpenAI a fermé la marche le 3 septembre avec GPT-6 Astra, ouvert d'abord à quelques organisations puis aux abonnés payants de ChatGPT les jours suivants. CNBC rappelle que la sortie avait été retardée après des attaques informatiques menées en juillet par des agents d'OpenAI que personne n'avait autorisées.
J'ai essayé les trois concurrents sur des tâches de mon quotidien et aucun ne m'a donné envie de quitter Claude, sur lequel tourne tout mon parc d'agents. Une migration coûte des jours de réglages et je ne la lance que pour un gain net. J'ai en revanche basculé sur Fable 5.1 dès sa sortie, pour une raison de coût que je détaille juste en dessous.
Le prix des relectures
Un agent relit tout son contexte à chaque échange, c'est-à-dire ses consignes, l'historique de la conversation et les documents qu'il a ouverts. Les fournisseurs gardent ce contexte en mémoire tampon (le « cache ») et le facturent moins cher qu'un texte neuf. Avec Fable 5.1, Anthropic a divisé par quatre le prix de ces relectures : il passe à 0,25 dollar le million de jetons contre 1 dollar avant. L'éditeur annonce une facture en baisse d'environ 25 % pour un usage courant et jusqu'à 45 % pour un usage très tourné vers les agents.
J'ai voulu savoir si ces chiffres tenaient chez moi et j'ai mesuré une semaine de travail de mes agents. Ils relisent plus de cent fois plus de texte qu'ils n'en écrivent, si bien que la baisse du prix des relectures pèse bien plus que celle des réponses. Je retiens la leçon au-delà de ce modèle précis : quand on compare deux IA pour un agent, le prix du cache pèse plus lourd que le prix affiché en gros sur la page.
La comparaison du mois l'illustre bien. GPT-6 Astra et Fable 5.1 affichent le même prix pour le texte lu et le texte écrit, alors que la relecture en cache coûte 1 dollar le million chez OpenAI et quatre fois moins chez Anthropic. Pour un agent qui travaille toute la journée, cet écart finit par peser lourd sur la facture.
Opus 5.5 fait des films
Anthropic a sorti Claude Opus 5.5 le 22 septembre. Sur la plupart des travaux, il se hisse au niveau de Fable 5.1 pour un prix nettement plus bas de 4 dollars le million de jetons lus et 20 dollars le million écrit. L'éditeur le dit aussi 30 % plus rapide que la version précédente.
Ce sont pourtant ses créations qui ont fait parler de lui. En quelques jours les réseaux se sont remplis de films d'animation, de jeux jouables dans le navigateur et de scènes en 3D qu'il a entièrement écrits en code. Certains ont même leur musique composée par le modèle. Un recueil tenu sur GitHub en rassemble déjà deux douzaines, du jeu de vélo sur la côte à l'explication animée du fonctionnement d'un navigateur.
Quelques films de la communauté m'ont bluffé. Kevin Ngo a sorti une petite histoire dessinée à la main dont chaque image et la musique sortent du code. Addy Osmani explique le fonctionnement d'un navigateur en 40 secondes avec des croquis animés, et vittorio raconte l'histoire de l'Occident par son architecture en deux minutes. Aucun de ces films n'a été tourné ni monté dans un logiciel de vidéo.
Mes vidéos de présentation
Mon assistant tourne sur Opus 5.5 depuis sa sortie et le 26 septembre au soir, j'ai voulu savoir s'il savait en faire autant pour Mon Devis Dentaire. Je lui ai envoyé sans aucun cahier des charges une consigne en anglais de deux lignes.
« make a dynamic 40-second motion graphics video that shows what an incredible motion designer you are, like it's your showreel for a résumé. go all out. Topic : presenting Mon Devis Dentaire »
Je lui demandais une vidéo animée de 40 secondes qui montre quel motion designer incroyable il est, comme la bande démo qu'on joint à un CV, en y mettant tout ce qu'il a. Dans la foulée j'ai ajouté qu'il fallait mettre en avant les fonctions les plus importantes et trouver des phrases qui tuent, avec une piste d'accroche : « Vos devis reviennent enfin signés ».
L'assistant n'ouvre aucun logiciel de montage. Il écrit une page web animée que HyperFrames, un outil libre, filme image par image pour en tirer un fichier vidéo. La voix off vient de Gemini chez Google et les bruitages d'une banque de sons libres de droits. La première version m'a bluffé et c'est la septième que vous voyez ici.
Le soir même, j'ai dicté la même envie pour Football Fight, mon jeu de culture foot où l'on relie des joueurs par les clubs qu'ils ont en commun. Cette fois je parlais en français et je donnais le fil : on comprend le jeu en 30 secondes avec sa direction artistique, puis on découvre le mode carrière, le classement et le vestiaire. Mon premier retour a ajouté l'accroche des trois premières secondes, « Est-ce que tu connais vraiment le football ? ».
Il a fallu dix versions. L'image était juste presque du premier coup et je l'ai corrigée par petites touches, comme un clic de souris sur le bouton final ou du vert quand deux joueurs partagent un club. Une seule fois j'ai tout refusé, quand l'assistant a remplacé ses dessins par de vraies captures du jeu. Le vrai chantier a été le son. La voix m'endormait alors que je voulais une pub qui transporte. J'ai fini par choisir moi-même entre trois nouvelles voix en les écoutant.
Celle de Foxy n'est pas encore finie. Elle arrive bientôt !
Des agents avec un prénom
Le 11 septembre, Salesforce a présenté une équipe de sept agents qui portent chacun un prénom et un métier. Casey répond aux clients par téléphone, SMS ou WhatsApp et Hunter relance les ventes qui risquent de capoter avant la fin du trimestre. Hunter peut suivre un objectif sur plusieurs semaines en décidant lui-même des tâches à faire et du moment où il doit demander l'accord d'un vendeur.
Microsoft a suivi le 25 septembre avec un Copilot refondu dont l'onglet Autopilot crée un agent avec un nom, un rôle et un but. Il continue de travailler dans Microsoft 365 quand plus personne n'est devant l'écran. Autopilot n'est ouvert qu'en avant-première privée et aucun prix n'est annoncé.
De plus en plus d'entreprises vendent leurs agents de cette façon, en équipe de collègues virtuels qui ont chacun un prénom et un poste. En France, Limova suit ce modèle depuis un moment avec huit agents qui se partagent le support client, le référencement, la prospection ou la comptabilité. Je pense que c'est la bonne direction parce qu'un patron comprend tout de suite ce qu'il achète quand on lui présente quelqu'un qui relance ses devis plutôt qu'un « outil d'automatisation ».
Mes agents ont un prénom depuis le premier jour et chacun a son périmètre, si bien que ce virage me conforte plus qu'il ne m'inquiète. Les offres de Salesforce et de Microsoft visent pour l'instant de grands comptes et il faudra attendre les prix pour savoir si un artisan ou un commerçant y aura accès.
Faut-il ralentir l'IA ?
Le 12 septembre, le patron d'Anthropic Dario Amodei a publié un long texte intitulé « We Must Pace the Frontier » où il demande aux laboratoires de ralentir la course aux modèles plus puissants. Il propose des évaluateurs indépendants installés à demeure chez chaque laboratoire et un organisme commun de normes sur le modèle du gendarme de la bourse américaine. Anthropic applique déjà la première mesure de son côté et Sam Altman, le patron d'OpenAI, s'est dit d'accord dans la foulée.
La réponse n'a pas tardé. Le 18 septembre, quatre consommateurs ont attaqué en justice Anthropic, OpenAI, Google et SpaceXAI à San Francisco. Ils les accusent de s'entendre pour freiner des produits concurrents, ce que le droit américain de la concurrence interdit.
Je comprends qu'on veuille ralentir, parce que cette amélioration permanente fait peur et qu'elle me fait peur à moi aussi. Chaque mois apporte un modèle qui rend le précédent dépassé. Je pense que nos souris et nos claviers vont disparaître bien plus vite qu'on ne l'imagine et qu'une bonne partie de ce qu'on apprend aujourd'hui sera obsolète dans trois ans. Pour une petite entreprise, rien ne change dans l'immédiat puisque les modèles actuels restent disponibles et que ce débat porte sur les suivants.
Mistral lève 3 milliards
Le 8 septembre, Mistral AI a annoncé une levée de 3 milliards d'euros qui porte sa valeur au-delà de 21 milliards. C'est la plus grosse levée jamais faite par une entreprise technologique européenne non cotée. Je la suis de près pour une raison concrète. Certains métiers comme les avocats, les notaires ou la santé me demandent un modèle hébergé en Europe et soumis au droit européen, et Mistral est aujourd'hui l'alternative la plus solide pour eux.
Ce que j'ai changé chez moi
Mon agent le plus gourmand est passé sur Fable 5.1 le jour où j'ai compris que le cache pesait l'essentiel de sa facture. Le changement a pris plus de temps que prévu parce que le nom du modèle était écrit à plusieurs endroits de son code et que l'agent retombait sur l'ancien selon le chemin par lequel on l'appelait.
J'ai aussi mesuré le niveau de réflexion qu'on peut demander à ces modèles. Sur une vraie tâche de raisonnement, l'effort le plus bas a coûté deux fois moins cher et répondu plus de trois fois plus vite avec la même réponse juste. Sur une question courte, le réglage ne change rien au prix. Mon assistant a désormais un bouton à côté de la zone de saisie pour choisir le modèle et l'effort selon la tâche.
Le reste du mois est passé sur la chaîne qui transforme mes réunions en tâches faites, que je raconte dans un article dédié.
Ce que je ferais à votre place
Pas grand-chose ! Vous n'avez aucune raison de suivre ces sorties au jour le jour et changer d'outil à chaque nouveau modèle fait perdre plus de temps qu'il n'en fait gagner. Les baisses de prix finissent de toute façon par arriver chez ceux qui construisent leurs outils sur ces modèles.
Si vous n'avez encore jamais essayé, commencez par un texte que vous repoussez. Copiez le dernier avis Google laissé sur votre commerce dans la version gratuite de ChatGPT ou de Claude et demandez-lui une réponse. Ça prend deux minutes et vous verrez tout de suite ce que ces outils savent faire sans rien brancher. Et si vous voulez savoir ce qu'un assistant comme Foxy prendrait en charge chez vous, je vous réponds volontiers.