Une fiche par modèle : ce qui change, le prix, ouvert ou fermé, la source. Pas un article à chaque sortie — juste ce qu’il faut savoir avant de choisir un outil. Mis à jour le 23 Sep 2026.
Claude Opus 5.5
Anthropic · 22 sept. 2026
Premier modèle de la famille Claude 5.5 : le niveau de Fable 5.1 sur la plupart des tâches, 20 % moins cher qu'Opus 5 et plus de 30 % plus rapide. Anthropic annonce Sonnet 5.5 et Haiku 5.5 dans les prochaines semaines.
Le modèle « de travail » de Google pour le code et les agents, sorti trois semaines après 3.6 Flash. Prix de lancement valable jusqu'au 31 décembre 2026 ; ensuite 1,50 $ / 7,50 $.
Le vaisseau amiral d'Alibaba : 2 400 milliards de paramètres, texte, image et vidéo en entrée. Les poids ont été publiés le 12 août sous licence propre, sans l'entrée image du service en ligne.
Une intelligence proche de Fable 5 pour moitié prix, avec un curseur d'effort réglable et une fenêtre de contexte d'un million de tokens. Modèle par défaut de l'offre Claude Max.
Le plus gros modèle à poids ouverts jamais publié : 2 800 milliards de paramètres, dont 16 experts actifs sur 896. Environ 4e mondial sur l'indice Artificial Analysis, premier sur le développement web. Téléchargeable et hébergeable chez soi.
Le modèle « du milieu » d'Anthropic, le plus agentique de la gamme et le moins cher pour faire tourner des agents en continu. Le tarif de lancement (2 $ / 10 $) est devenu définitif.
Le modèle chinois à poids ouverts (licence MIT) qui a relancé la guerre des prix : prix de l'API divisé par dix sur les requêtes en cache. Une version V4.1 est arrivée en septembre.
Le prédécesseur de K3, à poids ouverts : orchestration de plusieurs agents en parallèle, code et génération d'interfaces. Prix de l'API Moonshot ; d'autres hébergeurs facturent différemment.
Un seul modèle ouvert (Apache 2.0) qui réunit instruction, raisonnement et code, avec la vision. C'est lui qui propulse l'assistant Smart Window de Firefox en France.
Le haut de gamme de Google en 2026, en aperçu. Tarif doublé (4 $ / 18 $) au-delà de 200 000 tokens de contexte. Testé dans notre benchmark à quatre épreuves.
Le grand modèle européen à poids ouverts (Apache 2.0) : 675 milliards de paramètres en mélange d'experts, 41 milliards actifs par requête. Hébergeable chez soi.
Prix publics en dollars par million de tokens, entrée puis sortie, tels que constatés à la date de la fiche (hors remises, cache et gros contextes). « Poids ouverts » : le modèle peut être téléchargé et hébergé chez soi.