NapseflowNapseflow
Numérique

Le vrai prix de Claude : notre analyse de 11 modèles, avec 3 prompts et 200 requêtes

Next.ink · mis à jour il y a 16 j

Haiku est le modèle le moins cher d’Anthropic, contrairement à Fable, mais dans quelles proportions ? Où se placent Sonnet et Opus ? Les versions 5 changent-elles la donne ? Next a testé près de 200 combinaisons différentes afin d’apporter un peu de clarté dans l’obscurité de la facturation des IA génératives. On entend beaucoup […].

Analyse des modèles Claude

L’article présente une étude comparative des coûts des modèles d’IA générative développés par Anthropic, une entreprise spécialisée dans ce domaine. Quatre familles de modèles sont analysées : Haiku, Sonnet, Opus et Fable, chacune correspondant à des usages différents. Haiku est le modèle le plus léger et économique, adapté aux réponses rapides et aux tâches simples. Sonnet est conçu pour des tâches plus complexes comme le codage ou l’analyse. Opus est réservé au raisonnement approfondi et aux recherches complexes. Enfin, Fable est le modèle le plus puissant et coûteux, dédié aux projets critiques et longs. L’étude compare 11 versions de ces modèles, dont les dernières générations (Haiku 4.5, Sonnet 5, Opus 5, Fable 5.1) et des versions antérieures. Les prix varient considérablement, passant de 1,3 centime par requête pour Haiku 4.5 à 92,1 centimes pour Fable 5.1.

Facturation par tokens

Les modèles d’IA générative sont facturés en fonction du nombre de tokens, un terme technique désignant les unités de texte (mots, parties de mots ou ponctuation) utilisées en entrée (le prompt) et en sortie (la réponse générée par l’IA). Par exemple, une phrase comme « Bonjour, comment ça va ? » peut être découpée en tokens comme « Bonjour », « , », « comment », « ça », « va », « ? ». L’étude utilise l’API d’Anthropic, qui permet de mesurer précisément le nombre de tokens consommés pour chaque requête. Les coûts sont calculés en millions de tokens : par exemple, une requête sur Haiku 4.5 coûte en moyenne 1,3 centime, tandis que la même requête sur Fable 5.1 coûte 92,1 centimes. Les modèles plus avancés consomment davantage de tokens, notamment en raison de leur capacité à gérer des raisonnements complexes.

Protocole de test

Pour comparer les modèles, l’étude a utilisé trois prompts (questions ou demandes adressées à l’IA) différents, chacun testé sur les 11 modèles avec cinq niveaux de raisonnement (paramètre ajustable allant de low à max). Les trois prompts sont : une devinette (« Ô frère, fils de ma mère, ton père est le frère de mon enfant. Qui suis-je ? »), une demande de création d’un carnet de voyage pour un trajet en voiture électrique entre Bayonne et Montpellier, et une demande de développement d’une extension pour navigateur permettant d’inverser les titres et sous-titres sur un site d’actualité. Chaque combinaison (modèle + prompt + niveau de raisonnement) a été testée près de 200 fois pour obtenir des données fiables. Les résultats montrent que les modèles plus lourds, comme Fable, consomment jusqu’à 100 fois plus de tokens que Haiku pour des tâches similaires.

Écarts de prix entre modèles

Les différences de coût entre les modèles sont marquées. Haiku est en moyenne 11 fois moins cher que Sonnet, avec un coût de 1,3 centime par requête contre 15 centimes pour Sonnet. Passer de Sonnet à Opus augmente la facture de 40 %, et Fable coûte trois fois plus cher qu’Opus. Le rapport entre Haiku et Fable atteint un facteur de 50, voire 100 pour certaines requêtes. Par exemple, une requête sur Sonnet 5 coûte 19,3 centimes en moyenne, contre 27,8 centimes pour Opus 5 et 92,1 centimes pour Fable 5.1. Ces écarts s’expliquent par la complexité des tâches que chaque modèle est capable de gérer : plus le modèle est lourd, plus il consomme de tokens et plus son coût est élevé. Les versions récentes des modèles (comme Sonnet 5 ou Opus 5) sont également plus chères que leurs prédécesseurs.

Limites des forfaits Pro et Max

L’article souligne les difficultés rencontrées par les utilisateurs des forfaits Claude Pro et Claude Max d’Anthropic, qui incluent des limites d’utilisation floues. Contrairement à l’API, où les coûts sont transparents et calculés au token près, les forfaits payants proposent des crédits mensuels dont les contours sont mal définis. Certains utilisateurs rapportent avoir épuisé leurs crédits en quelques requêtes, tandis que d’autres constatent des changements fréquents dans les limites d’utilisation. Cette opacité rend difficile l’estimation des coûts réels pour les utilisateurs non techniques. L’API, en revanche, offre une visibilité totale sur les dépenses, ce qui en fait un outil privilégié pour une analyse précise comme celle menée dans l’étude.

Ce que ça pourrait changer

L’étude publiée par *Next* se concentre sur les modèles d’Anthropic, mais annonce déjà des analyses similaires pour d’autres IA génératives. Un prochain article sera consacré à *ChatGPT* d’OpenAI, suivi d’une étude sur *Gemini* de Google. Ces comparaisons permettront aux utilisateurs de mieux comprendre les coûts et les performances des différentes solutions disponibles sur le marché. L’objectif est d’apporter de la clarté dans un domaine où les prix et les fonctionnalités évoluent rapidement, souvent de manière opaque. Les résultats détaillés des tests, incluant le nombre de tokens consommés pour chaque modèle et chaque prompt, sont disponibles pour les abonnés de *Next*.

Sujets complémentaires

Ce contenu a été généré par intelligence artificielle à partir de l'article source. Il peut contenir des erreurs ou imprécisions.