Le bon modèle d'IA pour chaque tâche.
Choisissez ce que vous voulez faire. lebonmodel compare les modèles d'OpenAI et d'Anthropic sur cette tâche précise, avec l'abonnement que vous avez déjà.
Le plus adapté chez chaque éditeur
Niveau et coût sur cette tâche
100 = le meilleur modèle actuel sur cette tâche. Chaque point est un modèle, à son réglage le plus adapté.
- OpenAI
- Anthropic
- Niveau requis
- Hors de vos abonnements
Coût d'une tâche en API, échelle logarithmique
Le classement pour cette tâche
Ouvrez une ligne pour voir les scores qui comptent ici.
Ce que chaque formule vous donne pour cette tâche
À prix comparable, le meilleur niveau atteignable dans chaque offre, et ce que les éditeurs publient sur les volumes. Ni OpenAI ni Anthropic ne publient de quota en tokens.
Comment lebonmodel compare
Une note par tâche
Chaque tâche s'appuie sur les évaluations d'Artificial Analysis qui la mesurent le mieux : lecture de longs PDF pour interroger un document, Terminal-Bench pour coder, indice juridique pour un contrat. Chaque modèle est noté à chaque niveau d'effort, puis comparé au meilleur : 100 correspond au meilleur modèle actuel sur cette tâche.
Des niveaux en métiers
Référence à partir de 93 % du meilleur score, Senior à 82 %, Confirmé à 68 %, Junior à 50 %. Chaque famille de tâches a son échelle de métiers : de stagiaire juridique à associé pour un contrat, de stagiaire développeur à architecte pour le code. C'est une analogie pour se repérer, pas une mesure de la valeur d'un métier.
Le coût d'une tâche
Quand une évaluation ressemble à la tâche, nous reprenons le coût réellement mesuré par Artificial Analysis pour chaque modèle, réflexion comprise. Sinon, nous comptons les tokens lus et écrits au prix de l'API. Dans un abonnement, ce coût indique à quelle vitesse la tâche entame votre quota.
Les abonnements
Pour chaque offre, nous ne retenons que les réglages réellement proposés dans ChatGPT, ChatGPT Work, Codex, l'appli Claude et Claude Code, ainsi que la taille des documents acceptée. Si vous n'avez que la conversation, comme dans beaucoup d'entreprises, cochez « Conversation uniquement ». Les volumes viennent des pages d'aide des éditeurs, qui ne les publient jamais en tokens.
Les limites
Aucune évaluation récente ne mesure la qualité en français. Le mode Pro de ChatGPT n'est pas évalué : nous le montrons comme GPT-6 Astra au maximum. Le mode Think des offres gratuites, qui repose sur GPT-5.6 Luna, est compté avec un effort moyen. Pour GPT-5.6 Sol en mode Instant et Claude Haiku 4.5 sans réflexion, quelques scores sont estimés à partir du même modèle. Les modèles à accès restreint ou à héberger soi-même ne sont pas comparés.
Mise à jour
Données du 6 octobre 2026. Les modèles changent vite : un essai sur vos propres documents reste le meilleur arbitre. Pour un budget mensuel selon votre volume, voyez la page Estimer un budget.