Opecla. Le déclic IA. Choisir un modèle ↗
Comparer les modèles · gratuit

Quel modèle
pour votre besoin ?

Coder, lire un document, résoudre un problème… Comparez les résultats selon ce que vous voulez faire.

6 modèles OpenAI & Claude11 usages mesurésRelevé le 30 septembre 2026
Choisir les modèles 6 / 6
Afficher dans le graphique
Tous les modèles

Votre besoin

Dépenser moins

Comparer le coût de tâches effectuées avec les modèles via leur API.

Test indépendant
Prix en dollars pour un million de fragments de texte envoyés.Une barre plus courte signifie un coût plus bas.
GPT-6 LunaOpenAI
0,1 $
Claude Sonnet 5.5Anthropic
2 $
GPT-6.1 SolOpenAI
2 $
GPT-6 SolOpenAI
2 $
Claude Opus 5.5Anthropic
4 $
GPT-6 AstraOpenAI
10 $

Un token est un fragment de texte, pas toujours un mot. Tarif standard hors cache ; des conditions supplémentaires peuvent s’appliquer aux très longs textes.

Comment choisir ?

Le meilleur choix dépend
de votre tâche.

  1. Partez de votre besoin.Un modèle peut être à l’aise pour coder et moins bon pour lire un document.
  2. Lisez le score du bon test.64 % signifie 64 % de réussite sur ce test. Cela ne veut pas dire « bon à 64 % dans tous les domaines ».
  3. Regardez aussi le coût et l’attente.Un score plus haut peut demander plus de temps et plus d’argent.
Voir les chiffres, les réglages et les sources

Test : Tarif API · texte envoyé. Le réglage « Max » donne au modèle davantage de temps pour réfléchir. Il ne correspond pas au même budget pour tous.

Résultats détaillés du test Tarif API · texte envoyé
ModèleRésultatConditionsSource
GPT-6 Luna0,1 $Réglage Max. Réglage maximal du raisonnement ; budget de sortie propre au modèle.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
Claude Sonnet 5.52 $Réglage Max. Raisonnement adaptatif ; repli vers un autre modèle activé par défaut.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
GPT-6.1 Sol2 $Réglage Max. Réglage maximal du raisonnement ; budget de sortie propre au modèle.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
GPT-6 Sol2 $Réglage Max. Réglage maximal du raisonnement ; budget de sortie propre au modèle.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
Claude Opus 5.54 $Réglage Max. Raisonnement adaptatif ; repli vers un autre modèle activé par défaut.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
GPT-6 Astra10 $Réglage Max. Réglage maximal du raisonnement ; budget de sortie propre au modèle.Résultat chez Artificial Analysis ↗Relevé le 30 septembre 2026
Comment cette comparaison est faite

Un évaluateur extérieur aux fabricants

Artificial Analysis teste les modèles d’OpenAI, d’Anthropic et d’autres entreprises avec sa propre méthode. Chaque graphique compare un seul test et une seule version de ce test. Nous n’avons pas utilisé les scores publicitaires des fabricants pour remplir ces graphiques.

Des conditions communes, avec des différences à connaître

Résultats indépendants d’Artificial Analysis, mêmes tests et versions, modèles au réglage maximal. Un même réglage ne donne pas exactement le même temps de réflexion à chaque modèle.

  • Le réglage maximal ne correspond pas au même budget de calcul ou de réponse pour tous les modèles. Les températures et limites de sortie suivent les exceptions du protocole.
  • Les modèles Claude sont évalués avec leur mécanisme de repli activé : certaines tâches peuvent être prises en charge par un autre modèle.
  • Les tests de qualité sont principalement en anglais via API. Ils ne garantissent pas la qualité d’une réponse française dans ChatGPT ou Claude.
  • Relevé du 30 septembre 2026. Les résultats peuvent évoluer ; les petits écarts et scores arrondis ne prouvent pas une différence significative.
  • Les résultats Sonnet 5.5 incluent une évaluation avant publication avec un problème de réponses structurées depuis corrigé ; une nouvelle mesure peut changer ses scores.

Comprendre les unités

« % » indique la réussite définie par le test. « Points » indique un score de comparaison : ce n’est pas un pourcentage. Les dollars représentent des coûts API, c’est-à-dire le coût d’un modèle utilisé par un logiciel, distinct d’un abonnement ChatGPT ou Claude. Les secondes mesurent l’attente. Un « fragment » de texte, appelé token, peut être un mot ou seulement une partie d’un mot.

Méthode des tests de qualité ↗ · Méthode des mesures de vitesse ↗

D’autres analyses utiles

Vals AI ↗ explique aussi ses tests communs et leurs marges d’erreur. Arena ↗ compare les préférences des utilisateurs pour des réponses présentées sans nom de modèle. Ces deux méthodes ne mesurent pas exactement la même chose ; leurs scores ne sont pas mélangés ici.

Les données sont un relevé conservé dans le projet. Cette page ne promet pas une mise à jour automatique.

Consulter aussi les fiches d’usage et d’accès aux modèles ↗