Le 6 octobre 2026, le coût de génération d’un million de tokens de sortie variait considérablement entre dix-huit modèles d’IA proposés par des entreprises comme OpenAI, Anthropic, Google, Mistral AI, DeepSeek et xAI. Selon les données recueillies par ActuIA, les prix s’étendaient de 0,50 dollar pour le GPT-6 Luna d’OpenAI à 50 dollars pour le GPT-6 Astra et le Claude Fable 5.1 d’Anthropic. Les chiffres ont été convertis en euros en utilisant le taux de change de la Banque centrale européenne, fixé à 1 euro pour 1,1204 dollar, qui était le dernier taux disponible au moment de l’enregistrement. Les données ont été collectées entre 0 h et 1 h UTC ce jour-là. Les prix indiqués correspondent au tarif standard, qui suppose un « contexte court » allant jusqu’à 272 000 tokens d’entrée pour les modèles d’OpenAI et 200 000 tokens pour le Gemini 3.1 Pro de Google et le Grok 4.7. Certains modèles, comme le Grok 4.7 de xAI, appliquent un tarif plus élevé pour tous les tokens d’une requête si l’invite dépasse ce seuil. Google facture un tarif supérieur pour les invites dépassant 200 000 tokens, tandis qu’OpenAI n’explique pas clairement comment le passage au seuil supérieur affecte la facturation. La colonne « entrée depuis le cache » indique le coût de lecture des tokens à partir d’un cache de requêtes, sans inclure le coût d’écriture de nouvelles données. La colonne « lots » fait référence au traitement différé via l’API Batch, qui propose généralement une réduction en échange d’un temps de réponse plus long. La liste complète des modèles et de leurs tarifs respectifs, en dollars par million de tokens, comprenait plusieurs variantes d’OpenAI, Anthropic, Google, Mistral AI et DeepSeek, certains modèles proposant des prix différents selon les heures de pointe et les heures creuses. Une fois convertis en euros, les prix suivaient des tendances similaires : le GPT-6 Astra coûtait environ 8,93 euros pour l’entrée, tandis que le GPT-6 Luna descendait jusqu’à 0,089 euro pour l’entrée. Les réductions pour les tokens lus depuis le cache allaient de 75 % pour le Grok 4.7 à 98 % pour les heures creuses de DeepSeek. Cependant, ces réductions ne s’appliquent qu’aux requêtes identiques, où les instructions initiales et les documents de référence restent les mêmes d’un appel à l’autre. Plusieurs nouveaux modèles avaient été lancés dans les mois précédant l’enregistrement, notamment le Claude Fable 5.1 d’Anthropic et le V4.1 Flash de DeepSeek, qui ont introduit des tarifs plus bas. OpenAI et Mistral AI ont également sorti de nouveaux modèles, tandis que Google a lancé le Gemini 3.8 Flash à un tarif réduit. Des frais supplémentaires, comme la location de stockage ou la résidence des données, ont été signalés, avec des points d’accès régionaux ajoutant 10 % au coût. Certains modèles, comme DeepSeek, proposent des tarifs plus bas pendant les heures creuses, tandis que d’autres, comme Anthropic, permettent des réductions cumulatives pour le traitement par lots, la mise en cache et la résidence des données.