Ce qu'on appelle un chatbot : une question, une réponse écrite, produite token par token. C'est le type le plus répandu, et celui dont l'estimation est la plus directe — les octets qui arrivent sont la réponse qui s'écrit.
Facturé au volume reçu, converti en tokens puis en énergie au tarif de 2 Wh par millier de tokens.
| Service | Région d'inférence | Intensité | Réponse de 500 tokens |
|---|---|---|---|
| Claude | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| ChatGPT / OpenAI | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Grok / xAI | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Meta AI | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Mistral / Le Chat | France | 50 g/kWh | 0,05 g · 500 tokens |
| DeepSeek | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Microsoft Copilot | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Poe | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| OpenRouter | Monde | 480 g/kWh | 0,48 g · 500 tokens |
| Groq | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Together AI | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Fireworks | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Cohere | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Hugging Face Inference | Monde | 480 g/kWh | 0,48 g · 500 tokens |
| Qwen / Tongyi | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Kimi / Moonshot | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Zhipu / GLM | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Ernie / Baidu | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Doubao / ByteDance | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Z.ai | Chine | 580 g/kWh | 0,58 g · 500 tokens |
| Character.AI | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| Pi / Inflection | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| AWS Bedrock (US) | États-Unis | 380 g/kWh | 0,38 g · 500 tokens |
| AWS Bedrock (UE) | Union européenne | 250 g/kWh | 0,25 g · 500 tokens |
| DeepL | Union européenne | 250 g/kWh | 0,06 g · 500 tokens |
| Grammarly | États-Unis | 380 g/kWh | 0,1 g · 500 tokens |