Une réponse de 500 tokens produite par Together AI coûte environ 1 Wh, soit 0,38 gCO₂e. Together AI est un service de conversation dont l'inférence tourne aux États-Unis, où le courant vaut 380 gCO₂e par kilowattheure.
| Type d'usage | Conversation |
|---|---|
| Région d'inférence | États-Unis US |
| Intensité du réseau | 380 gCO₂e/kWh |
| Tarif énergétique | 2 Wh / 1 000 tokens |
| Octets par token | 25 |
L'estimation est linéaire : ces trois lignes sont le même calcul à trois échelles. Ce sont des ordres de grandeur, pas des mesures.
| Une réponse de 500 tokens | 1 Wh | 0,38 gCO₂e |
|---|---|---|
| Cent réponses — une journée de travail avec un assistant | 100 Wh | 38 gCO₂e |
| Mille réponses | 1 kWh | 380 gCO₂e |
Le même échange, au même modèle, facturé au réseau électrique d'une autre région. C'est l'endroit du calcul où le choix du fournisseur pèse le plus lourd — davantage que la longueur des réponses.
| Suisse | 40 g/kWh | 0,04 gCO₂e |
|---|---|---|
| France | 50 g/kWh | 0,05 gCO₂e |
| Union européenne | 250 g/kWh | 0,25 gCO₂e |
| États-Unis ce service | 380 g/kWh | 0,38 gCO₂e |
| Monde | 480 g/kWh | 0,48 gCO₂e |
| Chine | 580 g/kWh | 0,58 gCO₂e |
Les connexions sortantes vers ces domaines, résolus en adresses. La comparaison se fait sur l'adresse, jamais sur le nom d'hôte : rien n'est déchiffré, rien n'est lu.
Le périmètre est opérationnel : l'électricité de l'inférence, et rien d'autre. Ni la fabrication des serveurs, ni l'entraînement du modèle amorti sur les requêtes, ni le réseau de transport.
Le tarif est celui du type de service, pas celui du modèle exact que vous avez appelé : CarbonWatch ne lit pas le contenu et ne sait pas si la réponse vient d'un petit modèle ou d'un grand. Un raisonnement long coûte davantage que ce qui est compté ici.
Le rapport entre octets reçus et tokens produits est le paramètre le plus incertain du modèle. Il est réglable, service par service, dans le registre.