Ollama, LM Studio, llama.cpp et les autres n'envoient rien : le modèle tourne ici, et l'électricité consommée est celle de cette prise. C'est le seul cas où le réseau électrique choisi dans les réglages s'applique.
Facturé au temps d'inférence, 0,75 Wh par minute — environ 45 W de machine en charge. Les octets ne comptent pas : ils circulent sur la boucle locale. La détection se fait au nom du processus et à la charge processeur, jamais au réseau.
| Service | Processus |
|---|---|
| Ollama (local) | ollama |
| LM Studio (local) | lm studio · lmstudio |
| llama.cpp (local) | llama-server · llama-cli |
| Jan (local) | jan-nitro · nitro |
| vLLM (local) | vllm |
| LocalAI (local) | local-ai |
| GPT4All (local) | gpt4all |
| Msty (local) | msty |
| AnythingLLM (local) | anythingllm |
| ComfyUI (local) | comfyui |
| KoboldCpp (local) | koboldcpp |
| RamaLama (local) | ramalama |