Tokens-per-joule
Inference energy efficiency for a controlled run: output tokens divided by joules at a declared measurement boundary. Report model/version, workload, token accounting, precision/quality, context, batch/concurrency, latency, and utilization; it is not universal across setups.