Crowdsourced, cryptographically signed measurements of how fast large language models
actually run: decode tokens per second, time to first token, and latency, across consumer
GPUs, Apple Silicon, and hosted APIs, under one reproducible workload suite (suite-v1).