Generation speed
—
Cumulative output tokens / second
Read-only inference telemetry
Model, generation, GPU and host status — no controls, no inference probes.
No loaded model reported
| Task | Prompt tokens | Prompt t/s | Output tokens | Generation t/s | Total time | Completed |
|---|---|---|---|---|---|---|
| Waiting for completed request metrics… | ||||||
Read-only collector · three-second hardware sampling · filtered performance events only · prompts and responses are never collected or displayed.