Prefill uses 5 measured requests per context after warmup. Ordinary generation uses 3 per case after warmup. Each speed request generates 256 tokens. Prompt cache hits must be zero. The candidate was ...