Prefill uses 5 measured requests per context after warmup. Ordinary generation uses 3 per case after warmup. Each speed request generates 256 tokens. Prompt cache hits must be zero. The candidate was ...
Some results have been hidden because they may be inaccessible to you
Show inaccessible results