The percentage of inference requests that can reuse cached computations from previous similar prompts.