SpecEE: Accelerating Large Language Model Inference with Speculative Early Exiting

Open in new window