Bridging The Gaps Between Token Pruning and Full Pre-training via Masked Fine-tuning

Open in new window