Capturing Token Tendencies for Training-Free Token Pruning in Multimodal Large Language Models
arXiv:2607.28341v1 Announce Type: new Abstract: While visual token pruning is essential for efficient Multimodal Large Language Models (MLLMs), existing training-free methods suffer from a critical li