SlimVLM: Sensitivity-aware Dynamic Structured Pruning with Adaptive Visual Token Selection for Efficient Vision-Language Models figure
AlphaXiv 中文概览(可滚动查看)