SparseVLM 精读:让问题决定保留哪些视觉 Token 2026-07-23 2026-07-23 AI 多模态大模型 / 推理加速 / 视觉 Token 裁剪 / 稀疏推理 / SparseVLM / LLaVA / ICML 从文本 rater、逐层视觉 Token 稀疏化与被裁 Token 回收出发,拆解 ICML 2025 的 SparseVLM 如何在不训练新参数的前提下加速多模态大模型推理。 4 | 0