LLaVA-Mini 精读:一个视觉 Token 如何加速图像与视频推理 2026-07-29 2026-07-29 AI 多模态大模型 / 推理加速(推理侧) / 视觉 Token 压缩 / 多模态预融合 / 长视频理解 / LLaVA-Mini / ICLR 拆解 ICLR 2025 的 LLaVA-Mini 如何用模态预融合与查询压缩,把送入主语言模型的视觉 Token 从 576 个降到 1 个,属于推理加速(推理侧)方向。 1 | 0