DeeR-VLA 精读:用动态早退加速多模态机器人推理 2026-07-22 2026-07-22 AI 多模态大模型 / 推理加速 / 动态早退 / VLA / 机器人学习 / NeurIPS 从多出口 MLLM、动作一致性判据与预算约束出发,拆解 NeurIPS 2024 的 DeeR-VLA 如何动态跳过 LLM 层,实现多模态机器人推理加速。 7 | 0
TD-MPC2 精读:用隐式世界模型统一 104 个连续控制任务 2026-07-22 2026-07-22 AI 强化学习 / 世界模型 / 模型预测控制 / 连续控制 / 多任务学习 / ICLR 从隐式潜在动力学、SimNorm、离散回归、策略先验与 MPPI 规划出发,拆解 ICLR 2024 Spotlight 论文 TD-MPC2 如何用统一超参数稳定训练并扩展到 317M 参数、80 个任务。 4 | 0
Yo'LLaVA 精读:用 16 个软 Token 记住你的专属视觉概念 2026-07-21 2026-07-22 AI 多模态大模型 / 个性化 / 视觉概念 / 软提示 / YoLLaVA / NeurIPS 从可学习身份 Token、视觉属性软提示与难负样本出发,拆解 NeurIPS 2024 的 Yo'LLaVA 如何用 5 张图完成多模态大模型个性化。 2 | 0
FlashAttention-3 精读:用异步流水与 FP8 加速 Hopper Attention 2026-07-21 2026-07-22 AI AI Systems / FlashAttention / GPU Kernel / Hopper / FP8 / NeurIPS 从 Hopper 的 TMA、WGMMA 和 FP8 出发,拆解 FlashAttention-3 如何用 warp specialization、GEMM-Softmax 流水与低误差量化提升精确注意力吞吐。 3 | 0
DCCF 精读:把跨模态冲突当作假新闻证据 2026-07-20 2026-07-22 AI 多模态 / 假新闻检测 / DCCF / 表征学习 / 多任务学习 / 论文精读 从事实-情感解耦、动态特征演化与冲突-共识度量出发,拆解 DCCF 的多模态假新闻检测方法、实验结果、复现缺口与结论边界。 1 | 0
M3 精读:可伸缩视觉 Token 如何加速多模态推理 2026-07-20 2026-07-22 AI 多模态大模型 / 推理加速 / 视觉 Token 压缩 / M3 / LLaVA / ICLR 从嵌套视觉 Token、多尺度训练目标与预填充成本出发,拆解 ICLR 2025 的 M3 如何在同一多模态大模型中按需切换推理粒度。 0 | 0
BLIP-2 精读:用 Q-Former 接通冻结视觉编码器与大语言模型 2026-07-20 2026-07-22 AI 多模态 / 视觉语言模型 / BLIP-2 / Q-Former / 参数高效训练 / ICML 从 Q-Former、三种表征学习目标与两阶段预训练出发,拆解 BLIP-2 如何用冻结视觉编码器和冻结 LLM 构建多模态模型。 0 | 0
DPO 精读:不用 PPO,如何直接从偏好数据对齐语言模型 2026-07-19 2026-07-22 AI LLM / DPO / RLHF / 偏好对齐 / 模型后训练 / NeurIPS 从 KL 约束的 RLHF 目标出发,推导 DPO 的闭式策略映射、偏好损失、训练流程、实验边界与复现要点。 0 | 0
QLoRA 精读:4-bit 量化如何把 65B 微调压进单卡 2026-07-18 2026-07-22 AI LLM / QLoRA / LoRA / 模型量化 / 参数高效微调 / NeurIPS 从 NF4、双重量化、Paged Optimizer 与全层 LoRA 出发,拆解 QLoRA 的显存账本、训练流程、实验边界和复现要点。 0 | 0
Transformer、ViT 与 CLIP 基础:从三篇代表论文到高频面试题 2026-07-13 2026-07-22 AI Transformer / ViT / CLIP / 多模态 / 深度学习 / 面试 以三篇代表论文为主线,串起 Transformer、Vision Transformer 与 CLIP 的结构、目标和面试高频题。 1 | 0