AI 2026年6月29日 · 18 分钟阅读 大模型微调:从 Step 到 Loss 到 LoRA,把训练拆明白 沿着训练循环的数据流,拆解 LLM/VLM 微调实验中从数据加载到参数更新的每一个设计决策 #LLM #微调 #LoRA #训练策略 #深度学习 #VLM
AI 2026年6月25日 · 17 分钟阅读 LoRA 微调 VLM 2B~8B:参数、显存、踩坑记录 覆盖 Qwen2.5-VL / Qwen3-VL / InternVL 系列 2B-8B VLM 的 LoRA/QLoRA 微调最佳实践,含大模型参数策略、分辨率差异、多卡训练指南 #LoRA #VLM #微调 #Qwen-VL #深度学习 #QLoRA #FSDP #多卡训练