2026年9月23日 · 参数高效微调LoRA 参数高效微调:低秩分解与关键配置冻结原权重,只训练两个小矩阵 A(d×r) 与 B(r×k) 去逼近 ΔW,可训练参数从 dk 降到 r(d+k):挂在哪、秩 r 怎么选。
2026年9月23日 · 参数高效微调QLoRA 原理图解:三个组件把微调显存压下来4-bit 量化冻结基座 + 16-bit LoRA 适配器,按「传统量化 → NF4 → 双重量化 → 分页优化器」的顺序逐层拆开。