L14 · 由简入深 AI 学习路线

🛠️ 微调实战进阶

把开源大模型训练成你的专属助手:LoRA/QLoRA、指令数据、Unsloth 极速微调、中文小模型 MiniMind,到评测并部署一个能落地的领域模型。

已学 0 / 10 章

10 天学习路线图

每天一章,从「微调全景再认识」到「做一个领域问答助手」。点击卡片开始阅读,进度自动保存在本机。

3 个浏览器内可玩演示

不用装任何环境,直接在页面里看懂微调的三大关键环节。

① LoRA 微调原理台

看 LoRA 怎么用两个低秩小矩阵 A/B 只训练一小部分参数,把基座模型「拧」成你要的样子。

② 微调数据配比台

通用对话 + 领域问答 + 高质量对话怎么配比,才不会「学新忘旧」(灾难性遗忘)。

③ 训练损失曲线台

loss 曲线怎么看:过拟合、欠拟合、学习率太快太慢,各自长什么样。

提示:学习进度保存在你浏览器本地(localStorage),换设备不会同步。演示中的「显存/损失曲线/配比」为教学模拟,展示机制与典型趋势。