首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >LoRA(低秩适配) >LoRA 权重如何合并回原模型?

LoRA 权重如何合并回原模型?

词条归属:LoRA(低秩适配)

1. 合并的数学基础

由于 ΔW = B·A 与原权重 W 具有相同的矩阵形状,训练完成后可直接将二者相加,得到新的权重 W' = W + B·A,形成一个与原模型结构完全一致的常规权重矩阵。

2. 零推理开销

合并后的模型是一个普通权重矩阵,前向传播时不再需要额外的低秩分支计算,因此推理速度与原始模型完全相同,不引入任何额外延迟。

3. 支持热插拔

在合并之前,LoRA 权重也可作为独立的小文件保存与加载。这使得同一基础模型可搭配多个不同的 LoRA 权重,通过切换或组合实现快速的任务切换与多概念融合。

相关文章
谷歌面试官:“以后面试都允许用 Gemini。” 我:“那还考什么?” 面试官:“考你会不会被 AI 带沟里。”
外媒 Business Insider 报道称,谷歌内部文件显示,从今年下半年起,计划在软件工程师招聘的“代码理解”面试环节,允许候选人使用谷歌官方认证的 AI 助手;试点阶段将统一使用自研模型 Gemini。谷歌发言人向媒体证实了这一安排。
程序员鱼皮
2026-06-12
2680
LoRA再升级!英伟达 | 提出权重分解低阶适应:DoRA,极大的增强模型学习能力
大模型的高效微调一直是业内关注的焦点,因为这将直接影响大模型在不同专业领域的应用。在广泛使用的参数高效微调(PEFT)方法中,LoRA 及其变体由于避免了额外的推理成本而获得了相当大的普及。然而,这些方法与完全微调(FT)之间仍然经常存在精度差距。
ShuYini
2024-02-22
1.8K0
微调:让通用大模型变成你的「专属定制ROM」——从AOSP到LoRA的迁移学习
• 英伟达、AMD、英特尔联手参投,AI初创公司Hark完成7亿美元融资,聚焦AI基础设施建设
陆业聪
2026-05-25
3280
原神盲盒风格:AI绘画Stable Diffusion原神人物公仔实操:核心tag+lora模型汇总
在这篇文章中,我们将深入探讨原神盲盒的艺术风格,以及如何运用AI绘画技术(Stable Diffusion)——来创造原神角色公仔。我们将通过实践操作让读者更好地理解这种技术,以及如何利用关键标签和Lora模型来优化生成的结果。
AI飞行家
2023-07-22
4.3K0
开源模型二次开发后的备案义务判定:改了多少行代码才算"自研"?
核心摘要:本文深度解析基于 Qwen、Llama、DeepSeek 等开源模型进行微调、蒸馏、RAG 开发的合规边界。重点阐述监管对“自研”的判定逻辑、9种技术形态的备案路径差异、LoRA 灰色地带处理策略,以及备案必须达到的量化硬指标。
ai备案指南-满满
2026-08-28
2010
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券