分类: 大模型

2 篇文章

一言
幻术世界有什么不好,现实太残酷,只会让这空洞越来越大。——火影忍者
thumbnail
LoRA小结
前言:PEFT的诞生      传统的预训练-下游任务微调的范式,是对预训练模型所有参数进行微调,即全量微调。之前基于Bert、GPT1的下游微调任务都是这么干的。因为当时的预训练模型参数量比较少,所以速度并没有那么慢。…