编程导航
主页
学习
教程
AI 项目
问答
求职
直播
APP
AI导航
新
会员
发 布
登录/注册
沈念
后端开发
·
09-16 22:19
Day 8 ✅ 今天做了:学习大模型微调 ⏰ 明天计划:学习cc原理 📚 今日感悟:大模型微调就是将大模型从通才变为专才,主要还是用LoRa,这时不需要考虑全量矩阵,只用考虑A和B两个稀疏矩阵。rank越大,LoRa表达能力越强,但是参数量越多;rank越小,LoRa表达能力越弱,但是参数量越少。对注意力KQV的Q和V加LoRa,LoRa的输出会乘以一个缩放因子,缩放因子越大,修改幅度越大。
训练营打卡
2
1
分享
操作
在APP中打开
评论
相关内容
0个评论
全部评论
最热
最新
楼层
点击
登录
,快来和大家讨论吧~
表情
图片
发布
暂无评论
热门话题
更多>
1
训练营打卡
16980
2
学习打卡
3680
3
AI
2190
4
求职
1590
5
交流
850
6
Java
550
7
AI编程
540
8
职场
520
9
编程
520
10
程序员
470