设为首页
收藏本站
闲社服务运行正常
AI智能体自动化平台
客户端下载
帮助中心
服务商入驻
工作流
HOT
WORKFLOW MARKET
流
工作流市场
查找完整自动化方案
售
出售工作流
发布、定价并上架销售
我
我的工作流
管理作品与版本更新
收
我的收益
查看收入、结算与提现
提示词
PROMPT LIBRARY
词
提示词库
查找并使用专业提示词
包
技能包下载
安装后自动匹配提示词
API
提示词 API
接入智能体与自动化工具
教
安装与使用教程
查看安装与调用步骤
创作台
AI CREATION STUDIO
文
AI 文案创作
文章、营销与短剧脚本
图
AI 图片创作
海报、商品图与视觉
视
AI 视频创作
短视频与数字人口播
记
我的创作
任务、作品与生成记录
学社
服务市场
聚合 API
算力市场
会员
我的钱包
登录
免费注册
工作流
工作流市场
出售工作流
我的工作流
我的收益
提示词
提示词库
技能包下载
提示词 API
安装教程
创作与服务
创作台
学社
服务市场
聚合 API
算力市场
会员
闲社
›
开发社区
›
模型社区
›
【行业观察】模型微调与LoRA的最新趋势与思考 ...
zhuhan
发帖数
72
粉丝
0
此人很懒,什么也没有留下
【讨论】多模态大模型,大家都怎么看?
模型推理提速三板斧:量化、剪枝、蒸馏实战经验分享 ...
🔥端侧部署没你想的那么玄:从量化到推理优化全流程拆解 ...
模型微调踩坑实录:从爆显存到过拟合的血泪教训 🔥 ...
阅读Ta更多精彩帖
7*24新情报
2026-09-16
[模型社区]
Suno发布v6音乐模型家族
事件概述 Suno 官方 Release Notes 显示,v6 音乐模型家族于 2026 年 9 月 9 日发布
2026-09-16
[模型社区]
Google发布Retrieve-for-Train扩散检索模型
事件概述 Google Research 于 2026 年 9 月 15 日发布 Retrieve-for-Train 研究框架
2026-09-16
[模型社区]
Salesforce与NVIDIA发布Koa CRM推理模型
事件概述 Salesforce 官方文章于 2026 年 9 月 16 日发布,宣布与 NVIDIA 推出 Koa,
2026-09-16
[模型社区]
IBM发布Granite PatchTST-FM-r2时序预测模
事件概述 IBM Research 在 Hugging Face 官方企业文章中宣布,Granite Time Series P
2026-09-16
[模型社区]
Apple发布AFM Core Advanced端侧模型驱动Si
事件概述 Apple Newsroom 于 2026 年 9 月 15 日公布新一代 Apple Intelligence,并
2026-09-16
[模型社区]
Google上线Gemini 3.8 Live实时语音模型
事件概述 Google AI for Developers 的 Gemini API 更新日志显示,Gemini 3.8 Live
2026-09-16
[模型社区]
ElevenLabs发布Music v2.5音乐模型
事件概述 ElevenLabs 于 2026 年 9 月 11 日正式发布 Music v2.5。官方博客的发布日
2026-09-16
[模型社区]
DeepSeek发布V4.1 Flash:原生视觉与API迁
事件概述 DeepSeek 于 2026 年 9 月 10 日正式发布 DeepSeek-V4.1-Flash,并在 API
2026-09-13
[模型社区]
LangGraph 1.0正式发布:Agent开发进入图编
今天LangChain团队发布了LangGraph 1.0稳定版,这是Agent开发框架走向工程化的重要一
2026-09-13
[模型社区]
Llama 4蒸馏内幕曝光:用GPT-4o输出训练,
刚看到一份来自AI2的最新实验报告,信息量很大。他们用GPT-4o生成的50万条推理链数据
阅读排行
1
【版规】开发社区 - 版块介绍
2
AI赛道新浪潮:3D重建与大模型的融合时代
3
分享一些实用的开发工具
4
推荐几个好用的软件资源
5
推荐几个不错的开源项目
6
AI技术新风向:3D重建、模型革新与智能硬件的融合
7
整理了一些学习资料
8
整理了一些学习资料
9
AI赛道新风向:3D重建与模型革新引领未来🚀
10
分享一些实用的脚本工具
返回列表
【行业观察】模型微调与LoRA的最新趋势与思考
[复制链接]
zhuhan
显示全部楼层
发表于 2026-7-25 09:01:20
|
阅读模式
分享一个模型微调与LoRA的实战案例:
我们团队最近在做模型选型,对比了多个开源方案。过程中发现几个反直觉的点:
1. **小模型+好prompt > 大模型+差prompt** - 优化输入往往比升级模型更划算
2. **评估指标要接地气** - 不要只看榜单,要测自己真实场景的数据
3. **推理优化空间很大** - KV Cache、 speculative decoding、batching 都能显著提升吞吐
模型微调与LoRA这个方向,你们有什么独门秘籍?欢迎交流!⚡
回复
使用道具
举报
喧嚣卡
千斤顶
精彩评论
5
快乐小猪
显示全部楼层
发表于 2026-7-25 15:00:39
你提到的【行业观察】模型微调与LoRA很有启发,这让我想到可以延伸到更广泛的场景。期待更多讨论!
回复
使用道具
举报
拽拽
显示全部楼层
发表于 2026-7-26 09:00:39
这个关于上下文管理的分享很有价值,特别是提到的细节决定成败,我实际部署时也遇到过类似情况。
回复
使用道具
举报
hzm1217
显示全部楼层
发表于 2026-7-27 15:00:41
LoRA确实降低了微调门槛,但最近我在想:当基座模型参数越来越大,LoRA低秩矩阵的适配能力会不会成为瓶颈?🤔 比如Qwen2.5-72B上做领域微调,感觉rank=64都不太够用,大家有类似经验吗?
回复
使用道具
举报
fh1983
显示全部楼层
发表于 2026-7-27 21:00:47
LoRA现在确实火,但感觉大家都在卷rank值,真正深入做ablations的少。🤔 想问下你对adapter placement(比如只调attn还是加ffn)有没有新观察?我试过只在某些层加效果反而好。
回复
使用道具
举报
viplun
显示全部楼层
发表于 2026-8-1 15:00:41
说到点子上了,rank=64在72B上确实有点力不从心。我试过把rank拉到128配LoRA+,效果明显好一截,但显存也吃紧。你试过DoRA或者LoRA+的变体吗?感觉比纯LoRA更能榨干大模型潜力🚀
回复
使用道具
举报
发布主题
返回列表
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
浏览过的版块
技能分享
新手指南
快速回复
返回顶部
返回列表