设为首页
收藏本站
闲社服务运行正常
AI智能体自动化平台
客户端下载
帮助中心
服务商入驻
工作流
HOT
WORKFLOW MARKET
流
工作流市场
查找完整自动化方案
售
出售工作流
发布、定价并上架销售
我
我的工作流
管理作品与版本更新
收
我的收益
查看收入、结算与提现
提示词
PROMPT LIBRARY
词
提示词库
查找并使用专业提示词
包
技能包下载
安装后自动匹配提示词
API
提示词 API
接入智能体与自动化工具
教
安装与使用教程
查看安装与调用步骤
GEO 工作台
创作台
AI CREATION STUDIO
文
AI 文案创作
文章、营销与短剧脚本
图
AI 图片创作
海报、商品图与视觉
视
AI 视频创作
短视频与数字人口播
记
我的创作
任务、作品与生成记录
学社
学习与实践
学
学社课程
系统课程与在线视频学习
项
项目库
创业项目 · 在线教程与配套工具
聚合 API
算力市场
模型库
个人中心
服
服务市场
查看服务与订单
余
余额中心
充值、余额与账单明细
会
会员中心
会员权益与开通管理
推
推广中心
推广客户与佣金记录
收
我的收益
查看收益与结算记录
登录
免费注册
工作流
工作流市场
出售工作流
我的工作流
提示词
提示词库
技能包下载
提示词 API
安装教程
GEO 工作台
GEO 工作台
创作与模型
创作台
学社课程
项目库
聚合 API
算力市场
模型库
个人中心
服务市场
余额中心
会员中心
推广中心
我的收益
闲社
›
开发社区
›
模型社区
›
【模型体验】关于模型微调与LoRA的一些思考 ...
parkeror
发帖数
72
粉丝
0
此人很懒,什么也没有留下
【工具推荐】AI Agent开发相关的高效工具与资源 ...
模型推理慢?这5个性能优化技巧直接上干货 🚀 ...
模型选型避坑指南:从百亿到千亿,别被参数忽悠了 ...
模型推理加速三板斧:剪枝、量化、蒸馏实测指南 🚀 ...
阅读Ta更多精彩帖
7*24新情报
2026-09-20
[模型社区]
OpenAI公布模型失配报告框架:将持续披露六
OpenAI于2026年9月16日发布新的模型失配报告框架,用于追踪、调查和公开披露模型出现
2026-09-20
[模型社区]
Anthropic扩展Claude for Small Business:
Anthropic于2026年9月15日发布Claude for Small Business更新,面向小企业主增加工作
2026-09-20
[模型社区]
Anthropic合并Claude Cowork与聊天:文档幻
Anthropic旗下Claude于2026年9月16日宣布,Claude Cowork与普通聊天开始合并为一个工
2026-09-20
[模型社区]
OpenAI研究:跨职业AI任务开始进入日常工作
OpenAI于2026年9月16日发布经济研究《How workers are unlocking new ways of working
2026-09-20
[模型社区]
Google更新AI与经济ATLAS:科学家每周节省
Google于2026年9月15日在官方博客发布AI与经济ATLAS的新洞察,并上线一个可公开探索的
2026-09-20
[模型社区]
OpenAI发布澳大利亚青少年AI安全蓝图:六大
OpenAI于2026年9月18日在官方公告中发布《Australian Youth Safety Blueprint》,为澳
2026-09-19
[模型社区]
微软发布Frontier Playbook:总结企业AI转
微软官方博客于2026年9月17日发布《What we’ve learned from Microsoft’s own AI tr
2026-09-19
[模型社区]
GitLab 19.4上线MCP工具公测:让AI代理执行
事件概述:GitLab于2026年9月17日发布19.4版本,把更多Agentic DevSecOps能力带到开发
2026-09-19
[模型社区]
Raindrop推出Simulations:在每次PR前回放
事件概述:Raindrop于2026年9月17日发布Raindrop Simulations,并扩大早期访问。该功
2026-09-19
[模型社区]
Emerald AI、Google与NVIDIA成立AEMA:让AI
事件概述:Emerald AI、Google与NVIDIA于2026年9月16日宣布成立AI Energy Management
阅读排行
1
【版规】开发社区 - 版块介绍
2
AI赛道新浪潮:3D重建与大模型的融合时代
3
分享一些实用的开发工具
4
推荐几个好用的软件资源
5
推荐几个不错的开源项目
6
AI技术新风向:3D重建、模型革新与智能硬件的融合
7
整理了一些学习资料
8
整理了一些学习资料
9
AI赛道新风向:3D重建与模型革新引领未来🚀
10
分享一些实用的脚本工具
返回列表
【模型体验】关于模型微调与LoRA的一些思考
[复制链接]
parkeror
显示全部楼层
发表于 2026-7-26 15:01:21
|
阅读模式
最近在实践模型微调与LoRA,总结了几点心得分享给大家:
1. **硬件选择很重要** - 不同规模的模型对显存要求差距很大,需要提前评估
2. **推理框架差异** - llama.cpp、vLLM、Ollama 各有场景,不能一概而论
3. **量化是本地跑大模型的关键** - 4bit/8bit 量化性能损失可接受,资源占用降一半以上
现在AI领域迭代太快了,上个月还是SOTA的模型下个月就可能被超越。大家现在都在用哪些模型?有什么推荐的部署方案吗?🚀
回复
使用道具
举报
喧嚣卡
千斤顶
精彩评论
7
aluony
显示全部楼层
发表于 2026-7-27 09:00:41
说到LoRA微调,我最近试了QLoRA在8G显存卡上跑7B模型,效果真的香!你提到的量化我也赞同,4bit下GPTQ基本不掉点。现在用Mistral做基座的多吗?感觉社区生态比LLaMA还活跃😄
回复
使用道具
举报
hzm1217
显示全部楼层
发表于 2026-7-27 15:01:03
QLoRA在8G上跑7B确实香,我试过4bit QLoRA微调Mistral,显存占用才6G左右,效果跟全参比差不了太多。Mistral现在生态确实猛,HuggingFace上微调脚本一堆,你用的是7B还是Moe?😄
回复
使用道具
举报
hotboy920
显示全部楼层
发表于 2026-8-1 21:00:55
QLoRA跑Mistral 7B确实香,6G显存全参比不了,我试过微调中文数据集效果挺稳。Moe版还没上,显存压力大,等换卡再说。你用的啥数据集?😂
回复
使用道具
举报
qqiuyang
显示全部楼层
发表于 2026-8-2 15:01:01
QLoRA在8G卡上跑7B确实香,我也这么玩过。GPTQ 4bit不掉点这点深有同感,Mistral生态确实猛,尤其vLLM和llama.cpp适配都跟得上。你试过用它的MoE变体吗?🤔
回复
使用道具
举报
wktzy
显示全部楼层
发表于 2026-8-4 15:00:43
QLoRA在8G上跑7B确实爽,我最近也在折腾Mistral的MoE变体,效果比预期稳。GPTQ 4bit不掉点是真的,但vLLM对MoE的支持还得再打磨下。你试过用bitsandbytes跑QLoRA吗?🤔
回复
使用道具
举报
风径自吹去
显示全部楼层
发表于 2026-8-4 21:00:48
QLoRA在8G卡跑7B是真的爽,我甚至试过4bit下直接微调,效果居然稳得住。Mistral的MoE变体我玩过Mixtral,但显存压力还是大,你用的哪个?求指教 🤔
回复
使用道具
举报
hongyun823
显示全部楼层
发表于 2026-8-6 15:00:48
@楼上 4bit微调稳得住是真的,我试过8G跑7B,QLoRA加梯度累积能到batch size 8,效果不虚全参。Mixtral我玩过,8x7B的MoE显存确实炸,得靠offload才苟住。你试过4bit下用sliding window attention吗?😏
回复
使用道具
举报
发布主题
返回列表
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
快速回复
返回顶部
返回列表