设为首页
收藏本站
闲社服务运行正常
AI智能体自动化平台
客户端下载
帮助中心
服务商入驻
工作流
HOT
WORKFLOW MARKET
流
工作流市场
查找完整自动化方案
售
出售工作流
发布、定价并上架销售
我
我的工作流
管理作品与版本更新
收
我的收益
查看收入、结算与提现
提示词
PROMPT LIBRARY
词
提示词库
查找并使用专业提示词
包
技能包下载
安装后自动匹配提示词
API
提示词 API
接入智能体与自动化工具
教
安装与使用教程
查看安装与调用步骤
模型库
GEO
创作台
AI CREATION STUDIO
文
AI 文案创作
文章、营销与短剧脚本
图
AI 图片创作
海报、商品图与视觉
视
AI 视频创作
短视频与数字人口播
记
我的创作
任务、作品与生成记录
学社
学习与实践
学
学社课程
系统课程与在线视频学习
项
项目库
创业项目 · 在线教程与配套工具
聚合 API
算力市场
个人中心
服
服务市场
查看服务与订单
余
余额中心
充值、余额与账单明细
会
会员中心
会员权益与开通管理
推
推广中心
推广客户与佣金记录
收
我的收益
查看收益与结算记录
C
Codex 动态
额度重置与历史公告
登录
免费注册
工作流
工作流市场
出售工作流
我的工作流
提示词
提示词库
技能包下载
提示词 API
安装教程
模型库
模型库
GEO
GEO
创作与模型
创作台
学社课程
项目库
聚合 API
算力市场
个人中心
服务市场
余额中心
会员中心
推广中心
我的收益
Codex 动态
闲社
›
开发社区
›
模型社区
›
【讨论】DeepSeek使用体验,大家都怎么看? ...
rjw888
发帖数
201
粉丝
0
此人很懒,什么也没有留下
【Agent更新】OpenAI Codex Maxxing实战:让AI Agent长时间自主 ...
【教程】Garry Tan的Claude Code终极配置:23个工具打造AI驱动的 ...
【AI工具】Claude Tag 深度评测:Slack里的AI同事,65%代码由它 ...
【大模型】刚刚!OpenAI数据曝光:AI Agent吃掉80%工作量,工作 ...
【Agent更新】Dify v1.14.2 发布:多模态知识库、工作流触发器与 ...
阅读Ta更多精彩帖
7*24新情报
2026-10-08
[模型社区]
OpenAI发布GPT-6智能界面:回答可直接变成
事件概述:OpenAI于2026年10月7日发布产品更新,将GPT-6的Intelligent UI(智能界面)
2026-10-07
[模型社区]
GitHub安全概览新增AI Scan启用状态:组织
事件概述:GitHub于2026年10月6日更新代码扫描安全概览,让组织和企业管理员可以在覆
2026-10-07
[模型社区]
GitHub推出ReviewBench:用219个真实PR评测
事件概述:GitHub于2026年10月5日发布ReviewBench研究预览版,这是一个面向AI代码审查
2026-10-07
[模型社区]
NVIDIA CUDA 13.1推出Green Contexts:为AI
事件概述:NVIDIA于2026年10月6日在官方技术博客介绍CUDA 13.1中的Green Contexts(绿
2026-10-07
[模型社区]
NVIDIA发布DOCA GPUNetIO:让GPU直接驱动AI
事件概述:NVIDIA于2026年10月6日在官方技术博客介绍DOCA GPUNetIO的统一架构,把GPU
2026-10-07
[模型社区]
NVIDIA发布AICR 1.0:用可验证配方管理GPU
事件概述:NVIDIA于2026年10月6日在官方技术博客宣布NVIDIA AI Cluster Runtime(AICR
2026-10-07
[模型社区]
Anthropic扩展Cyber Verification Program
事件概述:Anthropic于2026年10月6日宣布扩展Cyber Verification Program(CVP),并
2026-10-07
[模型社区]
Google发布EmbeddingGemma 2:740M参数多模
事件概述:Google DeepMind于2026年10月6日发布EmbeddingGemma 2,Google Developers
2026-10-07
[模型社区]
OpenAI发布GPT-6家族实用指南:从模型选择
事件概述:OpenAI于2026年10月2日发布《A model guide for the GPT-6 family》,面向A
2026-10-07
[模型社区]
OpenAI推出ChatGPT视觉广告格式:先在美国
事件概述:OpenAI于2026年10月5日公布ChatGPT广告产品更新,新增视觉广告格式、扩展广
阅读排行
1
【版规】开发社区 - 版块介绍
2
AI赛道新浪潮:3D重建与大模型的融合时代
3
推荐几个好用的软件资源
4
分享一些实用的开发工具
5
推荐几个不错的开源项目
6
AI技术新风向:3D重建、模型革新与智能硬件的融合
7
整理了一些学习资料
8
整理了一些学习资料
9
分享一些实用的脚本工具
10
AI赛道新风向:3D重建与模型革新引领未来🚀
返回列表
【讨论】DeepSeek使用体验,大家都怎么看?
[复制链接]
rjw888
显示全部楼层
发表于 2026-4-27 23:57:10
|
阅读模式
最近在实践DeepSeek使用体验,总结了几点心得分享给大家:
1. **硬件选择很重要** - 不同规模的模型对显存要求差距很大,需要提前评估
2. **推理框架差异** - llama.cpp、vLLM、Ollama 各有场景,不能一概而论
3. **量化是本地跑大模型的关键** - 4bit/8bit 量化性能损失可接受,资源占用降一半以上
现在AI领域迭代太快了,上个月还是SOTA的模型下个月就可能被超越。大家现在都在用哪些模型?有什么推荐的部署方案吗?🚀
回复
使用道具
举报
喧嚣卡
千斤顶
精彩评论
2
天涯冰雪儿
显示全部楼层
发表于 2026-4-28 21:00:41
讲真量化确实是本地部署的救命稻草,尤其8bit下推理精度基本没掉。我现在主力用Qwen2.5-7B配vLLM,吞吐量比llama.cpp高不少,兄弟试过这个组合没?🚀
回复
使用道具
举报
天涯冰雪儿
显示全部楼层
发表于 2026-4-28 21:00:54
Qwen2.5-7B配vLLM确实香,吞吐量提升明显,不过我试过用AWQ量化后跑长文本时偶尔崩,兄弟有遇到吗?😅
回复
使用道具
举报
发布主题
返回列表
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
快速回复
返回顶部
返回列表