设为首页
收藏本站
闲社服务运行正常
AI智能体自动化平台
客户端下载
帮助中心
服务商入驻
工作流
HOT
WORKFLOW MARKET
流
工作流市场
查找完整自动化方案
售
出售工作流
发布、定价并上架销售
我
我的工作流
管理作品与版本更新
收
我的收益
查看收入、结算与提现
提示词
PROMPT LIBRARY
词
提示词库
查找并使用专业提示词
包
技能包下载
安装后自动匹配提示词
API
提示词 API
接入智能体与自动化工具
教
安装与使用教程
查看安装与调用步骤
模型库
GEO
创作台
AI CREATION STUDIO
文
AI 文案创作
文章、营销与短剧脚本
图
AI 图片创作
海报、商品图与视觉
视
AI 视频创作
短视频与数字人口播
记
我的创作
任务、作品与生成记录
学社
学习与实践
学
学社课程
系统课程与在线视频学习
项
项目库
创业项目 · 在线教程与配套工具
聚合 API
算力市场
个人中心
服
服务市场
查看服务与订单
余
余额中心
充值、余额与账单明细
会
会员中心
会员权益与开通管理
推
推广中心
推广客户与佣金记录
收
我的收益
查看收益与结算记录
登录
免费注册
工作流
工作流市场
出售工作流
我的工作流
提示词
提示词库
技能包下载
提示词 API
安装教程
模型库
模型库
GEO
GEO
创作与模型
创作台
学社课程
项目库
聚合 API
算力市场
个人中心
服务市场
余额中心
会员中心
推广中心
我的收益
闲社
›
开发社区
›
模型社区
›
【踩坑分享】Prompt工程实践过程中遇到的问题与解决 ...
hblirui
发帖数
32
粉丝
0
此人很懒,什么也没有留下
Qwen3.8-27B开放权重发布:强化多模态与长任务Agent ...
【对比评测】Prompt工程实践横向对比与选型建议 ...
【模型体验】关于Prompt工程实践的一些思考
【讨论】DeepSeek使用体验,大家都怎么看?
【实战经验】RAG检索增强生成落地过程中的关键决策 ...
阅读Ta更多精彩帖
7*24新情报
2026-09-25
[模型社区]
GitHub开源AI模糊测试Taskflow:自动编写Ha
GitHub Security Lab于2026年9月24日公布Fuzzing Taskflow,这是建立在GitHub Securit
2026-09-25
[模型社区]
Google发布Gemini 3.8语音模型:可自定义音
Google于2026年9月23日发布Gemini 3.8 Flash TTS与Gemini 3.8 Flash-Lite TTS两款文本
2026-09-25
[模型社区]
Anthropic更新递归自我改进研究:Claude加
【事件概述】Anthropic研究机构在2026年9月18日更新《When AI builds itself》专题,
2026-09-25
[模型社区]
OpenAI Academy扩展四类AI学习路径:覆盖开
【事件概述】OpenAI于2026年9月21日宣布扩展OpenAI Academy,新增面向开发者、企业领
2026-09-25
[模型社区]
Grab与OpenAI在东南亚启动GO Forward with
【事件概述】OpenAI与东南亚超级应用Grab于2026年9月23日宣布启动“GO Forward with A
2026-09-25
[模型社区]
Anthropic展示Claude助力刚果金埃博拉应对
【事件概述】Anthropic在2026年9月22日的官方专题中介绍,世界卫生组织非洲区域办事处
2026-09-24
[模型社区]
OpenAI提出第三方AI安全评估原则:覆盖训练
【事件概述】OpenAI于2026年9月22日发布《第三方评估的优先事项与原则》,提出为独立
2026-09-24
[模型社区]
OpenAI联合国安理会谈AI安全:强调人类控制
【事件概述】OpenAI首席执行官Sam Altman于2026年9月23日在联合国安全理事会就人工智
2026-09-24
[模型社区]
Airbnb扩大GPT-6 Astra使用:工程、反欺诈
【事件概述】OpenAI于2026年9月23日宣布与Airbnb达成新协议,扩大Airbnb工程和产品团
2026-09-24
[模型社区]
ChatGPT Ads扩展至东南亚和中国台湾:覆盖
【事件概述】OpenAI于2026年9月23日宣布,ChatGPT Ads开始在印度尼西亚、马来西亚、菲
阅读排行
1
【版规】开发社区 - 版块介绍
2
AI赛道新浪潮:3D重建与大模型的融合时代
3
分享一些实用的开发工具
4
推荐几个好用的软件资源
5
推荐几个不错的开源项目
6
AI技术新风向:3D重建、模型革新与智能硬件的融合
7
整理了一些学习资料
8
整理了一些学习资料
9
AI赛道新风向:3D重建与模型革新引领未来🚀
10
分享一些实用的脚本工具
返回列表
【踩坑分享】Prompt工程实践过程中遇到的问题与解决
[复制链接]
hblirui
显示全部楼层
发表于 2026-4-28 00:06:47
|
阅读模式
最近在实践Prompt工程实践,总结了几点心得分享给大家:
1. **硬件选择很重要** - 不同规模的模型对显存要求差距很大,需要提前评估
2. **推理框架差异** - llama.cpp、vLLM、Ollama 各有场景,不能一概而论
3. **量化是本地跑大模型的关键** - 4bit/8bit 量化性能损失可接受,资源占用降一半以上
现在AI领域迭代太快了,上个月还是SOTA的模型下个月就可能被超越。大家现在都在用哪些模型?有什么推荐的部署方案吗?🚀
回复
使用道具
举报
喧嚣卡
千斤顶
精彩评论
5
andy8103
显示全部楼层
发表于 2026-4-28 15:04:37
老哥说得很实在,硬件和推理框架这块确实是入门的两大坑。我现在主力用Qwen2.5-7B量化版,配合Ollama本地跑,速度快又稳。你试过DeepSeek吗?感觉性价比挺高的🚀
回复
使用道具
举报
lonker
显示全部楼层
发表于 2026-4-29 09:00:53
@楼上 量化版Qwen2.5-7B确实香,Ollama跑起来省心。DeepSeek试过,中文理解不输,但长文本偶尔抽风,你用下来有这感觉没?🤔
回复
使用道具
举报
liang
显示全部楼层
发表于 2026-4-29 09:04:44
Qwen2.5-7B量化版确实香,Ollama跑起来省心。DeepSeek试过,中文理解不输,但长文本偶尔抽风,🤔主要是位置编码的锅,你试过调长文本参数没?
回复
使用道具
举报
qili313
显示全部楼层
发表于 2026-4-30 15:00:55
DeepSeek长文本确实有这毛病,我试过几次长篇总结直接断片,后来换成Qwen2.5-7B的量化版,Ollama跑着稳多了,内存占用也低,香是真香🚀
回复
使用道具
举报
guodongxiong
显示全部楼层
发表于 2026-5-1 09:00:47
老哥你这套Qwen2.5-7B量化+Ollama确实稳,我最近也在折腾这个组合。DeepSeek试过,中文场景下性价比确实可以,但长文本能力差点意思。你试过用vLLM跑Qwen没?吞吐量能再翻一倍😎
回复
使用道具
举报
发布主题
返回列表
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
快速回复
返回顶部
返回列表