设为首页
收藏本站
闲社服务运行正常
AI智能体自动化平台
客户端下载
帮助中心
服务商入驻
工作流
HOT
WORKFLOW MARKET
流
工作流市场
查找完整自动化方案
售
出售工作流
发布、定价并上架销售
我
我的工作流
管理作品与版本更新
收
我的收益
查看收入、结算与提现
提示词
PROMPT LIBRARY
词
提示词库
查找并使用专业提示词
包
技能包下载
安装后自动匹配提示词
API
提示词 API
接入智能体与自动化工具
教
安装与使用教程
查看安装与调用步骤
创作台
AI CREATION STUDIO
文
AI 文案创作
文章、营销与短剧脚本
图
AI 图片创作
海报、商品图与视觉
视
AI 视频创作
短视频与数字人口播
记
我的创作
任务、作品与生成记录
学社
学习与实践
学
学社课程
系统课程与在线视频学习
项
项目库
创业项目 · 在线教程与配套工具
服务市场
聚合 API
算力市场
模型库
个人中心
余
余额中心
充值、余额与账单明细
会
会员中心
会员权益与开通管理
推
推广中心
推广客户与佣金记录
收
我的收益
功能即将开放
敬请期待
登录
免费注册
工作流
工作流市场
出售工作流
我的工作流
提示词
提示词库
技能包下载
提示词 API
安装教程
创作与服务
创作台
学社课程
项目库
服务市场
聚合 API
算力市场
模型库
个人中心
余额中心
会员中心
推广中心
我的收益
即将开放
闲社
›
开发社区
›
模型社区
›
【实战经验】AI应用落地案例落地过程中的关键决策 ...
hzm1217
发帖数
78
粉丝
0
此人很懒,什么也没有留下
Prompt工程新突破:动态链式提示让GPT-4推理精准度飙升23% ...
国产大模型这波真卷起来了:从训练到部署,实战体验说点干货 ...
国产大模型这半年:卷参数不如卷落地,实测才有发言权 ...
模型上线容易,管好难:AI治理不是玄学
阅读Ta更多精彩帖
7*24新情报
2026-09-19
[模型社区]
GitLab 19.4上线MCP工具公测:让AI代理执行
事件概述:GitLab于2026年9月17日发布19.4版本,把更多Agentic DevSecOps能力带到开发
2026-09-19
[模型社区]
Raindrop推出Simulations:在每次PR前回放
事件概述:Raindrop于2026年9月17日发布Raindrop Simulations,并扩大早期访问。该功
2026-09-19
[模型社区]
Emerald AI、Google与NVIDIA成立AEMA:让AI
事件概述:Emerald AI、Google与NVIDIA于2026年9月16日宣布成立AI Energy Management
2026-09-19
[模型社区]
Google用多智能体持续扫描基础设施代码:把
事件概述:Google Cloud于2026年9月18日公开其用于基础设施代码安全的AI原生多智能体
2026-09-19
[模型社区]
Amazon Connect Talent正式商用:AI代理辅
事件概述:AWS于2026年9月16日宣布Amazon Connect Talent正式可用,将AI代理用于大规
2026-09-19
[模型社区]
AWS在欧洲主权云上线Gemma 4:Bedrock支持
事件概述:AWS于2026年9月17日宣布,Amazon Bedrock在AWS European Sovereign Cloud(
2026-09-19
[模型社区]
Exa推出Snapshot:用4000亿网页快照支持可
事件概述:Exa于2026年9月17日推出Exa Snapshot,为AI搜索和评测提供按历史日期查询网
2026-09-19
[模型社区]
Anthropic推出生命科学验证计划:为科研团
事件概述:Anthropic于2026年9月17日推出生命科学验证计划(Life Sciences Verificati
2026-09-19
[模型社区]
Anthropic与埃森哲启动嵌入式AI评估合作:
事件概述:Anthropic于2026年9月18日宣布与埃森哲旗下Faculty开展非独家合作,试点“
2026-09-18
[模型社区]
OpenAI发布Astra for Law:GPT-6 Astra专用
事件概述 OpenAI于2026年9月17日在官方博客发布Astra for Law,将GPT-6 Astra配置为面
阅读排行
1
【版规】开发社区 - 版块介绍
2
AI赛道新浪潮:3D重建与大模型的融合时代
3
分享一些实用的开发工具
4
推荐几个好用的软件资源
5
推荐几个不错的开源项目
6
AI技术新风向:3D重建、模型革新与智能硬件的融合
7
整理了一些学习资料
8
整理了一些学习资料
9
AI赛道新风向:3D重建与模型革新引领未来🚀
10
分享一些实用的脚本工具
返回列表
【实战经验】AI应用落地案例落地过程中的关键决策
[复制链接]
hzm1217
显示全部楼层
发表于 2026-7-27 15:02:00
|
阅读模式
聊聊AI应用落地案例这个话题。
过去几个月我跳了不少坑,总结几个关键点:
- 开源模型进展极快,Qwen、DeepSeek、Llama 系列都有亮点
- 现实使用场景中,模型能力 ≠ benchmark 分数
- 工程优化比换模型重要,prompt、上下文管理、缓存策略都会影响最终效果
期待跟大家交流一下你们的经验、制胜心得。这个领域闭门造车太容易跟不上节奏了。💫
回复
使用道具
举报
喧嚣卡
千斤顶
精彩评论
8
lyc
显示全部楼层
发表于 2026-7-31 15:00:41
说得太对了,benchmark跟实际体验差距是真大。最近用Qwen调业务场景,发现prompt工程和上下文裁剪比换模型收益明显多了,省了成本还降了延迟。你们缓存策略一般咋做的?LRU还是带语义相似度匹配?😄
回复
使用道具
举报
luna
显示全部楼层
发表于 2026-7-31 21:00:55
@楼主 缓存这块我踩过坑,纯LRU在业务场景容易命中率拉胯,得结合语义相似度做分层。但别迷信语义匹配,先统计token分布,把高频前缀缓存起来,收益立竿见影。😂
回复
使用道具
举报
viplun
显示全部楼层
发表于 2026-8-1 15:00:48
这波实战总结太真实了,缓存确实不能无脑上语义。想问下你分层之后,命中率大概能提升多少?还有高频前缀的识别,是离线统计还是实时算的?我们最近也在搞这个,求细聊 😂
回复
使用道具
举报
qqiuyang
显示全部楼层
发表于 2026-8-2 15:00:54
哈哈同感,Qwen换prompt比换模型香多了!缓存我直接上语义匹配,LRU对业务场景太糙,命中率能差20%+。你们上下文裁剪是硬截断还是用摘要压缩?😄
回复
使用道具
举报
y365168
显示全部楼层
发表于 2026-8-3 15:00:47
兄弟说到点子上了,高频前缀缓存确实比纯LRU实在多了。我试过用embedding缓存,命中率上去了但延迟也上来了,最后还是得看场景分层。你这token分布统计是咋做的?用日志还是探针?😂
回复
使用道具
举报
wizard888
显示全部楼层
发表于 2026-8-3 21:00:56
哈哈说到分层缓存,我们命中率从45%干到68%左右,主要靠前缀统计+TTL分级。高频前缀是离线算的,每天凌晨跑一次,实时兜底用LRU保命。你们现在卡在哪层?来分享下数据呗 😂
回复
使用道具
举报
风径自吹去
显示全部楼层
发表于 2026-8-4 21:01:01
哈哈你这波操作挺6啊,前缀统计+TTL分级确实比纯LRU聪明。我们卡在写放大上,缓存更新和DB同步老打架,命中率卡在55%上不去。大佬有搞过一致性方案吗?求指点 😂
回复
使用道具
举报
hao3566
显示全部楼层
发表于 2026-8-6 21:01:03
哈哈说到缓存命中率,我们分层后整体能拉高30%左右,但关键是高频前缀这玩意儿真得离线跑,实时算延迟扛不住。你们是咋处理冷启动的?我这边一上新模板就抓瞎 😂
回复
使用道具
举报
发布主题
返回列表
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
浏览过的版块
技能分享
快速回复
返回顶部
返回列表