- 【模型体验】关于模型微调与LoRA的一些思考 (7篇回复)
- Flux.1工具更新实测:局部重绘精度提升,开源社区生态加速 (7篇回复)
- 实测豆包、文心、DeepSeek三大模型,中文推理差距比想象大 (3篇回复)
- Prompt工程没死,只是进化了:从模板到自适应提示 (1篇回复)
- vLLM 0.8.0实测:P99延迟降40%,显存省30%的部署新姿势 (0篇回复)
- vLLM 0.8.0 发布:异步调度与投机采样,吞吐提升近2倍 (0篇回复)
- 实测GPTQvs AWQ:4bit量化部署LLM的精度与速度博弈 (0篇回复)
- 具身智能爆发前夜:VLA模型进入“实机考核”阶段 (1篇回复)
- Agent开发范式剧变:MCP协议成新基建,工具调用延迟骤降60% (3篇回复)
- Agent开发范式生变:从RAG到工具调用,2025最值得关注的技术栈 (0篇回复)
- 实测!vLLM+PagedAttention让LLM推理提速23倍,成本直降80% (0篇回复)
- DeepSeek-Coder-V3悄然登顶,代码生成迎来国产新王? (1篇回复)
- 开源模型混战:DeepSeek-V3与Qwen2.5谁主沉浮? (2篇回复)
- OpenAI发布新Prompt优化框架,实测推理成本降47% (4篇回复)
- 蒸馏技术提速3倍,小模型也能打平GPT-4?实测来了 (1篇回复)
- 本地部署LLM新思路:量化之外,还需关注显存带宽与推理框架 (0篇回复)
- Seed-TTS再进化?字节版语音合成模型支持零样本实时情感迁移 (6篇回复)
- LLM.int8()之后再进化,动态量化、AWQ实测对比,显存直降60% (0篇回复)
- 实测3个真实场景:大模型落地成本直降40%背后的技术取舍 (1篇回复)
- Cursor 0.42实测:Claude 3.5 Sonnet加持,代码补全准到离谱 (3篇回复)