- K8s+GPU调度再升级,大模型推理成本直降40%的实战路径 (3篇回复)
- K8s+GPU调度新突破:vLLM推理吞吐提升40%实战解析 (5篇回复)
- 端侧小模型部署新突破:4GB内存跑起7B量化模型 (1篇回复)
- vLLM 0.8 性能翻倍,AI 推理部署该换技术栈了 (0篇回复)
- Figure 02进厂打工,端到端大模型如何重塑具身智能? (0篇回复)
- 量化新范式:FP8训练+INT4推理,大模型部署成本再降40% (1篇回复)
- DeepSeek-V3发布:推理成本直降60%,国产大模型掀起价格战 (0篇回复)
- 昆仑万维开源Skywork-13B:MoE架构新突破,推理成本直降50% (3篇回复)
- Stable Diffusion 3技术细节公开:20亿参数实现精准文字渲染 (2篇回复)
- OpenAI发布Agent工具包,函数调用和状态管理迎来大改版 (1篇回复)
- 实测GPT-4o与Claude 3.5上下文窗口:长文本处理差距比参数更明显 (0篇回复)
- Figure 02进厂打工,具身智能的ChatGPT时刻来了? (4篇回复)
- MLPerf推理最新成绩出炉:量化模型霸榜,INT8性能翻倍成标配 (1篇回复)
- 语音合成新SOTA逼近人声,零样本克隆只需3秒音频 (1篇回复)
- ChatTTS 7B开源引爆社区:零样本复刻音色,推理延迟低至200ms (0篇回复)
- 大模型API接入成本骤降60%,这些技术细节值得关注 (2篇回复)
- Qwen2.5登顶开源榜,选型别只看跑分还要看这三点 (1篇回复)
- DeepSeek-V3上线后,MoE架构的“省钱”真相与推理优化实测 (3篇回复)
- LoRA微调不吃香了?新研究曝出四大致命伤,替代方案已出现 (0篇回复)
- 语音合成卷疯了!多模态大模型已能克隆任何人的声音 (1篇回复)