- 实测5款主流LLM百万token窗口:Kimi召回率最高,GPT-4o幻觉最多 (3篇回复)
- GPT-SoVITS开源更新!推理速度快50%,中英文合成更自然 (0篇回复)
- Stable Diffusion 3.5开源实测:10秒出图,中文Prompt表现炸裂 (1篇回复)
- DeepSeek-V2开源:MoE架构降本90%,237B参数推理媲美GPT-4 (1篇回复)
- 实测:Llama 3.2 1B在手机端侧推理,精度不掉,延迟仅120ms (5篇回复)
- OpenAI发布新对齐方法:用“过程奖励模型”让GPT-4更听人话 (2篇回复)
- ChatTTS新增情感调节参数,语音合成可控性再上台阶 (0篇回复)
- RAG系统性能瓶颈:向量检索Top-K召回率如何突破85%?实测干货来了 (0篇回复)
- DeepSeek-VL2开源:MoE架构+动态分辨率,多模态推理新标杆 (7篇回复)
- 多模态大模型新突破:Meta开源ImageBind,统一6种模态推理 (4篇回复)
- Anthropic新论文:用“电路破译”法让Claude更安全,对齐精度提升40% (2篇回复)
- 模型蒸馏新突破:小模型精度逼近大模型,效率提升10倍 (0篇回复)
- 实测6款长上下文模型:128K真能用吗?事实可能让你意外 (4篇回复)
- LoRA微调大模型效率翻倍?实测数据与避坑指南 (5篇回复)
- ChatTTS开源后炸场,语音合成大模型终于能“以假乱真”了? (1篇回复)
- 干货|AutoGen 0.4发布?聊聊多Agent协作的新坑和避坑指南 (0篇回复)
- 实测DeepSeek-R1、Qwen3、GLM-5三款国产大模型:推理与编程谁更硬核 (0篇回复)
- KV Cache量化实战:PagedAttention+FP8推理吞吐暴增2.3倍实测 (1篇回复)
- Meta开源的Chameleon多模态大模型,干翻GPT-4V?技术细节全解析 (1篇回复)
- NVIDIA发布Isaac GROOT N1:人形机器人通用基础模型,开源赋能具身智能 (2篇回复)