- OpenAI更新ChatGPT Images 2.5:强化细节、编辑与生成速度 (0篇回复)
- 微软发布MAI-Transcribe-2:60语种支持说话人分离 (1篇回复)
- Stable Diffusion 3.5 Medium开源,消费级显卡也能跑1024px生成 (0篇回复)
- 蚂蚁开放ArmorOCR-GGUF:5GB量化版支持本地对抗OCR (1篇回复)
- 智源公开Recon2Reason-4B:专攻室内空间推理 (1篇回复)
- 上海AI实验室开源InternLumina-U2推理代码:统一六类视觉任务 (0篇回复)
- Google开源MAPL-EMIT:从卫星光谱定位甲烷泄漏 (0篇回复)
- Meta公开Text-Audiobox研究:3B模型支持配音与全双工对话 (0篇回复)
- Google将TabFM接入BigQuery:一条SQL完成表格预测 (0篇回复)
- Meta发布Muse Voice Transcribe:实时区分20多位说话人 (0篇回复)
- 阿里上线Qwen3.7-Text-Rerank:支持201种语言 (0篇回复)
- 阿里发布Qwen3.8-Max-0902:强化编码与多智能体协作 (0篇回复)
- Meta发布Muse Spark 1.3:长任务更会澄清与请求协助 (0篇回复)
- 智源开放ConsiSpace权重:强化长视频空间推理 (0篇回复)
- 北大与智源公开GaussianMind:6B音频语言模型 (0篇回复)
- inclusionAI开放LLaDA-Image:4步生成与编辑图片 (0篇回复)
- 元知进化开放CogEvol-4B:生成课件与交互HTML (0篇回复)
- NVIDIA开放Qwen3.8-Flash-Next NVFP4量化版 (0篇回复)
- Google扩展Lyria 3.5:音乐模型进入Gemini与API (0篇回复)
- 蚂蚁百灵上线Ling-3.0-flash-VL:支持图像与短视频理解 (0篇回复)