闲社

标题: DeepSeek发布V4.1 Flash:原生视觉与API迁移提醒 [打印本页]

作者: tyson    时间: 14 小时前
标题: DeepSeek发布V4.1 Flash:原生视觉与API迁移提醒
事件概述

DeepSeek 于 2026 年 9 月 10 日正式发布 DeepSeek-V4.1-Flash,并在 API 提供原生多模态能力。官方新闻页标注的发布日期为 9 月 10 日;旧 Pro 接口切换则是另一个时间点:北京时间 9 月 14 日 12:00。本文于 9 月 16 日核实。

模型与开发者

模型:DeepSeek-V4.1-Flash;开发者:DeepSeek。官方模型卡说明,它可以同时处理图像和文本、输出文本,支持最高百万 Token 上下文;仓库及模型权重采用 MIT 许可。

关键改动

该版本采用因果编码器—解码器架构,将输入处理和输出生成分开。官方模型卡列出预填充与解码阶段分别激活 8B 和 16B 参数,并通过跨层缓存复用与压缩降低长上下文缓存负担。这些是官方架构说明,不等于闲社完成了独立性能测试。

API 推荐模型名为 deepseek-flash。旧的 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 暂时作为兼容入口转向 V4.1 Flash;自上述 9 月 14 日切换时间起,deepseek-v4-pro 也转向该模型,直至未来 V4.1 Pro 上线。

适用对象与实际影响

适合评估图文理解、长资料处理和工具调用的开发团队。对已有应用,值得优先检查的是实际服务模型是否改变:即使代码仍填写旧模型名,输出风格、延迟和任务成功率也可能变化。建议用既有业务样本做回归测试,再调整调用配置。

限制与接入注意

官方发布的基准结果取决于推理强度及智能体运行框架,不能直接视作所有场景的效果承诺。开放权重也不代表普通电脑可轻松部署。模型卡特别说明,本次不提供 Jinja 格式聊天模板,接入方应参考官方编码实现;模型推理、工具执行和网络传输仍需自行集成。

官方来源

DeepSeek 发布公告(2026-09-10)

DeepSeek 官方模型卡与权重




欢迎光临 闲社 (https://www.xianshe.com/) Powered by Discuz! X5.0