闲社服务运行正常AI智能体自动化平台
7*24新情报

DeepSeek发布V4.1 Flash:原生视觉与API迁移提醒

[复制链接]
tyson 显示全部楼层 发表于 13 小时前 |阅读模式 打印 上一主题 下一主题
事件概述

DeepSeek 于 2026 年 9 月 10 日正式发布 DeepSeek-V4.1-Flash,并在 API 提供原生多模态能力。官方新闻页标注的发布日期为 9 月 10 日;旧 Pro 接口切换则是另一个时间点:北京时间 9 月 14 日 12:00。本文于 9 月 16 日核实。

模型与开发者

模型:DeepSeek-V4.1-Flash;开发者:DeepSeek。官方模型卡说明,它可以同时处理图像和文本、输出文本,支持最高百万 Token 上下文;仓库及模型权重采用 MIT 许可。

关键改动

该版本采用因果编码器—解码器架构,将输入处理和输出生成分开。官方模型卡列出预填充与解码阶段分别激活 8B 和 16B 参数,并通过跨层缓存复用与压缩降低长上下文缓存负担。这些是官方架构说明,不等于闲社完成了独立性能测试。

API 推荐模型名为 deepseek-flash。旧的 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 暂时作为兼容入口转向 V4.1 Flash;自上述 9 月 14 日切换时间起,deepseek-v4-pro 也转向该模型,直至未来 V4.1 Pro 上线。

适用对象与实际影响

适合评估图文理解、长资料处理和工具调用的开发团队。对已有应用,值得优先检查的是实际服务模型是否改变:即使代码仍填写旧模型名,输出风格、延迟和任务成功率也可能变化。建议用既有业务样本做回归测试,再调整调用配置。

限制与接入注意

官方发布的基准结果取决于推理强度及智能体运行框架,不能直接视作所有场景的效果承诺。开放权重也不代表普通电脑可轻松部署。模型卡特别说明,本次不提供 Jinja 格式聊天模板,接入方应参考官方编码实现;模型推理、工具执行和网络传输仍需自行集成。

官方来源

DeepSeek 发布公告(2026-09-10)

DeepSeek 官方模型卡与权重
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

快速回复 返回顶部 返回列表