首页 > 资讯 > DeepSeek V4.1 Flash开始限时内测:新架构、原生多模态

DeepSeek V4.1 Flash开始限时内测:新架构、原生多模态

36氪文章 2026-09-08 19:15 2 阅读 查看原文

9月8日下午,DeepSeek在官方交流群中开启 DeepSeek V4.1 Flash中间版本内测。根据官方群内通知,新模型采用了新的模型结构,原生支持多模态,同时在能力、速度和成本上进一步优化。

目前,这并不是一次正式公开发布。腾讯科技查询发现,截至发稿,DeepSeek官网、API官方文档和Change Log中均尚未出现V4.1 Flash的正式发布记录,公开API文档目前列出的仍是DeepSeek-V4-Flash-0731、DeepSeek-V4-Pro-0813和此前上线的DeepSeek-V4-Flash-Vision-Exp。

根据DeepSeek官方交流群给出的调用方式,开发者无需修改原来的 base_url,只需将模型名称改为:deepseek-v4.1-flash-expires-on-0910即可调用。

目前该模型计费方式与 deepseek-v4-flash 相同,每个账号最多支持20路并发。

模型ID中的“expires-on-0910”也意味着,这可能是一个将在9月10日到期的临时测试端点。从目前的信息来看,DeepSeek此次更像是在正式版本确定之前,把一个中间checkpoint放入真实API环境中进行短期测试。

更值得关注的是,DeepSeek第一次明确提到:新的模型结构和原生多模态。

01、从外挂Vision,到原生多模态

DeepSeek实际上已经提前为多模态铺了路。

8月21日,DeepSeek正式上线了实验模型 DeepSeek-V4-Flash-Vision-Exp。根据DeepSeek官方Change Log,这个模型可以同时接受图片和文本输入,也是V4 Flash系列第一次正式具备视觉理解能力。

不过,当时的处理方式仍然相对独立。

DeepSeek目前的API文档把 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 列成两个单独的模型。其中,前者对应DeepSeek-V4-Flash-0731,后者才支持图片输入。

DeepSeek官方当时也明确表示,Vision Exp在纯文本Agent、推理和知识能力上与普通V4 Flash基本相当,主要提升来自需要视觉理解的Agent任务。官方称,在这类任务上,多模态Agent能力已经“接近Opus 4.8”。

这和V4.1 Flash此次透露出的信息存在明显区别。

DeepSeek在内测通知中使用的是“原生多模态支持”,同时强调“采用了新的模型结构”。如果最终正式版本延续这一设计,就意味着DeepSeek可能正在把此前相对独立的视觉能力进一步整合进基础模型,而不再只是给V4 Flash额外提供一个Vision实验版本。

不过,目前DeepSeek尚未公布V4.1 Flash的技术报告、参数规模、架构细节和benchmark,因此还不能据此判断具体采用了什么多模态架构,也不能确认它与现有V4 Flash-Vision-Exp之间的技术继承关系。

“新架构”究竟新在哪里,目前仍然是这次内测留下的最大悬念。

02、V4 Flash刚刚才更新一个多月

V4.1 Flash出现的速度也相当快。DeepSeek在今年4月24日正式推出V4系列,提供V4 Pro和V4 Flash两个版本。

7月31日,DeepSeek又更新了V4 Flash。当前API中的 deepseek-v4-flash 实际对应 DeepSeek-V4-Flash-0731

但这一次升级并没有改变模型底层架构。DeepSeek在官方Change Log中专门注明,V4-Flash-0731与此前V4-Flash-Preview保持相同的模型架构和模型规模,只重新进行了Post-training

尽管没有更换底座,这次后训练仍然大幅加强了Agent能力。DeepSeek公布的测试中,V4 Flash在Terminal Bench 2.1上达到82.7,NL2Repo为54.2,DeepSWE为54.4,Toolathlon Verified达到70.3。

半个月之后,DeepSeek又在8月13日推出正式版V4 Pro;8月21日进一步补上V4 Flash Vision Exp。

也就是说,从7月底至今一个多月时间里,DeepSeek已经连续完成了 V4 Flash更���、V4 Pro正式版、V4 Flash Vision Exp 三次模型调整。现在出现的V4.1 Flash内测版本,可能改变模型架构。

03、Flash可能正在变得越来越重要

还有一个细节值得关注。在DeepSeek官方内测反馈问卷中,DeepSeek直接询问测试用户:

“DeepSeek V4.1 Flash中间版本能否全面替换线上的DeepSeek V4 Pro?”

当前DeepSeek把V4系列分成Flash和Pro两条产品线。按照官方API价格,V4 Flash的成本明显低于V4 Pro。

以峰值时段为例,目前V4 Flash每百万tokens缓存未命中输入价格为 0.44美元,输出为 1.32美元;V4 Pro分别为 1.32美元和3.96美元,正好约为Flash的3倍。非高峰时段价格再减半。

目前V4.1 Flash内测仍然按照现有V4 Flash收费。如果这一版本能够在维持Flash定价的同时接近现有Pro的表现,它可能为部分使用Pro的开发者提供新的选择。实际替代效果仍需测试验证。

本文来自微信公众号“腾讯科技”,作者:晓静,36氪经授权发布。