DeepSeek V4.1 Flash来了,原生多模态,同价!更强!
今天刚下完班,就看见了这条DeepSeek的消息,V4.1 Flash 这两天在内测了。没有发布会,没有预热海报,只是在官方的交流群里通知了一声,开发者把模型名一改就能用。
先说这是个啥
V4.1 Flash,名字看着像 V4-Flash 的小版本升级,但是里子是换过的。按照官方的说法,就是采用了新的模型结构,原生多模态支持,能力更强、速度更快、成本更低。

原生多模态
这次升级里,阁主最在意的就是原生多模态这四个字。
DeepSeek 家之前是纯LLM语言大模型,是没有看图能力的,在8月21日上线的 V4-Flash-Vision-Exp 就是干这个的,等于在 V4-Flash 的底子上接了一个视觉编码器,
V4.1 Flash 不一样,多模态是出厂自带的。文字和图片混在一起,模型自己就可以理解了,这也是Deepseek第一次来。
对跑 Agent 的人来说是实打实的刚需。Agent 要读网页截图、读软件界面、读图表,读完接着调工具干活,大模型不理解图片的话,你要手动去描述,比如一个bug,你要复制bug给大模型,以后只需要截个图,让AI自己去识别理解就可以了。
怎么用上
接入非常简单,base_url 都不用动,把模型名改一下就行。
deepseek-v4.1-flash-expires-on-0910
只不过这次内测到9月10日就结束了,接口下线,之后应该离正式上线不久了吧。
这次内测价格计费跟 V4-Flash 一致,但有一个数字要注意,单账号并发上限是 20。对比一下,V4-Flash 正式版的并发上限是 2500,差了一百多倍。这个是给大家内测的,不是跑任务用的。
| V4-Flash 正式版 | V4.1 Flash 内测版 | |
|---|---|---|
| 模型结构 | 上一代架构 | 全新架构 |
| 多模态 | 看图需另挂 Vision-Exp | 原生支持 |
| 计费 | 官方定价 | 与 V4-Flash 同价 |
| 并发上限 | 2500 | 20 |
| 状态 | 正式版 | 内测,9月10日下线 |
有意思的是官方直接问开发者,V4.1 Flash 能否全面替换线上的 V4 Pro。如果flash的价格,pro的能力,是不是deepseek内蒙古新的服务器群都扛不住了?
至于全新的架构到底带来了多大的提升,“能力更强"目前还只是官方的说法。只能等内测的同学们来发表了。