
9 月 8 日DeepSeek 在官方交流群里发了个通知DeepSeek V4.1-Flash 的中间版本开始内测。没有发布会没有刷屏海报官方措辞也很简短——采用新的模型结构原生支持多模态能力更强、速度更快、成本更低。据澎湃新闻报道这个内测是当天悄然开启的但消息传开得很快不少开发者当天就开始跑了。这个内测版本看点在哪先说结论这次变化最大的不是更强而是原生多模态。翻一下 DeepSeek 的时间线就能看出区别。7 月底V4-Flash 正式版 API 上线公测主打 Agent 能力8 月 21 日DeepSeek 才把视觉理解单独做成一个实验模型 V4-Flash-Vision-Exp 放到 API 上据官方介绍它的纯文本能力和 V4-Flash 正式版持平但在需要视觉理解的 Agent 评测上大幅跃升多模态 Agent 能力已接近 Opus-4.8。也就是说过去 DeepSeek 的多模态是外挂——一个独立的 Exp 模型单独上线、单独调用。这次 V4.1-Flash 不一样官方说的是原生多模态支持即视觉能力直接长在主模型结构里不再是另外拉一支队伍。对开发者来说这意味着以后不用为了能看图专门切换模型一套接口里文本和图像一起处理对做截图理解、OCR、图表分析这类 Agent 场景是个实在的便利。顺着 DeepSeek 的迭代节奏看中间版本通常是两个大版本之间的过渡迭代先放出来让开发者试收集反馈再决定要不要转正——所以它的生命周期短、变数大这从命名就能看出来。另一个值得注意的细节是模型名deepseek-v4.1-flash-expires-on-0910过期时间直接写在名字里官方自己也拿不准它能不能转正——据 IT 之家报道随附的反馈问卷里DeepSeek 直接问用户这个中间版本能否全面替换线上正在服务的 V4 Pro。这个问题其实挺有信息量。Flash 是 DeepSeek 的便宜快档位Pro 是强档位现在官方拿 Flash 的中间版本来问能不能替掉 Pro说明档位之间的能力边界正在被重新划定。再结合 8 月中旬的新闻——据报道V4 Pro 等正式版上线当天DeepSeek API 就改成峰谷分时计价闲时半价、高峰翻倍部分模型最高涨幅明显——不难看出 DeepSeek 的思路一边用价格杠杆引导错峰一边让 Flash 档位尽可能多地吃掉日常流量。开发者怎么上手有什么坑调用方式非常省事接口完全兼容base_url 不用动只改模型名fromopenaiimportOpenAI clientOpenAI(api_keysk-你的key,base_urlhttps://api.deepseek.com,# 保持原地址不变)respclient.chat.completions.create(modeldeepseek-v4.1-flash-expires-on-0910,messages[{role:user,content:用一句话介绍这个模型}],)print(resp.choices[0].message.content) 多模态输入也走同一套 OpenAI 兼容格式文本之外带图片即可官方此前公布的 V4-Flash-Vision-Exp 支持 JPEG、PNG、GIF、WebP 等常见格式。 上手容易但有几个坑得先说清楚-**它是内测品别上生产。**模型名里的 expires-on-0910 不是装饰9月10日就可能下线或改名拿它做线上依赖随时可能404。想接入等正式版发布再切现在只适合跑评测、验证效果。--**有并发限制。**据报道内测每账号限流20并发压测和大批量任务先别指望它。--**计费是暂时的。**目前按 deepseek-v4-flash 的价格计费但官方没说以后不变。按 DeepSeek 已经上线的峰谷计价玩法真转正后价格结构大概率会调整成本模型要按最坏情况估。--**没有技术报告和跑分。**截至各路媒体报道时官方通知只有方向性描述没附技术报告和榜单数据。能力更强、成本更低到底强多少、低多少得靠实测别被一句话宣传带节奏。--**建议单独开一个 API key 来测。**内测计费和正式 Flash 一样混在主 key 里月底对账时分不清哪笔是内测调用独立 key 也方便随时一键停掉。## 对普通打工人的实际影响说句实在的这类更新对不写代码的同事可能毫无感知但对日常接 API、做内部工具的运维和开发来说信号很明确**多模态正在从高端配置变成基础配置价格还在往下走**。上一代视觉能力要单独用 Exp 模型这一代直接进 Flash 档等于用便宜档位的钱干原来要加钱的活。 想尝鲜的跑几个自己的真实场景对比一下文本、视觉和速度比看任何评测都靠谱。你怎么看这个Flash 替 Pro的试探——是真能打还是官方在收集数据评论区聊聊。