同一个任务,DeepSeek 新模型用时少 60%,账单却多了 40%
栏目:AI 工具
发布时间:2026-09-09 11:00
选题来源:百度热搜「DeepSeek V4.1 Flash 限时内测」
状态:READY
先说结论:这次 DeepSeek 的内测新模型,快是真快,贵也是真贵——同一个任务,端到端用时可能少 60%,但你的账单可能涨 40%。这不是我编的,是首批开发者一边用一边骂出来的。
9 月 8 日下午,DeepSeek 在官方交流群里宣布 V4.1 Flash 中间版本内测开始。注意,是”中间版本”,官方博客到现在都没正式介绍,连公开 API 文档里都还只有 V4-Flash-0731 和 V4-Pro-0813(来源:36氪、澎湃新闻)。从模型名字看,这个内测版本 9 月 10 日自动过期下线,留给你的体验时间只有两天。
一、快在哪:不是小修小补,是换架构
第一批开发者的反馈高度一致:太快了。
- 同一任务端到端处理,SVG 代码生成快 6 倍
- 长上下文检索快 5 倍多
- 有团队用 ClaudeCode 平台实测,模拟互动拍立得相机的任务,5 分钟就交付了一个成熟作品(来源:搜狐)
为什么快这么多?因为 V4.1 Flash 换了新的模型结构,而且原生支持多模态——这是 DeepSeek 一直以来的短板。此前 8 月 21 日上线的 V4 Flash Vision-Exp 还只是视觉理解实验版,这次直接把多模态做进了底座(来源:澎湃新闻)。
二、贵在哪:速度上去了,token 也烧得更快了
官方说”成本更低”,但首批开发者普遍不买账。
有开发者直说”5 分钟 10 块钱”,还有人说”瞬间几十块没了”。原因很好理解:速度快 = 相同时间内 token 消耗更多。你让它在 5 分钟里干完原来要 30 分钟干的活,token 总量自然上去。
看看官方公布的计费,和现有 deepseek-v4-flash 完全一样(来源:第一财经/中华网、新浪财经):
| 时段 | 缓存命中输入 | 未命中输入 | 输出 |
|---|---|---|---|
| 空闲时段 | 0.05 元/百万 token | 1.5 元/百万 token | 4.5 元/百万 token |
| 高峰时段 | 0.1 元/百万 token | 3 元/百万 token | 9 元/百万 token |
也就是说:每 token 单价没降,官方说的”成本更低”更多指底层推理效率提升,能不能转化成你账单上的数字减少,还得测试验证。目前每账号限流 20 路并发,更适合功能验证和效果测试,不适合直接承接大规模线上业务。
三、怎么用:不改地址,改个名字就行
调用方式简单到离谱(来源:36氪):
- base_url 保持不变
- 模型名改成
deepseek-v4.1-flash-expires-on-0910 - 计费与 deepseek-v4-flash 相同,20 路并发上限
四、争议:V4.1 Flash 想吞掉 V4 Pro ?
这里有个耐人寻味的细节。DeepSeek 官方内测反馈问卷里,直接问了测试用户一个问题:
“DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro?”
目前 V4 系列分成 Flash 和 Pro 两条线。按官方 API 价格,峰值时段 V4 Flash 每百万 token 缓存未命中输入 0.44 美元、输出 1.32 美元;V4 Pro 是 1.32 美元和 3.96 美元——正好约 3 倍(来源:36氪)。
如果 V4.1 Flash 真能逼近 Pro 的能力,还保持 Flash 的价格,那 Pro 线就尴尬了。我的判断是:DeepSeek 这一波内测,表面上测新模型,实际上在测试”以 Flash 价格卖 Pro 能力”这个定价策略的可行性。真到正式上线那天,要么 Flash 提价,要么 Pro 降价,总有一边要动。
五、省钱的 3 个实操建议
如果你这两天想试,建议这样控制成本:
- 只做小任务验证:别拿生产流量去怼,20 并发上限本来就撑不住
- 掐着空闲时段跑:凌晨到早上是非高峰,同样任务 token 价格能差近一半
- 把长上下文检索任务优先交给它:这是它相对老模型提升最明显、ROI 最高的场景(快 5 倍)
六、FAQ
Q1:V4.1 Flash 内测到什么时候结束?
A:按模型命名规则,9 月 10 日自动过期下线,留给开发者的体验时间约两天(9 月 8 日 16:00 起)。
Q2:内测需要申请吗?
A:不需要单独申请,改模型名即可调用,但每账号限 20 路并发。
Q3:V4.1 Flash 和 V4 Flash 是什么关系?
A:V4.1 Flash 是采用新模型结构的中间版本,原生多模态;V4 Flash 是现行正式版(对应 V4-Flash-0731)。V4.1 Flash 内测期间计费与 V4 Flash 相同。
Q4:多模态能力真的到了吗?
A:官方称原生支持多模态,视觉理解 Agent 能力接近 Opus-4.8(来源:澎湃新闻引 DeepSeek 说法)。是否兑现,等内测反馈出来再下结论。
来源:第一财经、新浪财经、36氪、澎湃新闻、搜狐科技。DeepSeek 尚未更新官方博客正式介绍新模型,更多信息需等内测结束后正式上线。
你这两天准备去试 V4.1 Flash 吗?还是继续用老模型等正式版?评论区聊聊你的实测结果。








