欢迎光临
我们一直在努力

同一个任务,DeepSeek 新模型用时少 60%,账单却多了 40%

同一个任务,DeepSeek 新模型用时少 60%,账单却多了 40%

栏目:AI 工具
发布时间:2026-09-09 11:00
选题来源:百度热搜「DeepSeek V4.1 Flash 限时内测」
状态:READY


先说结论:这次 DeepSeek 的内测新模型,快是真快,贵也是真贵——同一个任务,端到端用时可能少 60%,但你的账单可能涨 40%。这不是我编的,是首批开发者一边用一边骂出来的。

9 月 8 日下午,DeepSeek 在官方交流群里宣布 V4.1 Flash 中间版本内测开始。注意,是”中间版本”,官方博客到现在都没正式介绍,连公开 API 文档里都还只有 V4-Flash-0731 和 V4-Pro-0813(来源:36氪澎湃新闻)。从模型名字看,这个内测版本 9 月 10 日自动过期下线,留给你的体验时间只有两天。

一、快在哪:不是小修小补,是换架构

第一批开发者的反馈高度一致:太快了

  • 同一任务端到端处理,SVG 代码生成快 6 倍
  • 长上下文检索快 5 倍多
  • 有团队用 ClaudeCode 平台实测,模拟互动拍立得相机的任务,5 分钟就交付了一个成熟作品(来源:搜狐

为什么快这么多?因为 V4.1 Flash 换了新的模型结构,而且原生支持多模态——这是 DeepSeek 一直以来的短板。此前 8 月 21 日上线的 V4 Flash Vision-Exp 还只是视觉理解实验版,这次直接把多模态做进了底座(来源:澎湃新闻)。

二、贵在哪:速度上去了,token 也烧得更快了

官方说”成本更低”,但首批开发者普遍不买账。

有开发者直说”5 分钟 10 块钱”,还有人说”瞬间几十块没了”。原因很好理解:速度快 = 相同时间内 token 消耗更多。你让它在 5 分钟里干完原来要 30 分钟干的活,token 总量自然上去。

看看官方公布的计费,和现有 deepseek-v4-flash 完全一样(来源:第一财经/中华网新浪财经):

时段 缓存命中输入 未命中输入 输出
空闲时段 0.05 元/百万 token 1.5 元/百万 token 4.5 元/百万 token
高峰时段 0.1 元/百万 token 3 元/百万 token 9 元/百万 token

也就是说:每 token 单价没降,官方说的”成本更低”更多指底层推理效率提升,能不能转化成你账单上的数字减少,还得测试验证。目前每账号限流 20 路并发,更适合功能验证和效果测试,不适合直接承接大规模线上业务。

三、怎么用:不改地址,改个名字就行

调用方式简单到离谱(来源:36氪):

  • base_url 保持不变
  • 模型名改成 deepseek-v4.1-flash-expires-on-0910
  • 计费与 deepseek-v4-flash 相同,20 路并发上限

四、争议:V4.1 Flash 想吞掉 V4 Pro ?

这里有个耐人寻味的细节。DeepSeek 官方内测反馈问卷里,直接问了测试用户一个问题:

“DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro?”

目前 V4 系列分成 Flash 和 Pro 两条线。按官方 API 价格,峰值时段 V4 Flash 每百万 token 缓存未命中输入 0.44 美元、输出 1.32 美元;V4 Pro 是 1.32 美元和 3.96 美元——正好约 3 倍(来源:36氪)。

如果 V4.1 Flash 真能逼近 Pro 的能力,还保持 Flash 的价格,那 Pro 线就尴尬了。我的判断是:DeepSeek 这一波内测,表面上测新模型,实际上在测试”以 Flash 价格卖 Pro 能力”这个定价策略的可行性。真到正式上线那天,要么 Flash 提价,要么 Pro 降价,总有一边要动。

五、省钱的 3 个实操建议

如果你这两天想试,建议这样控制成本:

  1. 只做小任务验证:别拿生产流量去怼,20 并发上限本来就撑不住
  2. 掐着空闲时段跑:凌晨到早上是非高峰,同样任务 token 价格能差近一半
  3. 把长上下文检索任务优先交给它:这是它相对老模型提升最明显、ROI 最高的场景(快 5 倍)

六、FAQ

Q1:V4.1 Flash 内测到什么时候结束?
A:按模型命名规则,9 月 10 日自动过期下线,留给开发者的体验时间约两天(9 月 8 日 16:00 起)。

Q2:内测需要申请吗?
A:不需要单独申请,改模型名即可调用,但每账号限 20 路并发。

Q3:V4.1 Flash 和 V4 Flash 是什么关系?
A:V4.1 Flash 是采用新模型结构的中间版本,原生多模态;V4 Flash 是现行正式版(对应 V4-Flash-0731)。V4.1 Flash 内测期间计费与 V4 Flash 相同。

Q4:多模态能力真的到了吗?
A:官方称原生支持多模态,视觉理解 Agent 能力接近 Opus-4.8(来源:澎湃新闻引 DeepSeek 说法)。是否兑现,等内测反馈出来再下结论。


来源:第一财经、新浪财经、36氪、澎湃新闻、搜狐科技。DeepSeek 尚未更新官方博客正式介绍新模型,更多信息需等内测结束后正式上线。

你这两天准备去试 V4.1 Flash 吗?还是继续用老模型等正式版?评论区聊聊你的实测结果。

赞(0)
未经允许不得转载:时间网 » 同一个任务,DeepSeek 新模型用时少 60%,账单却多了 40%

更好的WordPress主题

支持快讯、专题、百度收录推送、人机验证、多级分类筛选器,适用于垂直站点、科技博客、个人站,扁平化设计、简洁白色、超多功能配置、会员中心、直达链接、文章图片弹窗、自动缩略图等...

联系我们联系我们

登录

找回密码

注册