当前位置:首页>文章>使用指南>DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

文本是《AI咨询(共136篇)》专题的第 136 篇。阅读本文前,建议先阅读前面的文章:

DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

DeepSeek 又一次把大模型的价格打到了让人怀疑看错的程度:百万 tokens 输入,最低只要 0.02 元。

这一次,DeepSeek 放出的不只是一款更快的模型,而是一套非常激进的发布节奏:V4.1 Flash 先上,V4.1 Pro 随后登场。

更值得关注的是,在 V4.1 Flash 正式上线之后、V4.1 Pro 上线之前,现有 V4 Pro 请求将被全部路由至 V4.1 Flash,并按照 Flash 的价格计费。

一句话概括:能力往上走,价格却往下打。

不过先说明一个容易被标题忽略的细节:这里的“百万 Token 最低 2 分钱”,指的是缓存命中、空闲时段的输入价格,并不是所有请求、所有时段都统一按 2 分钱计费。
DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

01 V4.1 Flash 到底狠在哪里?

根据 DeepSeek 面向 API 用户的通知,V4.1 Flash 计划于北京时间 2026 年 9 月 10 日前后正式发布。

通知中给出的表述非常直接:经过内部、外部多方测试,V4.1 Flash 在性能、费用、速度和总用时等多项指标上,已经全面超越 V4 Pro。

这意味着,“Flash”不再只是一个为了速度而牺牲能力的轻量版本。它正在变成一个更均衡的选择:既要响应快,也要能力强,还要把推理成本继续压低。

另有当日资讯显示,DeepSeek 正在把快速、专家和识图等模式合并为统一的智能模式,使模型能够根据任务复杂度和输入类型自动调节处理方式。至于完整架构、多模态能力边界和具体基准成绩,仍应以上线后的官方技术文档为准。

DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

02 百万 tokens 只要 0.02 元,怎么算的?

从通知公布的价格表来看,V4.1 Flash 采用空闲时段与高峰时段两档价格。

计费项目 空闲时段 高峰时段
百万 tokens 输入(缓存命中) 0.02 元 0.04 元
百万 tokens 输入(缓存未命中) 1 元 2 元
百万 tokens 输出 4 元 8 元

高峰时段为周一至周五的 9:00—12:00、14:00—18:00,其余时间为空闲时段。

所以,标题中的“最低 2 分钱”有三个前提:

  1. 计算的是输入 tokens;
  2. 请求命中了上下文缓存;
  3. 调用发生在空闲时段。

即便加上这些条件,这个价格仍然极具冲击力。对于拥有大量重复上下文的业务,例如固定系统提示词、长文档问答、知识库检索、批量内容生产和多轮工作流,缓存命中带来的成本优势会非常明显。

03 真正刺激的,是中间这段“窗口期”

这次通知里最值得开发者盯住的,不只是价格表,而是模型路由安排。

DeepSeek 表示:在 V4.1 Flash 正式上线后、V4.1 Pro 上线前,原本发往 V4 Pro 的请求,将全部路由至 V4.1 Flash,并按照 V4.1 Flash 的单价计费。

这会形成一个很特别的过渡窗口:用户不必立刻修改原有调用,就可能直接体验到官方所称“多项指标全面超越 V4 Pro”的新模型,同时承担更低的 Flash 价格。

有人把它称为“Pro 能力、Flash 价格”的限时窗口。严格来说,V4.1 Flash 并不等于尚未发布的 V4.1 Pro;但对现有 V4 Pro 用户而言,这段时间确实很适合集中进行压测、迁移验证和成本对比。

04 V4.1 Pro,才是 DeepSeek 留下的后手

如果 V4.1 Flash 已经能够在多项指标上超过 V4 Pro,那么紧随其后的 V4.1 Pro,自然会拉高外界的预期。

Flash 负责把速度、可用性和价格打下来,Pro 则大概率承担更复杂任务、更高能力上限和旗舰体验。这样的“双模型节奏”,很可能意味着 DeepSeek 正在重新划分产品线:Flash 不再等于“能力缩水”,Pro 也不再只是“速度更慢但更聪明”。

当然,V4.1 Pro 的正式能力、价格和发布时间,目前仍需等待官方后续信息。现在能确定的是:Flash 先行,Pro 在后,DeepSeek 还没有把所有牌打完。

05 开发者现在最应该做什么?

DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

第一,立刻梳理现有 V4 Pro 调用链路。重点检查模型别名、路由策略、输出格式、工具调用和重试机制,避免自动切换后出现兼容性问题。

第二,分别在高峰与空闲时段进行成本测试。不要只看“最低价格”,要结合缓存命中率、输入输出比例、并发量和真实业务时段计算最终账单。

第三,利用窗口期做同任务对照。把现有 V4 Pro 的代表性任务交给 V4.1 Flash 重跑,比较答案质量、首字延迟、总耗时、稳定性和单位任务成本。

第四,提前为 V4.1 Pro 留出评测集。Flash 适不适合日常生产,Pro 值不值得承担旗舰任务,最终都要由真实业务数据决定。

结语

DeepSeek 这次真正凶狠的地方,不是单纯把某一个价格降到了 0.02 元,而是同时推动了三件事:新模型能力升级、旧模型请求自动迁移、API 成本继续下探。

当百万 tokens 的价格开始用“分”来计算,大模型竞争的门槛也在发生变化。未来真正拉开差距的,可能不再是“能不能调用最强模型”,而是谁能更早把模型接进业务、跑通工作流,并用更低的成本稳定地产生结果。

需要注意的是,本文根据 DeepSeek API 用户通知截图及 2026 年 9 月 10 日当日公开资讯整理。模型实际发布时间、技术规格、能力边界和最终计费规则,请以 DeepSeek 正式上线页面及官方文档为准。

如果你想持续追踪和对比国内外主流大模型,可以关注 大模型统一平台 llmuni.com,更方便地了解模型动态与实际使用体验。

这里是 LLMUNI,专注于多模型 API 聚合与开发者接入体验。可前往 llmuni.com 查看当前模型与接入方式。

DeepSeek杀疯了!V4.1突然空降,价格直接打穿:百万Token最低只要2分钱!

如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见。

给TA打赏
共{{data.count}}人
人已打赏
使用指南

OpenAI 生图王炸上线:GPT Image 2.5 快了 50%,AI 修图终于听懂“其他别动”

2026-9-9 15:18:07

使用指南工具配置

GPT-6突然刷屏!OpenAI还没官宣,全网却已经开始倒计时

2026-7-29 15:48:57

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索