DeepSeek V4 正式版即将上线:高峰时段 API 价格翻倍,背后是算力与基建压力

量子位 2026-06-30T08:14:47.716695

摘要:DeepSeek 宣布 V4 正式版将于 7 月上线,高峰时段 API 价格翻倍,其余时段保持原有低价。这背后是算力资源紧张与自建数据中心需求的推动。同时,正式版将针对预览版常见的幻觉、长上下文稳定性等问题进行优化。涨价虽意外,但用户普遍认为性价比依然突出。

高峰期涨价,非高峰维持地板价

近日,多位开发者收到 DeepSeek 官方邮件,确认 DeepSeek V4 正式版将于 7 月上线。邮件中最引人注目的变化是——高峰时段(UTC 时间 01:00-04:00 和 06:00-10:00),API 输入 token(缓存命中)、输入 token(缓存未命中)、输出 token 的价格均翻倍

尽管价格翻倍,但 DeepSeek 的“价格屠夫”形象深入人心,开发者们依然感慨:“即便翻倍,还是便宜”。0xSupergemma 创始人 Jun Song 在社交平台上的反应极具代表性:

值得注意的是,非高峰时段的价格保持不变,仍维持 DeepSeek 一贯的“地板价”水平。这种通过高峰定价进行负载管理的方式,既缓解了算力压力,又未整体抬高用户成本。

从“永久降价”到“高峰涨价”,算力瓶颈浮出水面

DeepSeek 过去以“低成本算法奇迹”著称,从 V3 到 R1 再到预览版 V4,每次迭代都伴随着极致性价比。今年 4 月,V4 预览版上线仅两天,DeepSeek 便宣布大幅降价:输入输出低至 2.5 折,缓存命中输入更享受一折优惠,且缓存折扣无时间限制。当时 DeepSeek 研究员陈德里曾明确表示“输入缓存是永久降价”。

因此,此次高峰涨价看似“反常”,实则是算力紧张与基础设施投入压力的必然结果。近年来,DeepSeek 在数据中心建设上布局频繁:

这些动作表明,DeepSeek 正从依赖云端算力租赁转向自建数据中心,以应对日益增长的推理需求。高峰涨价正是配合这一战略的短期负载管理手段。

V4 正式版:优化性能,修复预览版痛点

DeepSeek 在邮件中明确,“此次更新将带来更多的功能优化和性能提升”。两个月来,开发者对 V4 预览版反馈较为集中的问题包括:

1. 幻觉率偏高

部分任务中,模型会给出非常自信但偏离事实的回答。对于代码开发、资料检索、科研等场景,这一问题影响显著。

2. 超长上下文稳定性不足

尽管 V4 预览版宣称支持“百万上下文窗口”,但实际使用中,随着上下文堆积或复杂推理任务叠加,稳定性下降,甚至出现崩溃。这在多工具调用、多轮决策的 agent 工作流中尤为突出——这也是 MoE(混合专家)模型的常见通病。

3. 复杂代码任务表现有待提升

部分开发者反馈,V4 面对复杂代码时过度保守,且真实代码审查测试中出现“过度标记”现象,即把大量正常逻辑误判为潜在 bug。

4. 缺乏原生多模态能力

DeepSeek 在文本推理领域已具备强大影响力,但用户始终期待其推出原生的多模态模型,并以一贯的低价策略进入该市场。

综上所述,用户对 DeepSeek V4 正式版的期待可以概括为:更强的能力、更低的价格、更快的速度、更长的上下文、更准的代码,以及补全多模态。这既是用户“朴实的小愿望”,也是推动 DeepSeek 持续进化的动力。

关键要点


参考链接:
[1] https://x.com/jun_song/status/2071552338243076310?s=20
[2] https://x.com/teortaxesTex/status/2071367631269986648?s=20


图片

图片

查看原文