DeepSeek V4正式版即将发布:双版本、峰谷计费与真实能力解析
摘要
全网等待近三个月,DeepSeek V4正式版临近发布 DeepSeek V4正式版(GA)已进入发布倒计时,最早明日上线,最迟不出本周。目前已有部分开发者获得灰度测试权限,开启首轮实测。 两个版本同步推出:V4 Flash 与 V4 Pr...
全网等待近三个月,DeepSeek V4正式版临近发布
DeepSeek V4正式版(GA)已进入发布倒计时,最早明日上线,最迟不出本周。目前已有部分开发者获得灰度测试权限,开启首轮实测。
两个版本同步推出:V4 Flash 与 V4 Pro
本次发布包含两个主力模型:轻量高效的 DeepSeek V4 Flash,以及能力更强的 DeepSeek V4 Pro。二者定位清晰——Flash主打高吞吐、低成本场景;Pro则面向复杂推理与多步Agent任务。
如何确认是否已接入V4 GA?一个可验证的判断方式
用户可通过模型输出的思维链(Chain-of-Thought)首句人称特征进行快速识别:若思考过程以“I'm”或“I'll”开头,而非旧版常见的“Let me”,则大概率已切换至V4 GA版本。该现象源于V4对第一人称一致性与角色代入感的底层优化,属内部可复现的行为特征。
V4实际能力表现:不追求单项登顶,但综合可用性显著提升
多位一线开发者实测反馈显示:V4整体推理水准接近Claude Opus 4.8级别;在代码生成任务中,表现直追当前头部闭源模型;Agent任务执行稳定性增强,3D结构描述与SVG生成质量明显改善;同一任务所需迭代轮次较Fable 5略多,反映其更侧重单步准确率与逻辑收敛性。
生成能力实证:从游戏到UI,一次成型
V4 Pro已能独立生成具备完整交互逻辑的HTML游戏,例如融合《我的世界》建造机制与《无人深空》探索元素的沙盒模拟器;亦可一次性产出玩法完整、UI可用的「割绳子」经典解谜游戏;此外,在Xbox手柄SVG渲染、物理引擎示意、动态UI组件等多类前端生成任务中均展现出强结构理解与工程落地能力。
首次引入峰谷计费模式:价格策略全面升级
V4 API定价将启用「峰谷计费」机制:
• V4 Pro:百万输出Token平时0.87美元,高峰时段1.74美元;缓存未命中输入0.435美元/百万。
• V4 Flash:百万输出仅0.28美元(高峰0.56美元),缓存命中输入低至0.0028美元/百万。
此举标志着DeepSeek首次在计价模型上引入时间维度变量,但核心逻辑未变——仍以极致性价比为锚点。
性能与价格的再平衡:七分之一成本,八成Opus级体验
在SWE-bench Verified等权威评测中,V4 Pro-Max距Claude Opus 4.6 Max仅差0.2个百分点,而价格仅为后者的约1/7。尽管在超长上下文检索、专业级软件工程任务及特定知识推理维度上仍有差距,但V4将「够用、好用、便宜」的实用主义路线走得更稳、更远。
老模型退役,新周期开启
伴随V4上线,deepseek-chat与deepseek-reasoner两个历史模型将于7月24日正式下线。这不仅是技术代际的切换,更是产品策略的聚焦——所有资源向V4双版本集中,构建统一、高效、可持续演进的模型服务基座。
不是颠覆者,而是定义者
V4未必是参数最大、榜单最高、单项最强的模型,但它再次重申了一条已被验证的技术路径:以可承受的成本,交付接近顶级闭源模型的综合能力。当行业仍在比拼峰值性能时,DeepSeek选择把算力价值真正交还给用户——这一次,「价格屠夫」装上了计价器,但刀锋依然朝向不合理溢价。
评论 (4)
老模型下线有点可惜,不过新模型应该更厉害。搞不懂为啥不做参数最大的
公众号没有啥大突破,就是在性能和价格上做平衡,希望有更大创新
能达到Claude八成体验,价格还低,这性比价太高了,上线我就试试
这功能挺多啊,还能生成游戏,开峰谷计费价格也实惠,估计很多开发者会用