公司动态
DeepSeek V4 Pro 正式版深夜上线:跑分紧贴 Fable 5,价格却只有它的零头
DeepSeek V4 Pro 正式版深夜上线跑分紧贴 Fable 5价格却只有它的零头Gork4.6几乎同步发行⚡ 同一秒两份旗舰模型前后脚落地。梁文锋的 DeepSeek V4 Pro 与马斯克的 Grok 4.6把 AI 最贵那张王座的价签一起撕了。 8 月 12 日深夜DeepSeek 上线 V4 Pro 正式版模型名 DeepSeek-V4-Pro-0813API 同步开放定价保持不变。它吃下 100 万 Token 上下文、最高吐出 384K底座是一个 1.6 万亿参数的 MoE每次推理激活约 490 亿参数。巧合的是马斯克这边的 Grok 4.6 也在同一窗口露面——两款顶级模型撞在了一起。 这回 DeepSeek 依旧没走常规发布流程技术博客、媒体沟通会都没有唯独官网 API 定价页把模型版本号从预览版改成了 0813。来源官方定价页 https://api-docs.deepseek.com/quick_start/pricing/ Grok 4.6 见 x.ai/news/grok-4-6 。眼下榜单仍以 DeepSeek 自测与社区流传图为主独立第三方评测还在路上。 把分数摊开看便宜的那一侧这次没掉链子一些对比分析终端实操 Terminal Bench 87.9距 Fable 5 的 88.0 仅 0.1 分之差盖过 Opus 4.8 的 85.0带工具的高难推理 HLE 60.0压过 Opus 4.857.9贴着 Fable 563.0的尾灯软件工程 DeepSWE 由预览版 12.8 跳到 62.7翻了约 5 倍反超 Opus 4.8 的 58.0安全攻防 CyberGym 83.3、长链自动化 AutomationBench 31.8两项直接越过 Fable 5。价格价格才是重头戏每百万 Token 输出 0.87 美元国内 6 元摊下来是 Fable 550 美元的约 1/57、Grok 4.66 美元的约 1/7。背后是「压缩稀疏注意力 重度压缩注意力」两套机制把单 Token 推理开销压到 V3.2 代的 27%、KV 缓存压到 10%——百万级上下文的成本就这么腾出来。 这说明 DeepSeek 的旗号已经从前两年的「便宜够用」悄悄改成了「又便宜又顶配」——过去那道「贵的不够用、便宜的不够强」的墙被它自己拆了。发布历史 把时间回到过去今年 4 月 V4 Pro 预览版刚露面时Agent 类任务还明显落后海外第一梯队而 V4 Flash 用近乎白送的调用价先抢下了流量基本盘。如今 Pro 正式版补上的正是「顶尖能力」这块空缺。同一盘棋里DeepSeek 还藏着 Harness——模型管思考Harness 管动手和编排二者合体才是能端到端干活的智能体。社区消息说它今天就要开放测试竞争维度正从「谁模型分数高」转向「谁能交付完整智能体方案」。一些客观的不足点 不过没有免费午餐。实测里 V4 Pro 的推理过程变得极其简省——能省略的修饰全省了意思还在可读性却掉了不少多半是压缩 Token 带来的副作用拿它正经写长文基本歇菜。更现实的是算力账面梁文锋自己说过 DeepSeek 大约只有 2 万张 H100 等效卡而定价页还挂着「近期会有明显调价」的提示眼下这扇低价门能开多久不好说。期待 往后最该盯的是 V4 Pro 的模型权重几时放出MIT 许可按 Flash「先开放 API、再放权重」的节奏应该只是时间问题以及 Harness 公测后DeepSeek 能不能从「一个强模型」长成「一套能跑通的智能体系统」。马斯克已经预告 Grok 4.7OpenAI 和 Anthropic 的反击也迟早到来——这一局才刚发牌。