AI 热点快报:DeepSeek V4 Pro 0813 GA 发布,同日 Qwen 2.4T 开放权重与 Grok 4.6 三连发(2026-08-13)
事件与背景
8 月 12 日成为 2026 年迄今「发布密度」最高的一天:UTC 15:01 的 Qwen3.8-2.4T(548 分)、15:32 的 Grok 4.6(467 分)、16:04 的 DeepSeek V4 Pro 0813(820 分),三个前沿模型在 90 分钟内接连落地。HN 评论区自己都在问:「Just after DeepSeek-V4-Pro-0813 published, is this on purpose?」
三个发布的具体事实(均经独立来源验证):
- DeepSeek V4 Pro 0813:OpenRouter 页面标注为「GA release of DeepSeek V4 Pro」(OpenRouter 模型页),官方定价文档确认 1M 上下文、最大输出 384K、thinking/non-thinking 双模式,定价 $0.435/$0.87 每百万 token(输入缓存命中仅 $0.003625)(DeepSeek 官方文档)。文档同时预告「近期将整体上调 API 定价」。
- Qwen3.8-2.4T-A95B:2.4T 参数、95B 激活、512-expert MoE 的开放权重模型(HF 模型卡),BF16 无损权重约 4.9TB,Unsloth 1-bit 动态量化仅 397GB(Unsloth 本地运行指南);Unsloth 称其「rivals GPT-5.6 Sol」。
- Grok 4.6:与 SpaceXAI 联合发布(Cursor 官方博客),Artificial Analysis 智能指数 61,追平 GPT-5.6 Sol、仅次于 Claude Opus 5(63),被评价为「returns SpaceXAI to the intelligence frontier and leads on cost efficiency」(AA 基准分析);定价 $2/$6 每百万 token,快版加倍,已在 Cursor、Grok Build、SpaceXAI API 上线。
为什么现在重要
1. 发布节奏压缩到「按小时」,技术选型周期必须重设。 三家前沿模型在同 90 分钟内落地,Qwen 15:01、Grok 15:32、DeepSeek 16:04 UTC,评论区都在问「是不是故意的」。影响判断:前沿发布窗口已从季度级变成天级甚至小时级,「每季度选一次模型」的团队将系统性落后,持续评测 + 快速切换能力成为工程标配。
2. 开放权重阵营首次把「1M 上下文 + 2.4T 规模」同时摆上桌。 DeepSeek 1M 上下文 GA 出货,Qwen 2.4T 权重开放(BF16 4.9TB / 1-bit 397GB,本地与自托管首次触达前沿级)。影响判断:「开源追不上闭源」的叙事在本周失去支撑,依赖 API 成本模型与闭源上下文窗口的产品假设都要重算。
3. 价格曲线被打穿,且 DeepSeek 明示这是「intro pricing」。 V4 Pro $0.435/$0.87 只有 Grok 4.6($2/$6)的约 1/5,官方文档却预告「近期显著上调」——典型抢占市场的导入价。影响判断:未来 1-2 周是 API 重定价窗口,做成本敏感型产品(批量 agent、长文档处理)的团队应尽快锁定用量或完成迁移测试。
4. Grok 4.6 的差异化信号在「回合效率」而非原始分数。 AA-Briefcase 长程 agent 基准上,它以平均约 53 回合、0.5B 输入 token 完成任务,而 Claude Opus 5 系约需 103 回合、2.0B token(据 AA 文章)。影响判断:长程 agent 的性价比度量(回合数、token 消耗)将取代单点 benchmark,成为 agent 产品选型的核心指标。
5. GA 级产品「quietly released」:信息渠道正在迁移。 DeepSeek 没有发布会,靠 API 文档与 OpenRouter 页面上线,HN 上甚至出现「DeepSeek V4 Pro 0813 quietly released」的讨论。影响判断:模型发布的一手信息从厂商博客转向 OpenRouter / API 文档 / 第三方评测,订阅模型路由平台比订阅新闻页更能捕捉套利窗口。
工程师/产品人今天能做什么
- 把 V4 Pro 0813 接进你自己的评测集:在 OpenRouter 或 DeepSeek 官方 API 上跑现有任务,重点测 1M 上下文检索与 384K 长输出是否改变你的 chunking / 输出截断设计。
- 用 AA 的回合数据重算 agent 成本:若你的 agent 平均回合数 > 50,对比 Grok 4.6($2/$6)与 DeepSeek($0.435/$0.87)的端到端成本,评估把部分流量路由到便宜模型。
- 评估 Qwen3.8-2.4T 的本地化路径:社区已有 1-bit GGUF(397GB)在 4×DGX Spark 上运行的 recipe(GitHub 示例),先确认硬件上限与量化容忍度再决定是否自托管。
- 锁定 DeepSeek 用量与缓存策略:官方已预告涨价,重度依赖方应评估预付费与缓存命中优化(缓存命中输入仅 $0.003625/百万),并在涨价前完成 A/B 迁移测试。
- 把「模型发布监控」换成聚合源:关注 OpenRouter Discover 与 Artificial Analysis 而非单家新闻页,本周至少跑通一次「新模型 → 评测 → 切换」的流水线演练。
待观察
- DeepSeek 涨价的时间与幅度:官方称「significant」上调但未给日期,V4 Pro 会否从导入价回归正常区间、Flash 版本是否跟进,值得跟踪。
- Qwen3.8-27B 本周发布:Unsloth 文档称 27B 将于本周放出,16GB 显存可跑的小尺寸若同步开放权重,本地生态将再下一城。
- SpaceXAI × Cursor 整合节奏:Grok 4.6 已在 Cursor 内置 2x 用量,收购完成后的 Composer 与模型路线图如何演进。
- HF 模型卡在本环境无法直连验证(curl 超时),Qwen 权重事实以 Unsloth 指南、HN 讨论与 GitHub 社区仓库交叉验证为准,读者可浏览器直接访问。
声明:本文来源均经 curl 验证返回 200(OpenRouter、DeepSeek 官方文档、Cursor、Artificial Analysis、Unsloth、GitHub API)或经 HN Algolia API 验证元数据;x.ai 官方页与 huggingface.co 在本环境网络出口受限,相关事实以可访问的二手权威源交叉验证为准。