Qwen3.8-Max:编码与“共事”的新标杆,Max 级模型首次开放权重(2026-08-03)
本文为翻译/转载,原文使用 CC BY-NC-SA 4.0 协议发布。 原文作者:Hacker News 社区讨论 原文标题:Qwen3.8-Max: A New Bar for Coding and Cowork 原文链接:https://news.ycombinator.com/item?id=49150470 原文发布:2026-08-03 本博客不参与任何商业变现(含 ads / 付费 / affiliate),本译文遵循 CC BY-NC-SA 4.0 条款发布。
译者按
8 月 3 日,阿里 Qwen 官宣 Qwen3.8-Max——Qwen 家族迄今最强模型(社区估算约 2.4T 参数),最重磅的新闻是:这是 Qwen-Max 级别模型首次开放权重,下周发布,同期还有社区最期待的本地模型 Qwen3.8-27B。消息半天内冲到 Hacker News 684 分、340+ 评论。对中文读者来说,Qwen 是本土最熟悉的模型家族,这条帖子恰好呈现了海外开发者视角下的中国模型竞争力:既有对 $2/$6 定价的惊叹与对比 Kimi K3 的追问,也有”AI 没有护城河、估值该跌 90%“的冷水,还有 AWS Bedrock 迟迟不支持开源模型的吐槽。信息密度极高,值得完整一读。需要说明:qwen.ai 官方博客正文不在白名单内(©),本文仅翻译 HN 讨论串本身(CC BY-NC-SA)。
正文
发帖原文
Qwen3.8-Max: A New Bar for Coding and Cowork 链接:https://qwen.ai/blog?id=qwen3.8(官方博客,© 未转载) HN 讨论:684 分 / 340+ 评论,发布于 2026-08-03
帖子本身是纯链接帖(无正文),核心信息来自评论区对官方公告的转述与讨论。综合评论区可确认的事实:
- Qwen3.8-Max:Qwen 家族迄今最强模型,社区估算总参数约 2.4T;首次宣布开放 Max 级权重,开放权重版本下周发布;
- Qwen3.8-27B:下周同步开放权重,被视为社区最关心的本地模型;
- 定价 $2/$6(每百万 token,输入/输出),被评论者认为比 Kimi K3 更亲民;
- 官方支持 reasoning_effort 三档调节(xhigh / medium / low),用于控制推理深度与成本;
- 7 月 19 日 Qwen3.8-Max-Preview 已在阿里 Token Plan、Qoder、QoderWork 上亮相,因此也有评论质疑”今天到底发布了什么”。
社区精彩评论精选
一、发布疑云:今天到底发布了个啥?
1. (@simonw,即 Simon Willison)
“我不太明白。页面标注的发布日期是今天,但 [7 月 19 日] Qwen3.8-Max-Preview 就已登陆阿里的 Token Plan、Qoder 和 QoderWork。我还用它画了只鹈鹕……所以今天到底发布的是什么?”
2. (@Alifatisk)
“这则新闻的核心是:模型离开了 Preview 阶段,并且他们首次发布 Max 系列的开放权重版本。你可以随时在 Qwen Chat 免费试用。阿里云的门槛对我来说太高了。“
二、参数与开放权重:开源社区的”甜蜜烦恼”
3. (@khanhnguyen8386)
“2.4 万亿参数,下周开放权重?开源社区怕是要集体搞个 GoFundMe 众筹,才买得起跑这头怪兽的 VRAM。”
4. (@toshinoriyagi)
“他们还宣布下周发布 Qwen3.8-27B 的开放权重。Qwen3.6-27B 被广泛认为是目前最好的本地模型之一——除了它,几乎没有别的不刷榜、又没那么大的模型能接近它的水平。如果 3.8 真的有提升,那就太棒了。”
5. (@boredatoms)
“3.8-27B 才是这则新闻里真正重要的部分。”
6. (@ggcr)
“等着 Qwen3.8-27B!他们的基础模型和架构很快就成了本地推理和微调的首选,哪怕他们引入了一些棘手的东西(比如 GDN),用的人实在太多,几天/几周内大量 OSS 框架就都适配了。”
7. (@wxw)
“‘这也是我们首次开放 Qwen-Max 级别模型的权重——下周发布。’ 漂亮!“
三、价格与生态:$2/$6 的冲击波
8. (@theanonymousone)
“$2/$6 的价格比 K3 亲民太多了。好奇他们到底做了什么,才能做到这个价格(K3 显然做不到——其他大多数厂商的定价都和 K3 差不多)。”
9. (@ddxv)
“似乎只有这一处提到成本?‘Qwen3.8-Max 官方支持 reasoning_effort,可调节推理深度和控制成本:xhigh(默认,适合复杂任务)、medium(平衡精度与速度)、low(优化速度与成本的高效推理)。’ 希望它真的便宜很多。我一直爱用 DeepSeek,因为它几乎免费,每天几分钱的使用成本,很难有动力切换。”
10. (@tesnorindian)
“AWS Bedrock 至今不支持 GLM 5.2、DeepSeek V4 Flash 0731、Kimi K3 这些最新的开放权重模型,他们甚至只支持 Qwen 3 这种老模型。他们为什么这么不愿意支持开放权重模型?“
四、护城河与估值:AI 到底值不值一万亿?
11. (@me551ah)
“这让我怀疑 AI 公司到底有没有护城河。所有 LLM 请求都是幂等的——每次 API 调用你都得把整个对话历史发过去,模型既不学习也不记忆,这让用户随时切换模型变得极其容易。如今大多数主流 AI 框架改一行代码就能换模型。这让我怀疑 OpenAI 和 Anthropic 的万亿美元估值是否合理。如果它们合理,那 Kimi、Qwen、DeepSeek 也该值一万亿;或者它们全都该大幅贬值——两者必居其一。”
12. (@ulfw)
“AI 是商品,这已经被证明了。估值必须跌掉 90%。每周都有不同的模型’夺冠’——这正是商品市场的典型定义,而不是估值所暗示的’赢家通吃’市场。”
13. (@adi2907)
“一旦 OpenAI 和 Anthropic 上市,每一次这样的发布公告都会成为可靠的卖出信号。“
五、实测与质疑:真上手是什么体验?
14. (@jjcm)
“视觉 Web 开发 / PerceptionBench 的分数对 image→HTML 流程来说很有前景。我做了些实测:让 Opus 5 和 Qwen3.8-Max 把同一批复杂设计稿转成 SPA。Claude 大约 16 分钟完成,而我花了将近 2 小时’伺候’ Qwen 的构建——用 OpenCode 跑 Qwen 版本时遇到了大量报错和超时。实现过程中能看出它视觉能力不错,但超时问题让它在生产环境里很难用。”
15. (@TacticalCoder)
“‘在这个案例中,Qwen3.8-Max 被要求从零创建 oh-my-cli 项目,并在 10 多天的长周期自主编码中构建一个自我进化的 harness。’ 官方没说结果有多成功,但结合另一件事看有点搞笑:一位 Anthropic 开发者说 Claude 已经埋头苦干 15 天试图用另一种语言重写自己——目前还拿不出任何成果。‘你重写 Claude Code,我们重写 oh-my-cli。”你 15 天一事无成,我们 10 天搞定。‘当然,这是拿苹果比橘子。但我总觉得他们完全清楚自己写了什么。”
16. (@choppaface)
“‘通过反馈回路自我进化’——这是不是意味着他们蒸馏了 Claude?听起来很像 Claude Code 经常干的事。”
17. (@whateveracct)
“哦,所以他们蒸馏了 Fable 和 Sol,是吧?”
18. (@sheepscreek)
“我读到这则公告时超级兴奋,但看到 ‘Qwen3.8-Max 被要求从零创建 oh-my-cli 项目,并在 10 多天的长周期自主编码运行中……’ 就懵了——10 多天到底在构建啥?是个 shell 提示符定制工具?还是个编码 harness?都不是——好吧,勉强算后者。这个命名很烂的东西其实是一个自我进化的编码 harness,‘自我进化’这一点才是大事。真希望他们换一个例子。”
19. (@shAIster)
“你们有没有重新训练 Qwen,让它别在地缘政治问题上给出胡佛研究所式的答案?它明显被蒸馏出了强烈的亲西方偏见,好促进西方市场的销售。”
20. (@storus)
“我认为禁止开放权重模型的窗口正在快速关闭。希望美国政府会错过它,我们就能长期把 Fable 级别的模型(至少在部分能力上)以开放权重、不违反任何新法律的方式本地运行,作为长期基线。”
21. (@docheinestages)
“中国追上美国是迟早的事。在基础设施、制造业和工程师队伍上,中国都有优势,我预见他们会成为 SOTA 的领跑者。也许美国要不是忙着’设卡’和闭源,开源社区会更信任他们。“
六、本地部署与杂谈
22. (@Zenst)
“这些编码模型越来越好,但它们似乎都面向多语言。对很多人来说,一个只支持单语言的精简版 LLM 会非常棒——更小、更能跑在大家家里的硬件上(哪怕 CPU 都行)。一个同时懂汇编、Java、C 的模型很酷,但当你一次只用一个语言时,把这些拆成专用的、更小的 LLM 岂不更好?毕竟 Qwen3.8-Max 支持 90 多种编程语言——你让任何程序员列举计算机语言,能数出 20 个就算不错了。”
23. (@aliljet)
“我正试图在一台 16 核、128GB 内存、2080Ti 的机器上跑 Qwen 3.8 27B 稠密模型,怎么算都不划算。GPU 确实在哀嚎,但问题是:就算每月把 200 美元房租钱砸给大模型厂商,这台机器的升级账也算不过来……你们都是怎么论证本地模型的经济性的?”
24. (@fnord77)
“Token 末日取消了。”
25. (@luciana1u)
“我最信任的基准是:模型能不能不带混乱地解释自己的定价页面。“
译者注
- Qwen3.8-Max 的 2.4T 参数:来自 HN 评论区对官方材料的估算,应为 MoE(混合专家)架构的总参数,激活参数远小于此;此前 Qwen-Max 系列一直闭源,本次是首次宣布开放权重,标志意义大于参数本身。
- $2/$6 定价:按 HN 社区通行理解,指每百万 token 的输入/输出价格。评论者普遍把它与 Kimi K3 对比(K3 定价更高),并认为这是 Qwen 用推理成本结构换市场份额的打法。
- Qwen3.8-27B 与本地模型生态:27B 级别被社区视为”本地推理黄金尺寸”。Qwen3.6-27B 因”不刷榜、真实能力强”被反复提及为最佳本地模型之一,这也是为什么评论区一致认为 27B 开放权重才是真新闻。
- reasoning_effort:OpenAI 系 API 已普及的推理深度调节参数,Qwen 的 xhigh / medium / low 三档与之对应,用于在复杂任务与成本之间权衡。
- 胡佛研究所(Hoover Institution):美国斯坦福大学的保守派智库,常产出右翼叙事。该评论质疑 Qwen 在地缘政治议题上存在亲西方蒸馏偏见——类似质疑在 DeepSeek、Kimi 等中国模型的海外讨论中也经常出现。
- oh-my-cli:官方公告里举例的”从零构建”项目,据评论区描述是一个自我进化的编码 harness(能根据反馈循环持续改进自身)。TacticalCoder 的调侃对照的是 Anthropic 开发者关于”Claude 花 15 天重写自己”的轶事。
- Fable / Sol:英文圈社区频繁提及的前沿闭源模型/工具(本时间线内 Simon Willison 的博客也多次出现 Fable);“Fable 级别”即接近最强闭源模型的水平,“蒸馏 Fable 和 Sol”则是社区对 Qwen 能力来源的常见调侃。
- Tokenpocalypse(Token 末日):社区造词,指”token 成本失控、AI 使用贵到不可持续”的悲观预言;“Tokenpocalypse canceled”= 涨价末日没有发生,语带调侃。