阿里把压箱底的模型都开源了!Qwen 3.8 Max落地,底线正在成为别人的起跑线

Qwen 3.8 Max正式版上线,牌价反降20%,Max旗舰更首次承诺开源。阿里的算盘很清楚,大模型下半场比的不是谁更聪明,而是谁更便宜、更开放、更能干活。

图片


Qwen 3.8正式版这步棋,算的不是跑分是人心。


两周前在WAIC上还只是预览版的Qwen 3.8 Max,就在昨天8月3日正式版落地,API当天全量开放,还同步接入了阿里新推出的Agent产品千问办公。

2.4万亿参数、95B激活、百万token上下文,发布当天更新的第三方榜单LMArena里,Qwen整体仅次于Anthropic的Claude系列,CodeArena排名全球第四。

参数和跑分网上已经拆得够多了,但笔者看到了更有意思的事。

新旗舰比老旗舰便宜
但老旗舰反而更便宜


先看一个有点拧巴的定价。

Qwen 3.8 Max国内定价每百万token输入12元、输出36元,缓存命中低至1.5元,国际牌价2美元和6美元,官方口径称这个价格仅为Claude旗舰级模型API定价的40%和24%。

图片

和上代3.7-Max比,牌价也低了20%。旗舰换代不加价反降价,这在行业里并不常见。


12元 / 36元

每百万Token输入与输出 · 国内定价


但拧巴的地方在于3.7-Max眼下正在限时五折,老模型实际比新模型便宜近四成。

阿里没说折扣什么时候结束。

这其实是套组合拳,用3.7-Max的低价承接价格敏感的中小客户走量,用3.8 Max抢占高端企业和Agent场景立标杆,上下双线挤压竞品的定价空间。

正式版默认开启思考模式,reasoning_effort提供low、medium、xhigh三档,官方文档默认xhigh,而思考token按输出计费。

牌价降了20%,如果任务跑在最高深度档,思考链一拉长,实际账单可能不降反升。

降价降的是门槛,赚钱赚的是推理时长,模型想得越久,阿里收得越多。

卖模型越来越像卖云计算,入口价可以贴着成本打,利润藏在消耗量里。

2.4万亿的身子
95B的饭量


参数军备竞赛这个数字游戏,这次值得换个算法看。

2.4万亿总参数听着唬人,但典型推理场景下单次激活约950亿参数,占比不到4%。稀疏MoE加混合注意力的意义就在这,知识容量按2.4T存,计算开销按95B算。

模型变大了将近3倍,单次推理的算力成本却没有同比膨胀,这才是万亿参数模型敢卖出这个价的根本原因。


2.4T 95B

总参数 · 单次激活 · 占比不到4%


放到行业里看更有意思。

一个多月内,GLM 5.2Kimi K3DeepSeek V4 Flash接连出手,Kimi K3以2.8T参数保持最大开源权重模型的头衔。

表面看是参数在通胀,实际各家卷的方向已经悄悄换了,总参数负责撑场面,激活参数才决定钱包。

谁的激活效率做得狠,谁的推理成本就压得低,谁就有底气打价格战。

参数竞赛的上半场比谁的模型大,下半场比谁的模型省。

Max第一次开源
诚意还是被逼的


这次最反常的动作是阿里宣布下周把Qwen 3.8 Max的权重放上Hugging FaceModelScope,一同开源的还有27B版本。

要知道在此之前,没有任何一个Max级别的Qwen模型开源过。

3.7-Max没有,更早的Max也没有,Max一直是阿里捂得最严的那层。

Qwen系列的开源策略向来分层清晰,中小尺寸全开源做生态渗透,Max旗舰闭源做收入。

现在突然要把旗舰家底交出来,时机很耐人寻味,Kimi K3在7月27日刚刚全量开源权重,一周之后阿里就官宣Max开源,说这是巧合恐怕没人信。

开源在这两年已经完成了身份转变。

早年开源是情怀,现在开源是武器。

2.4T权重放出去,云厂商、服务器厂商、行业一体机方案商会快速跟进适配,基于Qwen Max做行业微调和私有化部署的门槛被直接削平,中小闭源模型的生存空间会被进一步挤压,而国产大模型的基线被整体抬到万亿参数级别。

不过要提个醒,截至目前这份权重还只是承诺,仓库尚未上线

而且2.4T的MoE模型即便开源,也远远超出普通服务器的部署能力,对绝大多数团队来说,开源的真正价值不在自己部署,而在第三方托管和微调服务的价格会被进一步打下来。

模型开始打卡上班
KPI从跑分变成了ROI


最后说一个容易被跑分淹没的变化,这次官方放出的成绩单,画风很不一样。

图片

图片

没有人类干预的情况下,Qwen 3.8 Max从空文件夹出发,自主搭建循环工程Loop Engineering框架,独立运行约16天交付了自进化智能体系统oh-my-cli,项目已完全开源,过程中人类工程师只通过钉钉提需求。

另一个案例更硬核,模型在无参考设计的条件下优化一个密码硬件加速器,历经约500轮交互,把逻辑门从8298个压到678个,芯片面积缩减81%。

它还在天池一场多模态挑战赛里24小时内压过了458支人类队伍。


16 天 · 81%

自主交付开源项目 · 芯片面积缩减


这些测试的共同点是把模型扔进真实世界干活,然后按结果结账。

当然也要冷静补一句,这些案例来自官方发布口径,真实生产环境受业务复杂度和工具链适配影响,表现会有波动,不能直接等同于交付效果。

但方向已经足够清晰,模型的评价标准正在从答对多少题,变成干成多少事。

这背后站着阿里的另一重身份。

7月千问刚确认成为Apple智能中国版的官方模型,数亿iPhone用户的云端大脑,考核标准从来不是榜单排名,而是稳定性、成本和合规。

正式发布当天阿里港股涨近6%,市场用真金白银投的票,投的不是跑分,是这套系统扛得住基础设施级别审视的预期。

  

冷静地说,3.8 Max的单项成绩里仍有一部分来自官方自测,CoWorkBench上它74.8对75.9还落后Fable 5,所谓仅次于Claude系列是整体梯队的判断,不是全维度第二。成绩单可以先看,更细的第三方验证值得再等。

但有一件事不需要等验证。从Kimi K3开源到阿里Max破例,从新旗舰降价到推理token计费,国产大模型的竞争重心正在从谁的模型更聪明,滑向谁的模型更便宜、更开放、更能干活。下周权重落地那天,才是真正的开考铃声。


本文数据均来自公开发布与官方文档

第三方测试成绩以独立验证为准



2026全球闪存峰会

随着生成式AI进入规模化落地阶段,大模型训练与推理对存储性能、容量、架构的需求持续攀升,存储正从被动的数据容器,升级为驱动AI产业发展的核心底座。


在此背景下,以“存力跃迁,AI破局”为核心主题的2026全球闪存峰会(Flash Memory World 2026),将于2026年8月26日在中国武汉正式举办。本届峰会由 DOIT 传媒、华中科技大学计算机科学与技术学院、华中科技大学集成电路学院联合主办,汇聚全球存储产业链力量,全面呈现闪存技术前沿突破与 AI 时代的产业新图景。



报名通道:https://app.ehub.net/register/nga5ph






扫描下方二维码 关注我们

我们以算力为线,持续跟进算力基础设施的报道,输出洞察,伴随算力行业实现算力自由。敬请关注!

本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信