对标 Claude Fable 5!阿里千问 3.8 Max 来了,2.4 万亿参数国产旗舰模型上线体验
AI 圈,又迎来一款重量级新模型。
2026 年 7 月 19 日,阿里千问团队正式亮相新一代旗舰模型预览版——==Qwen3.8-Max-Preview==。

最吸睛的数字,是==2.4 万亿参数==。
更引发讨论的是,阿里方面将其描述为当前最强大的模型之一,并表示其综合表现==仅次于 Anthropic 的 Claude Fable 5==。
消息公布后,Qwen3.8-Max 迅速成为国内外 AI 圈关注的焦点。但这次更新真正值得关注的,可能并不只是=="参数变大了"==。
核心信息:阿里将 Qwen3.8 Max 描述为当前最强大的模型之一,并称其综合表现==仅次于 Anthropic 的 Claude Fable 5==。
本文看点:
| 01 | 02 | 03 |
|---|---|---|
| 2.4 万亿参数,Preview 预览版先行开放 | "仅次于 Claude Fable 5"的真实含义 | 参数之外:Agent 能力与开放权重的影响 |
01 2.4 万亿参数,阿里新旗舰正式亮相
按照阿里千问官方发布的信息,Qwen3.8 正在启动发布,并计划在后续==开放模型权重==。
本次率先上线的是:==Qwen3.8-Max-Preview==
也就是千问 3.8 Max 的预览版本。其总参数规模达到==2.4 万亿==,目前已经可以通过阿里云 Token Plan、Qoder 和 QoderWork 等产品体验。
注意:这次上线的仍然是 Preview 预览版,并不等同于正式版已经完整发布。当前版本更像是一次提前开放体验:一边让用户和开发者实际测试,一边继续迭代模型能力。
02 "仅次于 Claude Fable 5",到底是谁说的?
这是本次发布中最容易引发误解的一点。
引用:据《华尔街日报》报道,阿里将 Qwen3.8 Max 描述为当前最强大的模型之一,并称其综合表现==仅次于 Anthropic 的 Claude Fable 5==。
因此,更准确的说法应该是:
阿里方面称,Qwen3.8 Max 的综合能力==仅次于 Claude Fable 5==。
截至 2026 年 7 月 30 日,公开的阿里官方页面主要确认了模型名称、2.4 万亿参数规模、体验入口以及后续开放权重计划,但尚未看到一份==完整公开的模型卡和综合基准测试表==。
所以,"全球第二"目前仍然属于厂商对自身模型能力的定位,还需要等待更多==第三方测试验证==。
即便暂时不讨论具体排名,阿里敢于直接把新模型放到 Claude 旗舰模型旁边比较,本身已经释放出一个明显信号:==千问正在主动进入全球前沿模型竞争区间。==
03 2.4 万亿参数,是否意味着一定更强?
看到"2.4 万亿参数",很多人的第一反应是:参数越多,模型就一定越强。但事情没有这么简单。
判断一款大模型的真实能力,不能只看总参数量,还要看:
- 训练数据质量
- 实际激活参数与模型架构
- 推理效率与上下文能力
- 工具调用与复杂任务完成率
尤其对于大规模==混合专家模型(MoE)==来说,总参数量并不意味着每次回答都会调用全部参数。
因此,2.4 万亿参数首先说明的是:阿里正在用更大的模型规模,==冲击更高的能力上限==。但它是否真的能够稳定超过 GPT、Gemini 等旗舰模型,还需要在代码、数学、长文本、Agent 任务和真实业务场景中继续验证。
参数规模能够制造第一眼冲击,真正决定用户是否长期使用的,仍然是:==效果、速度、稳定性和价格。==
04 为什么 Qwen3.8 Max 值得关注?
Qwen3.8 Max 的意义,不只是千问系列又完成了一次版本升级。它背后至少有三个更值得关注的变化。
第一,国产模型开始直接竞争全球前沿能力

过去,国产大模型的常见宣传方式是:接近海外旗舰、部分指标领先、中文能力更好。而这一次,阿里直接将 Qwen3.8 Max 放在 Claude Fable 5 这一前沿模型旁边进行比较。这说明国产模型竞争的目标,已经从=="追赶"逐渐转向"同场竞争"==。
第二,竞争重点正在转向 Agent 和复杂任务
目前 Qwen3.8-Max-Preview 主要通过 Token Plan、Qoder 和 QoderWork 等开发及智能体产品开放。这说明它的==核心战场并不只是普通聊天==。真正需要观察的是:它能不能理解复杂需求、连续调用工具、处理长流程任务,并最终交付可用结果。
注意:官方文档明确提到,当前 Qwen3.8 Max 本身并不具备多模态能力,需要配合其他视觉模型识别图片内容。
第三,开放权重可能带来更大影响
阿里千问官方表示,Qwen3.8 将很快走向==开放权重==。如果后续正式开放,并且许可证、推理成本和部署要求足够友好,它可能会进一步影响企业私有化部署、国产 AI 应用开发、模型微调、Agent 产品,以及==全球开源模型生态==。
对开发者而言,能下载、能修改、能部署的模型,与只能通过官方网页使用的模型,==价值完全不同==。
05 普通用户能感受到什么变化?

对于大多数普通用户来说,2.4 万亿参数本身并不重要。真正重要的是,模型能不能把==事情做好==。
- 面对一份几十页的资料,能否==准确提炼重点==
- 面对一个模糊需求,能否==拆解为清晰的执行步骤==
- 面对一个代码项目,能否==理解仓库结构并连续修改==
- 面对复杂工作流,能否==调用工具完成任务==
如果 Qwen3.8 Max 能够在这些场景中保持稳定,它的价值就不只是"又一个聊天机器人",而是逐渐接近一名==可以执行实际工作的 AI 助手==。
这也是当前 GPT、Claude、Gemini、Kimi 和千问共同竞争的方向:==从回答问题,走向完成任务。==
06 千问能否真正成为全球第二?
现在下结论,==还太早==。
一方面,阿里已经公开了 2.4 万亿参数规模,并开放了 Qwen3.8-Max-Preview 体验,这说明模型并不是停留在概念阶段。另一方面,目前仍然缺少足够完整的==公开评测数据==。
还需要继续观察:
- 真实推理速度如何?
- 长任务是否稳定?代码与 Agent 能力是否领先?
- 调用成本是否具备优势?开放权重何时真正落地?
- 第三方排行榜能否验证官方说法?
所以,比"全球第二"更值得关注的问题是:
Qwen3.8 Max 能不能在真实任务中,提供接近顶级闭源模型的能力,同时保持==更低的使用和部署成本==?
如果答案是肯定的,它带来的影响将==远大于一张排行榜==。
写在最后
Qwen3.8 Max 的出现,再次说明大模型竞争正在==明显加速==。GPT、Claude 和 Gemini 仍然占据全球 AI 市场的重要位置,但 Qwen、DeepSeek、Kimi 等国产模型也在不断==缩小差距==。
下一阶段的竞争,将不再只是比谁的参数更多、榜单排名更高。真正决定胜负的,将是:
谁更稳定,谁更便宜,谁更开放,谁==能真正进入用户的工作流。==
Qwen3.8-Max-Preview 已经上线。至于它能不能兑现"对标 Claude Fable 5"的期待,最终还要交给==真实用户、开发者和第三方评测==来回答。
可以确定的是:==国产大模型已经不满足于追赶,它们正在主动走上全球旗舰模型的牌桌。==
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见。
欢迎关注 一步API,我们还会持续分享更多 AI 资讯、AI 工具、实战经验、踩坑记录,助力你高效玩转 AI 开发、避开行业弯路。

