文章摘要
2026 年7月19日,阿里云通义千问推出Qwen3.8-Max-Preview旗舰预览模型。该模型总参数量2.4万亿,为原生多模态模型,支持多输入形态,有128K标准上下文窗口,支持双模式推理。官方称其能力全球领先。预览版已上线三大平台,千问PC端可免费体验,正式版将近期发布并开源。

2026年7月19日,阿里云通义千问正式推出Qwen3.8-Max-Preview旗舰预览模型,标志着阿里Qwen3.8预览版上线这一重要里程碑。该模型总参数量达2.4万亿(2.4T),是阿里云首款突破万亿参数的原生多模态旗舰模型,全面覆盖文本、图像、视频、文档多维度处理能力。官方宣称其综合能力在全球范围内仅次于Anthropic的Claude Fable 5,位列全球顶尖AI模型第一梯队。目前预览版已上线阿里Token Plan、Qoder及QoderWork三大平台,千问PC端同步开放免费体验。阿里承诺正式版将于近期发布并开源权重。

阿里Qwen3.8预览版上线

一、Qwen3.8-Max-Preview核心产品定位与技术架构

1.1 旗舰级定位与参数规模

Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰级MoE(混合专家)预览大模型。总参数量达到2.4万亿(2.4T),是目前全球参数规模最大的AI模型之一,仅次于Moonshot AI的Kimi K3(2.8万亿参数)。该模型正在以“天”为单位持续迭代进化,官方将其定位为“当今最强大的模型之一,可与领先的前沿AI模型媲美”。

值得注意的是,早期Qwen系列大量采用MoE架构——该架构在推理时仅激活一小部分权重,可将实际算力和成本压至远低于名义参数规模的水平。若Qwen3.8 Max沿用类似设计,其2.4万亿的“总参数”与实际推理开销之间的差距或同样显著。截至目前,阿里尚未公布激活参数规模、具体架构细节或完整的model card。

1.2 原生多模态能力

Qwen3.8-Max-Preview是Qwen系列中首个支持多模态能力的超万亿参数模型。该模型采用多模态架构,可同时处理文本、图片、视频和文档等多种输入形态。相较于侧重纯文本推理的前代旗舰,Qwen3.8-Max-Preview完成了从纯文本向全域多模态的彻底进化。

在输入输出模态方面,该模型支持文本、图像、视频的混合输入与处理。这种全模态能力使其能够在同一系统中完成跨模态的理解、推理与生成任务,极大拓展了AI模型在真实场景中的应用边界。

1.3 超大上下文窗口

Qwen3.8-Max-Preview全面优化了模型注意力机制与上下文架构,原生支持128K标准上下文窗口,特殊场景可无损拓展至1M百万级Token超长上下文。这一能力相较常规模型大幅提升了海量信息处理能力,有效解决了传统大模型长文本遗忘、逻辑断裂、细节缺失、全局统筹不足的痛点。

有报道指出该模型具备100万Token的上下文处理能力,同时支持思考模式、函数调用和内置工具。这种超长上下文能力使得Qwen3.8-Max-Preview在处理长篇文档分析、复杂代码库理解、长周期智能体任务等场景中具备显著优势。

1.4 双模式推理机制

Qwen3.8-Max-Preview延续了Qwen3系列标志性的双推理机制。该模型支持思考模式与快速模式的自由切换,无需更换模型权重。思考模式适用于数学推理、代码生成、长文档高精度运算等需要深度计算的场景;快速模式则适用于轻量化批量生成场景,可有效提升并发处理速度。

这种双模式设计使得开发者可以在同一模型上灵活应对不同复杂度、不同时效性要求的任务场景,兼顾了推理精度与响应速度的双重需求。

二、性能表现与行业竞争力

2.1 官方性能宣称

阿里官方将Qwen3.8-Max-Preview定位为“可能是除了Fable 5外最强大的模型”。在内部真实任务的测评中,如全栈开发、数据分析、Office办公工作流等多种复杂、多Agent、长程任务,Qwen3.8-Max-Preview展现出匹敌世界前沿模型的实力水平。

Qwen团队在官方社交媒体上表示,该模型“是目前可用中最强大的模型之一”,能够与领先的前沿AI模型相媲美,综合表现“仅次于Claude Fable 5”。阿里同时将Qwen3.8-Max定位为直接对标Anthropic、OpenAI和Google前沿模型的竞争系统。

2.2 与前代旗舰Qwen3.7-Max的对比

较不久前发布的旗舰模型Qwen3.7-Max,Qwen3.8-Max-Preview预览版模型能力又有显著提升。参与该项目的开发者表示,新模型在代码编写、全栈开发、数据分析及办公自动化等复杂生产力场景上,将全面超越前代模型。

从参数规模来看,Qwen3.8-Max-Preview实现了从千亿级到万亿级的跨越式突破,是阿里云首款突破万亿参数的旗舰模型。在多模态能力方面,前代旗舰侧重纯文本推理,而Qwen3.8-Max-Preview完成了向全域多模态的彻底进化。

2.3 与行业竞品的横向对比

Qwen3.8-Max-Preview的发布恰逢全球大模型参数竞赛进入“数万亿参数”时代。就在Qwen3.8亮相前数日,阿里系投资的Moonshot AI发布了Kimi K3,参数规模达2.8万亿,一度刷新“史上最大开放模型”纪录。Qwen3.8 Max以2.4万亿参数紧随其后,三家头部国产模型(Kimi K3、Qwen3.8 Max、MiniMax M3 Pro)已成功进入2-3万亿参数大模型俱乐部。

以下为Qwen3.8-Max-Preview与主要竞品的横向对比:

对比维度 Qwen3.8-Max-Preview Kimi K3 Claude Fable 5 Qwen3.7-Max
总参数量 2.4万亿 2.8万亿 未公开 未达万亿级
架构类型 MoE(推测) 开源权重 闭源 MoE
多模态支持 文本+图像+视频+文档 待确认 支持 纯文本为主
上下文窗口 128K标准/1M拓展 待确认 待确认 待确认
开源计划 正式版将开源权重 已开源 闭源 部分开源
推理模式 思考/快速双模式 待确认 思考模式 标准模式
当前状态 预览版可体验 已发布 已发布 已发布

目前尚无独立评测榜单对Qwen3.8进行评分,上一个被排名的Qwen模型Qwen3.7-Max在LMArena榜单上排名明显低于Fable 5的榜首位置。

三、应用场景与能力边界

3.1 代码工程与全栈开发

Qwen3.8-Max-Preview在代码工程场景中表现尤为突出。该模型在代码编写、全栈开发等复杂生产力场景上实现了对前代的全面超越。Qoder官方发布页将其称为通义千问最新一代基座模型,重点增强代码工程能力,覆盖全栈开发等复杂长程任务。

阿里云百炼官方文档将Qwen3.8-Max-Preview列为AI编程场景中的最强推理选项。开发者可通过Qoder平台(提供Desktop、JetBrains插件、CLI、Cloud Agents、移动端与网页版等多入口)直接体验模型的代码工程能力。

3.2 专业办公与数据分析

在专业办公场景中,Qwen3.8-Max-Preview同样表现出色。该模型覆盖Office办公工作流、数据分析等多种复杂、多Agent、长程任务。阿里云百炼将其定位为Agent开发和复杂办公分析场景中的最强推理选项。

模型的专业办公能力包括但不限于:长篇专业文档分析、多步骤智能体任务、批量数据分析、全链路办公自动化等。依托超大参数体量与全新迭代架构,Qwen3.8-Max-Preview在多Agent协同作业、长链路持续任务、模糊需求拆解、专业领域推理等场景中表现全面超越过往版本。

3.3 复杂推理与长程Agent任务

Qwen3.8-Max-Preview面向复杂推理和长程Agent任务进行了专门优化。模型在五大高难场景表现突出:代码工程开发、复杂逻辑推理、长篇专业文档分析、多步骤智能体任务、跨境多语言创作。

该模型定位为全域复杂任务处理中枢,专门针对高难度工程开发、长周期智能体自治、批量数据分析、专业办公自动化、超长文档复盘等高端场景优化。这种能力定位使其完美弥补了轻量化模型精度不足、普通多模态模型复杂推理薄弱的行业短板。

四、接入方式与定价策略

4.1 三大官方体验渠道

Qwen3.8-Max-Preview预览版已在阿里三大官方渠道首发上线:

阿里云百炼Token Plan:主推体验渠道,提供个人版与团队版订阅套餐。用户可通过Token Plan订阅服务抢先体验Qwen3.8-Max-Preview。

Qoder:程序员专属代码开发AI工作台。提供Desktop、JetBrains插件、CLI、Cloud Agents、移动端与网页版等多种访问入口。

QoderWork:企业级AI智能体开发平台。面向企业级深度AI开发与专业办公自动化场景。

此外,千问PC端及Web端也已同步上线Qwen3.8-Max-Preview,用户在模型列表中勾选即可免费体验。

4.2 Token Plan定价方案

Token Plan采用包月预付费、Credits统一积分计量模式,一套订阅兼容文本、图像、视频全系千问模型与第三方商用大模型。个人版三档套餐详情如下:

套餐档位 月费价格 折扣 适用场景
Lite轻量套餐 39元/月 6.5折(原价60元) 个人开发者、轻量AI工具
Standard标准套餐 139元/月 7.7折(原价180元) 标准开发与办公场景
Pro专业套餐 499元/月 8.3折(原价600元) 高强度专业开发

团队版同步推出三档席位方案:标准席位150元/席位/月(7.6折)、高级席位550元/席位/月(7.9折)、尊享席位1398元/席位/月。

4.3 限时优惠活动

Qwen3.8-Max-Preview推出了力度极大的限时优惠活动。白天Credits消耗限时1折(即正常用量的10%),个人版Token Plan夜间(每日22:00至次日08:00)在此基础上再享2折,即仅需0.2折。

除Token Plan外,Qoder和QoderWork已首发支持Qwen3.8-Max-Preview,千问PC端可免费体验。阿里云百炼官网还提供免费领取千万Tokens的活动。

五、开源计划与未来展望

5.1 正式版开源时间表

阿里官方明确表示Qwen3.8-Max正式版将于近期推出并开源。千问团队在社交媒体上预告了开放权重(Open Weight)的计划。正式版发布时,千问PC端及App将同步上线。

目前预览版暂不对外全面开源,仅对百炼订阅用户开放专属调用权限。阿里表示将“很快”放出完整开放权重,但尚未披露具体日期。

5.2 开源战略意义

Qwen3.8的开源计划标志着开源旗舰大模型阵营的进一步扩容。阿里在国内头部AI创业公司中广泛持股的战略布局,以及将开放权重视作争夺开发者生态核心筹码的考量,使得Qwen3.8的开源具有深远的行业意义。

后续正式版本全面开放权重开源后,将助力开发者与企业低成本搭建自主AI应用与智能体集群。模型深度适配阿里云全生态工具,兼容主流AI开发框架与智能体程序,落地门槛极低,适配个人开发、团队迭代、企业商用全层级场景。

5.3 行业影响与竞争格局

Qwen3.8-Max-Preview的发布折射出中国AI生态内部竞争格局的深刻变化。中国的大模型实验室不再将开放权重视作可有可无的附属选项,而是将其作为争夺开发者生态的核心筹码。

从全球视角来看,Qwen3.8的发布标志着中国AI开发者已正式进入“数万亿参数”时代。国产大模型在参数规模上已实现对国际头部玩家的快速追赶,Kimi K3、Qwen3.8 Max和MiniMax M3 Pro三家已成功进入2-3万亿参数大模型俱乐部。

六、技术细节与已知局限

6.1 已公布的技术规格

截至目前,已确认的Qwen3.8-Max-Preview技术规格包括:

  • 总参数量:2.4万亿(2.4T)
  • 架构类型:MoE(混合专家),具体激活参数未公布
  • 多模态支持:文本、图像、视频、文档
  • 上下文窗口:128K标准,可拓展至1M
  • 推理模式:思考模式与快速模式双模式
  • 知识截止日期:暂未公布
  • 模型文件大小:暂未公布

6.2 尚未公开的信息

截至2026年7月19日,官方尚未公布以下关键信息:

  • 激活参数(Active Parameters)具体规模
  • 具体架构细节与技术报告
  • 可复现的基准测评(Benchmark)结果
  • 上下文窗口与最大输出长度的精确数据
  • 知识截止日期
  • 最终权重许可协议条款

分析师指出,总参数规模并不能直接反映模型每个Token实际参与计算的参数量,也难以推算真实推理成本。在缺乏基准测评数据的情况下,对模型实际性能的评估仍需等待更多公开信息。

FAQ

问:Qwen3.8-Max-Preview的参数规模是多少?

Qwen3.8-Max-Preview的总参数量达2.4万亿(2.4T),是阿里云首款突破万亿参数的旗舰模型。

问:Qwen3.8-Max-Preview与Qwen3-8B是同一个模型吗?

不是。Qwen3-8B是82亿参数的开源密集型轻量模型,可在本地私有化部署;Qwen3.8-Max-Preview是2.4T万亿参数旗舰MoE模型,当前仅支持云端API调用。

问:Qwen3.8-Max-Preview支持哪些输入模态?

该模型采用多模态架构,可同时处理文本、图片、视频和文档等多种输入形态。

问:如何体验Qwen3.8-Max-Preview?

目前可通过三大官方渠道体验:阿里云百炼Token Plan订阅服务、Qoder代码开发平台、QoderWork企业级AI开发平台。千问PC端和Web端也可免费体验。

问:Qwen3.8-Max-Preview的定价是多少?

Token Plan个人版提供三档套餐:Lite 39元/月、Standard 139元/月、Pro 499元/月。目前有限时优惠,白天Credits消耗1折,夜间低至0.2折。

问:Qwen3.8-Max-Preview什么时候正式发布并开源?

阿里官方表示Qwen3.8-Max正式版将于近期推出并开源,但尚未公布具体日期。

问:Qwen3.8-Max-Preview的性能到底有多强?

阿里官方宣称其综合能力在全球范围内仅次于Anthropic的Claude Fable 5。但目前尚无独立第三方基准测评数据,实际性能有待进一步验证。

问:Qwen3.8-Max-Preview的上下文窗口有多大?

原生支持128K标准上下文窗口,特殊场景可无损拓展至1M百万级Token。有报道称其具备100万Token的上下文处理能力。

问:Qwen3.8-Max-Preview采用什么架构?

推测采用MoE(混合专家)架构,延续了早期Qwen系列的设计思路。但官方尚未公布激活参数规模等具体架构细节。

问:Qwen3.8-Max-Preview与Kimi K3相比如何?

Kimi K3参数规模为2.8万亿,略高于Qwen3.8-Max的2.4万亿。两者均为国产万亿级大模型,Qwen3.8-Max的正式版也将开源。目前尚无两者直接对比的独立评测数据。

以上内容不代表本平台立场,仅供读者参考