阿里千问3.8将至:2.4T参数预览版登陆阿里云与Qoder,正式版拟近期开源

阿里新一代旗舰大模型 **千问3.8Qwen3.8)**即将正式发布并开放权重。

2026年7月19日,参数规模达到 2.4T,即2.4万亿参数Qwen3.8-Max-Preview率先上线。用户目前可以通过阿里云Token Plan、Qoder及QoderWork等产品体验预览版,提前测试模型在代码工程、专业办公、数据分析和复杂长程任务中的表现。

公开信息显示,Qwen3.8正式版将在近期推出并开放权重。不过,截至2026年7月20日,阿里尚未完整披露正式版发布日期、激活参数、上下文窗口、训练数据、开源许可证及本地部署要求。

image.png

Qwen3.8-Max-Preview是什么?

Qwen3.8-Max-Preview是阿里通义千问系列的新一代旗舰基座模型预览版。

阿里云与Qoder官方资料显示,该模型总参数达到2.4T,相较上一代旗舰模型Qwen3.7-Max,重点提升以下能力:

代码工程与软件开发
专业办公与知识工作
全栈项目开发
数据分析
Office文档工作流
复杂长程任务
深度推理
视觉理解
Agent工具调用

Qoder将其定位为面向软件工程、办公工作和深度推理的最新千问基座模型。阿里云模型列表则确认,Qwen3.8-Max-Preview同时支持推理、视觉理解和文本生成。

需要注意的是,Qwen3.8-Max-Preview目前仍属于预览模型。预览期间,阿里会持续调整和升级模型能力;预览结束后,该模型可能下线,或被正式版本替换。

2.4T参数意味着什么?

2.4T代表Qwen3.8-Max拥有约2.4万亿总参数。

这是千问系列迄今公布的最大参数规模之一,也意味着阿里正在将旗舰模型继续扩展至万亿参数以上。

不过,总参数数量不能直接等同于实际推理成本,也不能单独决定模型最终能力。

如果Qwen3.8采用混合专家架构,模型在处理每个Token时可能只激活部分专家参数,而不是调用全部2.4万亿参数。但截至目前,阿里尚未正式公布Qwen3.8的专家数量、单次激活参数及具体架构。

因此,当前可以确认的是模型总参数为2.4T,但以下信息仍需等待技术报告或模型卡:

模型采用稠密架构还是MoE架构
每次推理实际激活多少参数
专家数量及路由方式
上下文窗口上限
训练Token规模
视觉编码器结构
推理所需硬件
量化与低精度部署方案

参数规模可以反映模型容量,但实际使用体验还会受到训练数据、后训练、推理资源、Agent框架和工具环境影响。

Qwen3.8预览版已上线哪些平台?

目前公开确认支持Qwen3.8-Max-Preview的入口主要包括阿里云Token Plan、Qoder及QoderWork。

1. 阿里云Token Plan

阿里云Token Plan是一种面向个人和团队的模型订阅服务。

与传统API按实际Token数量结算不同,Token Plan使用Credits额度,让用户在支持的模型和Agent工具中消耗统一用量。

Qwen3.8-Max-Preview目前仅面向Token Plan订阅用户提供,尚未像Qwen3.7-Max一样出现在阿里云百炼的普通按量API模型列表中。

个人版目前包括Lite、Standard和Pro三个套餐,限时价格分别为39元、139元和499元每月;团队版则按照座席和共享额度收费。价格及活动可能调整,应以阿里云最新页面为准。

Token Plan还提供联网搜索、网页抓取、代码解释器、文搜图及图搜图等工具,可用于构建较完整的Agent工作流。

2. Qoder

Qoder是面向软件开发场景的Agentic Coding平台,提供桌面端、JetBrains插件、CLI、云端Agent和移动端等产品形态。

开发者可以在Qoder的模型选择器中切换至Qwen3.8-Max-Preview,用于:

阅读大型代码仓库
跨文件修改代码
编写新功能
修复复杂Bug
执行终端命令
运行测试
重构项目
分析工程结构
处理长时间开发任务

Qoder官方活动页面显示,Qwen3.8-Max-Preview已经覆盖Qoder Desktop、JetBrains插件、CLI、QoderWake、Cloud Agents以及移动端和网页端。

3. QoderWork

QoderWork是Qoder面向日常办公和知识工作的桌面AI助手。

与主要处理代码的Qoder不同,QoderWork可以读取和编辑本地文档、表格、演示文稿及PDF,也支持数据处理、浏览器自动化、桌面操作和定时任务。

用户只需描述希望获得的结果,QoderWork便可自主规划步骤、调用工具并生成可交付文件。

Qwen3.8-Max-Preview进入QoderWork,意味着其能力不仅会用于编程,也会接受真实办公场景的检验,例如:

分析多个Excel文件
制作行业研究报告
生成PPT演示文稿
整理本地文件
阅读和归纳PDF
操作网页并提取数据
执行多步骤办公任务
结合多个Agent完成复杂交付

Qwen3.8为什么先发布预览版?

阿里没有等到正式版和开放权重准备完毕后再一次性上线,而是先将Qwen3.8-Max-Preview接入商业产品。

这种发布方式可以同时实现三个目标。

提前收集真实任务反馈

公开基准测试通常只能覆盖模型能力的一部分。

模型进入Qoder和QoderWork后,会面对大型代码仓库、真实办公文件、复杂网页、不同操作系统和长时间任务。这些场景更容易暴露模型在稳定性、工具调用和指令遵循方面的问题。

预览期积累的结果可以用于调整正式版。

测试长程Agent能力

Agent任务与普通对话不同。

模型不仅要回答问题,还需要持续执行:

1.理解目标
2.制定计划
3.读取文件
4.调用工具
5.检查结果
6.处理错误
7.修改方案
8.完成交付

任何一个环节出现上下文丢失、工具调用错误或任务提前终止,都可能影响最终结果。

让预览版先进入Qoder和QoderWork,相当于在正式开放权重前进行更大范围的Agent压力测试。

为正式版开放权重做生态适配

超大参数模型开放后,需要推理框架、云平台和开发工具完成适配。

预览版先行可以让阿里提前测试:

API兼容性
思考历史传递
工具调用格式
上下文缓存
并发限制
推理成本
不同Agent框架中的表现
模型安全和权限边界

待正式版开放权重后,相关工具和部署平台可以更快接入。

Qwen3.8目前只支持思考模式

阿里云文档显示,Qwen3.8-Max-Preview当前始终开启思考模式,暂不支持关闭。

模型支持通过reasoning_effort控制推理深度,目前提供:

xhigh
high
low

默认档位为xhigh

这说明Qwen3.8-Max-Preview更偏向复杂推理、代码工程和长程任务,而不是追求最低延迟的简单问答。

对于以下任务,更高思考强度可能带来帮助:

大型项目架构分析
跨文件代码重构
数学和逻辑推理
多步骤数据分析
长篇研究报告
Agent任务规划
复杂Office工作流

但更长的思考过程通常也意味着更高的延迟和计算消耗。

正式版本是否会增加非思考模式或更灵活的混合推理机制,目前尚未公布。

Qwen3.8重点提升代码工程能力

Qwen3.8-Max-Preview首先进入Qoder系列产品,说明代码工程是这一代模型的重要方向。

代码工程能力并不只是根据提示生成一个函数,而是要求模型理解完整项目,并在多个工具之间持续工作。

典型任务包括:

分析数十万行代码
理解模块依赖关系
修改多个相关文件
运行测试并读取错误日志
修复编译和运行问题
迁移框架或依赖版本
调整数据库结构
完成前后端联调
检查安全和兼容性
输出完整变更说明

Qoder官方资料称,Qwen3.8-Max-Preview在全栈开发和复杂长程任务上相较Qwen3.7-Max有所提升。该结论目前主要来自阿里和Qoder自身评测,仍需等待正式技术报告及第三方测试进一步验证。

专业办公与Cowork成为新重点

除了Coding,阿里还反复强调Qwen3.8在Cowork和Office办公工作流中的能力。

所谓Cowork,可以理解为AI与用户围绕真实工作文件和业务任务持续协作。

例如,用户可以要求模型:

读取多个财务表格并制作分析报告
将一批PDF整理为研究材料
根据数据生成图表和PPT
从网页搜集资料并核对来源
制作合同或方案初稿
根据修改意见更新多个文件
自动整理会议资料和行动项
在浏览器中执行连续操作

这类任务需要模型同时具备文件理解、代码执行、浏览器操作、工具调用和成果交付能力。

Qwen3.8接入QoderWork,正是为了将模型放入这些实际工作流中进行测试。

为什么真实用户场景比单一榜单更重要?

模型发布时通常会展示数学、代码、推理和知识问答等基准成绩。

这些数据有助于进行统一比较,但不一定能完整反映模型在真实工作中的表现。

真实用户更加关注:

长任务会不会中途停止
是否能够正确操作本地文件
会不会修改任务范围外的内容
工具调用失败后能否自行恢复
多轮执行后是否遗忘最初要求
输出文档能否直接使用
代码是否能够通过测试
是否会产生错误数据
推理速度和成本是否可接受

预览版先进入Qoder、QoderWork和Token Plan,可以通过大量真实任务发现这些问题。

从产品策略看,阿里是在模型正式开放权重前,将开发者和知识工作者变成更大范围的测试者。这一判断属于基于当前发布路径作出的分析。

预览期推出低折扣活动

Qwen3.8-Max-Preview上线期间,阿里云和Qoder同步推出限时折扣。

Qoder官方页面显示:

使用时段 Credits倍率 相对标准倍率
常规时段08:00—22:00 0.05x 1折
错峰时段22:00—次日08:00 0.01x 0.2折
原标准倍率 0.5x 标准价格

活动时间从2026年7月19日开始,结束时间暂未公布。折扣只影响Credits消耗,不会改变模型质量和上下文长度。

阿里云Token Plan个人版也提供相同的预览期优惠:常规调用Credits低至1折,夜间在此基础上再享2折。

大幅降低预览期使用成本,可以吸引用户运行更多长时间和高消耗任务,为正式版积累更丰富的反馈数据。

Qwen3.8正式版将开放权重

据千问官方消息及多家媒体报道,Qwen3.8正式版将在近期发布并开放权重。

这意味着开发者未来可能获得模型权重,用于研究、部署、微调或构建行业应用。

不过,“开放权重”和“完全开源”并不一定是同一个概念。

正式发布后,还需要关注以下信息:

是否开放基础模型权重
是否开放指令模型权重
使用什么许可证
是否允许商业使用
是否允许模型蒸馏
是否限制特定行业用途
是否公开训练代码
是否提供推理代码
是否提供量化版本
是否支持消费级硬件
是否同步登陆Hugging Face和魔搭社区

在许可证和完整仓库发布前,文章中使用“即将开放权重”会比“已经完整开源”更加准确。

千问家族持续推进开放模型路线

阿里此前已经开放多款Qwen3系列模型,包括稠密模型和混合专家模型。

Qwen3首批模型覆盖0.6B至235B等多个规模,基础模型和指令模型采用Apache 2.0许可证公开,支持开发者下载、部署和二次开发。

千问还围绕不同场景发布了多个开放模型系列:

Qwen3基础语言模型
Qwen3-Coder代码模型
Qwen3-VL视觉语言模型
Qwen3-Embedding向量模型
Qwen-Image图像生成模型
Qwen-Audio语音模型
Qwen-Omni全模态模型

Qwen3.8正式版开放后,将进一步补充千问家族的超大参数旗舰模型。

不过,2.4T参数也会带来较高的显存、存储和集群通信需求。即使权重开放,普通个人电脑预计也很难完整部署。

Qwen3.8与Qwen3.7有什么区别?

目前官方没有发布完整对比表,但根据已公开信息,可以作出以下阶段性比较:

对比项目 Qwen3.7-Max Qwen3.8-Max-Preview
产品状态 正式商用模型 预览模型
模型定位 上一代旗舰Max 新一代旗舰Max
总参数 官方当前页面未在同一口径披露 2.4T
思考模式 支持思考与非思考模式 始终开启思考
推理深度 依接口配置 xhigh、high、low
视觉理解 部分快照支持 支持
代码工程 官方称进一步提升
Cowork办公 支持 重点增强
普通百炼API 已开放 当前仅Token Plan可用
开放权重 未作为同名Max权重开放 正式版拟近期开源

以上比较依据阿里云现有产品文档整理,Qwen3.8最终规格仍可能在正式版中调整。

Qwen3.8正式发布后值得关注什么?

1. 激活参数规模

如果模型采用MoE架构,激活参数将直接影响推理成本和硬件需求。

2. 上下文窗口

长程代码和专业办公需要较大的上下文,但官方目前尚未公布Qwen3.8的具体上限。

3. 多模态范围

阿里云已经确认预览版支持视觉理解,但是否支持视频、音频或更复杂的跨模态输出,仍需等待说明。

4. Agent基准

Qwen3.8重点面向代码工程与Cowork任务,因此SWE-bench、Terminal-Bench、浏览器任务和办公Agent评测更具参考价值。

5. 推理成本

2.4T总参数模型的实际部署价格,将影响开发者是否能够大规模使用。

6. 开放许可证

许可证会决定企业能否商用、微调、蒸馏和重新发布模型。

7. 第三方框架适配

需要观察vLLM、SGLang、llama.cpp、Ollama和Transformers等社区工具是否能够快速支持。

Qwen3.8适合哪些用户提前体验?

软件开发者

适合测试大型项目理解、跨文件重构、Bug修复和终端工具调用。

数据分析人员

可以用于读取表格、编写分析代码、生成图表和整理报告。

产品与运营团队

适合制作方案、研究竞品、整理用户反馈及生成演示文稿。

投研与咨询人员

可尝试处理公司公告、行业报告、财务文件和多来源研究任务。

企业办公团队

可以通过Token Plan团队版或QoderWork测试文档、表格和浏览器自动化流程。

Agent开发者

适合检验模型在规划、工具调用、错误恢复和长任务执行方面的表现。

使用预览版需要注意什么?

能力可能持续变化

预览期间模型会不断调整,同一个任务在不同日期的结果可能存在差异。

不适合未经审核直接进入生产环境

涉及正式代码、财务数据、合同和重要业务决策时,仍需人工检查。

记录模型版本和测试日期

进行团队评测时,应保存使用时间、提示词、推理强度和运行环境,避免不同版本结果难以比较。

注意套餐和Credits限制

低折扣不等于无限使用。用户仍需查看套餐额度、并发限制及子Agent产生的额外调用。

等待正式许可证

计划私有化部署或商业二次开发的团队,应等待正式权重和许可证发布后再作决定。

总结

阿里新一代旗舰模型千问3.8即将正式发布并开放权重。

率先上线的Qwen3.8-Max-Preview总参数达到2.4T,目前已经进入阿里云Token Plan、Qoder和QoderWork,重点面向代码工程、专业办公、数据分析、视觉理解和复杂长程任务。

预览版当前始终开启思考模式,并支持xhigh、high和low三档推理深度。阿里通过低折扣方式鼓励开发者和知识工作者运行更多真实任务,从而在正式发布前检验模型稳定性、工具调用和成果交付能力。

正式版将在近期推出并开放权重,但具体发布日期、激活参数、上下文窗口、完整评测和许可证仍待公布。

从发布路径看,阿里正在把模型评测从实验室榜单扩展到代码工程和真实办公流程。Qwen3.8最终能否在开放后形成更广泛的开发者生态,还要看其实际性能、部署成本、许可证和社区工具适配情况。

相关链接

© 版权声明

相关文章

暂无评论

none
暂无评论...