公司动态
Qwen3.8-Max 正式版今日上线:MoE 2.4T 参数、100 万上下文、下周开源,接入方式全解
阿里巴巴通义千问团队于 2026 年 8 月 3 日正式发布 Qwen3.8-Max参数量达 2.4 万亿2.4T采用 MoE 稀疏激活架构激活参数约 95B是 Qwen 家族迄今规模最大的模型也是全球开源模型中第二个参数规模突破 2T 的版本。官方称其在编程Coding和专业办公Cowork两个核心方向全面升级第三方盲测榜单综合能力仅次于 Claude。模型权重将于下周开源届时同步开源 Qwen3.8-27B目前 API 已正式上线支持图像、视频、文档与文本全模态输入上下文窗口达 100 万 token。今天发布了什么2026 年 8 月 3 日阿里巴巴通义千问正式发布 Qwen3.8-Max 正式版。这不是新模型而是今年 7 月 19 日上线的 Qwen3.8-Max-Preview 预览版的正式版本——同一套架构经过系统性后训练迭代稳定性和综合能力显著提升。同步宣布的关键信息下周开源模型权重Qwen3.8-Max 将成为千问历史上首个开源的 Max 级权重版本同步开源 Qwen3.8-27B 稠密模型千问办公开启公测面向非开发者的 AI 办公智能体产品搭载 Qwen3.8-Max 同步开放API 正式上线可通过阿里云百炼、QwenCloud、Qoder 等平台调用不再是预览限流状态从预览版到正式版的核心变化官方的描述是以「天」为单位持续迭代编程和前端开发能力提升尤为明显。架构2.4T 参数、95B 激活、100 万上下文Qwen3.8-Max 是目前千问系列规模最大的模型核心架构参数参数数值总参数量2.4 万亿2.4T激活参数约 95B上下文窗口1M tokens约 100 万最大输入991K tokens最大输出131K tokens推理思维链上限262K tokensMoE 稀疏架构的意义在于总参数 2.4T每次推理只激活约 95B运算量接近 100B 级稠密模型但拥有更大参数量带来的知识容量和泛化能力。这也是为什么模型在保持推理效率的同时能覆盖法律、金融、设计等数百个专业领域任务。架构上与上一代的核心升级点是混合注意力机制——结合了标准 Multi-Head Attention 与线性注意力在处理超长文档100 万 token 量级时兼顾精度和效率不会因为上下文过长而显著降速。能力亮点16 天自主编程搓出一个 Hermes Agent官方最具冲击力的演示案例是Qwen3.8-Max 在 16 天内自主完成了一个完整 AI 编程框架Hermes Agent的编写——从需求分析、架构设计、代码实现到调试迭代全程无人工介入最终产出可运行的完整项目。这是在说一件具体的事长程自主执行能力。AI 不只是写代码片段而是能在「目标→规划→执行→反馈→修正」的循环中持续工作十几天覆盖跨越多个模块的完整工程任务。这正是 Qwen3.8 定义的核心升级方向——不是在单题 Benchmark 上多一两个百分点而是在真实工程任务中能端到端跑通。其他能力亮点原生全模态千问首个 Max 级别同时支持图像、视频、长文档、文本输入的模型视觉理解与文本推理在同一系统内处理专业领域覆盖官方称覆盖法律、金融、设计等数百个垂直领域可用于合同审查、财务分析、产品设计等场景工具调用内置原生支持code_interpreter、web_search、web_extractor、t2i_search文生图等工具可直接调用执行第三方榜单仅次于 Claude官方的口径是「综合能力仅次于 Fable 5Claude」。来自第三方独立评测的数据多个第三方盲测在总分上把 Qwen3.8-Max 排在全球第二仅次于 Claude Fable 5上一代 Qwen3.7-Max 的公开 SWE-bench Pro 成绩是 60.6%Qwen3.8 正式版的跑分结果预计很快发布第三方实测非官方基准里Qwen3.8-Max-Preview 在编程和前端任务上的输出质量被部分评测者描述为优于 Kimi K3 实测体验——尽管 Kimi K3 的官方 SWE-bench 数字更高值得注意的局限截至发布日官方尚未公布标准化 Benchmark 成绩SWE-bench Verified / Pro、LiveCodeBench 等。第三方的「仅次于 Fable 5」判断基于盲测主观评分不等同于经审计的客观基准。Claude Fable 5 的 SWE-bench Verified 成绩是 95%如果 Qwen3.8 正式版达到 70% 以上才算坐实第二梯队的定位。官方成绩公布前实测验证比参考榜单口径更有意义。开源计划与时间线事件时间Qwen3.8-Max-Preview 上线2026 年 7 月 19 日Qwen3.8-Max 正式版发布2026 年 8 月 3 日今日Qwen3.8-Max 权重开源下周预计 2026 年 8 月 10 日前后Qwen3.8-27B 同步开源同上这是千问历史上首次把 Max 级别2T 参数规模的权重开放出来。此前千问系列的开源版本最大到几百亿参数级别如 Qwen3.6-35B万亿级一直只在闭源 API 里提供。同步开源的 Qwen3.8-27B 是稠密模型版本27B 参数量适合有 2×A100 或 4×A6000 级别算力的团队本地部署——不依赖 API数据完全自控。API 定价2026 年 8 月QwenCloud 国际站定价计费类型价格输入2 美元 / 百万 token输出6 美元 / 百万 token输入隐式缓存命中0.25 美元 / 百万 token显式缓存读取0.17 美元 / 百万 token缓存命中时输入成本从 2 美元降到 0.25 美元节省 87.5%。对于 RAG、长文档分析这类多次查询同一上下文的场景缓存命中率高实际成本远低于标价。国内阿里云百炼平台提供单独定价且有活动折扣Token Plan 套餐。和主流模型怎么选模型总参数输出定价每百万 token开源上下文Qwen3.8-Max2.4T激活 95B6 美元下周开源1MClaude Fable 5闭源未公开闭源按订阅否200KDeepSeek V4-Pro未公开2 元/百万约 0.28 美元部分开源131KKimi K3未公开约 1-3 元/百万否128K选 Qwen3.8-Max 的场景需要 100 万 token 超长上下文分析整本代码库、长法律文件、长视频字幕需要全模态输入图文视频混合任务看重即将开源的权重下周可本地部署大参数量模型专业垂直领域任务法律、金融、设计需要大参数量支撑的知识覆盖选 DeepSeek V4-Flash 的场景高频 Agent 调用成本优先2 元/百万 token 输出约 Qwen3.8-Max 的 1/20Codex 工作流接入优先 Responses API 原生支持对开发者来说现在该做什么立即可用Qwen3.8-Max API 已正式上线通过阿里云百炼或 QwenCloud 可以直接调用。若你用的是多模型统一接入方案调用时改model字段为qwen3.8-max即可切换无需改动其他配置。等开源权重如果你的需求是本地部署——特别是对数据隐私有要求或者想在私有算力上跑 2.4T 量级的模型——等下周的开源权重更有意义。Qwen3.8-27B 的稠密版本是落地性价比更高的选择。多模型对比测试Qwen3.8-Max 正式版上线后官方跑分还没出来实测是最可靠的验证手段。如果你的 Agent 工作流或专业领域任务在 Qwen3.7-Max 上已经有基准拿同样的任务集跑一遍对比是最直接的判断依据。通过七牛云 AI Token Plan 可以在同一套 API Key 下调用包括 Qwen3.8 在内的多款主流国内大模型切换模型只改model字段不需要维护多套鉴权配置适合需要在多模型间做横向测试的团队qiniu.com/ai/plan。常见问题QQwen3.8-Max 和 Qwen3.8-Max-Preview 有什么区别Preview 是预览版以「天」为单位快速迭代功能完整但稳定性和部分任务质量偏低。正式版是在预览版基础上完成系统性后训练和评估后的稳定版本官方称编程和前端能力提升明显。API 模型 ID 由qwen3.8-max-preview切换为qwen3.8-max。Q2.4T 参数为什么可以只激活 95BMoE混合专家架构的特性。整个模型被切分为大量「专家」子网络每次推理时由路由层动态选择少量专家激活参与计算不激活的专家参数存在内存里但不参与运算。结果是推理计算量等同于 95B 稠密模型但参数量里的知识容量远超 95B。Q下周开源后本地部署需要多少算力Qwen3.8-Max2.4T 参数FP16/BF16 约需 4.8TB 显存目前超出消费级硬件范围需要大规模 GPU 集群。但同步开源的 Qwen3.8-27B 稠密版本要求合理得多——27B 参数 FP16 约需 54GB 显存2 张 A100 80G 或 4 张 RTX 4090 可以跑起来。Q上下文 100 万 token 实际能用来做什么100 万 token 约等于 75 万英文单词或 50 万汉字可以容纳整本中篇小说全文、中等规模代码库的所有文件、数小时的视频字幕、数百页的法律或金融文件。对于需要「把整个项目放进上下文」做分析的 Agent 任务100 万上下文是关键能力门槛。Q千问办公和 WorkBuddy 是竞品吗定位相近——都是面向非开发者的 AI 办公智能体。千问办公由阿里巴巴官方出品深度绑定 Qwen3.8-MaxWorkBuddy 由腾讯云出品支持自定义接入多款模型。前者的优势在于模型原生性后者的优势在于更开放的模型选择和 IM 集成能力。小结Qwen3.8-Max 正式版今天2026 年 8 月 3 日上线两件事值得记住一是「下周开源」——千问历史上首次把 Max 级权重放出来届时 Qwen3.8-27B 也同步可以本地部署二是「16 天自主编程」的 Hermes Agent 案例说明长程 Agent 执行能力已经超出演示范畴进入真实工程可用的边界。SWE-bench 等标准跑分在官方正式公布前仍有待观察实测验证比参考榜单口径更可靠。数据来源阿里云 Qwen 官方公告2026 年 8 月 3 日、QwenCloud 模型页面qwencloud.com/models/qwen3.8-max、InfoQ / 快科技 / OSCHINA 发布报道2026 年 8 月 3 日、第三方评测汇总2026 年 7-8 月。延伸阅读Qwen3.8-Max API 文档与定价qwencloud.com/models/qwen3.8-max七牛云 AI Token Plan多模型统一 API Keyqiniu.com/ai/plan