阿里巴巴发布2.4万亿参数Qwen3.8-Max:百万上下文、开放权重、API即用 阿里巴巴于2026年8月发布Qwen3.8-Max模型总参数达2.4万亿激活参数约950亿。该模型支持最高100万token上下文窗口已通过QwenCloud API开放调用开放权重计划在8月10日所在周通过Hugging Face和ModelScope发布。模型核心规格Qwen3.8-Max基于Qwen3.5架构构建支持文本、图像和视频输入输出为文本。关键参数如下总参数2.4万亿激活参数约950亿推理时仅部分参数参与降低计算成本和延迟上下文窗口最高100万token最大输入长度99.1万token思考模式下略有降低最大输出13.1万token推理预算上限26.2万tokenAPI定价每百万输入token 2美元每百万输出token 6美元缓存读取成本更低接口兼容OpenAI和DashScope接口集成仅需修改基础URL和模型ID基准表现基准测试Qwen3.8-Max对比Terminal-Bench 2.186.6高于Claude Opus 4.8和Fable 5的84.6仅次于GPT-5.6 Sol的88.8SWE-bench Pro67.7低于Fable 5FrontierSWE73.5低于Fable 5PaperBench93.0—IFBench82.8—GPQA Diamond92.6—OSWorld-Verified86.1视觉相关居前列Parametric CAD Bench91.5视觉相关居前列长时程自主执行能力内部测试显示该模型能独立完成长周期任务自主编码演示从空仓库开始连续运行超过16天生成265次提交、127个拉取请求和151个问题包含自动化构建、单元测试和恢复机制论文复现实验连续工作125小时编写7600行代码完成1100余次操作和33轮GPU训练最终方法使AIME24基准提升2.7个百分点开放权重的产业影响此前Qwen系列Max级别模型未开放权重此次计划公开2.4万亿参数版本及27B小模型允许用户在本地部署和微调。27B版本适合普通GPU硬件而2.4万亿版本仍需多节点数据中心环境。开放后软件工程、法律文档审查、媒体运营和设计等领域可直接使用仓库级编码代理和长视频索引工具。市场即时反应为阿里股价在香港市场单日上涨7.3%。分析人士指出中国开发者在芯片限制下仍能快速缩小与Anthropic、OpenAI的差距此次发布是又一例证。技术判断模型激活参数仅950亿推理时仅部分参数参与降低了计算成本和延迟。这反映出混合专家架构在效率上的实际优化而非单纯追求总参数规模。长时程自主执行能力来自对反馈循环、任务分配和异常恢复的内置支持使模型能将用户输入转化为可执行项目而非单次回答。与Fable 5在部分基准接近或超越表明中国团队在多模态代理和长文档处理上的针对性投入已产生可量化结果。开放权重决定可能源于对生态构建的考量通过允许第三方定制加速应用落地。本文首发于赢政天下 (https://www.winzheng.com)获取更多深度技术内容与资源欢迎访问官网。