趋近智
活跃参数
2.4T
上下文长度
1M
模态
Multimodal
架构
Mixture of Experts (MoE)
许可证
Proprietary
发布日期
2 Aug 2026
训练数据截止日期
-
排名
#17
| 基准 | 分数 | 排名 |
|---|---|---|
智能编程 max | 0.65 | 🥇 1 |
智能编程 标准 | 0.65 | 🥇 1 |
Web 开发 max | 1669 | 🥈 2 |
通用 max | 0.78 | 7 |
通用 标准 | 0.78 | 7 |
LiveBench 平均分 max | 0.78 | 7 |
LiveBench 平均分 标准 | 0.78 | 7 |
推理 max | 0.88 | 12 |
0.88 | 12 | |
数据分析 max | 0.78 | 13 |
数据分析 标准 | 0.78 | 13 |
Agent Arena 标准 | 0.06 | 14 |
Agent Arena max | 0.06 | 16 |
通用文本 max | 1481 | ⭐ 16 |
通用文本 标准 | 1481 | ⭐ 16 |
0.91 | 17 | |
0.91 | 17 | |
编程 max | 0.73 | 34 |
编程 标准 | 0.73 | 34 |
排名
#17
编程排名
#77
Qwen3.8-Max 是阿里云基于 2.4 万亿参数(95B 激活)混合专家架构构建的托管旗舰级大模型。采用门控 DeltaNet 线性注意力与标准门控注意力的混合设计,具备原生视觉输入能力、默认 100 万 token 上下文窗口、思考与非思考模式切换,以及面向复杂软件工程、科研复现与长周期自主任务的内置智能体工具链。
专有模型的详细架构规格有限。
阿里巴巴的 Qwen 3.8 系列代表了面向编程、专业工作、科学研究及长周期智能体任务的前沿混合专家(MoE)架构。该系列具备 2.4 万亿总参数(每个 Token 激活 950 亿参数),将门控 DeltaNet 线性注意力与标准门控注意力相结合,同时提供开源权重与托管旗舰级 API 服务。
APX AI
在线