趋近智
活跃参数
2.4T (估算)
上下文长度
1M
模态
Multimodal
架构
Mixture of Experts (MoE)
许可证
Proprietary
发布日期
2 Aug 2026
训练数据截止日期
-
API 价格 (每 1M)
输入: $2.00 · 输出: $6.00
排名
#14
| 基准 | 分数 | 排名 |
|---|---|---|
智能体指数 | 0.56 | 🥉 3 |
Web 开发 | 1681 | 4 |
0.65 | 5 | |
0.78 | 11 | |
LiveBench 平均分 | 0.78 | 11 |
研究生级问答 | 0.926 | 11 |
0.78 | 15 | |
0.88 | 16 | |
0.45 | 17 | |
0.76 | 17 | |
通用文本 | 1481 | 20 |
0.91 | 21 | |
Agent Arena | 0.03 | 21 |
0.73 | 40 |
排名
#14
编程排名
#33
Qwen3.8-Max 是阿里云基于 2.4 万亿参数(95B 激活)混合专家架构构建的托管旗舰级大模型。采用门控 DeltaNet 线性注意力与标准门控注意力的混合设计,具备原生视觉输入能力、默认 100 万 token 上下文窗口、思考与非思考模式切换,以及面向复杂软件工程、科研复现与长周期自主任务的内置智能体工具链。
专有模型的架构规格未公开。
阿里巴巴的 Qwen 3.8 系列代表了面向编程、专业工作、科学研究及长周期智能体任务的前沿混合专家(MoE)架构。该系列具备 2.4 万亿总参数(每个 Token 激活 950 亿参数),将门控 DeltaNet 线性注意力与标准门控注意力相结合,同时提供开源权重与托管旗舰级 API 服务。
Assistant
在线