趋近智
活跃参数
-
上下文长度
1M
模态
Multimodal
架构
Mixture of Experts (MoE)
许可证
-
发布日期
30 Jun 2026
训练数据截止日期
Jan 2026
没有可用的 Claude Sonnet 5 评估基准。
排名
-
编程排名
-
Anthropic 的 Claude Sonnet 5 专为智能体工作流、长程编程和高效推理而构建,默认提供 100 万 token 上下文窗口及自适应思考能力。
注意力
注意力结构
Grouped-Query Attention
注意力头
-
键值头
-
注意力头维度
-
位置嵌入
ROPE
RoPE Theta
-
滑动窗口注意力
-
滑动窗口大小
-
滑动窗口比例
-
线性注意力
-
线性注意力比例
-
归一化
-
激活函数
-
维度
隐藏维度大小
-
层数
-
FFN 中间层大小(稠密层)
-
多 Token 预测头数
-
分词器
词汇量大小
-
混合专家
专家参数总数
-
专家数量
-
活跃专家
-
共享专家数
-
FFN 中间层大小(每专家)
-
MoE 前的稠密层数
-
Anthropic 的 Claude Sonnet 5 于 2026 年 6 月 30 日发布,旨在打造最具智能体(Agentic)能力的 Sonnet 级别模型,以 Sonnet 的价格提供接近 Opus 4.8 水平的智能、编程和工具调用能力。它默认配备 100 万 token 的上下文窗口与 12.8 万最大输出 token,并默认启用自适应思考模式。
APX AI
在线