趋近智
排名
#2
| 基准 | 分数 | 排名 |
|---|---|---|
智能编程 max | 0.65 | 🥈 2 |
Web 开发 max | 1687 | 🥈 2 |
Agent Arena high | 0.14 | 🥉 3 |
推理 max | 0.91 | 🥉 3 |
通用 max | 0.80 | ⭐ 6 |
LiveBench 平均分 max | 0.80 | ⭐ 7 |
0.96 | ⭐ 8 | |
通用文本 high | 1492 | ⭐ 9 |
编程 max | 0.81 | 13 |
数据分析 max | 0.75 | 29 |
排名
#2 🥈
编程排名
#5
Claude Opus 5 是 Anthropic 的旗舰模型,专为高难度推理、高级软件工程以及长程智能体(agentic)工作流而设计。它提供全面的视觉和文档理解能力,并支持 100 万 token 的上下文窗口。
专有模型的详细架构规格有限。
Anthropic 的第四代 Claude 模型,具备先进的推理能力、高达 200K token 的扩展上下文窗口以及可配置的思考强度等级。其特点包括改进的安全对齐、细致入微的理解能力和卓越的任务完成能力。该系列包含 Opus(性能最强)、Sonnet(平衡型)和 Haiku(快速型)三种版本,并提供思考模式以实现针对复杂问题的透明思维链推理。
APX AI
在线