趋近智
排名
#73
| 基准 | 分数 | 排名 |
|---|---|---|
0.87 | 18 | |
LiveBench 平均分 | 0.76 | 21 |
专业知识 | 0.84 | 23 |
通用文本 auto | 1466 | 37 |
通用文本 标准 | 1459 | 49 |
Web 开发 | 1211 | 94 |
排名
#73
编程排名
#92
Grok 4.1 在实际可用性方面带来了显著提升,具备卓越的创意、情感和协作能力。该版本利用前沿的智能体推理模型作为奖励模型,针对风格、个性、有用性和对齐进行了优化。它在 LMArena 文本排行榜上表现出色,思考模式以 1483 Elo 分位居榜首,非思考模式以 1465 Elo 分位列第二,超越了所有其他模型。其特性包括 200 万 (2M) 上下文窗口、幻觉率大幅降低(在生产环境查询中从 12.09% 降至 4.22%),以及业内顶尖的情感智能(在 EQ-Bench 上达到 1586 Elo)。用户可通过 API 调用其推理模式和快速非推理模式。
专有模型的详细架构规格有限。
APX AI
在线