趋近智
参数
未公开
上下文长度
1M
模态
Multimodal
架构
未公开
许可证
Proprietary
发布日期
19 Feb 2026
训练数据截止日期
Jan 2025
API 价格 (每 1M)
输入: $2.00 · 输出: $12.00
排名
#51
| 基准 | 分数 | 排名 |
|---|---|---|
研究生级问答 | 0.943 | 🥉 3 |
通用文本 | 1487 | 13 |
high 0.79 | 14 | |
LiveBench 平均分 | high 0.77 | 17 |
high 0.77 | 18 | |
high 0.91 | 22 | |
high 0.84 | 31 | |
high 0.76 | 33 | |
high 0.44 | 40 | |
Agent Arena | -5.6 | 44 |
0.69 | 49 | |
Web 开发 | 1447 | 52 |
0.30 | 72 | |
智能体指数 | 0.10 | 96 |
排名
#51
编程排名
#64
Gemini 3.1 Pro 代表了 Google DeepMind 旗舰级多模态模型系列的重大演进,旨在处理复杂的推理和长程任务。在 Gemini 3 Pro 的架构基础上,此版本引入了精炼的训练方法,显著提升了基于逻辑的问题解决能力和算法执行效率。该模型旨在作为复杂智能体工作流的核心引擎,为多轮工具编排和高精度代码生成提供所需的稳定性。
从技术层面来看,该模型保持了原生多模态架构,能够在统一的潜在空间内处理文本、图像、音频、视频和 PDF 文档的交错序列。此版本的创新之处包括扩展的输出能力以及引入了细粒度推理级别,允许开发人员在推理深度和延迟之间进行优化权衡。它专门解决了软件工程和结构化数据分析中的挑战,在执行系统命令和管理大规模代码库的全局依赖项方面,可靠性得到了显著提升。
在实际应用中,Gemini 3.1 Pro 可作为企业级 AI 智能体和自主系统的高容量推理桥梁。其在百万级 Token 上下文窗口中保持连贯性的能力,使其在代码库级代码审计、法律文档综合以及长达数小时的视听分析方面尤为出色。该模型经过优化的输出特性优先考虑简洁、信息密集型的响应,在减少 Token 开销的同时,保持了科学研究和复杂金融建模所需的高语义保真度。
专有模型的架构规格未公开。
注意力
注意力结构
Multi-Head Attention
注意力头
未公开
键值头
未公开
注意力头维度
未公开
位置嵌入
Absolute Position Embedding
RoPE Theta
未公开
滑动窗口注意力
未公开
滑动窗口大小
未公开
滑动窗口比例
未公开
线性注意力
未公开
线性注意力比例
未公开
归一化
未公开
激活函数
未公开
维度
隐藏维度大小
未公开
层数
未公开
FFN 中间层大小(稠密层)
未公开
多 Token 预测头数
未公开
分词器
词汇量大小
未公开
谷歌最新一代多模态模型,在编程、数学、推理和语言理解方面拥有突破性性能。具备超大上下文窗口、原生多模态处理能力,以及极低延迟开销的思考模式。提供针对不同工作负载优化的 Pro 和 Flash 版本,其预览版在多项基准测试中展现出顶尖水平。
Assistant
在线