趋近智
参数
未公开
上下文长度
128K
模态
Multimodal
架构
未公开
许可证
Proprietary
发布日期
10 Jan 2026
训练数据截止日期
-
API 价格 (每 1M)
输入: $2.00 · 输出: $8.00
| 基准 | 分数 | 排名 |
|---|---|---|
编程 已归档 | 0.53 | 15 |
排名
-
编程排名
-
NVIDIA Optimus Alpha 提供优化的 AI 推理,重点关注效率和吞吐量。该模型具备针对 NVIDIA GPU 的硬件感知优化,支持在企业环境中进行高性能部署。它在需要持续高吞吐量且保持稳定低延迟的工作负载中表现出色,是需要在 NVIDIA 基础设施上实现大规模可靠性能的生产部署的理想选择。
专有模型的架构规格未公开。
注意力
注意力结构
Multi-Head Attention
注意力头
未公开
键值头
未公开
注意力头维度
未公开
位置嵌入
Absolute Position Embedding
RoPE Theta
未公开
滑动窗口注意力
未公开
滑动窗口大小
未公开
滑动窗口比例
未公开
线性注意力
未公开
线性注意力比例
未公开
归一化
未公开
激活函数
未公开
维度
隐藏维度大小
未公开
层数
未公开
FFN 中间层大小(稠密层)
未公开
多 Token 预测头数
未公开
分词器
词汇量大小
未公开
NVIDIA Optimus Alpha 系列模型结合了先进的 AI 功能与软硬件协同优化技术。该系列专为企业级部署量身定制,旨在 NVIDIA 基础设施上实现高吞吐量、低延迟及高效的资源利用率。
Assistant
在线