跳过主要内容
第一方

Nvidia

Nvidia 是一个第一方提供商,收录 31 个模型和 31 个接入项。

接入

API 基础地址
https://integrate.api.nvidia.com/v1
SDK
@ai-sdk/openai-compatible
环境变量
NVIDIA_API_KEY

模型

列表视图 / 表格视图

显示 31 / 31 个模型版本

模型组织家族提供商模型 ID协议流式输出上下文最大输出输入输出推理工具调用结构化输出温度参数权重价格发布日期更新时间
Inkling
thinkingmachines/inkling
TMThinking MachinesLing
thinkingmachines/inkling
Custom
1M1M
文本图像音频
文本
-开放权重
输入 $0/M
输出 $0/M
2026-07-152026-07-17
Laguna XS 2.1
poolside/laguna-xs-2.1
POPoolsideLaguna
poolside/laguna-xs-2.1
Custom
262K33K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2026-07-022026-07-02
GLM-5.2
zhipuai/glm-5.2
Zhipu AIGLM
z-ai/glm-5.2
Openai chat
1M131K
文本
文本
开放权重
输入 $0/M
输出 $0/M
2026-06-132026-07-22
Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b
NVIDIANemotron
nvidia/nemotron-3-ultra-550b-a55b
Custom
1M128K
文本
文本
-开放权重
输入 $0.5/M · 缓存读取 $0.15/M
输出 $2.5/M
2026-06-042026-06-04
Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
NVIDIANemotron
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
Custom
256K66K
文本图像视频音频
文本
-开放权重
输入 $0/M
输出 $0/M
2026-04-282026-04-28
Kimi K2.6
moonshotai/kimi-k2.6
Moonshot AIKimi
moonshotai/kimi-k2.6
Custom
262K262K
文本图像视频
文本
开放权重
输入 $0/M
输出 $0/M
2026-04-212026-07-22
Nemotron 3 Content Safety
nvidia/nemotron-3-content-safety
NVIDIANemotron
nvidia/nemotron-3-content-safety
Custom
128K4.1K
文本
文本
----开放权重
输入 $0/M
输出 $0/M
2026-04-162026-04-16
Gemma 4 31B IT
google/gemma-4-31b-it
GoogleGemma
google/gemma-4-31b-it
Custom
262K33K
文本图像
文本
开放权重
输入 $0/M
输出 $0/M
2026-04-022026-04-30
Llama Nemotron Rerank VL 1B v2
nvidia/llama-nemotron-rerank-vl-1b-v2
NVIDIANemotron
nvidia/llama-nemotron-rerank-vl-1b-v2
Custom
128K4.1K
文本图像
文本
----开放权重
输入 $0/M
输出 $0/M
2026-03-312026-03-31
Nemotron VoiceChat
nvidia/nemotron-voicechat
NVIDIANemotron
nvidia/nemotron-voicechat
Custom
128K8.2K
文本音频
文本
--开放权重
输入 $0/M
输出 $0/M
2026-03-162026-03-16
Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b
NVIDIANemotron
nvidia/nemotron-3-super-120b-a12b
Custom
262K262K
文本
文本
-开放权重
输入 $0.2/M
输出 $0.8/M
2026-03-112026-03-12
Qwen3.5 122B-A10B
alibaba/qwen3.5-122b-a10b
AlibabaQwen
qwen/qwen3.5-122b-a10b
Openai chat
262K66K
文本图像视频音频
文本
开放权重
输入 $0/M
输出 $0/M
2026-02-232026-03-18
Qwen3.5 397B-A17B
alibaba/qwen3.5-397b-a17b
AlibabaQwen
qwen/qwen3.5-397b-a17b
Openai chat
262K66K
文本图像视频音频
文本
开放权重
输入 $0/M
输出 $0/M
2026-02-152026-06-11
Llama Nemotron Embed VL 1B v2
nvidia/llama-nemotron-embed-vl-1b-v2
NVIDIANemotron
nvidia/llama-nemotron-embed-vl-1b-v2
Custom
33K2K
文本图像
文本
----开放权重
输入 $0/M
输出 $0/M
2026-02-102026-02-10
Nemotron Content Safety Reasoning 4B
nvidia/nemotron-content-safety-reasoning-4b
NVIDIANemotron
nvidia/nemotron-content-safety-reasoning-4b
Custom
128K4.1K
文本
文本
---开放权重
输入 $0/M
输出 $0/M
2026-01-222026-01-22
Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b
NVIDIANemotron
nvidia/nemotron-3-nano-30b-a3b
Custom
262K262K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2025-12-152025-12-15
Llama 3.1 Nemotron Safety Guard 8B v3
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
NVIDIANemotron
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
Custom
128K4.1K
文本
文本
----开放权重
输入 $0/M
输出 $0/M
2025-10-282025-10-28
Nemotron Nano 12B v2 VL
nvidia/nemotron-nano-12b-v2-vl
NVIDIANemotron
nvidia/nemotron-nano-12b-v2-vl
Custom
128K128K
文本图像视频
文本
-开放权重
输入 $0/M
输出 $0/M
2025-10-282025-10-28
Qwen3-Next 80B-A3B Instruct
alibaba/qwen3-next-80b-a3b-instruct
AlibabaQwen
qwen/qwen3-next-80b-a3b-instruct
Openai chat
131K33K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2025-092026-07-22
GPT OSS 120B
openai/gpt-oss-120b
OpenAIGPT
openai/gpt-oss-120b
Custom
131K33K
文本
文本
开放权重
输入 $0/M
输出 $0/M
2025-08-052026-07-22
GPT OSS 20B
openai/gpt-oss-20b
OpenAIGPT
openai/gpt-oss-20b
Custom
131K33K
文本
文本
开放权重
输入 $0/M
输出 $0/M
2025-08-052026-03-01
Llama 3.3 Nemotron Super 49B v1.5
nvidia/llama-3.3-nemotron-super-49b-v1.5
NVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1.5
Custom
131K131K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2025-07-252025-07-25
Gemma 3n 4B
google/gemma-3n-e4b-it
GoogleGemma
google/gemma-3n-e4b-it
Openai chat
33K-
文本
文本
--开放权重
输入 $0/M
输出 $0/M
2025-05-202025-06-03
Llama 3.1 Nemotron 70B Instruct
nvidia/llama-3.1-nemotron-70b-instruct
NVIDIANemotron
nvidia/llama-3.1-nemotron-70b-instruct
Custom
128K8.2K
文本
文本
--开放权重
输入 $0/M
输出 $0/M
2025-04-152025-04-15
Llama 3.3 Nemotron Super 49B v1
nvidia/llama-3.3-nemotron-super-49b-v1
NVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1
Custom
131K131K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2025-04-072025-08-08
Gemma 3 12B
google/gemma-3-12b-it
GoogleGemma
google/gemma-3-12b-it
Openai chat
131K16K
文本图像
文本
-开放权重
输入 $0/M
输出 $0/M
2025-03-132025-03-13
Gemma 3 4B
google/gemma-3-4b-it
GoogleGemma
google/gemma-3-4b-it
Openai chat
131K16K
文本图像
文本
--开放权重
输入 $0/M
输出 $0/M
2025-03-132025-03-13
Llama-3.3-70B-Instruct
meta/llama-3.3-70b-instruct
MetaLlama
meta/llama-3.3-70b-instruct
Custom
128K4.1K
文本
文本
-开放权重
输入 $0/M
输出 $0/M
2024-12-062026-07-22
Whisper 3 Large
openai/whisper-large-v3
OpenAIWhisper
openai/whisper-large-v3
Custom
4484.1K
音频
文本
----开放权重
输入 $0/M
输出 $0/M
2024-10-012026-03-17
Nemotron Mini 4B Instruct
nvidia/nemotron-mini-4b-instruct
NVIDIANemotron
nvidia/nemotron-mini-4b-instruct
Custom
128K8.2K
文本
文本
--开放权重
输入 $0/M
输出 $0/M
2024-08-212024-08-26
Mixtral 8x22B Instruct
mistral/mixtral-8x22b-instruct
Mistral AIMixtral
mistralai/mixtral-8x22b-instruct
Openai chat
66K-
文本文档
文本
-开放权重
输入 $0/M
输出 $0/M
2024-04-172024-04-17

常见问题