Skip to main content
First party

Nvidia

Nvidia is a First party provider with 36 models across 36 offerings.

Access

API base URL
https://integrate.api.nvidia.com/v1
SDK
@ai-sdk/openai-compatible
Environment variables
NVIDIA_API_KEY

Models

List view / Table view

36 of 36 model versions

ModelFamilyProvider model IDProtocolStreamingOrganizationContextMax outputInputOutputReasoningTool callStructuredTemperatureWeightsPriceReleasedUpdated
Inkling
thinkingmachines/inkling
TMThinking MachinesLing
thinkingmachines/inkling
Custom
Yes
1M1M
YesYes-NoYesOpen
input $0/M · output $0/M
2026-07-152026-08-06
Laguna XS 2.1
poolside/laguna-xs-2.1
POPoolsideLaguna
poolside/laguna-xs-2.1
Custom
Yes
262K33K
YesYes-NoYesOpen
input $0/M · output $0/M
2026-07-022026-08-06
GLM-5.2
zhipuai/glm-5.2
ZAZhipu AIGLM
z-ai/glm-5.2
Openai chat
Yes
1M131K
YesYesYesYesOpen
input $0/M · output $0/M
2026-06-132026-08-06
Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b
NVNVIDIANemotron
nvidia/nemotron-3-ultra-550b-a55b
Custom
Yes
1M128K
YesYes-NoYesOpen
input $0.5/M · output $2.5/M
cache read $0.15/M
2026-06-042026-06-04
Nemotron 3.5 Content Safety
nvidia/nemotron-3.5-content-safety
NVNVIDIANemotron
nemotron-3.5-content-safety
Custom
Yes
128K8.2K
Yes-No-NoYesOpenPricing unavailable2026-06-042026-06-04
Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
NVNVIDIANemotron
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
Custom
Yes
256K66K
YesYes-NoYesOpen
input $0/M · output $0/M
2026-04-282026-04-28
Kimi K2.6
moonshotai/kimi-k2.6
MAMoonshot AIKimi
moonshotai/kimi-k2.6
Custom
Yes
262K262K
YesYesYesYesOpen
input $0/M · output $0/M
2026-04-212026-08-06
Nemotron 3 Content Safety
nvidia/nemotron-3-content-safety
NVNVIDIANemotron
nvidia/nemotron-3-content-safety
Custom
Yes
128K4.1K
-No-No-No-NoOpen
input $0/M · output $0/M
2026-04-162026-04-16
Gemma 4 31B IT
google/gemma-4-31b-it
GOGoogleGemma
google/gemma-4-31b-it
Custom
Yes
262K33K
YesYesYesYesOpen
input $0/M · output $0/M
2026-04-022026-08-06
Llama Nemotron Rerank VL 1B v2
nvidia/llama-nemotron-rerank-vl-1b-v2
NVNVIDIANemotron
nvidia/llama-nemotron-rerank-vl-1b-v2
Custom
Yes
128K4.1K
-No-No-No-NoOpen
input $0/M · output $0/M
2026-03-312026-03-31
Nemotron Cascade 2 30B A3B
nvidia/nemotron-cascade-2-30b-a3b
NVNVIDIANemotron
nemotron-cascade-2-30b-a3b
Custom
Yes
256K33K
YesYes-NoYesOpenPricing unavailable2026-03-242026-04-09
Nemotron VoiceChat
nvidia/nemotron-voicechat
NVNVIDIANemotron
nvidia/nemotron-voicechat
Custom
Yes
128K8.2K
-NoYes-NoYesOpen
input $0/M · output $0/M
2026-03-162026-03-16
Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b
NVNVIDIANemotron
nvidia/nemotron-3-super-120b-a12b
Custom
Yes
262K262K
YesYes-NoYesOpen
input $0.2/M · output $0.8/M
2026-03-112026-03-12
Qwen3.5 122B-A10B
alibaba/qwen3.5-122b-a10b
ALAlibabaQwen
qwen/qwen3.5-122b-a10b
Openai chat
Yes
262K66K
YesYesYesYesOpen
input $0/M · output $0/M
2026-02-232026-08-06
Qwen3.5 397B-A17B
alibaba/qwen3.5-397b-a17b
ALAlibabaQwen
qwen/qwen3.5-397b-a17b
Openai chat
Yes
262K66K
YesYesYesYesOpen
input $0/M · output $0/M
2026-02-152026-08-06
Llama Nemotron Embed VL 1B v2
nvidia/llama-nemotron-embed-vl-1b-v2
NVNVIDIANemotron
nvidia/llama-nemotron-embed-vl-1b-v2
Custom
Yes
33K2K
-No-No-No-NoOpen
input $0/M · output $0/M
2026-02-102026-02-10
Nemotron Content Safety Reasoning 4B
nvidia/nemotron-content-safety-reasoning-4b
NVNVIDIANemotron
nvidia/nemotron-content-safety-reasoning-4b
Custom
Yes
128K4.1K
Yes-No-No-NoOpen
input $0/M · output $0/M
2026-01-222026-01-22
Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b
NVNVIDIANemotron
nvidia/nemotron-3-nano-30b-a3b
Custom
Yes
262K262K
YesYes-NoYesOpen
input $0/M · output $0/M
2025-12-152025-12-15
Llama 3.1 Nemotron Safety Guard 8B v3
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
NVNVIDIANemotron
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
Custom
Yes
128K4.1K
-No-No-No-NoOpen
input $0/M · output $0/M
2025-10-282025-10-28
Nemotron Nano 12B v2 VL
nvidia/nemotron-nano-12b-v2-vl
NVNVIDIANemotron
nvidia/nemotron-nano-12b-v2-vl
Custom
Yes
128K128K
YesYes-NoYesOpen
input $0/M · output $0/M
2025-10-282025-10-28
Qwen3-Next 80B-A3B Instruct
alibaba/qwen3-next-80b-a3b-instruct
ALAlibabaQwen
qwen/qwen3-next-80b-a3b-instruct
Openai chat
Yes
131K33K
-NoYesYesYesOpen
input $0/M · output $0/M
2025-092026-08-06
Nemotron Nano 9B v2
nvidia/nemotron-nano-9b-v2
NVNVIDIANemotron
nemotron-nano-9b-v2
Custom
Yes
131K131K
YesYes-NoYesOpenPricing unavailable2025-08-182025-08-18
gpt-oss-120b
openai/gpt-oss-120b
OPOpenAIGPT
openai/gpt-oss-120b
Custom
Yes
131K131K
YesYesYesYesOpen
input $0/M · output $0/M
2025-08-052026-08-06
gpt-oss-20b
openai/gpt-oss-20b
OPOpenAIGPT
openai/gpt-oss-20b
Custom
Yes
131K131K
YesYesYesYesOpen
input $0/M · output $0/M
2025-08-052026-08-06
Llama 3.3 Nemotron Super 49B v1.5
nvidia/llama-3.3-nemotron-super-49b-v1.5
NVNVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1.5
Custom
Yes
131K131K
YesYes-NoYesOpen
input $0/M · output $0/M
2025-07-252025-07-25
Mistral Nemotron
nvidia/mistral-nemotron
NVNVIDIANemotron
mistral-nemotron
Custom
Yes
128K8.2K
-NoYes-NoYesOpenPricing unavailable2025-06-112025-06-12
Gemma 3n 4B
google/gemma-3n-e4b-it
GOGoogleGemma
google/gemma-3n-e4b-it
Openai chat
Yes
33K-
-No-NoYesYesOpen
input $0/M · output $0/M
2025-05-202026-08-06
Llama 3.1 Nemotron 70B Instruct
nvidia/llama-3.1-nemotron-70b-instruct
NVNVIDIANemotron
nvidia/llama-3.1-nemotron-70b-instruct
Custom
Yes
128K8.2K
-NoYes-NoYesOpen
input $0/M · output $0/M
2025-04-152025-04-15
Llama 3.1 Nemotron Ultra 253B
nvidia/llama-3.1-nemotron-ultra-253b
NVNVIDIANemotron
llama-3.1-nemotron-ultra-253b
Custom
Yes
128K8.2K
YesYes-NoYesOpenPricing unavailable2025-04-072025-04-07
Llama 3.3 Nemotron Super 49B v1
nvidia/llama-3.3-nemotron-super-49b-v1
NVNVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1
Custom
Yes
131K131K
YesYes-NoYesOpen
input $0/M · output $0/M
2025-04-072025-08-08
Gemma 3 12B
google/gemma-3-12b-it
GOGoogleGemma
google/gemma-3-12b-it
Openai chat
Yes
131K16K
-NoYesYesYesOpen
input $0/M · output $0/M
2025-03-132026-08-06
Gemma 3 4B
google/gemma-3-4b-it
GOGoogleGemma
google/gemma-3-4b-it
Openai chat
Yes
131K16K
-No-NoYesYesOpen
input $0/M · output $0/M
2025-03-132026-08-06
Llama-3.3-70B-Instruct
meta/llama-3.3-70b-instruct
MEMetaLlama
meta/llama-3.3-70b-instruct
Custom
Yes
128K4.1K
-NoYesYesYesOpen
input $0/M · output $0/M
2024-12-062026-08-06
Whisper 3 Large
openai/whisper-large-v3
OPOpenAIWhisper
openai/whisper-large-v3
Custom
Yes
4484.1K
-No-No-No-NoOpen
input $0/M · output $0/M
2024-10-012026-03-17
Nemotron Mini 4B Instruct
nvidia/nemotron-mini-4b-instruct
NVNVIDIANemotron
nvidia/nemotron-mini-4b-instruct
Custom
Yes
128K8.2K
-NoYes-NoYesOpen
input $0/M · output $0/M
2024-08-212024-08-26
Mixtral 8x22B Instruct
mistral/mixtral-8x22b-0-1-0-3
MAMistral AIMixtral
mistralai/mixtral-8x22b-instruct
Openai chat
Yes
66K-
-NoYesYesYesOpen
input $0/M · output $0/M
2024-04-172026-08-06

FAQ