Skip to main content
First party

Nvidia

Nvidia is a First party provider with 31 models across 31 offerings.

Access

API base URL
https://integrate.api.nvidia.com/v1
SDK
@ai-sdk/openai-compatible
Environment variables
NVIDIA_API_KEY

Protocols

Openai chatCustom

Organizations

OrganizationFamiliesModels
Alibaba13
Google14
Meta11
Mistral AI11
Moonshot AI11
NVIDIA115
OpenAI23
POPoolside11
TMThinking Machines11
Zhipu AI11

Models

List view / Table view

31 of 31 model versions

ModelOrganizationFamilyProvider model IDContextMax outputInputOutputReasoningTool callStructuredTemperatureWeightsPricingReleasedUpdated
Inkling
thinkingmachines/ling/inkling
TMThinking MachinesLing
thinkingmachines/inkling
Custom · Streaming
1M1M
TextImageAudio
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2026-07-152026-07-17
Laguna XS 2.1
poolside/laguna/xs-2-1
POPoolsideLaguna
poolside/laguna-xs-2.1
Custom · Streaming
262K33K
Text
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2026-07-022026-07-02
GLM-5.2
zhipuai/glm/5-2
Zhipu AIGLM
z-ai/glm-5.2
Openai chat · Streaming
1M131K
Text
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2026-06-132026-07-22
Nemotron 3 Ultra 550B A55B
nvidia/nemotron/3-ultra-550b-a55b
NVIDIANemotron
nvidia/nemotron-3-ultra-550b-a55b
Custom · Streaming
1M128K
Text
Text
YesYes-NoYesOpen weight
input $0.5/M · cache read $0.15/M
output $2.5/M
2026-06-042026-06-04
Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron/3-nano-omni-30b-a3b-reasoning
NVIDIANemotron
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
Custom · Streaming
256K66K
TextImageVideoAudio
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2026-04-282026-04-28
Kimi K2.6
moonshotai/kimi/k2-6
Moonshot AIKimi
moonshotai/kimi-k2.6
Custom · Streaming
262K262K
TextImageVideo
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2026-04-212026-07-22
Nemotron 3 Content Safety
nvidia/nemotron/3-content-safety
NVIDIANemotron
nvidia/nemotron-3-content-safety
Custom · Streaming
128K4.1K
Text
Text
-No-No-No-NoOpen weight
input $0/M
output $0/M
2026-04-162026-04-16
Gemma 4 31B IT
google/gemma/4-31b-it
GoogleGemma
google/gemma-4-31b-it
Custom · Streaming
262K33K
TextImage
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2026-04-022026-04-30
Llama Nemotron Rerank VL 1B v2
nvidia/nemotron/llama-nemotron-rerank-vl-1b-v2
NVIDIANemotron
nvidia/llama-nemotron-rerank-vl-1b-v2
Custom · Streaming
128K4.1K
TextImage
Text
-No-No-No-NoOpen weight
input $0/M
output $0/M
2026-03-312026-03-31
Nemotron VoiceChat
nvidia/nemotron/voicechat
NVIDIANemotron
nvidia/nemotron-voicechat
Custom · Streaming
128K8.2K
TextAudio
Text
-NoYes-NoYesOpen weight
input $0/M
output $0/M
2026-03-162026-03-16
Nemotron 3 Super 120B A12B
nvidia/nemotron/3-super-120b-a12b
NVIDIANemotron
nvidia/nemotron-3-super-120b-a12b
Custom · Streaming
262K262K
Text
Text
YesYes-NoYesOpen weight
input $0.2/M
output $0.8/M
2026-03-112026-03-12
Qwen3.5 122B-A10B
alibaba/qwen/qwen3-5-122b-a10b
AlibabaQwen
qwen/qwen3.5-122b-a10b
Openai chat · Streaming
262K66K
TextImageVideoAudio
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2026-02-232026-03-18
Qwen3.5 397B-A17B
alibaba/qwen/qwen3-5-397b-a17b
AlibabaQwen
qwen/qwen3.5-397b-a17b
Openai chat · Streaming
262K66K
TextImageVideoAudio
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2026-02-152026-06-11
Llama Nemotron Embed VL 1B v2
nvidia/nemotron/llama-nemotron-embed-vl-1b-v2
NVIDIANemotron
nvidia/llama-nemotron-embed-vl-1b-v2
Custom · Streaming
33K2K
TextImage
Text
-No-No-No-NoOpen weight
input $0/M
output $0/M
2026-02-102026-02-10
Nemotron Content Safety Reasoning 4B
nvidia/nemotron/content-safety-reasoning-4b
NVIDIANemotron
nvidia/nemotron-content-safety-reasoning-4b
Custom · Streaming
128K4.1K
Text
Text
Yes-No-No-NoOpen weight
input $0/M
output $0/M
2026-01-222026-01-22
Nemotron 3 Nano 30B A3B
nvidia/nemotron/3-nano-30b-a3b
NVIDIANemotron
nvidia/nemotron-3-nano-30b-a3b
Custom · Streaming
262K262K
Text
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2025-12-152025-12-15
Llama 3.1 Nemotron Safety Guard 8B v3
nvidia/nemotron/llama-3-1-nemotron-safety-guard-8b-v3
NVIDIANemotron
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
Custom · Streaming
128K4.1K
Text
Text
-No-No-No-NoOpen weight
input $0/M
output $0/M
2025-10-282025-10-28
Nemotron Nano 12B v2 VL
nvidia/nemotron/nano-12b-v2-vl
NVIDIANemotron
nvidia/nemotron-nano-12b-v2-vl
Custom · Streaming
128K128K
TextImageVideo
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2025-10-282025-10-28
Qwen3-Next 80B-A3B Instruct
alibaba/qwen/qwen3-next-80b-a3b-instruct
AlibabaQwen
qwen/qwen3-next-80b-a3b-instruct
Openai chat · Streaming
131K33K
Text
Text
-NoYesYesYesOpen weight
input $0/M
output $0/M
2025-092026-07-22
GPT OSS 120B
openai/gpt/oss-120b
OpenAIGPT
openai/gpt-oss-120b
Custom · Streaming
131K33K
Text
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2025-08-052026-07-22
GPT OSS 20B
openai/gpt/oss-20b
OpenAIGPT
openai/gpt-oss-20b
Custom · Streaming
131K33K
Text
Text
YesYesYesYesOpen weight
input $0/M
output $0/M
2025-08-052026-03-01
Llama 3.3 Nemotron Super 49B v1.5
nvidia/nemotron/llama-3-3-nemotron-super-49b-v1-5
NVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1.5
Custom · Streaming
131K131K
Text
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2025-07-252025-07-25
Gemma 3n 4B
google/gemma/3n-e4b-it
GoogleGemma
google/gemma-3n-e4b-it
Openai chat · Streaming
33K-
Text
Text
-No-NoYesYesOpen weight
input $0/M
output $0/M
2025-05-202025-06-03
Llama 3.1 Nemotron 70B Instruct
nvidia/nemotron/llama-3-1-nemotron-70b-instruct
NVIDIANemotron
nvidia/llama-3.1-nemotron-70b-instruct
Custom · Streaming
128K8.2K
Text
Text
-NoYes-NoYesOpen weight
input $0/M
output $0/M
2025-04-152025-04-15
Llama 3.3 Nemotron Super 49B v1
nvidia/nemotron/llama-3-3-nemotron-super-49b-v1
NVIDIANemotron
nvidia/llama-3.3-nemotron-super-49b-v1
Custom · Streaming
131K131K
Text
Text
YesYes-NoYesOpen weight
input $0/M
output $0/M
2025-04-072025-08-08
Gemma 3 12B
google/gemma/3-12b-it
GoogleGemma
google/gemma-3-12b-it
Openai chat · Streaming
131K16K
TextImage
Text
-NoYesYesYesOpen weight
input $0/M
output $0/M
2025-03-132025-03-13
Gemma 3 4B
google/gemma/3-4b-it
GoogleGemma
google/gemma-3-4b-it
Openai chat · Streaming
131K16K
TextImage
Text
-No-NoYesYesOpen weight
input $0/M
output $0/M
2025-03-132025-03-13
Llama-3.3-70B-Instruct
meta/llama/3-3-70b-instruct
MetaLlama
meta/llama-3.3-70b-instruct
Custom · Streaming
128K4.1K
Text
Text
-NoYesYesYesOpen weight
input $0/M
output $0/M
2024-12-062026-07-22
Whisper 3 Large
openai/whisper/large-v3
OpenAIWhisper
openai/whisper-large-v3
Custom · Streaming
4484.1K
Audio
Text
-No-No-No-NoOpen weight
input $0/M
output $0/M
2024-10-012026-03-17
Nemotron Mini 4B Instruct
nvidia/nemotron/mini-4b-instruct
NVIDIANemotron
nvidia/nemotron-mini-4b-instruct
Custom · Streaming
128K8.2K
Text
Text
-NoYes-NoYesOpen weight
input $0/M
output $0/M
2024-08-212024-08-26
Mixtral 8x22B Instruct
mistral/mixtral/8x22b-instruct
Mistral AIMixtral
mistralai/mixtral-8x22b-instruct
Openai chat · Streaming
66K-
TextDocument
Text
-NoYesYesYesOpen weight
input $0/M
output $0/M
2024-04-172024-04-17

FAQ