Model List

Nvidia

102 models

Nvidia's NIM platform serves optimized, enterprise-ready inference for a wide range of open and proprietary models. This page lists every Nvidia model in the directory - the Nemotron family, Llama, Qwen, Mistral, embedding models, and speech models - with per-million-token pricing, context window sizes, output limits, and supported modalities.

nvidia.comAPI base: https://integrate.api.nvidia.com/v1

102 of 102 models

Home
01-ai/yi-large
01-ai/yi-large
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
ai21labs/jamba-1.5-large-instruct
ai21labs/jamba-1.5-large-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
aisingapore/sea-lion-7b-instruct
aisingapore/sea-lion-7b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
bigcode/starcoder2-15b
bigcode/starcoder2-15b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
databricks/dbrx-instruct
databricks/dbrx-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
deepseek-ai/deepseek-coder-6.7b-instruct
deepseek-ai/deepseek-coder-6.7b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
DeepSeek-V4-Flash-0731
deepseek-ai/deepseek-v4-flash-0731
-
-
-
-
-
-
-
1
-
-
Tools
Text
Text
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/codegemma-1.1-7b
google/codegemma-1.1-7b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/codegemma-7b
google/codegemma-7b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/deplot
google/deplot
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/diffusiongemma-26b-a4b-it
google/diffusiongemma-26b-a4b-it
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/gemma-2b
google/gemma-2b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/gemma-3-4b-it
google/gemma-3-4b-it
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/gemma-3-12b-it
google/gemma-3-12b-it
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/gemma-4-31b-it
google/gemma-4-31b-it
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
google/recurrentgemma-2b
google/recurrentgemma-2b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
ibm/granite-3.0-3b-a800m-instruct
ibm/granite-3.0-3b-a800m-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
ibm/granite-3.0-8b-instruct
ibm/granite-3.0-8b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
ibm/granite-8b-code-instruct
ibm/granite-8b-code-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
ibm/granite-34b-code-instruct
ibm/granite-34b-code-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
Inference:
adept/fuyu-8b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
Inference:
baai/bge-m3
-
-
-
-
-
-
-
-
-
-
-
Text
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/codellama-70b
meta/codellama-70b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.1-8b-instruct
meta/llama-3.1-8b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.1-70b-instruct
meta/llama-3.1-70b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.2-1b-instruct
meta/llama-3.2-1b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.2-3b-instruct
meta/llama-3.2-3b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.2-11b-vision-instruct
meta/llama-3.2-11b-vision-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.2-90b-vision-instruct
meta/llama-3.2-90b-vision-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-3.3-70b-instruct
meta/llama-3.3-70b-instruct
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1
meta/llama-guard-4-12b
meta/llama-guard-4-12b
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
@ai-sdk/openai-compatible
NVIDIA_API_KEY
https://integrate.api.nvidia.com/v1