Nvidia
102 modelsNvidia's NIM platform serves optimized, enterprise-ready inference for a wide range of open and proprietary models. This page lists every Nvidia model in the directory - the Nemotron family, Llama, Qwen, Mistral, embedding models, and speech models - with per-million-token pricing, context window sizes, output limits, and supported modalities.
nvidia.comAPI base: https://integrate.api.nvidia.com/v1
102 of 102 modelsShowing 102 of 102 models from 1 provider
01-ai/yi-large 01-ai/yi-large | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
ai21labs/jamba-1.5-large-instruct ai21labs/jamba-1.5-large-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
aisingapore/sea-lion-7b-instruct aisingapore/sea-lion-7b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
bigcode/starcoder2-15b bigcode/starcoder2-15b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
databricks/dbrx-instruct databricks/dbrx-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
deepseek-ai/deepseek-coder-6.7b-instruct deepseek-ai/deepseek-coder-6.7b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
DeepSeek-V4-Flash-0731 deepseek-ai/deepseek-v4-flash-0731 | - | - | - | - | - | - | - | 1 | - | - | Tools | Text | Text | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/codegemma-1.1-7b google/codegemma-1.1-7b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/codegemma-7b google/codegemma-7b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/deplot google/deplot | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/diffusiongemma-26b-a4b-it google/diffusiongemma-26b-a4b-it | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/gemma-2b google/gemma-2b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/gemma-3-4b-it google/gemma-3-4b-it | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/gemma-3-12b-it google/gemma-3-12b-it | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/gemma-4-31b-it google/gemma-4-31b-it | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
google/recurrentgemma-2b google/recurrentgemma-2b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
ibm/granite-3.0-3b-a800m-instruct ibm/granite-3.0-3b-a800m-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
ibm/granite-3.0-8b-instruct ibm/granite-3.0-8b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
ibm/granite-8b-code-instruct ibm/granite-8b-code-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
ibm/granite-34b-code-instruct ibm/granite-34b-code-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
Inference: adept/fuyu-8b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
Inference: baai/bge-m3 | - | - | - | - | - | - | - | - | - | - | - | Text | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/codellama-70b meta/codellama-70b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.1-8b-instruct meta/llama-3.1-8b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.1-70b-instruct meta/llama-3.1-70b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.2-1b-instruct meta/llama-3.2-1b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.2-3b-instruct meta/llama-3.2-3b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.2-11b-vision-instruct meta/llama-3.2-11b-vision-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.2-90b-vision-instruct meta/llama-3.2-90b-vision-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-3.3-70b-instruct meta/llama-3.3-70b-instruct | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |
meta/llama-guard-4-12b meta/llama-guard-4-12b | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | - | @ai-sdk/openai-compatible | NVIDIA_API_KEY | https://integrate.api.nvidia.com/v1 | |