Free NVIDIA NIM API Key, Base URL & Rate Limits
API ProviderNVIDIA NIM (NVIDIA Inference Microservices) provides API access to 100+ open-weight models hosted on NVIDIA infrastructure.
How to get a free NVIDIA NIM API key
- 1
- 2 Go to Settings → API Keys
- 3 Generate an API key
- 4 Browse available models 100+ open models. Nemotron Super 49B recommended.
- 5 Configure OpenAI client Base URL: https://integrate.api.nvidia.com/v1
Provider Snapshot
Supported Models 123 models
View in directory →| Model ID | Developer | Context | Availability | Free Tier | Use cases |
|---|---|---|---|---|---|
| z-ai/glm-5.2 z-ai/glm-5.2 | Z AI | 1.0M | Online | Yes | chat |
| deepseek-ai/deepseek-v4-flash-0731 deepseek-ai/deepseek-v4-flash | DeepSeek | 1.0M | Online | Yes | chat |
| minimaxai/minimax-m3 minimaxai/minimax-m3 | MiniMax | 1.0M | Online | Yes | chat |
| moonshotai/kimi-k2.6 moonshotai/kimi-k2.6 | Kimi | 262K | Online | Yes | chat |
| stepfun-ai/step-3.7-flash stepfun-ai/step-3.7-flash | StepFun | 262K | Online | Yes | chat |
| nvidia/nemotron-3-ultra-550b-a55b Nemotron 3 Ultra 550B A55B | NVIDIA NIM | 1.0M | Online | Yes | chat |
| poolside/laguna-xs-2.1 poolside/laguna-xs-2.1 | NVIDIA NIM | 262K | Online | Yes | chat |
| google/gemma-4-31b-it Gemma 4 31B IT | NVIDIA NIM | 262K | Online | Yes | chat |
| 01-ai/yi-large 01-ai/yi-large | NVIDIA NIM | 131K | Online | Yes | chat |
| meta/codellama-70b meta/codellama-70b | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| nvidia/llama3-chatqa-1.5-70b nvidia/llama3-chatqa-1.5-70b | NVIDIA NIM | 131K | Online | Yes | chat |
| writer/palmyra-fin-70b-32k writer/palmyra-fin-70b-32k | NVIDIA NIM | 131K | Online | Yes | chat |
| writer/palmyra-med-70b writer/palmyra-med-70b | NVIDIA NIM | 131K | Online | Yes | chat |
| writer/palmyra-med-70b-32k writer/palmyra-med-70b-32k | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/nemotron-3-nano-omni-30b-a3b-reasoning Nemotron 3 Nano Omni 30B A3B Reasoning | NVIDIA NIM | 256K | Online | Yes | chat |
| nvidia/nemotron-3-super-120b-a12b Nemotron 3 Super 120B A12B | NVIDIA NIM | 262K | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-ultra-253b-v1 nvidia/llama-3.1-nemotron-ultra-253b-v1 | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| ibm/granite-34b-code-instruct ibm/granite-34b-code-instruct | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| bigcode/starcoder2-15b bigcode/starcoder2-15b | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| google/deplot google/deplot | NVIDIA NIM | 131K | Online | Yes | chat |
| google/gemma-2b google/gemma-2b | NVIDIA NIM | 131K | Online | Yes | chat |
| google/recurrentgemma-2b google/recurrentgemma-2b | NVIDIA NIM | 131K | Online | Yes | chat |
| microsoft/kosmos-2 microsoft/kosmos-2 | NVIDIA NIM | 131K | Online | Yes | chat |
| microsoft/phi-3-vision-128k-instruct microsoft/phi-3-vision-128k-instruct | NVIDIA NIM | 131K | Online | Yes | chatvision |
| microsoft/phi-3.5-moe-instruct microsoft/phi-3.5-moe-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| mistralai/mixtral-8x22b-v0.1 mistralai/mixtral-8x22b-v0.1 | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-51b-instruct nvidia/llama-3.1-nemotron-51b-instruct | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| nvidia/nemoretriever-parse nvidia/nemoretriever-parse | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/nemotron-4-340b-instruct nvidia/nemotron-4-340b-instruct | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| nvidia/nemotron-4-340b-reward nvidia/nemotron-4-340b-reward | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| nvidia/nemotron-parse nvidia/nemotron-parse | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| nvidia/neva-22b nvidia/neva-22b | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/nvclip nvidia/nvclip | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/riva-translate-4b-instruct nvidia/riva-translate-4b-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/vila nvidia/vila | NVIDIA NIM | 131K | Online | Yes | chat |
| writer/palmyra-creative-122b writer/palmyra-creative-122b | NVIDIA NIM | 131K | Online | Yes | chat |
| openai/gpt-oss-120b GPT OSS 120B | NVIDIA NIM | 131K | Online | Yes | chat |
| adept/fuyu-8b adept/fuyu-8b | NVIDIA NIM | 131K | Online | Yes | chat |
| aisingapore/sea-lion-7b-instruct aisingapore/sea-lion-7b-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| deepseek-ai/deepseek-coder-6.7b-instruct deepseek-ai/deepseek-coder-6.7b-instruct | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| google/codegemma-1.1-7b google/codegemma-1.1-7b | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| google/codegemma-7b google/codegemma-7b | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| ibm/granite-3.0-8b-instruct ibm/granite-3.0-8b-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| ibm/granite-8b-code-instruct ibm/granite-8b-code-instruct | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| nv-mistralai/mistral-nemo-12b-instruct nv-mistralai/mistral-nemo-12b-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/mistral-nemo-minitron-8b-8k-instruct nvidia/mistral-nemo-minitron-8b-8k-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| zyphra/zamba2-7b-instruct zyphra/zamba2-7b-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/nemotron-3.5-content-safety nvidia/nemotron-3.5-content-safety | NVIDIA NIM | 128K | Online | Yes | chatreasoning |
| nvidia/cosmos-reason2-8b nvidia/cosmos-reason2-8b | NVIDIA NIM | 131K | Online | Yes | chat |
| mistralai/mistral-large mistralai/mistral-large-3-675b-instruct-2512 | NVIDIA NIM | 8K | Online | Yes | chat |
| baai/bge-m3 baai/bge-m3 | NVIDIA NIM | 131K | Online | Yes | chat |
| mistralai/codestral-22b-instruct-v0.1 mistralai/codestral-22b-instruct-v0.1 | NVIDIA NIM | 131K | Online | Yes | chatcoding |
| nvidia/llama-3.3-nemotron-super-49b-v1.5 nvidia/llama-3.3-nemotron-super-49b-v1.5 | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| mistralai/mistral-7b-instruct-v0.3 mistralai/mistral-7b-instruct-v0.3 | NVIDIA NIM | 131K | Online | Yes | chat |
| nvidia/nemotron-nano-3-30b-a3b nvidia/nemotron-nano-3-30b-a3b | NVIDIA NIM | 131K | Online | Yes | chatreasoning |
| ibm/granite-3.0-3b-a800m-instruct ibm/granite-3.0-3b-a800m-instruct | NVIDIA NIM | 131K | Online | Yes | chat |
| thinkingmachines/inkling Inkling | NVIDIA NIM | 256K | Online | Yes | chat |
| nvidia/llama-3.3-nemotron-super-49b-v1 Llama 3.3 Nemotron Super 49B v1 | NVIDIA NIM | 131K | Online | Yes | chat |
| openai/gpt-oss-20b GPT OSS 20B | NVIDIA NIM | 131K | Online | Yes | chat |
| meta/llama-3.1-70b-instruct meta/llama-3.1-70b-instruct | Meta | 131K | Online | Yes | chat |
| mistralai/mistral-large-2-instruct mistralai/mistral-large-2-instruct | Mistral | 131K | Online | Yes | chat |
| nvidia/nemotron-mini-4b-instruct Nemotron Mini 4B Instruct | NVIDIA NIM | 128K | Online | Yes | chat |
| google/diffusiongemma-26b-a4b-it google/diffusiongemma-26b-a4b-it | NVIDIA NIM | 8K | Online | Yes | chat |
| meta/llama-3.2-90b-vision-instruct meta/llama-3.2-90b-vision-instruct | NVIDIA NIM | 8K | Online | Yes | chat |
| mistralai/mistral-nemotron mistralai/mistral-nemotron | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/riva-translate-4b-instruct-v1.1 nvidia/riva-translate-4b-instruct-v1.1 | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/ising-calibration-1.5-31b nvidia/ising-calibration-1.5-31b | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/riva-translate-4b-instruct-v2 nvidia/riva-translate-4b-instruct-v2 | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-70b-instruct nvidia/llama-3.1-nemotron-70b-instruct | NVIDIA | 131K | Online | Yes | chatreasoning |
| nvidia/nemotron-3-nano-30b-a3b Nemotron 3 Nano 30B A3B | NVIDIA NIM | 262K | Online | Yes | chat |
| nvidia/llama-nemotron-embed-1b-v2 nvidia/llama-nemotron-embed-1b-v2 | NVIDIA NIM | 131K | Online | Yes | chatreasoningembedding |
| nvidia/llama-nemotron-embed-vl-1b-v2 nvidia/llama-nemotron-embed-vl-1b-v2 | NVIDIA NIM | 131K | Online | Yes | chatreasoningembedding |
| meta/llama-3.2-11b-vision-instruct meta/llama-3.2-11b-vision-instruct | Meta | 131K | Online | Yes | chatvision |
| ai21labs/jamba-1.5-large-instruct ai21labs/jamba-1.5-large-instruct | AI21 Labs | 131K | Online | Yes | chat |
| nvidia/nemotron-nano-12b-v2-vl Nemotron Nano 12B v2 VL | NVIDIA NIM | 128K | Online | Yes | chat |
| meta/llama-3.2-3b-instruct meta/llama-3.2-3b-instruct | Meta | 131K | Online | Yes | chat |
| nvidia/embed-qa-4 nvidia/embed-qa-4 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1 nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| nvidia/llama-3.2-nv-embedqa-1b-v1 nvidia/llama-3.2-nv-embedqa-1b-v1 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| nvidia/nemotron-3-embed-1b nvidia/nemotron-3-embed-1b | NVIDIA NIM | 131K | Online | Yes | chatreasoningembedding |
| nvidia/nv-embedqa-e5-v5 nvidia/nv-embedqa-e5-v5 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| nvidia/nv-embedqa-mistral-7b-v2 nvidia/nv-embedqa-mistral-7b-v2 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| snowflake/arctic-embed-l snowflake/arctic-embed-l | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| databricks/dbrx-instruct databricks/dbrx-instruct | Databricks | 131K | Online | Yes | chat |
| meta/llama2-70b meta/llama2-70b | Meta | 131K | Online | Yes | chat |
| meta/llama-3.2-1b-instruct meta/llama-3.2-1b-instruct | Meta | 60K | Online | Yes | chat |
| meta/llama-guard-4-12b meta/llama-guard-4-12b | NVIDIA NIM | 1.0M | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-nano-vl-8b-v1 nvidia/llama-3.1-nemotron-nano-vl-8b-v1 | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/nvidia-nemotron-nano-9b-v2 nvidia/nvidia-nemotron-nano-9b-v2 | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-nano-8b-v1 nvidia/llama-3.1-nemotron-nano-8b-v1 | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/nv-embed-v1 nvidia/nv-embed-v1 | NVIDIA NIM | 131K | Online | Yes | chatembedding |
| nvidia/nv-embedcode-7b-v1 nvidia/nv-embedcode-7b-v1 | NVIDIA NIM | 131K | Online | Yes | chatcodingembedding |
| meta/llama-3.3-70b-instruct Llama-3.3-70B-Instruct | NVIDIA NIM | 128K | Online | Yes | chat |
| nvidia/llama-3.1-nemotron-safety-guard-8b-v3 Llama 3.1 Nemotron Safety Guard 8B v3 | NVIDIA NIM | 128K | Online | Yes | chat |
| meta/llama-3.1-8b-instruct meta/llama-3.1-8b-instruct | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/llama-3.1-nemoguard-8b-content-safety nvidia/llama-3.1-nemoguard-8b-content-safety | NVIDIA NIM | 8K | Online | Yes | chat |
| nvidia/llama-3.1-nemoguard-8b-topic-control nvidia/llama-3.1-nemoguard-8b-topic-control | NVIDIA NIM | 8K | Online | Yes | chat |
| deepseek-ai/deepseek-v4-pro deepseek-ai/deepseek-v4-pro | DeepSeek | 1.0M | Check provider | Yes | chat |
| z-ai/glm-5.1 z-ai/glm-5.1 | Z AI | 203K | Check provider | Yes | chat |
| minimaxai/minimax-m2.7 minimaxai/minimax-m2.7 | MiniMax | 205K | Check provider | Yes | chat |
| qwen/qwen3.5-397b-a17b qwen/qwen3.5-397b-a17b | Alibaba | 262K | Check provider | Yes | chat |
| qwen/qwen3.5-122b-a10b qwen/qwen3.5-122b-a10b | Alibaba | 262K | Check provider | Yes | chat |
| stepfun-ai/step-3.5-flash stepfun-ai/step-3.5-flash | StepFun | 262K | Check provider | Yes | chat |
| abacusai/dracarys-llama-3.1-70b-instruct abacusai/dracarys-llama-3.1-70b-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| mistralai/mistral-medium-3.5-128b mistralai/mistral-medium-3.5-128b | NVIDIA NIM | 8K | Check provider | Yes | chat |
| bytedance/seed-oss-36b-instruct bytedance/seed-oss-36b-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| google/gemma-2-2b-it google/gemma-2-2b-it | NVIDIA NIM | 8K | Check provider | Yes | chat |
| google/gemma-3n-e2b-it google/gemma-3n-e2b-it | NVIDIA NIM | 8K | Check provider | Yes | chat |
| meta/llama-4-maverick-17b-128e-instruct meta/llama-4-maverick-17b-128e-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| mistralai/mistral-small-4-119b-2603 mistralai/mistral-small-4-119b-2603 | NVIDIA NIM | 8K | Check provider | Yes | chat |
| nvidia/gliner-pii nvidia/gliner-pii | NVIDIA NIM | 8K | Check provider | Yes | chat |
| nvidia/ising-calibration-1-35b-a3b nvidia/ising-calibration-1-35b-a3b | NVIDIA NIM | 8K | Check provider | Yes | chat |
| sarvamai/sarvam-m sarvamai/sarvam-m | NVIDIA NIM | 8K | Check provider | Yes | chat |
| stockmark/stockmark-2-100b-instruct stockmark/stockmark-2-100b-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| mistralai/mixtral-8x7b-instruct-v0.1 mistralai/mixtral-8x7b-instruct-v0.1 | NVIDIA NIM | 8K | Check provider | Yes | chat |
| upstage/solar-10.7b-instruct upstage/solar-10.7b-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| qwen/qwen3-next-80b-a3b-instruct qwen/qwen3-next-80b-a3b-instruct | NVIDIA NIM | 8K | Check provider | Yes | chat |
| microsoft/phi-4-multimodal-instruct microsoft/phi-4-multimodal-instruct | Microsoft | 131K | Check provider | Yes | chat |
| microsoft/phi-4-mini-instruct microsoft/phi-4-mini-instruct | Microsoft | 8K | Check provider | Yes | chat |
| mistralai/ministral-14b-instruct-2512 mistralai/ministral-14b-instruct-2512 | NVIDIA NIM | 8K | Check provider | Yes | chat |
| nvidia/nemotron-3-content-safety Nemotron 3 Content Safety | NVIDIA NIM | 128K | Check provider | Yes | chat |
| nvidia/nemotron-content-safety-reasoning-4b Nemotron Content Safety Reasoning 4B | NVIDIA NIM | 128K | Check provider | Yes | chat |
| google/gemma-3n-e4b-it google/gemma-3n-e4b-it | NVIDIA NIM | 8K | Check provider | Yes | chat |
Developer Tools
NVIDIA NIM FreeLLM Score free API access score
How we score →What is NVIDIA NIM?
100+ open models from NVIDIA — no credit card, 40 RPM.
NVIDIA NIM (NVIDIA Inference Microservices) provides API access to 100+ open-weight models hosted on NVIDIA infrastructure. The free tier is available to all NVIDIA Developer Program members (free sign-up) with a limit of ~40 requests/minute. Models include Llama, Mistral, DeepSeek-R1, Nemotron, and domain-specific variants. All endpoints are OpenAI-compatible.
- 100+ open models available
- No daily token cap
- ~40 RPM free tier
- No credit card required
API Compatibility: Live-tested OpenAI-compatible Chat Completions
NVIDIA NIM Free Tier Limits & Pricing
NVIDIA NIM API Setup Tutorials
NVIDIA NIM is fully compatible with popular AI coding assistants like Cursor, Claude Code, and more. To see step-by-step API configuration instructions for your favorite tool, please visit our Global Configuration Guide →
NVIDIA NIM Model Use Cases
What NVIDIA NIM's free models are best for, based on aggregated model capabilities:
NVIDIA NIM Limitations & Caveats
- ~40 RPM shared across all models, not per-model
- Some models require additional registration per model family
- Unavailable models listed in catalog but uncallable with standard key
NVIDIA NIM FAQ
Why can't I call certain models on NVIDIA NIM even though they're listed?
NVIDIA NIM's catalog includes all models, but some require additional per-model-family registration. If you get a 403 error, go to the model's page and click "Try API" to register for that specific model family.
Is the 40 RPM limit shared across all models?
Yes — NVIDIA NIM applies a global ~40 RPM limit to your API key, shared across all model calls. If you're using multiple models in parallel, the combined rate cannot exceed ~40 RPM.
Does NVIDIA NIM require phone verification?
Yes, NVIDIA Developer account signup requires phone number verification. This is a one-time step during account creation.