NVIDIA NIM logo

Free NVIDIA NIM API Key, Base URL & Rate Limits

API Provider

NVIDIA NIM (NVIDIA Inference Microservices) provides API access to 100+ open-weight models hosted on NVIDIA infrastructure.

OpenAI CompatibleFree TierStreamingFunction CallingVision

How to get a free NVIDIA NIM API key

  1. 1
    Sign up at build.nvidia.com Free NVIDIA Developer account. No credit card.
  2. 2
    Go to Settings → API Keys
  3. 3
    Generate an API key
  4. 4
    Browse available models 100+ open models. Nemotron Super 49B recommended.
  5. 5
    Configure OpenAI client Base URL: https://integrate.api.nvidia.com/v1

Provider Snapshot

P Provider Type API Provider
O OpenAI Compatible Yes
U Base URL https://integrate.api.nvidia.com/v1
F Free Tier 97 free models online
P Phone Required Yes
S Streaming Yes
T Function Calling Yes
V Vision Yes
L Last Updated 2026-08-06

Supported Models 123 models

View in directory →
Model ID Developer Context Availability Free Tier Use cases
z-ai/glm-5.2
z-ai/glm-5.2
Z AI 1.0M Online Yes chat
deepseek-ai/deepseek-v4-flash-0731
deepseek-ai/deepseek-v4-flash
DeepSeek 1.0M Online Yes chat
minimaxai/minimax-m3
minimaxai/minimax-m3
MiniMax 1.0M Online Yes chat
moonshotai/kimi-k2.6
moonshotai/kimi-k2.6
Kimi 262K Online Yes chat
stepfun-ai/step-3.7-flash
stepfun-ai/step-3.7-flash
StepFun 262K Online Yes chat
nvidia/nemotron-3-ultra-550b-a55b
Nemotron 3 Ultra 550B A55B
NVIDIA NIM 1.0M Online Yes chat
poolside/laguna-xs-2.1
poolside/laguna-xs-2.1
NVIDIA NIM 262K Online Yes chat
google/gemma-4-31b-it
Gemma 4 31B IT
NVIDIA NIM 262K Online Yes chat
01-ai/yi-large
01-ai/yi-large
NVIDIA NIM 131K Online Yes chat
meta/codellama-70b
meta/codellama-70b
NVIDIA NIM 131K Online Yes chatcoding
nvidia/llama3-chatqa-1.5-70b
nvidia/llama3-chatqa-1.5-70b
NVIDIA NIM 131K Online Yes chat
writer/palmyra-fin-70b-32k
writer/palmyra-fin-70b-32k
NVIDIA NIM 131K Online Yes chat
writer/palmyra-med-70b
writer/palmyra-med-70b
NVIDIA NIM 131K Online Yes chat
writer/palmyra-med-70b-32k
writer/palmyra-med-70b-32k
NVIDIA NIM 131K Online Yes chat
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
Nemotron 3 Nano Omni 30B A3B Reasoning
NVIDIA NIM 256K Online Yes chat
nvidia/nemotron-3-super-120b-a12b
Nemotron 3 Super 120B A12B
NVIDIA NIM 262K Online Yes chat
nvidia/llama-3.1-nemotron-ultra-253b-v1
nvidia/llama-3.1-nemotron-ultra-253b-v1
NVIDIA NIM 131K Online Yes chatreasoning
ibm/granite-34b-code-instruct
ibm/granite-34b-code-instruct
NVIDIA NIM 131K Online Yes chatcoding
bigcode/starcoder2-15b
bigcode/starcoder2-15b
NVIDIA NIM 131K Online Yes chatcoding
google/deplot
google/deplot
NVIDIA NIM 131K Online Yes chat
google/gemma-2b
google/gemma-2b
NVIDIA NIM 131K Online Yes chat
google/recurrentgemma-2b
google/recurrentgemma-2b
NVIDIA NIM 131K Online Yes chat
microsoft/kosmos-2
microsoft/kosmos-2
NVIDIA NIM 131K Online Yes chat
microsoft/phi-3-vision-128k-instruct
microsoft/phi-3-vision-128k-instruct
NVIDIA NIM 131K Online Yes chatvision
microsoft/phi-3.5-moe-instruct
microsoft/phi-3.5-moe-instruct
NVIDIA NIM 131K Online Yes chat
mistralai/mixtral-8x22b-v0.1
mistralai/mixtral-8x22b-v0.1
NVIDIA NIM 131K Online Yes chat
nvidia/llama-3.1-nemotron-51b-instruct
nvidia/llama-3.1-nemotron-51b-instruct
NVIDIA NIM 131K Online Yes chatreasoning
nvidia/nemoretriever-parse
nvidia/nemoretriever-parse
NVIDIA NIM 131K Online Yes chat
nvidia/nemotron-4-340b-instruct
nvidia/nemotron-4-340b-instruct
NVIDIA NIM 131K Online Yes chatreasoning
nvidia/nemotron-4-340b-reward
nvidia/nemotron-4-340b-reward
NVIDIA NIM 131K Online Yes chatreasoning
nvidia/nemotron-parse
nvidia/nemotron-parse
NVIDIA NIM 131K Online Yes chatreasoning
nvidia/neva-22b
nvidia/neva-22b
NVIDIA NIM 131K Online Yes chat
nvidia/nvclip
nvidia/nvclip
NVIDIA NIM 131K Online Yes chat
nvidia/riva-translate-4b-instruct
nvidia/riva-translate-4b-instruct
NVIDIA NIM 131K Online Yes chat
nvidia/vila
nvidia/vila
NVIDIA NIM 131K Online Yes chat
writer/palmyra-creative-122b
writer/palmyra-creative-122b
NVIDIA NIM 131K Online Yes chat
openai/gpt-oss-120b
GPT OSS 120B
NVIDIA NIM 131K Online Yes chat
adept/fuyu-8b
adept/fuyu-8b
NVIDIA NIM 131K Online Yes chat
aisingapore/sea-lion-7b-instruct
aisingapore/sea-lion-7b-instruct
NVIDIA NIM 131K Online Yes chat
deepseek-ai/deepseek-coder-6.7b-instruct
deepseek-ai/deepseek-coder-6.7b-instruct
NVIDIA NIM 131K Online Yes chatcoding
google/codegemma-1.1-7b
google/codegemma-1.1-7b
NVIDIA NIM 131K Online Yes chatcoding
google/codegemma-7b
google/codegemma-7b
NVIDIA NIM 131K Online Yes chatcoding
ibm/granite-3.0-8b-instruct
ibm/granite-3.0-8b-instruct
NVIDIA NIM 131K Online Yes chat
ibm/granite-8b-code-instruct
ibm/granite-8b-code-instruct
NVIDIA NIM 131K Online Yes chatcoding
nv-mistralai/mistral-nemo-12b-instruct
nv-mistralai/mistral-nemo-12b-instruct
NVIDIA NIM 131K Online Yes chat
nvidia/mistral-nemo-minitron-8b-8k-instruct
nvidia/mistral-nemo-minitron-8b-8k-instruct
NVIDIA NIM 131K Online Yes chat
zyphra/zamba2-7b-instruct
zyphra/zamba2-7b-instruct
NVIDIA NIM 131K Online Yes chat
nvidia/nemotron-3.5-content-safety
nvidia/nemotron-3.5-content-safety
NVIDIA NIM 128K Online Yes chatreasoning
nvidia/cosmos-reason2-8b
nvidia/cosmos-reason2-8b
NVIDIA NIM 131K Online Yes chat
mistralai/mistral-large
mistralai/mistral-large-3-675b-instruct-2512
NVIDIA NIM 8K Online Yes chat
baai/bge-m3
baai/bge-m3
NVIDIA NIM 131K Online Yes chat
mistralai/codestral-22b-instruct-v0.1
mistralai/codestral-22b-instruct-v0.1
NVIDIA NIM 131K Online Yes chatcoding
nvidia/llama-3.3-nemotron-super-49b-v1.5
nvidia/llama-3.3-nemotron-super-49b-v1.5
NVIDIA NIM 131K Online Yes chatreasoning
mistralai/mistral-7b-instruct-v0.3
mistralai/mistral-7b-instruct-v0.3
NVIDIA NIM 131K Online Yes chat
nvidia/nemotron-nano-3-30b-a3b
nvidia/nemotron-nano-3-30b-a3b
NVIDIA NIM 131K Online Yes chatreasoning
ibm/granite-3.0-3b-a800m-instruct
ibm/granite-3.0-3b-a800m-instruct
NVIDIA NIM 131K Online Yes chat
thinkingmachines/inkling
Inkling
NVIDIA NIM 256K Online Yes chat
nvidia/llama-3.3-nemotron-super-49b-v1
Llama 3.3 Nemotron Super 49B v1
NVIDIA NIM 131K Online Yes chat
openai/gpt-oss-20b
GPT OSS 20B
NVIDIA NIM 131K Online Yes chat
meta/llama-3.1-70b-instruct
meta/llama-3.1-70b-instruct
Meta 131K Online Yes chat
mistralai/mistral-large-2-instruct
mistralai/mistral-large-2-instruct
Mistral 131K Online Yes chat
nvidia/nemotron-mini-4b-instruct
Nemotron Mini 4B Instruct
NVIDIA NIM 128K Online Yes chat
google/diffusiongemma-26b-a4b-it
google/diffusiongemma-26b-a4b-it
NVIDIA NIM 8K Online Yes chat
meta/llama-3.2-90b-vision-instruct
meta/llama-3.2-90b-vision-instruct
NVIDIA NIM 8K Online Yes chat
mistralai/mistral-nemotron
mistralai/mistral-nemotron
NVIDIA NIM 8K Online Yes chat
nvidia/riva-translate-4b-instruct-v1.1
nvidia/riva-translate-4b-instruct-v1.1
NVIDIA NIM 8K Online Yes chat
nvidia/ising-calibration-1.5-31b
nvidia/ising-calibration-1.5-31b
NVIDIA NIM 8K Online Yes chat
nvidia/riva-translate-4b-instruct-v2
nvidia/riva-translate-4b-instruct-v2
NVIDIA NIM 8K Online Yes chat
nvidia/llama-3.1-nemotron-70b-instruct
nvidia/llama-3.1-nemotron-70b-instruct
NVIDIA 131K Online Yes chatreasoning
nvidia/nemotron-3-nano-30b-a3b
Nemotron 3 Nano 30B A3B
NVIDIA NIM 262K Online Yes chat
nvidia/llama-nemotron-embed-1b-v2
nvidia/llama-nemotron-embed-1b-v2
NVIDIA NIM 131K Online Yes chatreasoningembedding
nvidia/llama-nemotron-embed-vl-1b-v2
nvidia/llama-nemotron-embed-vl-1b-v2
NVIDIA NIM 131K Online Yes chatreasoningembedding
meta/llama-3.2-11b-vision-instruct
meta/llama-3.2-11b-vision-instruct
Meta 131K Online Yes chatvision
ai21labs/jamba-1.5-large-instruct
ai21labs/jamba-1.5-large-instruct
AI21 Labs 131K Online Yes chat
nvidia/nemotron-nano-12b-v2-vl
Nemotron Nano 12B v2 VL
NVIDIA NIM 128K Online Yes chat
meta/llama-3.2-3b-instruct
meta/llama-3.2-3b-instruct
Meta 131K Online Yes chat
nvidia/embed-qa-4
nvidia/embed-qa-4
NVIDIA NIM 131K Online Yes chatembedding
nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
NVIDIA NIM 131K Online Yes chatembedding
nvidia/llama-3.2-nv-embedqa-1b-v1
nvidia/llama-3.2-nv-embedqa-1b-v1
NVIDIA NIM 131K Online Yes chatembedding
nvidia/nemotron-3-embed-1b
nvidia/nemotron-3-embed-1b
NVIDIA NIM 131K Online Yes chatreasoningembedding
nvidia/nv-embedqa-e5-v5
nvidia/nv-embedqa-e5-v5
NVIDIA NIM 131K Online Yes chatembedding
nvidia/nv-embedqa-mistral-7b-v2
nvidia/nv-embedqa-mistral-7b-v2
NVIDIA NIM 131K Online Yes chatembedding
snowflake/arctic-embed-l
snowflake/arctic-embed-l
NVIDIA NIM 131K Online Yes chatembedding
databricks/dbrx-instruct
databricks/dbrx-instruct
Databricks 131K Online Yes chat
meta/llama2-70b
meta/llama2-70b
Meta 131K Online Yes chat
meta/llama-3.2-1b-instruct
meta/llama-3.2-1b-instruct
Meta 60K Online Yes chat
meta/llama-guard-4-12b
meta/llama-guard-4-12b
NVIDIA NIM 1.0M Online Yes chat
nvidia/llama-3.1-nemotron-nano-vl-8b-v1
nvidia/llama-3.1-nemotron-nano-vl-8b-v1
NVIDIA NIM 8K Online Yes chat
nvidia/nvidia-nemotron-nano-9b-v2
nvidia/nvidia-nemotron-nano-9b-v2
NVIDIA NIM 8K Online Yes chat
nvidia/llama-3.1-nemotron-nano-8b-v1
nvidia/llama-3.1-nemotron-nano-8b-v1
NVIDIA NIM 8K Online Yes chat
nvidia/nv-embed-v1
nvidia/nv-embed-v1
NVIDIA NIM 131K Online Yes chatembedding
nvidia/nv-embedcode-7b-v1
nvidia/nv-embedcode-7b-v1
NVIDIA NIM 131K Online Yes chatcodingembedding
meta/llama-3.3-70b-instruct
Llama-3.3-70B-Instruct
NVIDIA NIM 128K Online Yes chat
nvidia/llama-3.1-nemotron-safety-guard-8b-v3
Llama 3.1 Nemotron Safety Guard 8B v3
NVIDIA NIM 128K Online Yes chat
meta/llama-3.1-8b-instruct
meta/llama-3.1-8b-instruct
NVIDIA NIM 8K Online Yes chat
nvidia/llama-3.1-nemoguard-8b-content-safety
nvidia/llama-3.1-nemoguard-8b-content-safety
NVIDIA NIM 8K Online Yes chat
nvidia/llama-3.1-nemoguard-8b-topic-control
nvidia/llama-3.1-nemoguard-8b-topic-control
NVIDIA NIM 8K Online Yes chat
deepseek-ai/deepseek-v4-pro
deepseek-ai/deepseek-v4-pro
DeepSeek 1.0M Check provider Yes chat
z-ai/glm-5.1
z-ai/glm-5.1
Z AI 203K Check provider Yes chat
minimaxai/minimax-m2.7
minimaxai/minimax-m2.7
MiniMax 205K Check provider Yes chat
qwen/qwen3.5-397b-a17b
qwen/qwen3.5-397b-a17b
Alibaba 262K Check provider Yes chat
qwen/qwen3.5-122b-a10b
qwen/qwen3.5-122b-a10b
Alibaba 262K Check provider Yes chat
stepfun-ai/step-3.5-flash
stepfun-ai/step-3.5-flash
StepFun 262K Check provider Yes chat
abacusai/dracarys-llama-3.1-70b-instruct
abacusai/dracarys-llama-3.1-70b-instruct
NVIDIA NIM 8K Check provider Yes chat
mistralai/mistral-medium-3.5-128b
mistralai/mistral-medium-3.5-128b
NVIDIA NIM 8K Check provider Yes chat
bytedance/seed-oss-36b-instruct
bytedance/seed-oss-36b-instruct
NVIDIA NIM 8K Check provider Yes chat
google/gemma-2-2b-it
google/gemma-2-2b-it
NVIDIA NIM 8K Check provider Yes chat
google/gemma-3n-e2b-it
google/gemma-3n-e2b-it
NVIDIA NIM 8K Check provider Yes chat
meta/llama-4-maverick-17b-128e-instruct
meta/llama-4-maverick-17b-128e-instruct
NVIDIA NIM 8K Check provider Yes chat
mistralai/mistral-small-4-119b-2603
mistralai/mistral-small-4-119b-2603
NVIDIA NIM 8K Check provider Yes chat
nvidia/gliner-pii
nvidia/gliner-pii
NVIDIA NIM 8K Check provider Yes chat
nvidia/ising-calibration-1-35b-a3b
nvidia/ising-calibration-1-35b-a3b
NVIDIA NIM 8K Check provider Yes chat
sarvamai/sarvam-m
sarvamai/sarvam-m
NVIDIA NIM 8K Check provider Yes chat
stockmark/stockmark-2-100b-instruct
stockmark/stockmark-2-100b-instruct
NVIDIA NIM 8K Check provider Yes chat
mistralai/mixtral-8x7b-instruct-v0.1
mistralai/mixtral-8x7b-instruct-v0.1
NVIDIA NIM 8K Check provider Yes chat
upstage/solar-10.7b-instruct
upstage/solar-10.7b-instruct
NVIDIA NIM 8K Check provider Yes chat
qwen/qwen3-next-80b-a3b-instruct
qwen/qwen3-next-80b-a3b-instruct
NVIDIA NIM 8K Check provider Yes chat
microsoft/phi-4-multimodal-instruct
microsoft/phi-4-multimodal-instruct
Microsoft 131K Check provider Yes chat
microsoft/phi-4-mini-instruct
microsoft/phi-4-mini-instruct
Microsoft 8K Check provider Yes chat
mistralai/ministral-14b-instruct-2512
mistralai/ministral-14b-instruct-2512
NVIDIA NIM 8K Check provider Yes chat
nvidia/nemotron-3-content-safety
Nemotron 3 Content Safety
NVIDIA NIM 128K Check provider Yes chat
nvidia/nemotron-content-safety-reasoning-4b
Nemotron Content Safety Reasoning 4B
NVIDIA NIM 128K Check provider Yes chat
google/gemma-3n-e4b-it
google/gemma-3n-e4b-it
NVIDIA NIM 8K Check provider Yes chat

Developer Tools

K Save API Key Never lose your API keys — save keys from all providers in one place. T Test API Key Test your API key and check quota.

NVIDIA NIM FreeLLM Score free API access score

How we score →
88 /100
⭐ FreeLLM's Pick — Best for easy signup
Generosity Free limits and access terms
65
Access Signup and key availability
100
Model Breadth Free model coverage
95
Reliability Status and stability signals
70
Compatibility SDK and endpoint support
100
Quality Model capability signals
95

What is NVIDIA NIM?

100+ open models from NVIDIA — no credit card, 40 RPM.

NVIDIA NIM (NVIDIA Inference Microservices) provides API access to 100+ open-weight models hosted on NVIDIA infrastructure. The free tier is available to all NVIDIA Developer Program members (free sign-up) with a limit of ~40 requests/minute. Models include Llama, Mistral, DeepSeek-R1, Nemotron, and domain-specific variants. All endpoints are OpenAI-compatible.

  • 100+ open models available
  • No daily token cap
  • ~40 RPM free tier
  • No credit card required

API Compatibility: Live-tested OpenAI-compatible Chat Completions

NVIDIA NIM Free Tier Limits & Pricing

Credit Card Not required
Phone Verification Required
Free Tier 97 free models online
Context Range 8K – 1.0M
Total Models 123 listed
Rate Limits Up to 40 RPM
API Compatibility Live-tested OpenAI-compatible Chat Completions

NVIDIA NIM API Setup Tutorials

NVIDIA NIM is fully compatible with popular AI coding assistants like Cursor, Claude Code, and more. To see step-by-step API configuration instructions for your favorite tool, please visit our Global Configuration Guide →

NVIDIA NIM Model Use Cases

What NVIDIA NIM's free models are best for, based on aggregated model capabilities:

Chat 123 models Reasoning 12 models Embedding 11 models Coding 9 models Vision 2 models

NVIDIA NIM Limitations & Caveats

  • ~40 RPM shared across all models, not per-model
  • Some models require additional registration per model family
  • Unavailable models listed in catalog but uncallable with standard key

NVIDIA NIM FAQ

Why can't I call certain models on NVIDIA NIM even though they're listed?

NVIDIA NIM's catalog includes all models, but some require additional per-model-family registration. If you get a 403 error, go to the model's page and click "Try API" to register for that specific model family.

Is the 40 RPM limit shared across all models?

Yes — NVIDIA NIM applies a global ~40 RPM limit to your API key, shared across all model calls. If you're using multiple models in parallel, the combined rate cannot exceed ~40 RPM.

Does NVIDIA NIM require phone verification?

Yes, NVIDIA Developer account signup requires phone number verification. This is a one-time step during account creation.