NVIDIA NIM
A NVIDIA NIM em build.nvidia.com é o endpoint de avaliação dos microsserviços NIM: uma API em formato OpenAI à frente do catálogo gratuito mais largo daqui. A lista /v1/models ao vivo tem 82 ids — DeepSeek V4 Flash, Nemotron 3 Ultra, Laguna XS, Kimi K3, MiniMax M3.
A NVIDIA NIM em build.nvidia.com é o endpoint de avaliação dos microsserviços NIM: uma API em formato OpenAI à frente do catálogo gratuito mais largo daqui. A lista /v1/models ao vivo tem 82 ids — DeepSeek V4 Flash, Nemotron 3 Ultra, Laguna XS, Kimi K3, MiniMax M3.
Um telefone, nunca cartão. Até 40 requisições por minuto e um milhão de tokens de contexto nos modelos longos. GLM 5.2 não está na lista atual. A NVIDIA diz que é para avaliação, não tráfego de produção — trate a chave assim.
- Modelos gratuitos
- 82
- Contexto máximo
- 1M
- Nível gratuito
- 40 requisições por minuto
- Requisito
- Verificação por telefone, sem cartão
Endpoint
https://integrate.api.nvidia.com/v1NVIDIA_API_KEYUp to 40 requests/minute- Compatível com OpenAI
- texto
- imagem
- áudio
- vídeo
- visão
- embeddings
- rerank
- raciocínio
Exemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://integrate.api.nvidia.com/v1',
apiKey: process.env.NVIDIA_API_KEY
})
const response = await client.chat.completions.create({
model: 'deepseek-ai/deepseek-v4-flash-0731',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://integrate.api.nvidia.com/v1",
api_key=os.environ["NVIDIA_API_KEY"],
)
response = client.chat.completions.create(
model="deepseek-ai/deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $NVIDIA_API_KEY" \
-d '{
"model": "deepseek-ai/deepseek-v4-flash-0731",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'Vale saber
- Verificação por telefone é exigida, mas não cartão de crédito.
- Pensado para avaliação, não para tráfego de produção.
- A lista /v1/models ao vivo tem 82 ids; o GLM 5.2 não está entre eles.
Modelos que você obtém de graça82
- Yi Large
01-ai/yi-large - Fuyu 8B
adept/fuyu-8b - Jamba 1.5 Large
ai21labs/jamba-1.5-large-instruct - Sea Lion 7B
aisingapore/sea-lion-7b-instruct - Starcoder 2 15B
bigcode/starcoder2-15b - Dbrx
databricks/dbrx-instruct - DeepSeek Coder 6.7B
deepseek-ai/deepseek-coder-6.7b-instruct - DeepSeek V4 Flash 0731
deepseek-ai/deepseek-v4-flash-0731 - DeepSeek V4 Pro 0813
deepseek-ai/deepseek-v4-pro-0813 - Codegemma 1.1 7B
google/codegemma-1.1-7b - Codegemma 7B
google/codegemma-7b - Deplot
google/deplot - Diffusiongemma 26B A4B
google/diffusiongemma-26b-a4b-it - Gemma 2B
google/gemma-2b - Gemma 3 12B
google/gemma-3-12b-it - Gemma 3 4B
google/gemma-3-4b-it - Gemma 4 31B
google/gemma-4-31b-it - Recurrentgemma 2B
google/recurrentgemma-2b - Granite 3.0 3B A800m
ibm/granite-3.0-3b-a800m-instruct - Granite 3.0 8B
ibm/granite-3.0-8b-instruct - Granite 34B Code
ibm/granite-34b-code-instruct - Granite 8B Code
ibm/granite-8b-code-instruct - Codellama 70B
meta/codellama-70b - Llama 3.2 11B Vision
meta/llama-3.2-11b-vision-instruct - Llama 3.2 90B Vision
meta/llama-3.2-90b-vision-instruct - Llama Guard 4 12B
meta/llama-guard-4-12b - Llama 2 70B
meta/llama2-70b - Muse Glimmer 30B
meta/muse-glimmer-30b - Kosmos 2
microsoft/kosmos-2 - Phi 3 Vision 128k
microsoft/phi-3-vision-128k-instruct - Phi 3.5 MoE
microsoft/phi-3.5-moe-instruct - MiniMax M3
minimaxai/minimax-m3 - Codestral 22B V0.1
mistralai/codestral-22b-instruct-v0.1 - Mistral 7B V0.3
mistralai/mistral-7b-instruct-v0.3 - Mistral Large
mistralai/mistral-large - Mistral Large 2
mistralai/mistral-large-2-instruct - Mistral Nemotron
mistralai/mistral-nemotron - Mixtral 8x22B V0.1
mistralai/mixtral-8x22b-v0.1 - Kimi K2.6
moonshotai/kimi-k2.6 - Kimi K3
moonshotai/kimi-k3 - Mistral Nemo 12B
nv-mistralai/mistral-nemo-12b-instruct - Ai Synthetic Video Detector
nvidia/ai-synthetic-video-detector - Cosmos Reason 2 8B
nvidia/cosmos-reason2-8b - Embed Qa 4
nvidia/embed-qa-4 - Ising Calibration 1.5 31B
nvidia/ising-calibration-1.5-31b - Llama 3.1 Nemoguard 8B Content Safety
nvidia/llama-3.1-nemoguard-8b-content-safety - Llama 3.1 Nemoguard 8B Topic Control
nvidia/llama-3.1-nemoguard-8b-topic-control - Llama 3.1 Nemotron 51B
nvidia/llama-3.1-nemotron-51b-instruct - Llama 3.1 Nemotron 70B
nvidia/llama-3.1-nemotron-70b-instruct - Llama 3.1 Nemotron Safety Guard 8B V3
nvidia/llama-3.1-nemotron-safety-guard-8b-v3 - Llama 3.1 Nemotron Ultra 253B V1
nvidia/llama-3.1-nemotron-ultra-253b-v1 - Llama 3.2 Nemoretriever 1B Vlm Embed V1
nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1 - Llama 3.2 Nv Embedqa 1B V1
nvidia/llama-3.2-nv-embedqa-1b-v1 - Llama Nemotron Embed VL 1B V2
nvidia/llama-nemotron-embed-vl-1b-v2 - Llama 3 Chatqa 1.5 70B
nvidia/llama3-chatqa-1.5-70b - Mistral Nemo Minitron 8B 8k
nvidia/mistral-nemo-minitron-8b-8k-instruct - Nemotron 3 Embed 1B
nvidia/nemotron-3-embed-1b - Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning - Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b - Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b - Nemotron 3.5 Content Safety
nvidia/nemotron-3.5-content-safety - Nemotron 3.5 Lightning 30B A3B
nvidia/nemotron-3.5-lightning-30b-a3b - Nemotron 4 340B
nvidia/nemotron-4-340b-instruct - Nemotron 4 340B Reward
nvidia/nemotron-4-340b-reward - Nemotron Nano 3 30B A3B
nvidia/nemotron-nano-3-30b-a3b - Nemotron Parse
nvidia/nemotron-parse - Neva 22B
nvidia/neva-22b - Nv Embedqa Mistral 7B V2
nvidia/nv-embedqa-mistral-7b-v2 - Nvclip
nvidia/nvclip - Riva Translate 4B
nvidia/riva-translate-4b-instruct - Riva Translate 4B V1.1
nvidia/riva-translate-4b-instruct-v1.1 - Riva Translate 4B V2
nvidia/riva-translate-4b-instruct-v2 - Vila
nvidia/vila - GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - Laguna XS 2.1
poolside/laguna-xs-2.1 - Arctic Embed L
snowflake/arctic-embed-l - Palmyra Creative 122B
writer/palmyra-creative-122b - Palmyra Fin 70B 32k
writer/palmyra-fin-70b-32k - Palmyra Med 70B
writer/palmyra-med-70b - Palmyra Med 70B 32k
writer/palmyra-med-70b-32k - Zamba 2 7B
zyphra/zamba2-7b-instruct