Todo modelo que você pode usar de graça.
Escolha um modelo e veja quais provedores o entregam a custo zero.
- Modelos
- 34
- Pesos abertos
- 25
- Provedores
- 23
Qwen 3A família da Alibaba, do 0.6B que roda num laptop aos gigantes MoE. As APIs hospedadas nomeiam o peso exato; esta página é a família.
Llama 3.3 70BO modelo aberto clássico da Meta. Quase todo provedor gratuito daqui o serve — a aposta padrão mais segura.
GPT-OSS 120BO lançamento open-weights da OpenAI. Roda no seu próprio hardware, ou de graça na Groq. A Cerebras ainda serve com o crédito de $5 no cadastro.
DeepSeek V4A família DeepSeek atual: V4 Flash e V4 Pro, 1M de contexto, thinking como interruptor em vez de segundo modelo.
Nemotron 3 UltraO 550B Ultra da NVIDIA, ajustado para agentes e chamadas de função. Grátis na NIM, OpenRouter (`:free`) e Requesty.
DeepSeek V4 FlashO cavalo de batalha atual da DeepSeek: 1M de contexto, thinking como interruptor. id oficial deepseek-v4-flash; a AMD serve o DeepSeek-V4-Flash-0731.GLM 5.2O carro-chefe atual da Z.ai. Excelente em código e chamadas de ferramentas. Grátis na OpenRouter (`z-ai/glm-5.2:free`); na própria Z.ai, o GLM-5 é cobrado por token.
Qwen CoderO ramo de código do Qwen. Pequeno o bastante para rodar local, bom o bastante para alimentar o autocompletar do editor.
Qwen 3.8 27BO 27B atual da Alibaba: thinking ou instruct num único id, imagens entram. A Groq serve a 131K; a janela gratuita da Cloudflare chega a 262K.Mixtral 8x7BO mixture-of-experts que provou que MoE funciona em campo aberto. Aposentado da API da própria Mistral; continua sendo uma ótima escolha local.
Laguna XSO pequeno modelo de código da Poolside. O id gratuito da OpenRouter é poolside/laguna-xs-2.1; a Requesty serve poolside/laguna-xs.2 a 33K.
Gemini 3.7 FlashO cavalo de batalha Flash atual do Google: código, agentes e entrada multimodal, 1M de contexto, grátis para testar no AI Studio.
Kimi K3O MoE aberto atual da Moonshot. Forte em uso de ferramentas agêntico e código. Grátis na NVIDIA NIM; a Groq aposentou os antigos ids K2.
DeepSeek R1O raciocinador de 2025 que abriu o chain-of-thought. Saiu da API da própria DeepSeek; segue grátis em alguns hosts e como pesos locais.
Qwen3.8-Flash-NextO checkpoint Flash-Next 3.8. A AMD Radeon Cloud serve exatamente esse id na cota Token Factory de $10/dia.Gemma 4 31BO 31B aberto do Google. A Cerebras serve gemma-4-31b com o crédito de $5 no cadastro; a Requesty lista google/gemma-4-31b-it a $0.
Nemotron 3 SuperO 120B Super. Exemplo da documentação da Requesty e um id a $0 desse gateway; também `:free` na OpenRouter.Gemini 3.5 Flash LiteO Gemini atual mais barato. Feito para classificação, extração e tudo que você roda milhares de vezes por dia.
GPT-OSS 20BO GPT-OSS menor. Mais rápido que o 120B na Groq, mesma janela de 131K e 1.000 requisições por dia.
GPT-OSS Safeguard 20BO classificador de segurança da linha GPT-OSS. A Groq o serve com a mesma cota gratuita de chat dos outros 20B.
DeepSeek V3.1A geração anterior da DeepSeek. Aposentado da API oficial; a SambaNova ainda hospeda o V3.1 no nível gratuito.GLM 4.7 FlashA linha gratuita permanente da Z.ai. 200K de contexto. glm-4.7, glm-5 e glm-5.2 são cobrados por token nesse host.
Qwen 3.6 27BO 27B anterior, ainda na lista gratuita da Groq. Mesma janela de 131K e 30 requisições por minuto do 3.8.
Qwen 3.7 PlusO id plus atual do Alibaba Model Studio (Singapura / internacional). 1M de contexto, 1M de tokens grátis por 90 dias. qwen3-plus não é um id atual.
Qwen 3 30B-A3BO MoE de 30B (3B ativos). A Cloudflare serve @cf/qwen/qwen3-30b-a3b-fp8 no pool gratuito do Workers AI.
Qwen 3.5 397BO Qwen 3.5 de 397B-A17B. O id Qwen atual da Ollama Cloud é qwen3.5:397b.
Qwen 3 8BO instruct 8B do Qwen 3. O id de exemplo do nível gratuito da SiliconFlow; pequeno o bastante para rodar localmente.Mistral SmallA linha small atual da Mistral. O Free mode da La Plateforme usa esse id; os modelos Labs (prefixo labs-) também são gratuitos.
Command AO modelo corporativo da Cohere, construído para RAG e citações. A chave de teste nunca expira.
Jamba 1.5 LargeUm Mamba-Transformer híbrido. Incomummente barato em documentos longos graças à arquitetura.Groq CompoundNão é um modelo, é um sistema: a Groq roteia seu pedido entre modelos e ferramentas embutidas como busca na web.
Groq Compound MiniO sistema Compound mais leve da Groq. Mesma ideia de roteamento de ferramentas, stack padrão menor.
Mistral Medium 3.5O modelo equilibrado da Mistral: hospedagem europeia e 256K de contexto. Pago na La Plateforme; não é a estrela do gratuito.
Phi-4O modelo pequeno da Microsoft que rende muito acima do seu tamanho em benchmarks de raciocínio.