Groq
Recomendado por midudev↗A inferência mais rápida do mercado. Sem cartão de crédito.
1.000 requisições por dia131K context
Alibaba
A família da Alibaba, do 0.6B que roda num laptop aos gigantes MoE. As APIs hospedadas nomeiam o peso exato; esta página é a família.
A inferência mais rápida do mercado. Sem cartão de crédito.
1.000 requisições por dia131K context
Uma chave, centenas de modelos, $5 de crédito todo mês. Sem markup nos tokens.
$5 de crédito por mês1M context
O Token Factory da AMD: cinco APIs gratuitas compartilhadas e $10 de uso por dia, com reset à meia-noite.
$10 de uso por dia1M context
Modelos na edge, a um fetch de distância do seu Worker.
10.000 neurônios por dia262K context
Inference Providers: milhares de modelos abertos com créditos mensais.
$0.10 de crédito por mês131K context
O hub da Alibaba: 50 modelos gratuitos via API, muitos deles ponta-de-lança chineses.
2.000 requisições por dia50 models
Os mesmos modelos e comandos do Ollama local, rodando na GPU de outra pessoa.
Créditos mensais de partida1M context
Qwen direto da fonte, com nível de 1M de contexto e cota gratuita para começar.
1M tokens por modelo, 90 dias1M context
Modelos abertos chineses com nível gratuito permanente, destilados incluídos.
Limites por modelo após KYC131K context
Milhares de demos de modelos abertos prontas para testar no navegador.
Acesso gratuitoCommunity demos