Groq
Recomendado por midudev↗La inferencia más rápida del mercado. Sin tarjeta de crédito.
1.000 peticiones al día131K context
Alibaba
La familia de Alibaba, desde el 0.6B que corre en un portátil hasta los gigantes MoE. Las APIs alojadas nombran el peso exacto; esta página es la familia.
La inferencia más rápida del mercado. Sin tarjeta de crédito.
1.000 peticiones al día131K context
Una clave, cientos de modelos, $5 de crédito cada mes. Sin sobrecoste en los tokens.
$5 de crédito al mes1M context
El Token Factory de AMD: cinco APIs gratuitas compartidas y $10 de uso al día, que se reinician a medianoche.
$10 de uso al día1M context
Modelos en el edge, a un fetch de tu Worker.
10.000 neuronas al día262K context
Inference Providers: miles de modelos abiertos con créditos mensuales.
$0.10 de crédito al mes131K context
El hub de Alibaba: 50 modelos gratuitos vía API, muchos de ellos punteros chinos.
2.000 peticiones al día50 models
Los mismos modelos y comandos que el Ollama local, pero corriendo en la GPU de otro.
Créditos mensuales de inicio1M context
Qwen directo de la fuente, con un nivel de 1M de contexto y cuota gratuita para empezar.
1M tokens por modelo, 90 días1M context
Modelos abiertos chinos con nivel gratuito permanente, destilados incluidos.
Topes por modelo tras KYC131K context
Miles de demos de modelos abiertos listas para probar en el navegador.
Acceso gratuitoCommunity demos