Groq
Groq fait tourner des modèles ouverts sur ses propres puces LPU, d’où des tokens qui reviennent plus vite que presque partout ailleurs. Un e-mail donne la clé. Pas de carte. La liste de chat gratuite est GPT-OSS, Qwen 3.6/3.8 et Compound — Llama, Kimi et DeepSeek sont partis.
Groq fait tourner des modèles ouverts sur ses propres puces LPU, d’où des tokens qui reviennent plus vite que presque partout ailleurs. Un e-mail donne la clé. Pas de carte. La liste de chat gratuite est GPT-OSS, Qwen 3.6/3.8 et Compound — Llama, Kimi et DeepSeek sont partis.
Les limites sont par modèle : 30 requêtes par minute et 1 000 par jour sur les ids de chat, 250 par jour sur Compound. L’ancien chiffre de 14 400 ne vaut que pour les classifieurs prompt-guard. Compatible OpenAI à api.groq.com/openai/v1 ; un SDK natif existe aussi.
- Modèles gratuits
- 7
- Contexte max
- 131K
- Offre gratuite
- 1 000 requêtes/jour
- Exigence
- Compte e-mail, sans carte
Point de terminaison
https://api.groq.com/openai/v1GROQ_API_KEY30 requests/minute, 1,000 requests/day- Compatible OpenAI
- SDK natif : Groq SDK
- texte
- image
- raisonnement
Exemples de code
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.groq.com/openai/v1',
apiKey: process.env.GROQ_API_KEY
})
const response = await client.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key=os.environ["GROQ_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $GROQ_API_KEY" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install groq-sdkimport Groq from 'groq-sdk'
const groq = new Groq({ apiKey: process.env.GROQ_API_KEY })
const response = await groq.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install groqimport os
from groq import Groq
client = Groq(api_key=os.environ["GROQ_API_KEY"])
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Bon à savoir
- Les limites sont par modèle : les modèles de chat sont à 1 000 requêtes/jour ; Compound à 250. Le chiffre de 14 400 ne concerne que les classifieurs prompt-guard.
- Llama 3.3, Kimi K2 et DeepSeek sont sortis de la liste gratuite — réservés Enterprise ou retirés.
Modèles que vous obtenez gratuitement7
- GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - GPT-OSS Safeguard 20B
openai/gpt-oss-safeguard-20b - Qwen 3.8 27B
qwen/qwen3.8-27b - Qwen 3.6 27B
qwen/qwen3.6-27b - Groq Compound
groq/compound - Groq Compound Mini
groq/compound-mini