Groq
Groq fa girare modelli aperti sui propri chip LPU, ed è per questo che i token tornano più veloci che quasi altrove. Un’e-mail dà la chiave. Niente carta. La lista chat gratuita è GPT-OSS, Qwen 3.6/3.8 e Compound — Llama, Kimi e DeepSeek sono andati.
Groq fa girare modelli aperti sui propri chip LPU, ed è per questo che i token tornano più veloci che quasi altrove. Un’e-mail dà la chiave. Niente carta. La lista chat gratuita è GPT-OSS, Qwen 3.6/3.8 e Compound — Llama, Kimi e DeepSeek sono andati.
I limiti sono per modello: 30 richieste al minuto e 1.000 al giorno sugli id chat, 250 al giorno su Compound. Il vecchio 14.400 vale solo per i classificatori prompt-guard. Compatibile OpenAI su api.groq.com/openai/v1; c’è anche un SDK nativo.
- Modelli gratuiti
- 7
- Contesto massimo
- 131K
- Piano gratuito
- 1.000 richieste al giorno
- Requisito
- Account e-mail, niente carta
Endpoint
URL base
https://api.groq.com/openai/v1Variabile ambiente
GROQ_API_KEYLimite di velocità
30 requests/minute, 1,000 requests/day- Compatibile OpenAI
- SDK nativo: Groq SDK
- testo
- immagine
- ragionamento
Esempi di codice
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.groq.com/openai/v1',
apiKey: process.env.GROQ_API_KEY
})
const response = await client.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key=os.environ["GROQ_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $GROQ_API_KEY" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install groq-sdkimport Groq from 'groq-sdk'
const groq = new Groq({ apiKey: process.env.GROQ_API_KEY })
const response = await groq.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install groqimport os
from groq import Groq
client = Groq(api_key=os.environ["GROQ_API_KEY"])
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale la pena sapere
- I limiti sono per modello: i modelli chat stanno a 1.000 richieste/giorno; Compound a 250. Il numero 14.400 vale solo per i classificatori prompt-guard.
- Llama 3.3, Kimi K2 e DeepSeek sono usciti dalla lista gratuita — solo Enterprise o ritirati.
Modelli che ottieni gratis7
- GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - GPT-OSS Safeguard 20B
openai/gpt-oss-safeguard-20b - Qwen 3.8 27B
qwen/qwen3.8-27b - Qwen 3.6 27B
qwen/qwen3.6-27b - Groq Compound
groq/compound - Groq Compound Mini
groq/compound-mini