Cerebras
Cerebras Cloud serviert Modelle von Wafer-Scale-Chips — deshalb kommt GPT-OSS 120B mit Tausenden Token pro Sekunde zurück. Der öffentliche Katalog umfasst zwei Modelle: gpt-oss-120b und gemma-4-31b.
Cerebras Cloud serviert Modelle von Wafer-Scale-Chips — deshalb kommt GPT-OSS 120B mit Tausenden Token pro Sekunde zurück. Der öffentliche Katalog umfasst zwei Modelle: gpt-oss-120b und gemma-4-31b.
Die Anmeldung schenkt einmalig $5. Eine Zahlungsmethode schaltet das Guthaben frei; ein ständiges Gratis-Tier ist es nicht. Nach den fünf Dollar kauft man nach. Die Anfragekappe liegt bei 5 pro Minute, 30K Token pro Minute, einer Million Token pro Tag, das Gratis-Fenster bei 65K. Arbeit bündeln statt in Schleifen zu feuern. OpenAI-kompatibel unter api.cerebras.ai/v1.
- Kostenlose Modelle
- 2
- Max. Kontext
- 65K
- Gratis-Tarif
- $5 Einmalguthaben
- Anforderung
- Kreditkarte erforderlich
Endpunkt
https://api.cerebras.ai/v1CEREBRAS_API_KEY5 requests/minute, 30K tokens/minute, 1M tokens/day- OpenAI-kompatibel
- Eigenes SDK: Cerebras Cloud SDK
- Text
- Bild
- Reasoning
Codebeispiele
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.cerebras.ai/v1',
apiKey: process.env.CEREBRAS_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key=os.environ["CEREBRAS_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $CEREBRAS_API_KEY" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install @cerebras/cerebras_cloud_sdkimport Cerebras from '@cerebras/cerebras_cloud_sdk'
const client = new Cerebras({ apiKey: process.env.CEREBRAS_API_KEY })
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install cerebras_cloud_sdkimport os
from cerebras.cloud.sdk import Cerebras
client = Cerebras(api_key=os.environ["CEREBRAS_API_KEY"])
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Wissenswert
- Der öffentliche Katalog umfasst zwei Modelle: gpt-oss-120b und gemma-4-31b. Llama, Qwen und DeepSeek sind weg.
- Die Anmeldung schenkt einmalig $5. Eine Zahlungsmethode schaltet das Guthaben frei; danach kauft man nach.
- 5 Anfragen/Minute sind wenig — Arbeit bündeln statt Anfragen in einer Schleife abzufeuern.
Modelle, die Sie gratis bekommen2
- GPT-OSS 120B
gpt-oss-120b - Gemma 4 31B
gemma-4-31b