SambaNova
SambaNova Cloud는 자체 RDU 칩에서 일곱 모델을 돌립니다: Llama 3.3 70B, DeepSeek V3.1과 V3.2, MiniMax M2.7과 M3, Gemma 4 31B, GPT-OSS 120B. 답이 올 때는 빠릅니다. 무료 상한은 빡빡합니다 — 분당 20회, 하루 20회, 하루 20만 토큰.
SambaNova Cloud는 자체 RDU 칩에서 일곱 모델을 돌립니다: Llama 3.3 70B, DeepSeek V3.1과 V3.2, MiniMax M2.7과 M3, Gemma 4 31B, GPT-OSS 120B. 답이 올 때는 빠릅니다. 무료 상한은 빡빡합니다 — 분당 20회, 하루 20회, 하루 20만 토큰.
이메일만으로 카드는 없습니다. MiniMax M3가 윈도우를 1M로 끌어올립니다. R1은 2026년 4월 카탈로그를 떠났습니다. OpenAI 호환. 이 웨이트들을 전용 실리콘에서 돌리고 싶을 때 쓰고, 물량이 필요할 때는 쓰지 마세요.
- 무료 모델
- 7
- 최대 컨텍스트
- 1M
- 무료 요금제
- 일 20요청
- 요구사항
- 이메일만, 카드 불필요
엔드포인트
기본 URL
https://api.sambanova.ai/v1환경 변수
SAMBANOVA_API_KEY속도 제한
20 requests/minute, 20 requests/day, 200K tokens/day- OpenAI 호환
- 텍스트
- 이미지
- 추론
코드 예시
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.sambanova.ai/v1',
apiKey: process.env.SAMBANOVA_API_KEY
})
const response = await client.chat.completions.create({
model: 'DeepSeek-V3.1',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.sambanova.ai/v1",
api_key=os.environ["SAMBANOVA_API_KEY"],
)
response = client.chat.completions.create(
model="DeepSeek-V3.1",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.sambanova.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $SAMBANOVA_API_KEY" \
-d '{
"model": "DeepSeek-V3.1",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'무료로 받는 모델7
- Llama 3.3 70B
Meta-Llama-3.3-70B-Instruct - DeepSeek V3.1
DeepSeek-V3.1 - DeepSeek V3.2
DeepSeek-V3.2 - MiniMax M2.7
MiniMax-M2.7 - MiniMax M3
MiniMax-M3 - Gemma 4 31B
Gemma-4-31B - GPT-OSS 120B
gpt-oss-120b