OVHcloud AI Endpoints
OVHcloud AI Endpoints 是托管在法国的欧洲无服务器推理。ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ 的公开目录列出 19 个在线模型,其中七个标价 €0:NVIDIA Riva TTS(英/德/西/意)、Qwen3Guard-Gen 0.6B 和 8B,以及 Stable Diffusion XL。
OVHcloud AI Endpoints 是托管在法国的欧洲无服务器推理。ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ 的公开目录列出 19 个在线模型,其中七个标价 €0:NVIDIA Riva TTS(英/德/西/意)、Qwen3Guard-Gen 0.6B 和 8B,以及 Stable Diffusion XL。
Llama 3.3 70B、GPT-OSS 20B/120B 和 Qwen 3.5/3.6 在拿到密钥后按量计费,但无账号也能调用,每分钟 2 次。注册 Public Cloud 项目后升到每分钟 400 次并开始计费。OpenAI 兼容地址 oai.endpoints.kepler.ai.cloud.ovh.net/v1。官方声明提示词不用于训练。
- 免费模型
- 7
- 最大上下文
- 262K
- 免费额度
- 7 个模型 €0
- 注册要求
- 什么都不用 —— 无账号
端点
接口地址
https://oai.endpoints.kepler.ai.cloud.ovh.net/v1环境变量
OVH_AI_ENDPOINTS_ACCESS_TOKEN速率限制
2 requests/minute anonymous; 400 requests/minute with a key- OpenAI 兼容
- 文本
- 图像
- 音频
- 语音
- 代码
代码示例
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})
const response = await client.chat.completions.create({
model: 'Meta-Llama-3_3-70B-Instruct',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://oai.endpoints.kepler.ai.cloud.ovh.net/v1",
api_key=os.environ["OVH_AI_ENDPOINTS_ACCESS_TOKEN"],
)
response = client.chat.completions.create(
model="Meta-Llama-3_3-70B-Instruct",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://oai.endpoints.kepler.ai.cloud.ovh.net/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OVH_AI_ENDPOINTS_ACCESS_TOKEN" \
-d '{
"model": "Meta-Llama-3_3-70B-Instruct",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'值得注意
- 目录中七个模型标价 €0:四个 NVIDIA Riva TTS 语音、Qwen3Guard-Gen 0.6B 和 8B,以及 Stable Diffusion XL。
- 对话模型(Llama 3.3 70B、GPT-OSS、Qwen 3.5/3.6)在拿到密钥后按量计费。没有密钥也能调用,每分钟 2 次。
- 五个目录 id 被列为不可用:Mistral 7B、Mistral Nemo、Mistral Small 3.2、Qwen3-32B 和 Qwen3-Coder-30B。
你能免费使用的模型7
- Riva TTS English
nvr-tts-en-us - Riva TTS German
nvr-tts-de-de - Riva TTS Spanish
nvr-tts-es-es - Riva TTS Italian
nvr-tts-it-it - Qwen 3Guard Gen 0.6B
qwen-guard-gen-06b - Qwen 3Guard Gen 8B
qwen-guard-gen-8b - Stable Diffusion XL
stable-diffusion-xl