OVHcloud AI Endpoints
OVHcloud AI Endpoints — европейский serverless-инференс с хостингом во Франции. Публичный каталог на ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ листит 19 живых моделей. Семь из них стоят €0: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B и 8B, и Stable Diffusion XL.
OVHcloud AI Endpoints — европейский serverless-инференс с хостингом во Франции. Публичный каталог на ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ листит 19 живых моделей. Семь из них стоят €0: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B и 8B, и Stable Diffusion XL.
Llama 3.3 70B, GPT-OSS 20B/120B и Qwen 3.5/3.6 становятся pay-as-you-go при наличии ключа; без ключа их всё ещё можно звать на 2 запроса в минуту. Зарегистрированный проект Public Cloud поднимает до 400 в минуту и начинает биллить. OpenAI-совместимый адрес — oai.endpoints.kepler.ai.cloud.ovh.net/v1. Говорят, промпты на обучение не идут.
- Бесплатные модели
- 7
- Макс. контекст
- 262K
- Бесплатный тариф
- 7 моделей по €0
- Требование
- Ничего — без аккаунта
Эндпоинт
https://oai.endpoints.kepler.ai.cloud.ovh.net/v1OVH_AI_ENDPOINTS_ACCESS_TOKEN2 requests/minute anonymous; 400 requests/minute with a key- Совместим с OpenAI
- текст
- изображения
- аудио
- речь
- код
Примеры кода
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})
const response = await client.chat.completions.create({
model: 'Meta-Llama-3_3-70B-Instruct',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://oai.endpoints.kepler.ai.cloud.ovh.net/v1",
api_key=os.environ["OVH_AI_ENDPOINTS_ACCESS_TOKEN"],
)
response = client.chat.completions.create(
model="Meta-Llama-3_3-70B-Instruct",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://oai.endpoints.kepler.ai.cloud.ovh.net/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OVH_AI_ENDPOINTS_ACCESS_TOKEN" \
-d '{
"model": "Meta-Llama-3_3-70B-Instruct",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'Стоит знать
- Семь моделей каталога стоят €0: четыре голоса NVIDIA Riva TTS, Qwen3Guard-Gen 0.6B и 8B, и Stable Diffusion XL.
- Чат-модели (Llama 3.3 70B, GPT-OSS, Qwen 3.5/3.6) становятся pay-as-you-go при наличии ключа. Без ключа их всё ещё можно звать на 2 запроса в минуту.
- Пять id каталога помечены как недоступные: Mistral 7B, Mistral Nemo, Mistral Small 3.2, Qwen3-32B и Qwen3-Coder-30B.
Модели, которые вы получаете бесплатно7
- Riva TTS English
nvr-tts-en-us - Riva TTS German
nvr-tts-de-de - Riva TTS Spanish
nvr-tts-es-es - Riva TTS Italian
nvr-tts-it-it - Qwen 3Guard Gen 0.6B
qwen-guard-gen-06b - Qwen 3Guard Gen 8B
qwen-guard-gen-8b - Stable Diffusion XL
stable-diffusion-xl