it's free*.ai

OVHcloud AI Endpoints

O OVHcloud AI Endpoints é inferência serverless europeia, hospedada na França. O catálogo público em ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ lista 19 modelos ao vivo. Sete deles estão a €0: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B e 8B, e Stable Diffusion XL.

O OVHcloud AI Endpoints é inferência serverless europeia, hospedada na França. O catálogo público em ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ lista 19 modelos ao vivo. Sete deles estão a €0: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B e 8B, e Stable Diffusion XL.

Llama 3.3 70B, GPT-OSS 20B/120B e Qwen 3.5/3.6 viram pré-pago com chave — sem ela ainda dá para chamá-los a 2 requisições por minuto. Um projeto Public Cloud registrado salta para 400 por minuto e começa a cobrar. Compatível com OpenAI em oai.endpoints.kepler.ai.cloud.ovh.net/v1. Eles dizem que prompts não são usados para treinar.

Modelos gratuitos
7
Contexto máximo
262K
Nível gratuito
7 modelos a €0
Requisito
Nada — sem conta

Endpoint

URL basehttps://oai.endpoints.kepler.ai.cloud.ovh.net/v1
Variável de ambienteOVH_AI_ENDPOINTS_ACCESS_TOKEN
Limite de taxa2 requests/minute anonymous; 400 requests/minute with a key

Exemplos de código

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
  apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})

const response = await client.chat.completions.create({
  model: 'Meta-Llama-3_3-70B-Instruct',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Vale saber

Modelos que você obtém de graça7