it's free*.ai

OVHcloud AI Endpoints

OVHcloud AI Endpoints è inferenza serverless europea, ospitata in Francia. Il catalogo pubblico su ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ elenca 19 modelli dal vivo. Sette sono a 0 €: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B e 8B, e Stable Diffusion XL.

OVHcloud AI Endpoints è inferenza serverless europea, ospitata in Francia. Il catalogo pubblico su ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ elenca 19 modelli dal vivo. Sette sono a 0 €: NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B e 8B, e Stable Diffusion XL.

Llama 3.3 70B, GPT-OSS 20B/120B e Qwen 3.5/3.6 diventano pay-as-you-go con una chiave; senza chiave restano chiamabili a 2 richieste al minuto. Un progetto Public Cloud registrato salta a 400 al minuto e inizia a costare. Compatibile OpenAI su oai.endpoints.kepler.ai.cloud.ovh.net/v1. Dichiarano che i prompt non vengono usati per l’addestramento.

Modelli gratuiti
7
Contesto massimo
262K
Piano gratuito
7 modelli a 0 €
Requisito
Niente — nessun account

Endpoint

URL basehttps://oai.endpoints.kepler.ai.cloud.ovh.net/v1
Variabile ambienteOVH_AI_ENDPOINTS_ACCESS_TOKEN
Limite di velocità2 requests/minute anonymous; 400 requests/minute with a key

Esempi di codice

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
  apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})

const response = await client.chat.completions.create({
  model: 'Meta-Llama-3_3-70B-Instruct',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Vale la pena sapere

Modelli che ottieni gratis7