it's free*.ai

Ollama

Ollama est le standard local : un CLI, une bibliothèque de modèles, un serveur compatible OpenAI sur localhost:11434/v1. `ollama pull llama3.3` une fois, puis on l’appelle comme n’importe quel autre fournisseur.

Ollama est le standard local : un CLI, une bibliothèque de modèles, un serveur compatible OpenAI sur localhost:11434/v1. `ollama pull llama3.3` une fois, puis on l’appelle comme n’importe quel autre fournisseur.

macOS, Linux, Windows. Aucun quota. La requête ne quitte jamais la machine sauf si vous optez pour Cloud. Pour une GUI : LM Studio. Pour du batching de production : vLLM.

Contexte max
Whatever your RAM allows
Offre gratuite
Illimité et privé
Exigence
Rien — pas de compte

Point de terminaison

URL de basehttp://localhost:11434/v1
Limite de débitNone — it is your machine

Exemples de code

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'http://localhost:11434/v1',
  apiKey: 'not-needed'
})

const response = await client.chat.completions.create({
  model: 'llama3.3',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Bon à savoir

Modèles que vous obtenez gratuitement5