it's free*.ai

Verzeichnis · geprüft 2 Sep 2026

Jeder kostenlose Weg, ein KI-Modell auszuführen.

Ratengrenzen, Kontextfenster und Basis-URLs für 25 Anbieter mit echtem Gratis-Tarif — plus die Laufzeiten, die ganz ohne Anbieter auskommen.

463
kostenlose Modelle
25
Anbieter
21
ohne Konto
9
lokale Laufzeiten

Kostenlose APIs

Fremde Hardware zum Nulltarif, sortiert danach, wie viel sie Ihnen geben.

25
AnbieterKontingentKontextModelleAnmeldungEnthalten
Google AI StudioVon midudev empfohlen1.500 Anfragen/Tag1M17 Modelle
Gemini 3.7 FlashGemini 3.6 FlashGemini 3.5 FlashGemini 3.5 Flash LiteGemini 3.1 Flash LiteGemini 3 FlashGemini 2.5 FlashGemini 2.5 Flash LiteGemini 2.5 Flash ImageGemini 2.0 FlashGemini 2.0 Flash LiteGemini 3.1 Flash ImageGemini 3.1 Flash TTSGemini 2.5 Flash TTSGemini Embedding 001Gemini Embedding 2Imagen 4 Fast
GroqVon midudev empfohlen1.000 Anfragen/Tag131K7 Modelle
NVIDIA NIMVon midudev empfohlen40 Anfragen/Minute1M82 Modelle
GPT-OSS 120BYi LargeFuyu 8BJamba 1.5 LargeSea Lion 7BStarcoder 2 15BDbrxDeepSeek Coder 6.7BDeepSeek V4 Flash 0731DeepSeek V4 Pro 0813Codegemma 1.1 7BCodegemma 7BDeplotDiffusiongemma 26B A4BGemma 2BGemma 3 12BGemma 3 4BGemma 4 31BRecurrentgemma 2BGranite 3.0 3B A800mGranite 3.0 8BGranite 34B CodeGranite 8B CodeCodellama 70BLlama 3.2 11B VisionLlama 3.2 90B VisionLlama Guard 4 12BLlama 2 70BMuse Glimmer 30BKosmos 2Phi 3 Vision 128kPhi 3.5 MoEMiniMax M3Codestral 22B V0.1Mistral 7B V0.3Mistral LargeMistral Large 2Mistral NemotronMixtral 8x22B V0.1Kimi K2.6Kimi K3Mistral Nemo 12BAi Synthetic Video DetectorCosmos Reason 2 8BEmbed Qa 4Ising Calibration 1.5 31BLlama 3.1 Nemoguard 8B Content SafetyLlama 3.1 Nemoguard 8B Topic ControlLlama 3.1 Nemotron 51BLlama 3.1 Nemotron 70BLlama 3.1 Nemotron Safety Guard 8B V3Llama 3.1 Nemotron Ultra 253B V1Llama 3.2 Nemoretriever 1B Vlm Embed V1Llama 3.2 Nv Embedqa 1B V1Llama Nemotron Embed VL 1B V2Llama 3 Chatqa 1.5 70BMistral Nemo Minitron 8B 8kNemotron 3 Embed 1BNemotron 3 Nano Omni 30B A3B ReasoningNemotron 3 Super 120B A12BNemotron 3 Ultra 550B A55BNemotron 3.5 Content SafetyNemotron 3.5 Lightning 30B A3BNemotron 4 340BNemotron 4 340B RewardNemotron Nano 3 30B A3BNemotron ParseNeva 22BNv Embedqa Mistral 7B V2NvclipRiva Translate 4BRiva Translate 4B V1.1Riva Translate 4B V2VilaGPT-OSS 20BLaguna XS 2.1Arctic Embed LPalmyra Creative 122BPalmyra Fin 70B 32kPalmyra Med 70BPalmyra Med 70B 32kZamba 2 7B
OpenRouterVon midudev empfohlen18 Modelle ohne Kosten1M18 Modelle
Ling 3.0 Flash FinDots 3 Note PreviewLFM 2.5 2.6BNemotron 3.5 LightningInkling SmallLaguna S 2.1InklingLaguna XS 2.1North Mini CodeGLM 5.2Nemotron 3.5 Content SafetyNemotron 3 UltraMiniMax M3Nemotron 3 Nano OmniGemma 4 26B A4BGemma 4 31BMiniMax M2.7Nemotron 3 SuperFree Models Router
Vercel AI GatewayVon midudev empfohlen$5 Guthaben/Monat1M12 Modelle
AMD Radeon Cloud$10 Nutzung/Tag1M5 Modelle
Requesty200 Anfragen/Tag1M12 Modelle
Laguna M.1Laguna XS.2Ling 3.0 TinyGemma 4 31BLeanstral 1.5Nemotron 3 Super 120B A12BNemotron 3 Nano Omni 30B A3B ReasoningNemotron 3 Nano 30B A3BNemotron 3.5 Content SafetyNemotron 3 Ultra 550B A55BMuse Glimmer 30BNemotron 3.5 Lightning 30B A3B
Cerebras$5 Einmalguthaben65K2 Modelle
Cloudflare Workers AI10.000 Neuronen/Tag262K40 Modelle
GPT-OSS 120BQwen 3.8 27BGPT-OSS 20BLlama 3.3 70BLlama 4 ScoutLlama 3.1 8B FastLlama 3.1 8B FP8Llama 3.2 11B VisionLlama 3.2 1BLlama 3.2 3BGemma 4 26BGLM 4.7 FlashGranite 4.0 H MicroNemotron 3 SuperQwen 3 30B A3BQwen 2.5 Coder 32BQwQ 32BMistral Small 3.1DeepSeek R1 Distill 32BLlama Guard 3 8BWhisper Large V3 TurboBGE M3BGE BaseEmbeddingGemma 300MFLUX.1 SchnellQwen 3 Embedding 0.6BGemma 3 12BLlama 3.1 8BMistral 7BLLaVA 1.5 7BWhisperNova 3MeloTTSStable Diffusion XLResnet 50BART Large CNNDistilBERT SST 2SQLCoder 7BPhi 2
Mistral AIFree mode und Labs256K12 Modelle
Mistral SmallMistral Small 2506Mistral NemoCodestralPixtral 12BLabs Mistral SmallMistral EmbedMistral ModerationMistral OCRMistral Small 3.1Devstral SmallMagistral Small
Cohere1.000 Anfragen/Monat256K12 Modelle
Command ACommand A+Command R+Command RCommand R7BCommand A ReasoningCommand A TranslateEmbed V4Embed English V3Embed Multilingual V3Rerank V3.5Rerank English V3
LLM7.io10/Minute (40 mit Token)1M5 Modelle
GPT-OSS 120BGemma 4 31BMiniMax M2.7CodestralMistral Nemo
DeepSeekGuthaben bei Anmeldung1M3 Modelle
Hugging Face$0,10 Guthaben/Monat131K135 Modelle
GPT-OSS 120BQwen 3.8 27BGLM 5.3 FlashGLM 5.3Kimi K3DeepSeek V4 Flash 0731Granite 4.2 30BGLM 5.3 Flash BF16Muse Glimmer 30BGemma 4 31BGranite 4.2 3BLlama 3.1 8BGranite 4.2 8BGLM 5.3 BF16Qwen 3.8 2.4T A95BDeepSeek V4 Pro 0813DeepSeek V4 FlashQwen 3.5 9BInkling SmallQwen 3.6 35B A3BGemma 4 26B A4BHy3GLM 5.2InklingLing 3.0 FlashGPT-OSS 20BMiniMax M3DeepSeek V4 ProTernary Bonsai 27B GgufGLM 4.7 FlashDeepSeek R1Qwen 3 8BLlama 3.3 70BQwen 2.5 Coder 7BNVIDIA Nemotron 3 Ultra 550B A55B NVFP4Qwen 3 Coder NextNVIDIA Nemotron 3.5 Lightning 30B A3B BF16Qwen 3 Coder 30B A3BQwen 3 4B 2507Qwen 3.5 35B A3BQwen 3.6 27BMiMo V2.5Qwen 2.5 Coder 32BApertus V1.5 8BQwen 3 14BKimi K2.6GLM 5.2 FP8Kimi K2.7 CodePhi 4Gemma 3 4BQwen 3 235B A22B 2507Apertus V1.5 70BL3 8B Stheno V3.2Qwen 3 30B A3BStep 3.7 FlashQwen 3 Next 80B A3BDeepSeek V3.2MiMo V2.5 ProLlama 4 Scout 17B 16EQwen 3 32BQwen 3.5 397B A17BQwen 3 235B A22BKimi K2.5Gemma 3 27BQwen 3.5 27BQwen 3.5 122B A10BQwen 3 235B A22B Thinking 2507Tiny Aya GlobalGLM 5Gemma 3 12BHermes 3 Llama 3.1 70BTiny Aya WaterGLM 5.1Llama Guard 4 12BQwen 2.5 72BGLM 5.1 FP8Apertus 8B 2509DeepSeek V3GLM 4.7DeepSeek V3 0324DeepSeek R1 Distill Llama 8BWizardLM 2 8x22BERNIE 4.5 VL 424B A47B Base PTDeepSeek V3.2 ExpGLM 4.6V FlashAutoGLM Phone 9B MultilingualTernary Bonsai 27B AWQ 4bitL3 8B Lunaris V1Gemma SEA LION V4 27BLlama 4 Maverick 17B 128E FP8Qwen 3 VL 235B A22BDeepSeek R1 Distill Llama 70BApertus 70B 2509GLM 4.5VQwen 3 VL 30B A3BGLM 4 32B 0414Qwen SEA LION V4 32BQwen 3 VL 235B A22B ThinkingQwen 2.5 Coder 3BMiniMax M1 80kBielik 11B V3.0Qwen 2.5 VL 72BDeepSeek R1 Distill Qwen 7BKimi K2DeepSeek R1 0528GLM 4.5DeepSeek R1 Distill Qwen 14BGLM 4.5 AirDeepSeek V3.1GLM 4.6 FP8Qwen 3 4B Thinking 2507Qwen 3 Coder 480B A35BDeepSeek V3.1 TerminusC4ai Command R 08 2024GLM 4.6Kimi K2 0905Step 3.5 FlashAya Expanse 32BGLM 4.7 FP8MiniMax M2MiniMax M2.7C4ai Command R7B 12 2024MiniMax M2.1GLM 4.5V FP8C4ai Command R7B Arabic 02 2025MiniMax M2.5GLM 4.6VC4ai Command A 03 2025Aya Vision 32BGLM 4.6V FP8GPT-OSS Safeguard 20BCommand A Reasoning 08 2025Command A Translate 08 2025Tiny Aya EarthTiny Aya Fire
ModelScope2.000 Anfragen/Tag1M50 Modelle
Qwen 3.8 27BDeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Pro 0813EA 29B A4BAntAngelMedLongCat Flash LiteMiniMax M1MiniMax M3Mistral LargeQwen Image EditCompassJudger 32BInternVL 3.5ERNIE 4.5 0.3BERNIE 4.5 21BERNIE 4.5 300BERNIE 4.5 VL 28BQwen Image EditQwen 3 14BQwen 3 235BQwen 3 235BQwen 3 235B ThinkingQwen 3 30B A3BQwen 3 30B A3B ThinkingQwen 3 4BQwen 3 8BQwen 3 Coder 30BQwen 3 Embedding 0.6BQwen 3 Embedding 4BQwen 3 Embedding 8BQwen 3 Next 80BQwen 3 Next 80B ThinkingQwen 3 VL 235BQwen 3 VL 8BQwen 3 VL 8B ThinkingQwen 3.5 122BQwen 3.5 27BQwen 3.5 35BQwen 3.5 397BQwen 3.8 Flash NextIntern S1Intern S1 MiniIntern S2Step 3.5 FlashStep 3.7 FlashHunyuan Hy3XiYanSQL 32BXiYanSQL 32B 2504GLM 4.7 FlashGLM 5.2
Z.ai (Zhipu)GLM-Flash-Modelle gratis200K4 Modelle
GLM 4.7 FlashGLM 4.5 FlashGLM 4.6 FlashGLM 4 Flash
SambaNova20 Anfragen/Tag1M7 Modelle
Ollama CloudMonatliche Starter-Credits1M19 Modelle
OVHcloud AI Endpoints7 Modelle für €0262K7 Modelle
Riva TTS EnglishRiva TTS GermanRiva TTS SpanishRiva TTS ItalianQwen 3Guard Gen 0.6BQwen 3Guard Gen 8BStable Diffusion XL
Alibaba Model Studio1M Token pro Modell, 90 Tage1M Modelle
Qwen 3.7 PlusQwen 3.6 PlusQwen 3.5 PlusQwen 3 Coder PlusQwen 3.5 Plus Long
OpenCode Zen6 kostenlose Modelle1M6 Modelle
Nemotron 3 UltraNemotron 3 LightningMiMoLing FlashBig PickleMuse Spark
AI21 Labs$10 Guthaben für 3 Monate256K2 Modelle
SiliconFlowModell-Limits nach KYC131K3 Modelle
Qwen 3 8BQwen 2.5 7BGLM 4 9B
Nebius AI Studio$1 Test für 30 Tage128K1 Modelle
Nscale$5 Startguthaben128K2 Modelle
Llama 4 ScoutLlama 3.3 70B

Auf dem eigenen Rechner ausführen

Kein Kontingent, kein Schlüssel, keine Anfrage verlässt das Gerät. Per Definition für immer kostenlos — wenn das Modell passt.

Ollama

CLI + Server

Ein Befehl, und das Modell läuft auf deinem Rechner. Keine Limits, keine Quotas.

localhost:11434/v1

LM Studio

Desktop-App

Ollama mit GUI: finden, laden und lokal chatten.

localhost:1234/v1

llama.cpp

Engine

Die Engine, auf der fast alles andere läuft. Pures C++, keine Abhängigkeiten.

localhost:8080/v1

Jan

Desktop-App

Open-Source-ChatGPT-Alternative, die zu 100 % offline funktioniert.

localhost:1337/v1

GPT4All

Desktop-App

Lokal mit deinen Dokumenten chatten — nichts verlässt den Laptop.

Local RAG

vLLM

Inference-Server

Der Serving-Stack der Produktion. PagedAttention und Continuous Batching auf deiner eigenen GPU.

localhost:8000/v1

MLX

Apple Silicon

Apples Array-Framework. Auf einem M-Series-Mac der schnellste Weg zu lokalen Modellen.

localhost:8080/v1

llamafile

Einzelne Binärdatei

Eine Datei ist Modell und Laufzeit zugleich. Herunterladen, chmod +x, starten. Keine Installation.

localhost:8080/v1

KoboldCpp

Einzelne Binärdatei

Eine einzelne Binärdatei um llama.cpp, abgestimmt auf lange Texte und kreatives Schreiben.

GGUF

Rund um die Modelle

Kostenlose KI-Tools, die kein Modell sind: Editoren, Playgrounds und Dinge, die Ihnen verraten, was Sie wählen sollen.

14

Fragen, die wirklich gestellt werden

Kurze Antworten. Die langen stehen auf jeder Anbieterseite.

Gibt es eine kostenlose KI-API ohne Kreditkarte?

Die meisten Anbieter auf dieser Seite funktionieren ohne eine. Google AI Studio gibt 1.500 Gemini-Anfragen pro Tag für eine E-Mail. Groq ist am schnellsten mit 1.000 pro Tag. Die :free-Modelle von LLM7.io und Kilo brauchen gar kein Konto. NVIDIA NIM, ModelScope, SiliconFlow, Zhipu und Alibaba verlangen eine Telefonnummer, nie eine Karte. Cerebras und Nebius wollen eine Zahlungsmethode für ihr Startguthaben.

Welcher Gratis-Tarif hat die höchsten Limits?

Nach Anfragen: Google AI Studio mit 1.500 pro Tag oder NVIDIA NIM mit 40 pro Minute ohne veröffentlichtes Tageslimit. Nach Token: Cerebras mit einer Million pro Tag auf dem $5-Guthaben. Nach Kontext: Gemini, NIM und DeepSeek V4 mit 1M. Es gibt keinen einzelnen Sieger, weshalb die obige Tabelle sortiert.

Kann ich etwas auf einem Gratis-Tarif in Produktion bringen?

Selten. Die meisten sind Evaluierungstarife ohne Uptime-Versprechen, und einige verbieten Produktion ausdrücklich. Prototypen Sie darauf und kalkulieren Sie den bezahlten Tarif, bevor Sie starten.

Was bedeutet OpenAI-kompatibel eigentlich?

Der Anbieter akzeptiert dieselbe Anfrageform wie das OpenAI-SDK, Sie tauschen also zwei Zeilen — die Basis-URL und den Schlüssel — und der Rest Ihres Codes bleibt unverändert. Fast alles hier ist so.

Brauche ich eine GPU, um ein Modell lokal auszuführen?

Nein. llama.cpp und GPT4All führen 7B-Modelle auf einer normalen Laptop-CPU aus, und jeder neuere Mac läuft sie über MLX gut. Eine GPU kauft Tempo, keinen Zugang.

Trainieren kostenlose Anbieter mit dem, was ich sende?

Manche schon — Google sagt das für den kostenlosen Gemini-Tarif ausdrücklich. Gehen Sie davon aus, dass kostenlos bedeutet, dass Ihre Prompts frei verwendet werden, sofern der Anbieter nichts anderes sagt, und behalten Sie Vertrauliches auf einer lokalen Laufzeit.