Каждая модель, которую можно использовать бесплатно.
Выберите модель и посмотрите, какие провайдеры отдают её бесплатно.
- Модели
- 34
- Открытые веса
- 25
- Вендоры
- 23
Qwen 3Семейство Alibaba: от 0.6B, который тянет ноутбук, до MoE-гигантов. Хостинг-API называют точный вес; эта страница — про семейство.
Llama 3.3 70BКлассическая открытая модель Meta. Почти каждый бесплатный провайдер здесь её отдаёт — самый надёжный дефолт.
GPT-OSS 120BОткрытый релиз OpenAI. Работает на своём железе или бесплатно на Groq. Cerebras по-прежнему отдаёт его за стартовый кредит $5.
DeepSeek V4Актуальное семейство DeepSeek: V4 Flash и V4 Pro, контекст 1M, рассуждения переключателем, а не отдельной моделью.
Nemotron 3 Ultra550B Ultra от NVIDIA, заточен под агентов и вызовы функций. Бесплатно на NIM, OpenRouter (`:free`) и Requesty.
DeepSeek V4 FlashАктуальная рабочая лошадка DeepSeek: контекст 1M, рассуждения переключателем. Официальный id deepseek-v4-flash; AMD отдаёт DeepSeek-V4-Flash-0731.GLM 5.2Актуальный флагман Z.ai. Отличается в кодинге и вызовах инструментов. Бесплатно на OpenRouter (`z-ai/glm-5.2:free`); у самой Z.ai GLM-5 тарифицируется по токенам.
Qwen CoderКодинговая ветка Qwen. Достаточно мала для локального запуска и достаточно хороша для автодополнения в редакторе.
Qwen 3.8 27BАктуальный 27B от Alibaba: thinking или instruct в одном id, принимает изображения. Groq отдаёт на 131K; бесплатное окно Cloudflare доходит до 262K.Mixtral 8x7BMixture-of-experts, доказавший, что MoE работает в открытом мире. Из собственной API Mistral ушёл; локально всё ещё отличный выбор.
Laguna XSМалая кодинг-модель Poolside. Бесплатный id OpenRouter — poolside/laguna-xs-2.1; Requesty отдаёт poolside/laguna-xs.2 на 33K.
Gemini 3.7 FlashАктуальная рабочая лошадка Google из линейки Flash — код, агенты и мультимодальный ввод, контекст 1M, бесплатно попробовать в AI Studio.
Kimi K3Актуальная открытая MoE от Moonshot. Силён в агентных вызовах инструментов и кодинге. Бесплатно на NVIDIA NIM; Groq убрал старые id K2.
DeepSeek R1Рассуждающая модель 2025 года, открывшая chain-of-thought. Из собственной API DeepSeek исчезла; ещё бесплатна у нескольких хостеров и как локальные веса.
Qwen3.8-Flash-NextЧекпойнт Flash-Next 3.8. Именно этот id AMD Radeon Cloud отдаёт в рамках дневной квоты Token Factory на $10.Gemma 4 31BОткрытая 31B от Google. Cerebras отдаёт gemma-4-31b за стартовый кредит $5; Requesty листит google/gemma-4-31b-it по $0.
Nemotron 3 Super120B Super. Пример из документации Requesty и $0-id этого шлюза; также `:free` на OpenRouter.Gemini 3.5 Flash LiteСамый дешёвый актуальный Gemini. Создан для классификации, извлечения и всего, что гоняешь тысячи раз в день.
GPT-OSS 20BМладший GPT-OSS. На Groq быстрее 120B, то же окно 131K и 1 000 запросов в день.
GPT-OSS Safeguard 20BКлассификатор безопасности линейки GPT-OSS. Groq отдаёт его в том же бесплатном чат-лимите, что и остальных 20B.
DeepSeek V3.1Предыдущее поколение DeepSeek. Из официальной API убрано; SambaNova по-прежнему хостит V3.1 бесплатно.GLM 4.7 FlashПостоянная бесплатная линейка Z.ai. Контекст 200K. glm-4.7, glm-5 и glm-5.2 на этом хосте тарифицируются по токенам.
Qwen 3.6 27BПредыдущий 27B, всё ещё в бесплатном списке Groq. То же окно 131K и 30 запросов в минуту, что у 3.8.
Qwen 3.7 PlusАктуальный plus-id в Alibaba Model Studio (Сингапур / международный). Контекст 1M, 1M бесплатных токенов на 90 дней. qwen3-plus — уже не существующий id.
Qwen 3 30B-A3BMoE на 30B (активно 3B). Cloudflare отдаёт @cf/qwen/qwen3-30b-a3b-fp8 в бесплатном пуле Workers AI.
Qwen 3.5 397BQwen 3.5 на 397B-A17B. Актуальный Qwen-id в Ollama Cloud — qwen3.5:397b.
Qwen 3 8BInstruct 8B от Qwen 3. Примерный id бесплатного тарифа SiliconFlow; достаточно мал, чтобы работать и локально.Mistral SmallАктуальная линейка small у Mistral. Free mode на La Plateforme использует этот id; модели Labs (префикс labs-) тоже бесплатны.
Command AКорпоративная модель Cohere, построенная вокруг RAG и цитирования. Пробный ключ не истекает никогда.
Jamba 1.5 LargeГибрид Mamba-Transformer. Благодаря архитектуре необычно дёшев на длинных документах.Groq CompoundНе одна модель, а система: Groq маршрутизирует запрос между моделями и встроенными инструментами вроде веб-поиска.
Groq Compound MiniОблегчённая система Compound на Groq. Та же идея маршрутизации инструментов, меньше дефолтный стек.
Mistral Medium 3.5Сбалансированная модель Mistral: европейский хостинг и контекст 256K. На La Plateforme платная; не звезда бесплатного тарифа.
Phi-4Малая модель Microsoft, бьющая намного выше своего размера в бенчмарках рассуждений.