infoclaw.ru
  • ИИ-агенты
  • Обучение
  • OpenClaw ▾
    • Что такое OpenClaw
    • Установка
    • Навыки
    • Ошибки и решения
    • Интеграции
    • MCP-серверы
    • Безопасность
    • Сценарии использования
    • Enterprise
    • Для разработчиков
  • Hermes
  • Свой ИИ ▾
    • Локальный ИИ
    • Доступ из России
    • Цены и подписки
  • Материалы ▾
    • Новости
    • Разборы
    • Сравнения
    • Глоссарий
FAQ
  1. Главная
  2. Локальный ИИ
  3. Локальные модели: 9 рабочих под ваше железо + сколько весит каждая
Локальный ИИ

Локальные модели: 9 рабочих под ваше железо + сколько весит каждая

Какая локальная модель запустится на вашем компьютере: девять семейств с размерами файлов в гигабайтах, таблица подбора под память и предупреждение о моделях, которые локально не работают вовсе.

Степан Ноянов · 29 июля 2026 г. · 10 мин чтения · Обновлено: 17 августа 2026 г.
Локальные модели: 9 рабочих под ваше железо + сколько весит каждая

В этом материале

  1. Короткий ответ
  2. Сначала проверьте, что модель вообще локальная
  3. Что означают цифры в названии
  4. Правило, по которому выбирают размер
  5. Таблица подбора под железо
  6. Девять семейств, которые работают локально
  7. Что не запустится локально
  8. Как выбрать конкретную модель
  9. Быстрая проверка «потянет ли»
  10. Пять ошибок при первом запуске
  11. Где лежат веса и сколько места они съедают
  12. Что выбрать под вашу задачу
  13. Коротко о главном

Короткий ответ

Главная ошибка новичка — скачать самую популярную модель и разочароваться. Половина того, что стоит в топе каталога, на вашем компьютере не запустится в принципе: это облачные модели, у которых локального варианта нет.

Ниже девять семейств, которые действительно работают локально, с размерами файлов в гигабайтах, таблицей подбора под память и правилом, по которому размер выбирается. Размеры проверены в каталоге Ollama 17 августа 2026 года.

Сначала проверьте, что модель вообще локальная

В каталоге Ollama у моделей есть метки: tools, thinking, vision и — ключевая для нас — cloud. Метка cloud означает, что модель выполняется на серверах Ollama, а не у вас.

Каталог Ollama с фильтром tools: у первых трёх моделей в списке стоит метка cloud — локально они не запускаются
Каталог Ollama с фильтром tools: у первых трёх моделей в списке стоит метка cloud — локально они не запускаютсяснято 17 августа 2026

На снимке первые три результата — glm-5.2, deepseek-v4-flash и kimi-k3 — все с меткой cloud. Это флагманы, о которых пишут новости, и именно их чаще всего пытаются поставить себе на ноутбук.

ВажноМетка cloud — не про то, что модель большая. Она про то, что весов для локального запуска не опубликовано вовсе. Ждать, пока «скачается», бессмысленно: скачиваться нечему.

Проверить просто: у локальной модели в описании стоят размеры (3b, 12b, 27b), и на странице тегов виден вес файла. Нет размеров и веса — модель облачная.

Что означают цифры в названии

В названиях встречаются обозначения вроде 3B, 12B, 30B — это количество параметров в миллиардах. Чем больше число, тем «умнее» модель и тем больше памяти ей нужно.

Второе слово — квантизация (q4, q8, qat в имени тега). Это сжатие: у одного и того же семейства gemma4 вариант на 12B весит 7,6 ГБ в обычном виде и 13 ГБ в q8 — почти вдвое больше при том же числе параметров. По умолчанию Ollama качает разумно сжатый вариант, и лезть в это специально не нужно.

Третье, что стоит знать: MoE. У таких моделей заявлено, скажем, 30B параметров, но в каждом запросе работают только 3B. Памяти нужно как под большую модель, а скорость — как у маленькой. Хороший размен, если память есть.

Правило, по которому выбирают размер

Модель должна помещаться в память целиком. Если не помещается — часть считает процессор, и скорость падает в разы. Не на проценты, а именно в разы: с «быстрее, чем читаю» до «успеваю заварить чай».

Практическая прикидка: берите вес файла из таблицы ниже и прибавьте пару гигабайт на контекст. Получившееся число должно быть меньше вашей видеопамяти — или, на Mac с Apple Silicon, меньше общего объёма памяти минус то, что занято системой.

Скорость в токенах в секунду здесь намеренно не приводится: она зависит от конкретной видеокарты, версии драйвера и длины контекста, и чужие цифры на вашем железе не воспроизведутся. Проверяется она за две минуты — как именно, в разделе про пробу ниже.

Таблица подбора под железо

Та же таблица целиком, если хочется увидеть все варианты сразу:

Ваше железоРазмер моделиЧего ожидать
Ноутбук без видеокарты, 8–16 ГБ ОЗУ1–3BМедленно, годится для простого: пересказ, перевод
Видеокарта 6–8 ГБ7–8BКомфортная скорость, хорошее качество для повседневного
Видеокарта 12–16 ГБ12–14BЗаметно умнее, справляется с кодом и разбором документов
Видеокарта 24 ГБ и больше27–32BБлизко к облачным моделям среднего класса
Mac с Apple Silicon, 16 ГБ7–14BХорошая скорость за счёт единой памяти
Mac с Apple Silicon, 32–64 ГБ27–70BЛучший «домашний» вариант без сборки ПК

Девять семейств, которые работают локально

1. gemma4 — универсал по умолчанию

Самое скачиваемое семейство в каталоге: 22,5 млн загрузок. Умеет инструменты, изображения и рассуждение, доступно в размерах от e2b до 31b.

ТегВес файла
gemma4:e2b-it-qat4,3 ГБ
gemma4:e4b-it-qat6,1 ГБ
gemma4:12b-it-qat7,2 ГБ
gemma4:12b7,6 ГБ
gemma4:latest9,6 ГБ
gemma4:26b-it-qat16 ГБ
gemma4:31b20 ГБ

Кому: всем, кто не знает, с чего начать. Подвох: gemma4:latest весит 9,6 ГБ — на машине с 8 ГБ памяти он не поместится, хотя команда выглядит самой безобидной в каталоге.

2. granite4.1 — самый лёгкий вход

IBM, лицензия Apache 2.0, поддержка инструментов и структурированного JSON.

ТегВес файла
granite4.1:3b2,1 ГБ
granite4.1:8b5,3 ГБ
granite4.1:30b17 ГБ

Кому: ноутбукам без видеокарты и тем, кому нужен предсказуемый JSON на выходе. Версия на 3B — самая лёгкая модель в подборке, которая при этом умеет вызывать инструменты, то есть годится в мозг простому агенту.

3. qwen3.6 — сильный универсал верхнего сегмента

Размеры 27B и 35B, есть работа с изображениями и рассуждение. Вес вариантов на 27B — от 17 до 20 ГБ в зависимости от квантизации, а версия без сжатия доходит до 56 ГБ.

Кому: видеокартам на 24 ГБ и Mac с 32 ГБ и больше. Подвох: разброс весов внутри одного размера здесь самый большой в каталоге — смотрите на гигабайты, а не на «27b» в имени.

4. qwen3.8 — то же семейство, свежее

Обновлённая линейка с упором на код и долгие агентские задачи, размер 27B.

Кому: тем, у кого qwen3.6 уже работает и хочется прибавки без смены железа.

5. muse-glimmer — под локальных агентов

Модель Meta на 30B под лицензией Apache 2.0, заявлена как рассчитанная на постоянно работающих локальных агентов: вызов инструментов, длинные задачи, восстановление после ошибок.

Кому: если локальная модель нужна не для чата, а как мозг агента. Ровно тот случай, ради которого стоит поставить 30B вместо 12B.

6. nemotron-3.5-lightning — MoE для постоянной работы

NVIDIA, 30B общих параметров при 3B активных. Заявлена под «always-on» агентов — то есть под сценарий, когда модель отвечает часто и понемногу.

Кому: когда памяти хватает, а скорость важнее максимального качества.

7. nemotron3 — мультимодальный разбор документов

NVIDIA, 33B, объединяет видео, аудио, изображения и текст. Заявленные сценарии — вопросы по документам, пересказ, расшифровка.

Кому: разбору бумаг и записей, когда данные не должны уходить в облако.

8. ornith — под агентское программирование

Семейство для агентского кода, размеры 9B и 35B, поддержка инструментов.

Кому: 9B — редкий случай, когда модель под код помещается на среднее железо.

9. lfm2 — для устройств

24B при архитектуре, рассчитанной на работу на устройстве, поддержка инструментов.

Кому: промежуточный вариант между «совсем лёгкой» и «серьёзной», если у вас 16–24 ГБ.

Что не запустится локально

Модели, которые в каталоге помечены cloud и постоянно попадают в подборки «лучших открытых»:

МодельЧем известна
glm-5.2флагман Z.ai под долгие задачи
deepseek-v4-flashMoE на 284B, 13B активных, контекст 1M
deepseek-v4-proстаршая версия того же семейства
kimi-k3мультимодальная агентская модель Moonshot
kimi-k2.6 и kimi-k2.7-codeпредыдущие версии, в том числе под код
minimax-m3 и minimax-m2.7агентские модели с контекстом 1M
glm-5.1предыдущий флагман Z.ai
nemotron-3-super120B MoE от NVIDIA

Все они доступны в облачном режиме Ollama — команды те же, вычисления на стороне. Когда это оправдано — отдельный разбор; коротко: когда приватность не критична, а качество нужно выше локального потолка.

ОсторожноОблачный режим Ollama выглядит как локальный: та же команда, тот же интерфейс. Отличие в том, что ваш текст уходит на чужие серверы. Если локальную модель вы выбирали именно ради приватности — проверьте метку перед запуском.

Как выбрать конкретную модель

Свежие открытые модели выходят каждые пару месяцев, поэтому кроме списка выше держите в голове критерии:

  1. Начните со среднего размера для вашего железа из таблицы. Понравится скорость — попробуйте на ступень выше.
  2. Берите свежие версии. Прогресс быстрый: модель этого года на 8B часто сильнее прошлогодней на 14B.
  3. Проверьте поддержку русского. Не все открытые модели одинаково пишут по-русски. Тестируйте на своей типичной задаче, а не на «расскажи анекдот».
  4. Для агента нужен вызов инструментов. Если модель будет мозгом ИИ-агента, у неё должна быть метка tools. Без неё агент не сможет ничего сделать — только поговорить.

Быстрая проверка «потянет ли»

Скачайте модель и задайте типичный для вас вопрос. Смотрите на две вещи.

Скорость. Если текст появляется медленнее, чем вы читаете, — берите модель меньше. Это и есть тот замер, который имеет значение: не чужие токены в секунду, а ваше ощущение на вашем железе.

Качество на вашей задаче. Не на абстрактной, а на реальной: вашем письме, вашем документе, вашем куске кода.

Две-три пробы, и вы найдёте баланс. Место на диске потом освободите командой ollama rm.

ПолезноЕсли модель уже скачана, а места мало, посмотрите список командой ollama list — веса лежат до тех пор, пока их не удалить, и три-четыре забытых эксперимента спокойно съедают полсотни гигабайт.

Пять ошибок при первом запуске

Все пять встречаются постоянно и все пять лечатся до того, как вы решите, что «локальные модели не работают».

1. Скачали latest, не посмотрев вес. Тег latest — не «самая новая и лёгкая», а просто вариант по умолчанию, который выбрал автор. У gemma4 это 9,6 ГБ. На машине с 8 ГБ памяти модель формально скачается и даже запустится, но считать будет процессор, и ответа вы не дождётесь.

2. Считали память по числу параметров. «12B — это же 12 гигабайт» — неверно в обе стороны. У gemma4 вариант на 12B весит от 7,2 до 13 ГБ в зависимости от квантизации. Гигабайты на странице тегов, число в имени — только ориентир.

3. Забыли про контекст. Вес файла — это модель без разговора. Длинный диалог и большой документ занимают память сверх этого. Модель, которая впритык поместилась, начинает тормозить на третьем сообщении — и это выглядит как «сначала работала, потом сломалась».

4. Взяли модель без метки tools под агента. Агент даст модели список инструментов, а модель не поймёт, что с ним делать: ответит текстом вместо вызова. Со стороны это выглядит как «агент отказывается работать», хотя дело в модели.

5. Не закрыли остальное. Браузер с тридцатью вкладками на Mac с единой памятью — прямой конкурент модели за те же гигабайты. Перед замером скорости стоит закрыть тяжёлое, иначе вы измеряете не модель.

Где лежат веса и сколько места они съедают

Скачанные модели не удаляются сами и не чистятся при обновлении Ollama. Три-четыре забытых эксперимента по 7–17 ГБ — это полсотни гигабайт, которые обычно обнаруживаются в самый неподходящий момент.

Посмотреть, что скачано и сколько занимает:

ollama list

Удалить лишнее:

ollama rm gemma4:26b-it-qat

Полезная привычка: держать одну рабочую модель и одну лёгкую про запас, а остальное сносить сразу после пробы. Скачать обратно — это минуты, а место на ноутбуке кончается быстрее, чем терпение.

Отдельно про Mac: единая память означает, что модель и система делят один пул. Формально свободные гигабайты — не то же самое, что доступные модели, и запас в пару гигабайт здесь не роскошь, а условие работы.

Что выбрать под вашу задачу

Первая проба, ноутбук без видеокарты. granite4.1:3b — 2,1 ГБ, ставится за минуту, умеет инструменты.

Повседневный помощник, 8–16 ГБ. gemma4:12b-it-qat — 7,2 ГБ, работа с текстом и изображениями.

Мозг для локального агента. muse-glimmer на 30B, если памяти хватает; granite4.1:8b, если нет.

Код. ornith:9b на среднем железе, qwen3.8 на 24 ГБ и выше.

Разбор документов и записей. nemotron3, если есть 24 ГБ и больше.

Железо не тянет вовсе. Гибрид: маленькая локальная модель для приватного и рутинного, облачная — для сложного. Либо облачный режим Ollama, либо API за рубли.

Коротко о главном

  • Половина топа каталога — облачные модели с меткой cloud, локально они не запускаются вообще.
  • Смотрите на вес файла в гигабайтах, а не на число параметров в имени: у одного размера разброс бывает трёхкратный.
  • Модель должна помещаться в память целиком плюс пара гигабайт на контекст. Не помещается — скорость падает в разы.
  • Самый лёгкий рабочий вход — granite4.1:3b на 2,1 ГБ, и он уже умеет инструменты.
  • Агенту нужна метка tools. Без неё модель может только разговаривать.

Дальше по теме: установка Ollama, связка Ollama и OpenClaw и Ollama против LM Studio, если нужен интерфейс, а не команда.

ИИ-аватары

Сделаем цифрового двойника эксперта

Видео-аватар с клонированным голосом: контент, уроки и продажи от вашего лица без съёмок. Более 100 языков, ролики собираются из текста.

  • Видео и клон голоса
  • Контент без съёмочной группы
  • Опыт: цифровые двойники экспертов

Бесплатная консультация

Расскажите задачу — предложу решение и оценю сроки. Отвечает Степан Ноянов.

Или напишите сразу в Telegram: @noystem

Теги: локальные моделиOllamaвидеопамятьвыбор моделижелезоподборка

Вам также может быть интересно

Локальный ИИ

Установка Ollama: пошагово для Windows, macOS и Linux

29 июля 2026 г. 7 мин
Локальный ИИ

Что такое Ollama простыми словами и зачем она нужна

29 июля 2026 г. 6 мин
Локальный ИИ

Локальный ИИ: как запустить нейросеть на своём компьютере

29 июля 2026 г. 6 мин
💰
Инструмент Калькулятор стоимости AI-моделей Сравните цены GPT-5.4, Claude и Gemini за минуту
→
🎯
Квиз · 2 мин Какой OpenClaw подходит вам? 5 вопросов — персональная рекомендация
→

Популярное

  1. Ошибки OpenClaw: 7 групп + что проверять в каждой Ошибки и решения
  2. Как подключить MCP-сервер: 6 шагов + 8 ошибок, из-за которых он не виден MCP-серверы
  3. MCP-серверы: 15 рабочих + 13 архивных, которые до сих пор советуют MCP-серверы
  4. Что может делать ИИ-агент: 40 реальных задач с примерами ИИ-агенты
  5. ИИ-помощник: как выбрать и настроить своего в 2026 году ИИ-агенты

Категории

  • Что такое OpenClaw (8)
  • Установка (16)
  • Навыки (23)
  • Интеграции (15)
  • Сравнения (15)
  • Сценарии использования (23)
  • Новости (118)
  • Enterprise / NemoClaw (13)
  • Безопасность (10)
  • Для разработчиков (7)
  • Ошибки и решения (71)
  • Доступ из России (6)
  • Локальный ИИ (9)
  • ИИ-агенты (21)
  • Разборы (37)
  • Hermes Agent (10)
  • MCP-серверы (28)
  • Нейросети: цены и доступ (19)
  • Как сделать (11)
  • Обучение (4)
  • Глоссарий (12)
  • Claude Code (5)
  • ИИ в профессии (4)

Недавнее

  • Что такое n8n простыми словами: конструктор автоматизаций и ИИ-агентов сегодня
  • Как создать ИИ-агента в n8n: пошаговый разбор сегодня
  • Установка n8n: Docker, VPS или облако — по шагам сегодня

Быстрый старт

Новичок в OpenClaw? Начните отсюда:

  • → Что такое OpenClaw
  • → Установка за 10 минут
  • → Топ-10 навыков
  • → Подключить Telegram

Теги

установканавыкиtelegramwhatsappmacoswindowsenterpriseголосopen-sourcellmprivacynode.js
infoclaw.ru

Независимый информационный ресурс об ИИ-агенте OpenClaw. Статьи, гайды и новости на русском языке.

Разделы

  • Что такое OpenClaw
  • Установка
  • Навыки
  • Интеграции
  • MCP-серверы
  • Сравнения
  • Enterprise
  • Безопасность
  • Цены и подписки
  • Новости

Интеграции

  • Telegram
  • WhatsApp
  • Slack
  • Discord
  • iMessage
  • Teams
  • Matrix
  • Все (20+) →

Ресурсы

  • Вопросы и ответы
  • Глоссарий
  • Для разработчиков
  • Разборы
  • Карта сайта

© 2026 infoclaw.ru — Независимый ресурс. Не является официальным сайтом проекта OpenClaw.

О проекте Автор Политика конфиденциальности Пользовательское соглашение Контакты