Что даёт локальный запуск

Ollama ставится установщиком с официального сайта, дальше работает одна команда в терминале. Модель считается прямо на вашем железе: без подписки, без чужого сервера, без интернета после скачивания. Официальная позиция разработчиков прямая: запуск моделей на своём оборудовании всегда безлимитен. Платят только за облачные модели - те, что физически не влезают ни в одну домашнюю машину и считаются на серверах сервиса.

Что нужно перед установкой

Таблица прокручивается вбок на телефоне →

СистемаМинимумМесто под установку
WindowsWindows 10 22H2 и новееоколо 4 ГБ
macOSmacOS Sonoma 14 и новееоколо 1 ГБ
Linuxядро с поддержкой systemdоколо 1 ГБ

Видеокарта не обязательна - модель поедет и на процессоре, просто медленнее. Место под сами модели считается отдельно и это главная статья расхода диска: закладывайте минимум 10 ГБ сверх установщика, если планируете пробовать больше одной модели.

Установка и первый запуск

На Windows - через установщик со страницы загрузки, без прав администратора. На macOS - перетаскиванием файла Ollama.dmg в папку «Программы» или командой brew install ollama. На Linux - одной командой из официальной документации:

# Linux, официальный установщик
curl -fsSL https://ollama.com/install.sh | sh

# проверка версии и запуск первой модели
ollama --version
ollama run gemma3:4b

Первый запуск идёт дольше остальных - сначала модель скачивается, потом поднимается с диска в память. Выход из чата - команда /bye, модель после этого ещё несколько минут остаётся в памяти, чтобы следующий запуск был мгновенным.

Пять команд, которыми всё управляется

pull
Скачивает модель, не запуская - удобно поставить на ночь заранее.
run
Запускает модель и открывает чат прямо в терминале.
list
Показывает скачанные модели и их вес на диске.
ps
Показывает, какие модели сейчас держатся в памяти и сколько занимают.

Пятая команда - ollama rm имя-модели - удаляет модель с диска и освобождает место.

Как выбрать модель по памяти

Модель в работе занимает заметно больше места, чем весит файл на диске: сверху ложится окно контекста - буфер под диалог. Отсюда простое рабочее правило, а не точная формула: берите модель, чей файл на 3-4 ГБ меньше объёма свободной памяти вашего компьютера. Проверяется соотношение одной командой ollama ps, которая показывает реально занятую память рядом с весом файла из ollama list.

Таблица прокручивается вбок на телефоне →

Память компьютераОриентир по файлу модели
8 ГБдо 4 ГБ
16 ГБдо 10 ГБ
36 ГБдо 24 ГБ

Если у вас отдельная видеокарта, а не общая память (как на Apple Silicon), считать нужно по объёму памяти самой карты, а не по оперативной памяти системы целиком.

Работает ли без интернета

Уже скачанная модель отвечает полностью офлайн - для генерации ответа сеть не нужна вообще. А вот скачивание новой модели командой pull без интернета не работает: файл модели тянется из реестра, и без сети команда сразу падает с ошибкой соединения. Практическое правило: скачивайте модели, пока есть сеть, дальше они ваши насовсем, независимо от подключения.

Локальная модель против облачной

Локальная модель сильна там, где важна приватность и отсутствие лимитов: разбор личных документов, черновики, код, работа без стабильного интернета. Топовые облачные модели пока сильнее в сложных многошаговых рассуждениях - локальная модель их не заменяет полностью, а дополняет там, где данные не должны покидать компьютер.

Памятка

Сохраните себе
  1. Систему проверьте заранее: Windows 10 22H2+, macOS Sonoma 14+ или Linux с systemd.
  2. Заложите минимум 10 ГБ свободного диска сверх самого установщика.
  3. Первую модель выбирайте по правилу «файл на 3-4 ГБ меньше объёма памяти».
  4. Команда ollama ps покажет, влезла ли модель целиком в видеопамять или ушла на процессор.
  5. Скачивайте модели, пока есть интернет - дальше они работают полностью офлайн.

Частые вопросы

Ollama платная?

Локальный запуск бесплатен и не ограничен никогда - это прямая позиция разработчиков. Платят только за облачные модели, которые не помещаются на обычный компьютер.

Нужна ли видеокарта для запуска модели?

Нет, модель поедет и на процессоре, просто медленнее. Видеокарта ускоряет генерацию, но не обязательна для запуска.

Работает ли Ollama без интернета?

Уже скачанная модель отвечает полностью офлайн. Скачивание новой модели требует подключения к сети.

Ollama платная?
Локальный запуск бесплатен и не ограничен никогда. Платят только за облачные модели, которые не помещаются на обычный компьютер.
Нужна ли видеокарта, чтобы запустить модель в Ollama?
Нет, модель работает и на процессоре, просто медленнее - видеокарта только ускоряет ответ.
Работает ли Ollama без интернета?
Уже скачанная модель отвечает полностью офлайн, а скачивание новой модели требует подключения к сети.
← Все статьи блога