Как установить Ollama: Linux, macOS и Windows за одну команду
Официальные команды установки Ollama, первый ollama run и проверка, что модель отвечает локально — без облака и без пустых «скачайте с сайта».

Ollama — это рантайм, который ставит открытую модель на ваш компьютер и отдаёт её как локальный API. Без облачной подписки, без отправки промпта на чужой сервер. Ниже — установка с официального сайта и проверка, что модель реально отвечает.
Это не гайд про конкретную Llama: рантайм один, моделей много. Как скачать именно Llama после установки — в отдельной инструкции Llama как установить.
Linux и macOS: одна команда
На Linux и на macOS 14 Sonoma и новее официальный установщик такой:
curl -fsSL https://ollama.com/install.sh | shСкрипт качает бинарь, кладёт его в PATH и на Linux поднимает сервис. Обновить Ollama позже — той же командой.
macOS можно поставить и через .dmg со страницы Download. Windows 10 и новее — через установщик или в PowerShell:
irm https://ollama.com/install.ps1 | iexЛибо скачайте OllamaSetup.exe с ollama.com/download/windows.
Проверка, что бинарь на месте:
ollama -vДолжен напечатать номер версии. Если команда не находится — закройте терминал и откройте новый: установщик мог обновить PATH только для новой сессии.
Первый запуск модели
Скрипт установки сам поднимает ollama serve. Если сервис не стартовал (ручная установка на Linux), в одном терминале:
ollama serveВ другом — скачайте небольшую модель и сразу зайдите в чат. llama3.2 тянется быстро и живёт на ноутбуке:
ollama run llama3.2Первый запуск качает веса. Когда появится приглашение — напишите что угодно, например «ответь одним предложением: ты где работаешь?». Если ответ пришёл локально, установка закончена.
Полезные команды на каждый день:
ollama list
ollama pull llama3.1:8b
ollama rm llama3.2list показывает, что уже лежит на диске. pull качает, не открывая чат. rm удаляет веса, когда диск кончился.
Локальный API слушает http://127.0.0.1:11434. Это тот же OpenAI-совместимый чат, которым пользуются Open WebUI, Continue и многие агенты.
Какое железо нужно на старте
Сама Ollama бесплатна. Платить придётся только если вы уйдёте в облако Ollama или арендуете GPU. Для локального старта ориентир такой:
- 8 ГБ оперативной памяти — мелкие модели вроде Llama 3.2 1B/3B.
- 16 ГБ — комфортный минимум для 8B (Llama 3.1 8B, многие Qwen).
- 70B без серьёзной видеокарты — это уже десятки гигабайт RAM и минуты на токен, не «чат как в браузере».
Точные гигабайты зависят от квантования конкретной сборки в библиотеке Ollama. Если модель не влезает, процесс либо не стартует, либо начинает свопить диск — и тогда компьютер просто встанет.
На NVIDIA имеет смысл поставить драйвер так, чтобы работал nvidia-smi. На AMD Linux Ollama ставит отдельный ROCm-пакет; без него модель уйдёт в CPU.
Где это ломается
Не ставьте сборки со сторонних «зеркал». Официальный путь — ollama.com/download и скрипты с домена ollama.com.
Если ollama -v есть, а ollama run пишет, что не может подключиться к серверу — не запущен ollama serve (или systemd-юнит ollama на Linux). Проверка на Linux:
sudo systemctl status ollamaЛоги сервиса: journalctl -e -u ollama.
Не путайте Ollama с моделью. Ollama — программа. Llama, Qwen, Gemma — веса, которые она качает отдельно. Пока вы не сделали ollama run …, чата нет.
FAQ
Ollama — это нейросеть?
Нет. Это программа, которая запускает нейросети локально. Модель выбираете вы: Llama, Qwen, Gemma и сотни других из библиотеки.
Нужен ли аккаунт?
Для локального запуска — нет. Аккаунт Ollama нужен, если пользуетесь их облаком, не домашним компьютером.
Можно ли без видеокарты?
Да, на CPU. Медленнее, но 1B–8B модели на современном ноутбуке отвечают. 70B без GPU — плохая идея.
Как поставить конкретную версию?
На Linux/macOS в скрипт можно передать тег релиза, например OLLAMA_VERSION=0.5.7. Номера — в GitHub Releases.
Чем это отличается от ChatGPT?
Промпт не уходит в OpenAI. Качество ответа зависит от модели, которую вы скачали, а не от подписки Plus.
Источники
Читайте также
Комментарии
Пока никто не написал. Будьте первым.


