AI.Product ClubБлог Михаила Карпова
← Все материалы
HOW-TOПамять и локальный ИИ4 мин чтения

Модели Ollama: как выбрать под свой компьютер

Как выбрать модель Ollama: проверить память и режим выполнения, сравнить качество на своих примерах и записать расход времени.

Модель для Ollama выбирают под конкретный компьютер и задачу. Размер скачиваемого файла полезен для планирования диска, но не даёт полного ответа о памяти во время работы: важны контекст, параметры и способ загрузки.

Начните с двух доступных вариантов, которые соответствуют вашим ограничениям. Не скачивайте большую коллекцию до первого осмысленного теста.

Запишите среду и точный тег

Укажите ОС, объём памяти, видеокарту или модель компьютера, версию Ollama и полный тег модели. В каталоге прочитайте описание, требования и лицензию выбранного варианта. Тег важнее сокращённого названия семейства: варианты могут отличаться размером и настройками.

После установки Ollama посмотреть загруженные модели и работающие процессы можно командами:

ollama --version
ollama list
ollama ps

ollama ps показывает загруженные в память модели и размещение на CPU/GPU. Пустой список означает, что сейчас ничего не загружено, а не что моделей нет на диске. Команды и интерпретация описаны в CLI и FAQ.

Подготовьте три содержательных случая

Первый — извлечение фактов: «Анна готовит отчёт к пятнице; бюджет не указан». Нужно вернуть владельца, срок как написано и неизвестный бюджет. Без даты исходной заметки нельзя превращать пятницу в календарную дату.

Второй — конфликт: в старой инструкции запуск 20 сентября, в новом решении явно сказано «перенос на 27 сентября». Третий — отсутствие ответа: спросите о цене, которой нет в исходнике.

Ответь только по переданным данным.
Раздели подтверждённые факты, противоречия и неизвестное.
Не дополняй пропуски общими знаниями.
Для каждого факта укажи подтверждающий фрагмент.

Измерьте качество и ожидание

Прогоните один набор на каждом варианте, сохраняя полный запрос. Отдельно запишите первый ответ после загрузки и следующие ответы: время загрузки может повлиять на первое измерение. Зафиксируйте длину входа и настройки контекста.

Не выбирайте модель только по скорости. Если быстрый вариант придумывает бюджет, исправление может занять больше времени, чем ожидание другого ответа. Полезная единица сравнения — принятое решение после проверки.

Проверьте, где выполняется модель

В Ollama доступны и облачные возможности. Если задача требует локального выполнения, проверьте выбранную модель и конфигурацию, а не только наличие приложения на компьютере. Официальный FAQ описывает различие локального и облачного режима и отключение cloud-функций.

В комплекте — три случая и журнал сравнения. В этом материале нет измерений на конкретном оборудовании. Для оценки общих затрат продолжите с локального ИИ и облака.

Todo: попробуй на своей задачеПрогресс сохраняется в этом браузере.
ПРАКТИКА НА КУРСЕ / AI PRODUCT CLUB

Собери своего ИИ-агента и проверь результат

«AI Agents: от vibe coding к AI-команде»: desktop agents, MCP, skills, evals и harness. Отдельные воркшопы — от подключения инструментов до контроля качества.

7 практических воркшопов · записи · вопросы автору в чате

Посмотреть программу курса ↗

Автор: — практик автоматизации и автор курсов AI Product Club.