OpenClaw и Ollama: бесплатный локальный ИИ-ассистент без затрат на API

OpenClaw и Ollama — это связка, которая превращает ваш компьютер в полноценный ИИ-ассистент без единой подписки на API. Ollama запускает языковые модели локально на вашем железе, а OpenClaw подключает их к мессенджерам и инструментам. Результат: персональный AI, который работает бесплатно, не отправляет данные наружу и доступен из Telegram, WhatsApp или Slack.

Что такое Ollama и почему он важен для OpenClaw

Ollama — это бесплатная программа для запуска больших языковых моделей (LLM) прямо на вашем компьютере. Никаких серверов, никаких API-ключей, никаких ежемесячных платежей. Скачал, установил, запустил — и модель работает локально.

OpenClaw — это персональный AI-ассистент, который связывает мессенджеры (Telegram, WhatsApp, Slack, Discord, iMessage) с ИИ через единый шлюз. Обычно OpenClaw использует облачные провайдеры вроде OpenAI или Anthropic. Но с Ollama всё меняется: модель крутится у вас на машине, и OpenClaw общается с ней напрямую через локальный API.

Почему это круто:

  • Бесплатно. Никаких токенов, никаких счетов. Скачал модель — пользуйся.
  • Приватность. Данные не покидают ваш компьютер. Ни одно слово не улетает на чужие серверы.
  • Автономность. Работает без интернета. Только локальная модель и ваше железо.
  • Скорость. На хорошей видеокарте ответы приходят за секунды.
  • Какие модели подходят для OpenClaw

    OpenClaw работает как AI-агент: читает файлы, открывает браузер, выполняет команды. Это значит, что модель должна уметь работать с инструментами (tool calling) и держать большой контекст.

    Ollama рекомендует для OpenClaw две локальные модели:

  • gemma4 — для рассуждений и генерации кода. Требует примерно 16 ГБ видеопамяти.
  • qwen3.5 — для рассуждений, кода и работы с изображениями. Требует примерно 11 ГБ видеопамяти.
  • Важный момент: OpenClaw требует большой контекст. Рекомендуется минимум 64k токенов. Это значит, что модель должна удерживать длинные разговоры и не «забывать» контекст через несколько сообщений.

    Если у вас мощная видеокарта (16+ ГБ VRAM), берите gemma4. Если памяти поменьше — qwen3.5. Обе модели хорошо справляются с агентными задачами.

    Установка: одна команда

    Ollama автоматизирует весь процесс подключения OpenClaw. Вот что нужно сделать:

    Шаг 1: Установите Ollama

    Скачайте Ollama с официального сайта:

  • macOS: скачайте .dmg с ollama.com
  • Linux: выполните curl -fsSL https://ollama.com/install.sh | sh
  • Windows: скачайте установщик с ollama.com
  • После установки Ollama запустится автоматически.

    Шаг 2: Запустите OpenClaw через Ollama

    Откройте терминал и выполните:

    ollama launch openclaw
    

    Вот и всё. Ollama сделает всё сам:

  • Установка — если OpenClaw не установлен, Ollama предложит установить его через npm.
  • Безопасность — при первом запуске покажет предупреждение о доступе к инструментам.
  • Выбор модели — откроется селектор моделей (локальные или облачные).
  • Настройка — Ollama настроит провайдер, установит шлюз (gateway daemon), назначит выбранную модель основной и включит встроенный веб-поиск Ollama.
  • Запуск — шлюз стартует в фоне, откроется терминальный интерфейс OpenClaw (TUI).
  • Шаг 3: Выберите модель

    При первом запуске Ollama предложит выбрать модель. Для локальной работы рекомендуются:

  • gemma4 — если у вас 16+ ГБ VRAM
  • qwen3.5 — если у вас 11+ ГБ VRAM
  • Модель скачается автоматически при первом использовании.

    Настройка без запуска

    Если вы хотите сменить модель, не запуская шлюз и TUI:

    ollama launch openclaw --config
    

    Чтобы запустить сразу с конкретной моделью:

    ollama launch openclaw --model kimi-k2.5:cloud
    

    Если шлюз уже работает, он перезапустится автоматически, чтобы подхватить новую модель.

    Веб-поиск для локальных моделей

    Одна из фишек OpenClaw + Ollama — встроенный веб-поиск. OpenClaw поставляется с провайдером ollama web_search, который позволяет локальным моделям искать в интернете через хост Ollama.

    Веб-поиск включается автоматически при запуске через ollama launch openclaw. Если нужно настроить вручную:

    openclaw configure --section web
    

    Для работы веб-поиска с локальными моделями требуется авторизация: ollama signin.

    Подключение мессенджеров

    После запуска OpenClaw можно подключить мессенджеры, чтобы общаться с локальным AI из любого приложения:

    openclaw configure --section channels
    

    Поддерживаются: WhatsApp, Telegram, Slack, Discord, iMessage и другие. После настройки вы сможете писать боту в мессенджере, а он будет отвечать с помощью локальной модели через Ollama.

    Работа в фоновом режиме

    OpenClaw можно запустить без интерактива — для Docker, CI/CD или скриптов:

    ollama launch openclaw --model kimi-k2.5:cloud --yes
    

    Флаг --yes автоматически скачает модель, пропустит селекторы и запустит всё без вопросов. Обязательно указывайте --model.

    Остановка шлюза

    Когда нужно остановить OpenClaw:

    openclaw gateway stop
    

    Облачные модели через Ollama

    Ollama поддерживает не только локальные модели, но и облачные. Это полезно, если ваше железо не тянет тяжёлые модели, но вы всё равно хотите использовать OpenClaw через единый интерфейс:

  • kimi-k2.5:cloud — мультимодальная модель с субагентами
  • qwen3.5:cloud — рассуждения, код и работа с изображениями
  • glm-5.1:cloud — рассуждения и генерация кода
  • minimax-m2.7:cloud — быстрый код и повседневные задачи
  • Для облачных моделей не нужна мощная видеокарта — они работают на серверах Ollama.

    Сравнение: локальные vs облачные модели

    Характеристика Локальные (Ollama) Облачные (Ollama Cloud) Облачные (OpenAI/Anthropic)
    Стоимость Бесплатно Подписка Ollama Pro Платно за токены
    Приватность Полная Частичная Данные на серверах
    Скорость Зависит от железа Быстро Быстро
    Качество моделей Хорошее Отличное Отличное
    Требования к ПК Мощная видеокарта Любое железо Любое железо
    Интернет Не нужен Нужен Нужен

    Советы по оптимизации

    Контекстное окно. OpenClaw рекомендует минимум 64k токенов. Убедитесь, что выбранная модель поддерживает такой контекст. Проверить можно на ollama.com/search.

    Видеопамять. Чем больше VRAM, тем больше модель можно загрузить. 8 ГБ хватит для небольших моделей, 16+ ГБ — для gemma4.

    SSD. Модели весят от 4 до 40 ГБ. Храните их на SSD для быстрой загрузки.

    Оперативная память. Если VRAM не хватает, Ollama использует RAM. Для комфортной работы нужно минимум 16 ГБ, лучше 32 ГБ.

    Полезные ссылки

  • OpenClaw: что это за инструмент и зачем он нужен
  • Установка OpenClaw на VPS: пошаговое руководство
  • OpenClaw и Telegram: подключение бота
  • Документация Ollama: интеграция с OpenClaw
  • Каталог моделей Ollama
  • Итоги

    OpenClaw + Ollama — это способ получить полноценного AI-ассистента, который работает бесплатно, не отправляет данные на чужие серверы и доступен из любого мессенджера. Достаточно установить Ollama и выполнить одну команду: ollama launch openclaw. Система сама настроит всё остальное.

    Для локальных моделей нужна хорошая видеокарта (минимум 11 ГБ VRAM для qwen3.5, 16 ГБ для gemma4). Если железо не тянет — есть облачные модели через Ollama, которые работают на любых компьютерах.

    Главное преимущество этой связки — контроль. Ваш AI работает на ваших условиях, на вашем железе, с вашими данными. Никаких подписок, никаких лимитов, никаких утечек.