OrionChat: простой веб-интерфейс для локальных моделей Ollama вместо Open WebUI

Локальные ИИ-модели стали доступны как никогда: поставил Ollama, скачал модель — и можно общаться через терминал. Но терминальный чат неудобен, если работаешь с моделью постоянно. Готовых графических интерфейсов для Ollama много, однако де-факто стандарт Open WebUI многим кажется тяжёлым в настройке, а альтернативы вроде LibreChat, AnythingLLM и LobeChat больше похожи на «всё-в-одном» платформы, чем на лёгкого спутника локальной модели.

OrionChat решает именно эту задачу: это бесплатный open-source веб-интерфейс, который не пытается стать целой ИИ-платформой. Никакой автоматизации, агентов и запланированных задач — только чистый чат, выбор модели и отзывчивый интерфейс. Он умеет работать не только с Ollama, но и с OpenAI, Google Gemini, Claude, Groq, Cerebras и другими провайдерами. Скачанные модели OrionChat просто находит сам — без лишнего слоя управления моделями.

Установка за пять минут

Docker не нужен. Достаточно трёх шагов:

  1. Клонировать репозиторий и перейти в папку проекта:
git clone https://github.com/EliasPereirah/OrionChat.git
cd OrionChat
  1. Раздать файлы простым HTTP-сервером Python:
python -m http.server
  1. Открыть в браузере http://localhost:8000 — интерфейс загрузится сразу.

Настройка связи с Ollama

Здесь есть подводный камень: по умолчанию Ollama принимает запросы только от доверенных источников, и браузерный фронтенд автоматически в их число не попадает. Каждый запрос молча блокируется, пока явно не разрешить нужный origin.

Если Ollama установлена официальным скриптом, она почти наверняка работает как systemd-сервис — тогда добавьте override в юнит-файл:

sudo systemctl edit ollama.service

В открывшемся редакторе в секцию [Service] добавить:

[Service]
Environment="OLLAMA_ORIGINS=http://localhost"

Затем перезагрузить конфигурацию и перезапустить сервис:

sudo systemctl daemon-reload
sudo systemctl restart ollama

Если Ollama запускается вручную — достаточно задать переменную при старте:

OLLAMA_ORIGINS=http://localhost ollama serve

После этого обновите вкладку OrionChat: интерфейс подключится к Ollama и покажет список локальных моделей. В чате есть загрузка файлов и микрофон — то, чего нет в терминальном режиме. Переключение между моделями — пара кликов: например, с Gemma на Qwen или Mistral. Ответы форматируются как в обычном современном чат-боте: код, Markdown и таблицы отображаются корректно.

Ещё один плюс: OrionChat — не Electron-обёртка, он живёт прямо в браузере. Для тех, кто общается с локальными моделями по несколько часов в неделю, это заметное улучшение ежедневного опыта без сложного развёртывания.

Источник: itsfoss.com