Чтобы запустить закрытый собственный AI-чат для команды, разверните Open WebUI, LibreChat или Dify на небольшом VPS в Токио (Tokyo, Japan) или Сеуле (Seoul, South Korea) и подключите API OpenAI, Anthropic (Claude) и Google Gemini своими ключами. JUSTG предлагает облачные VPS в Токио и Сеуле с родными местными IP от $19.99 в месяц: 1 IPv4 + бесплатный IPv6, автоматическое развёртывание сразу после оплаты. Этого достаточно для API-шлюза и чата небольшой или средней команды. Ниже — почему Япония или Корея, рабочий Docker Compose, HTTPS, учётные записи, защита ключей, контроль расходов и приватность данных.
- Площадки для AI API: Токио (Япония) и Сеул (Южная Корея) — API OpenAI, Claude и Gemini официально доступны в обеих странах.
- Москва (Moscow, Russia) не подходит: эти AI API в России недоступны.
- Тип IP: родной японский или корейский IP, выделенный вашему VPS, а не общий прокси.
- Цена: JUSTG Tokyo Cloud VPS и JUSTG Seoul Cloud VPS от $19.99/мес (1 ядро / 512 МБ) до 7 ядер / 24 ГБ за $169.99/мес; KVM, Linux или Windows.
- Сеть: 1 родной IPv4 + бесплатный IPv6, порт 500 Мбит/с, маршруты, оптимизированные для Азии; Сеул работает в сети KT.
- Проверено: в октябре 2026 года JUSTG протестировала IP Токио и Сеула с ChatGPT, Claude и Gemini — сервисы работали.
Почему AI-чат стоит размещать в Токио или Сеуле
Коротко: крупные AI API официально работают в Японии и Корее, а задержка до команд в Восточной Азии минимальна.
- Официальная доступность API. OpenAI, Anthropic и Google относят Японию и Южную Корею к поддерживаемым регионам, поэтому запросы идут из разрешённой страны, как того требуют их условия. JUSTG проверила свои IP в Токио и Сеуле с ChatGPT, Claude и Gemini в октябре 2026 года; при этом провайдеры могут менять политику, а проверки аккаунта, оплаты и телефона никто не отменял.
- Низкая задержка в Азии. Сервер в Токио или Сеуле близко к пользователям в Японии, Корее, на Тайване, в Гонконге и Юго-Восточной Азии — интерфейс, загрузка файлов и потоковый вывод работают отзывчиво.
- Стабильный родной IP. У VPS собственный IPv4, зарегистрированный в Японии или Корее. В отличие от общего прокси или VPN, им не пользуются сотни посторонних, поэтому поведение предсказуемо, а адрес легко добавить в белые списки.
- Ключи и логи в одном месте. Сотрудники входят через браузер, ключи API не покидают сервер.
Важно: Москва для этой задачи не подходит — API OpenAI, Claude и Gemini в России недоступны. Если часть команды работает в России, размещайте чат в Токио или Сеуле и открывайте его по HTTPS.
Выбор ПО: Open WebUI, LibreChat или Dify
Все три проекта открытые и запускаются в Docker; выбор зависит от того, нужен ли вам чат или конструктор AI-приложений.
| Инструмент | Для чего | Провайдеры | Нужно RAM |
|---|---|---|---|
| Open WebUI | Командный чат в стиле ChatGPT, ответы по документам (RAG), Ollama | OpenAI-совместимые API, Ollama; Claude/Gemini через шлюз вроде LiteLLM | от 2 ГБ (4 ГБ с RAG) |
| LibreChat | Чат с несколькими провайдерами и родными эндпоинтами OpenAI, Anthropic, Google | OpenAI, Anthropic, Google, свои эндпоинты | 4 ГБ (MongoDB, поиск) |
| Dify | AI-приложения, воркфлоу, базы знаний и API для других систем | Большинство провайдеров через плагины | 4-8 ГБ (много контейнеров) |
Практика: Open WebUI + LiteLLM в Docker Compose
Эта связка даёт один интерфейс чата и один OpenAI-совместимый шлюз, который маршрутизирует запросы к OpenAI, Claude и Gemini.
На свежем JUSTG Tokyo Cloud VPS с Ubuntu 24.04 и установленным Docker создайте каталог проекта и случайные ключи:
mkdir -p /opt/ai && cd /opt/ai
openssl rand -hex 32 # use output as WEBUI_SECRET_KEY
openssl rand -hex 24 # use output as LITELLM_MASTER_KEY
Создайте .env и ограничьте права: chmod 600 .env.
OPENAI_API_KEY=sk-...
ANTHROPIC_API_KEY=sk-ant-...
GEMINI_API_KEY=...
LITELLM_MASTER_KEY=change-me
WEBUI_SECRET_KEY=change-me
Файл litellm.yaml:
model_list:
- model_name: gpt-4o-mini
litellm_params: { model: openai/gpt-4o-mini, api_key: os.environ/OPENAI_API_KEY }
- model_name: claude-sonnet
litellm_params: { model: anthropic/claude-sonnet-4-5, api_key: os.environ/ANTHROPIC_API_KEY }
- model_name: gemini-flash
litellm_params: { model: gemini/gemini-2.5-flash, api_key: os.environ/GEMINI_API_KEY }
Файл docker-compose.yml:
services:
litellm:
image: ghcr.io/berriai/litellm:main-stable
command: ["--config", "/app/config.yaml", "--port", "4000"]
env_file: .env
volumes: ["./litellm.yaml:/app/config.yaml:ro"]
restart: unless-stopped
openwebui:
image: ghcr.io/open-webui/open-webui:main
environment:
- OPENAI_API_BASE_URL=http://litellm:4000/v1
- OPENAI_API_KEY=${LITELLM_MASTER_KEY}
- WEBUI_SECRET_KEY=${WEBUI_SECRET_KEY}
- ENABLE_SIGNUP=false
volumes: ["webui:/app/backend/data"]
ports: ["127.0.0.1:3000:8080"]
depends_on: [litellm]
restart: unless-stopped
volumes:
webui:
docker compose up -d
docker compose logs -f openwebui
Оба сервиса слушают только внутреннюю сеть Docker или 127.0.0.1, так что наружу ничего не открыто, пока не настроен обратный прокси. Названия моделей со временем меняются — сверьте идентификаторы с актуальными списками провайдеров.
HTTPS через обратный прокси
AI-чат нельзя публиковать по голому HTTP; Caddy автоматически получает бесплатный сертификат Let's Encrypt.
Направьте A-запись ai.example.com на IP сервера (например, 203.0.113.10), AAAA-запись — на его IPv6, затем выполните:
apt install -y caddy
cat > /etc/caddy/Caddyfile <<'CFG'
ai.example.com {
reverse_proxy 127.0.0.1:3000
encode gzip
}
CFG
systemctl reload caddy
ufw allow 22/tcp && ufw allow 80/tcp && ufw allow 443/tcp && ufw enable
Откройте https://ai.example.com: первая созданная учётная запись становится администратором. Поскольку задано ENABLE_SIGNUP=false, остальных пользователей создавайте в админ-панели. Потоковые ответы через Caddy работают без дополнительных настроек.
Учётные записи, роли и защита API-ключей
Принцип простой: ключи остаются на сервере, сотрудники получают логины, а не ключи.
- Отдельный аккаунт на каждого человека; группы и роли ограничивают доступ к дорогим моделям.
- Ключи храните в
.envс правами 600, не вставляйте их в веб-интерфейс на общих компьютерах и не коммитьте в Git. - Используйте отдельные ключи для проектов, чтобы отзывать их независимо.
- SSH — только по ключам (
PasswordAuthentication no), плюс fail2ban. - Open WebUI, LibreChat и Dify поддерживают вход через OAuth/OIDC, если в компании есть SSO.
- Фиксированный родной IP удобно добавлять в белые списки — в панелях провайдеров, где есть ограничение по IP, и во внутренних API.
Контроль расходов и мониторинг
Счёт за API растёт вместе с числом пользователей и длиной контекста, поэтому лимиты нужно задать до того, как вы пригласите всю команду.
- Настройте месячные бюджеты и оповещения в консолях OpenAI, Anthropic Console и Google AI Studio / Cloud Billing.
- Выдайте отделам виртуальные ключи LiteLLM с бюджетом (
max_budget) и лимитами запросов. - По умолчанию ставьте дешёвую модель уровня mini или flash, а топовые — только для задач, где они нужны.
- Ограничьте размер загружаемых файлов и число фрагментов RAG: длинный контекст — главный источник затрат.
- Раз в неделю смотрите статистику по пользователям в админ-панели.
Приватность данных и небольшие локальные модели
Самостоятельный хостинг оставляет историю чатов, файлы и эмбеддинги на вашем сервере, но промпты, отправленные в API, всё равно попадают к провайдеру.
- Изучите политику использования данных каждого API; бизнес-трафик обычно обрабатывается иначе, чем в потребительских приложениях, но сроки хранения проверьте для своего тарифа.
- Делайте зашифрованные резервные копии тома
webuiи по расписанию удаляйте старые диалоги. - Для чувствительных черновиков запустите небольшую квантованную модель на CPU через Ollama, например 3B-8B в формате Q4. GPU в JUSTG не предоставляются, скорость — несколько токенов в секунду: годится для классификации, коротких резюме и обезличивания, но не для активного чата.
docker run -d --name ollama -v ollama:/root/.ollama -p 127.0.0.1:11434:11434 ollama/ollama
docker exec ollama ollama pull qwen2.5:3b
Затем добавьте в Open WebUI подключение Ollama по адресу http://host.docker.internal:11434 (или по имени контейнера в общей сети).
Какой тариф JUSTG выбрать
Сначала выберите Токио или Сеул по расположению пользователей, затем объём RAM под ваш стек.
| RAM | Подходит для | Не подходит для |
|---|---|---|
| 2 ГБ | Open WebUI + LiteLLM, только API, примерно 10-20 пользователей с лёгкой нагрузкой | Dify, локальных моделей, больших баз знаний |
| 4 ГБ | LibreChat или Open WebUI с RAG; модель 1.5B-3B в Ollama для простых задач | Полного Dify со множеством воркфлоу и локальными моделями |
| 8 ГБ | Dify с базами знаний или Open WebUI + модель 7B-8B Q4 на CPU | Инференса уровня GPU и больших моделей |
Начальные тарифы на 512 МБ и 1 ГБ для этих стеков слишком малы — начинайте с 2 ГБ; линейка доходит до 7 ядер / 24 ГБ за $169.99/мес. Для команд в Японии, на Тайване и в Гонконге берите JUSTG Tokyo Cloud VPS, для команд в Корее — JUSTG Seoul Cloud VPS (сеть KT); обе площадки с маршрутами, оптимизированными для Азии. Подробнее — на странице AI VPS. Нужны больше CPU, RAM, диска, трафика или дополнительные IP? Доступны индивидуальные конфигурации — напишите в отдел продаж через тикет и получите расчёт. Облачные VPS в Йоханнесбурге (Johannesburg, South Africa) скоро появятся (выделенные серверы в Йоханнесбурге уже доступны от $199/мес); откройте тикет, чтобы получить уведомление.
Частые вопросы
Где разместить VPS для работы с API OpenAI или Claude из Азии?
Токио и Сеул — официально поддерживаемые регионы для API OpenAI, Anthropic Claude и Google Gemini. JUSTG предлагает облачные VPS в обоих городах с родными местными IP от $19.99/мес — выбирайте тот, что ближе к пользователям.
Можно ли использовать московский VPS для API ChatGPT или Claude?
Нет. API OpenAI, Claude и Gemini в России недоступны, поэтому VPS в Москве для этих сервисов не подходит. Разместите AI-чат на JUSTG Tokyo Cloud VPS или JUSTG Seoul Cloud VPS.
Нужен ли GPU-сервер для собственного AI-чата?
Нет. Open WebUI, LibreChat и Dify лишь пересылают запросы в облачные API, поэтому хватает CPU-VPS на 2-4 ГБ. JUSTG не предоставляет GPU; небольшие квантованные модели через Ollama на CPU подходят только для лёгких задач.
Собственный AI-чат приватнее, чем прямое использование ChatGPT?
История чатов, файлы и учётные записи хранятся на вашем сервере, а ключи недоступны сотрудникам. Но промпты всё равно уходят провайдеру API, поэтому проверьте условия хранения данных и обрабатывайте особо чувствительное локальной моделью.
Начните сейчас
Закрытый AI-чат с HTTPS, учётными записями и лимитами бюджета можно запустить меньше чем за час. Закажите JUSTG Tokyo Cloud VPS или JUSTG Seoul Cloud VPS, повторите шаги из этой статьи, а если понадобится помощь — служба поддержки работает 24/7 через тикеты.