Центр помощи

Пошаговые руководства по серверам, сетям и аккаунту.

Сценарии использования и решения

Собственный AI-чат для команды на VPS в Токио или Сеуле (Open WebUI, LibreChat, Dify)

Чтобы запустить закрытый собственный AI-чат для команды, разверните Open WebUI, LibreChat или Dify на небольшом VPS в Токио (Tokyo, Japan) или Сеуле (Seoul, South Korea) и подключите API OpenAI, Anthropic (Claude) и Google Gemini своими ключами. JUSTG предлагает облачные VPS в Токио и Сеуле с родными местными IP от $19.99 в месяц: 1 IPv4 + бесплатный IPv6, автоматическое развёртывание сразу после оплаты. Этого достаточно для API-шлюза и чата небольшой или средней команды. Ниже — почему Япония или Корея, рабочий Docker Compose, HTTPS, учётные записи, защита ключей, контроль расходов и приватность данных.

Ключевые факты
  • Площадки для AI API: Токио (Япония) и Сеул (Южная Корея) — API OpenAI, Claude и Gemini официально доступны в обеих странах.
  • Москва (Moscow, Russia) не подходит: эти AI API в России недоступны.
  • Тип IP: родной японский или корейский IP, выделенный вашему VPS, а не общий прокси.
  • Цена: JUSTG Tokyo Cloud VPS и JUSTG Seoul Cloud VPS от $19.99/мес (1 ядро / 512 МБ) до 7 ядер / 24 ГБ за $169.99/мес; KVM, Linux или Windows.
  • Сеть: 1 родной IPv4 + бесплатный IPv6, порт 500 Мбит/с, маршруты, оптимизированные для Азии; Сеул работает в сети KT.
  • Проверено: в октябре 2026 года JUSTG протестировала IP Токио и Сеула с ChatGPT, Claude и Gemini — сервисы работали.

Почему AI-чат стоит размещать в Токио или Сеуле

Коротко: крупные AI API официально работают в Японии и Корее, а задержка до команд в Восточной Азии минимальна.

  • Официальная доступность API. OpenAI, Anthropic и Google относят Японию и Южную Корею к поддерживаемым регионам, поэтому запросы идут из разрешённой страны, как того требуют их условия. JUSTG проверила свои IP в Токио и Сеуле с ChatGPT, Claude и Gemini в октябре 2026 года; при этом провайдеры могут менять политику, а проверки аккаунта, оплаты и телефона никто не отменял.
  • Низкая задержка в Азии. Сервер в Токио или Сеуле близко к пользователям в Японии, Корее, на Тайване, в Гонконге и Юго-Восточной Азии — интерфейс, загрузка файлов и потоковый вывод работают отзывчиво.
  • Стабильный родной IP. У VPS собственный IPv4, зарегистрированный в Японии или Корее. В отличие от общего прокси или VPN, им не пользуются сотни посторонних, поэтому поведение предсказуемо, а адрес легко добавить в белые списки.
  • Ключи и логи в одном месте. Сотрудники входят через браузер, ключи API не покидают сервер.

Важно: Москва для этой задачи не подходит — API OpenAI, Claude и Gemini в России недоступны. Если часть команды работает в России, размещайте чат в Токио или Сеуле и открывайте его по HTTPS.

Выбор ПО: Open WebUI, LibreChat или Dify

Все три проекта открытые и запускаются в Docker; выбор зависит от того, нужен ли вам чат или конструктор AI-приложений.

ИнструментДля чегоПровайдерыНужно RAM
Open WebUIКомандный чат в стиле ChatGPT, ответы по документам (RAG), OllamaOpenAI-совместимые API, Ollama; Claude/Gemini через шлюз вроде LiteLLMот 2 ГБ (4 ГБ с RAG)
LibreChatЧат с несколькими провайдерами и родными эндпоинтами OpenAI, Anthropic, GoogleOpenAI, Anthropic, Google, свои эндпоинты4 ГБ (MongoDB, поиск)
DifyAI-приложения, воркфлоу, базы знаний и API для других системБольшинство провайдеров через плагины4-8 ГБ (много контейнеров)

Практика: Open WebUI + LiteLLM в Docker Compose

Эта связка даёт один интерфейс чата и один OpenAI-совместимый шлюз, который маршрутизирует запросы к OpenAI, Claude и Gemini.

На свежем JUSTG Tokyo Cloud VPS с Ubuntu 24.04 и установленным Docker создайте каталог проекта и случайные ключи:

mkdir -p /opt/ai && cd /opt/ai
openssl rand -hex 32   # use output as WEBUI_SECRET_KEY
openssl rand -hex 24   # use output as LITELLM_MASTER_KEY

Создайте .env и ограничьте права: chmod 600 .env.

OPENAI_API_KEY=sk-...
ANTHROPIC_API_KEY=sk-ant-...
GEMINI_API_KEY=...
LITELLM_MASTER_KEY=change-me
WEBUI_SECRET_KEY=change-me

Файл litellm.yaml:

model_list:
  - model_name: gpt-4o-mini
    litellm_params: { model: openai/gpt-4o-mini, api_key: os.environ/OPENAI_API_KEY }
  - model_name: claude-sonnet
    litellm_params: { model: anthropic/claude-sonnet-4-5, api_key: os.environ/ANTHROPIC_API_KEY }
  - model_name: gemini-flash
    litellm_params: { model: gemini/gemini-2.5-flash, api_key: os.environ/GEMINI_API_KEY }

Файл docker-compose.yml:

services:
  litellm:
    image: ghcr.io/berriai/litellm:main-stable
    command: ["--config", "/app/config.yaml", "--port", "4000"]
    env_file: .env
    volumes: ["./litellm.yaml:/app/config.yaml:ro"]
    restart: unless-stopped
  openwebui:
    image: ghcr.io/open-webui/open-webui:main
    environment:
      - OPENAI_API_BASE_URL=http://litellm:4000/v1
      - OPENAI_API_KEY=${LITELLM_MASTER_KEY}
      - WEBUI_SECRET_KEY=${WEBUI_SECRET_KEY}
      - ENABLE_SIGNUP=false
    volumes: ["webui:/app/backend/data"]
    ports: ["127.0.0.1:3000:8080"]
    depends_on: [litellm]
    restart: unless-stopped
volumes:
  webui:
docker compose up -d
docker compose logs -f openwebui

Оба сервиса слушают только внутреннюю сеть Docker или 127.0.0.1, так что наружу ничего не открыто, пока не настроен обратный прокси. Названия моделей со временем меняются — сверьте идентификаторы с актуальными списками провайдеров.

HTTPS через обратный прокси

AI-чат нельзя публиковать по голому HTTP; Caddy автоматически получает бесплатный сертификат Let's Encrypt.

Направьте A-запись ai.example.com на IP сервера (например, 203.0.113.10), AAAA-запись — на его IPv6, затем выполните:

apt install -y caddy
cat > /etc/caddy/Caddyfile <<'CFG'
ai.example.com {
    reverse_proxy 127.0.0.1:3000
    encode gzip
}
CFG
systemctl reload caddy
ufw allow 22/tcp && ufw allow 80/tcp && ufw allow 443/tcp && ufw enable

Откройте https://ai.example.com: первая созданная учётная запись становится администратором. Поскольку задано ENABLE_SIGNUP=false, остальных пользователей создавайте в админ-панели. Потоковые ответы через Caddy работают без дополнительных настроек.

Учётные записи, роли и защита API-ключей

Принцип простой: ключи остаются на сервере, сотрудники получают логины, а не ключи.

  • Отдельный аккаунт на каждого человека; группы и роли ограничивают доступ к дорогим моделям.
  • Ключи храните в .env с правами 600, не вставляйте их в веб-интерфейс на общих компьютерах и не коммитьте в Git.
  • Используйте отдельные ключи для проектов, чтобы отзывать их независимо.
  • SSH — только по ключам (PasswordAuthentication no), плюс fail2ban.
  • Open WebUI, LibreChat и Dify поддерживают вход через OAuth/OIDC, если в компании есть SSO.
  • Фиксированный родной IP удобно добавлять в белые списки — в панелях провайдеров, где есть ограничение по IP, и во внутренних API.

Контроль расходов и мониторинг

Счёт за API растёт вместе с числом пользователей и длиной контекста, поэтому лимиты нужно задать до того, как вы пригласите всю команду.

  • Настройте месячные бюджеты и оповещения в консолях OpenAI, Anthropic Console и Google AI Studio / Cloud Billing.
  • Выдайте отделам виртуальные ключи LiteLLM с бюджетом (max_budget) и лимитами запросов.
  • По умолчанию ставьте дешёвую модель уровня mini или flash, а топовые — только для задач, где они нужны.
  • Ограничьте размер загружаемых файлов и число фрагментов RAG: длинный контекст — главный источник затрат.
  • Раз в неделю смотрите статистику по пользователям в админ-панели.

Приватность данных и небольшие локальные модели

Самостоятельный хостинг оставляет историю чатов, файлы и эмбеддинги на вашем сервере, но промпты, отправленные в API, всё равно попадают к провайдеру.

  • Изучите политику использования данных каждого API; бизнес-трафик обычно обрабатывается иначе, чем в потребительских приложениях, но сроки хранения проверьте для своего тарифа.
  • Делайте зашифрованные резервные копии тома webui и по расписанию удаляйте старые диалоги.
  • Для чувствительных черновиков запустите небольшую квантованную модель на CPU через Ollama, например 3B-8B в формате Q4. GPU в JUSTG не предоставляются, скорость — несколько токенов в секунду: годится для классификации, коротких резюме и обезличивания, но не для активного чата.
docker run -d --name ollama -v ollama:/root/.ollama -p 127.0.0.1:11434:11434 ollama/ollama
docker exec ollama ollama pull qwen2.5:3b

Затем добавьте в Open WebUI подключение Ollama по адресу http://host.docker.internal:11434 (или по имени контейнера в общей сети).

Какой тариф JUSTG выбрать

Сначала выберите Токио или Сеул по расположению пользователей, затем объём RAM под ваш стек.

RAMПодходит дляНе подходит для
2 ГБOpen WebUI + LiteLLM, только API, примерно 10-20 пользователей с лёгкой нагрузкойDify, локальных моделей, больших баз знаний
4 ГБLibreChat или Open WebUI с RAG; модель 1.5B-3B в Ollama для простых задачПолного Dify со множеством воркфлоу и локальными моделями
8 ГБDify с базами знаний или Open WebUI + модель 7B-8B Q4 на CPUИнференса уровня GPU и больших моделей

Начальные тарифы на 512 МБ и 1 ГБ для этих стеков слишком малы — начинайте с 2 ГБ; линейка доходит до 7 ядер / 24 ГБ за $169.99/мес. Для команд в Японии, на Тайване и в Гонконге берите JUSTG Tokyo Cloud VPS, для команд в Корее — JUSTG Seoul Cloud VPS (сеть KT); обе площадки с маршрутами, оптимизированными для Азии. Подробнее — на странице AI VPS. Нужны больше CPU, RAM, диска, трафика или дополнительные IP? Доступны индивидуальные конфигурации — напишите в отдел продаж через тикет и получите расчёт. Облачные VPS в Йоханнесбурге (Johannesburg, South Africa) скоро появятся (выделенные серверы в Йоханнесбурге уже доступны от $199/мес); откройте тикет, чтобы получить уведомление.

Частые вопросы

Где разместить VPS для работы с API OpenAI или Claude из Азии?

Токио и Сеул — официально поддерживаемые регионы для API OpenAI, Anthropic Claude и Google Gemini. JUSTG предлагает облачные VPS в обоих городах с родными местными IP от $19.99/мес — выбирайте тот, что ближе к пользователям.

Можно ли использовать московский VPS для API ChatGPT или Claude?

Нет. API OpenAI, Claude и Gemini в России недоступны, поэтому VPS в Москве для этих сервисов не подходит. Разместите AI-чат на JUSTG Tokyo Cloud VPS или JUSTG Seoul Cloud VPS.

Нужен ли GPU-сервер для собственного AI-чата?

Нет. Open WebUI, LibreChat и Dify лишь пересылают запросы в облачные API, поэтому хватает CPU-VPS на 2-4 ГБ. JUSTG не предоставляет GPU; небольшие квантованные модели через Ollama на CPU подходят только для лёгких задач.

Собственный AI-чат приватнее, чем прямое использование ChatGPT?

История чатов, файлы и учётные записи хранятся на вашем сервере, а ключи недоступны сотрудникам. Но промпты всё равно уходят провайдеру API, поэтому проверьте условия хранения данных и обрабатывайте особо чувствительное локальной моделью.

Начните сейчас

Закрытый AI-чат с HTTPS, учётными записями и лимитами бюджета можно запустить меньше чем за час. Закажите JUSTG Tokyo Cloud VPS или JUSTG Seoul Cloud VPS, повторите шаги из этой статьи, а если понадобится помощь — служба поддержки работает 24/7 через тикеты.

Помог ли вам данный ответ?
Центр помощи
Сценарии использования и решения Японский сайт или веб-приложение на VPS в Токио: настройка с японским нативным IP Чтобы запустить японоязычный сайт на VPS в Токио, разместите его на сервере в Токио (Япония) с японским нативным IP, отдавайте по HTTPS… Сценарии использования и решения VPS в Токио с японским нативным IP для стриминга: TVer, ABEMA, U-NEXT — тесты и ограничения VPS в Токио с японским нативным IP для японских стриминговых сервисов — это сервер, который TVer, ABEMA, U-NEXT, Niconico, DMM TV и radiko… Сценарии использования и решения Корейский нативный IP на VPS в Сеуле: Wavve, TVING, Naver, Melon — тесты, 본인인증 и ограничения VPS в Сеуле с корейским нативным IP позволяет корейским сервисам — Wavve, TVING, Coupang Play, Naver и Chzzk, SOOP, Melon — видеть ваш… Сценарии использования и решения AI-бот поддержки для LINE или KakaoTalk на VPS в Токио или Сеуле Самый практичный способ сделать AI-бота поддержки для LINE или KakaoTalk — разместить вебхук на собственном VPS в Токио (Tokyo, Japan) для… Сценарии использования и решения AI-автоматизация 24/7 на VPS: дайджесты, перевод карточек и мониторинг для Японии, Кореи и России Проще всего запустить AI-автоматизацию 24/7 — ежедневные дайджесты, перевод карточек товаров, уведомления о ценах — на небольшом постоянно…
AlipayUnionPayVISAMastercardPayPalUSDTstripe