Centro de ayuda

Guías paso a paso sobre servidores, redes y tu cuenta.

Casos de uso y soluciones

Aloja tu propio espacio de chat con IA en un VPS en Tokio o Seúl (Open WebUI, LibreChat, Dify)

Para tener un espacio de chat con IA autoalojado y privado para tu equipo, instala Open WebUI, LibreChat o Dify en un VPS pequeño en Tokio (Tokyo, Japan) o Seúl (Seoul, South Korea) y conéctalo a las API de OpenAI, Anthropic (Claude) y Google Gemini con tus propias claves. JUSTG ofrece VPS en la nube en Tokio y Seúl con IP nativas locales desde 19,99 USD/mes, con 1 IPv4 + IPv6 gratuita y despliegue automático tras el pago, suficiente para un espacio basado en API para equipos pequeños y medianos. Esta guía explica por qué Japón o Corea, un ejemplo funcional con Docker Compose, HTTPS, cuentas de usuario, protección de claves, control de costes y privacidad de datos.

Datos clave
  • Ubicaciones para API de IA: Tokio (Japón) y Seúl (Corea del Sur); las API de OpenAI, Claude y Gemini están disponibles oficialmente en ambos países.
  • Moscú (Moscow, Russia) no es adecuado: estas API de IA no están disponibles en Rusia.
  • Tipo de IP: IP nativa japonesa o coreana, dedicada a tu VPS, no un proxy compartido.
  • Precio: JUSTG Tokyo Cloud VPS y JUSTG Seoul Cloud VPS desde 19,99 USD/mes (1 núcleo / 512 MB) hasta 7 núcleos / 24 GB por 169,99 USD/mes; KVM, Linux o Windows.
  • Red: 1 IPv4 nativa + IPv6 gratuita, puerto de 500 Mbps, rutas optimizadas para Asia; Seúl funciona sobre la red de KT.
  • Probado: en octubre de 2026 JUSTG probó sus IP de Tokio y Seúl con ChatGPT, Claude y Gemini y funcionaron.

Por qué alojar tu espacio de IA en Tokio o Seúl

En resumen: las principales API de IA están disponibles oficialmente en Japón y Corea, y la latencia hacia equipos en Asia oriental es baja.

  • Disponibilidad oficial de las API. OpenAI, Anthropic y Google incluyen a Japón y Corea del Sur entre sus regiones admitidas, así que tu servidor llama a las API desde un país soportado, como esperan sus términos. JUSTG probó sus IP nativas de Tokio y Seúl con ChatGPT, Claude y Gemini en octubre de 2026 y funcionaron; aun así, los proveedores pueden cambiar sus políticas y siguen aplicando las verificaciones de cuenta, pago y teléfono.
  • Baja latencia en Asia. Un servidor en Tokio o Seúl está cerca de usuarios en Japón, Corea, Taiwán, Hong Kong y el Sudeste Asiático, por lo que la interfaz, la subida de archivos y la respuesta en streaming son ágiles.
  • IP nativa estable. Tu VPS tiene su propia IPv4 registrada en Japón o Corea. A diferencia de un proxy o VPN compartido, no la usan cientos de desconocidos: el comportamiento es predecible y es fácil añadirla a listas blancas.
  • Claves y registros en un solo lugar. El personal entra con el navegador; las claves nunca salen del servidor.

Moscú no es una ubicación adecuada para este proyecto: las API de OpenAI, Claude y Gemini no están disponibles en Rusia. Si parte de tu equipo trabaja en Rusia, aloja el espacio en Tokio o Seúl y accede por HTTPS.

Elige el software: Open WebUI, LibreChat o Dify

Los tres son de código abierto y funcionan en Docker; la elección depende de si necesitas una interfaz de chat o un constructor de aplicaciones de IA.

HerramientaIdeal paraProveedoresRAM típica
Open WebUIChat de equipo tipo ChatGPT, chat con documentos (RAG), soporte de OllamaAPI compatibles con OpenAI, Ollama; Claude/Gemini mediante una pasarela como LiteLLM2 GB+ (4 GB con RAG)
LibreChatChat multiproveedor con endpoints nativos de OpenAI, Anthropic y GoogleOpenAI, Anthropic, Google, endpoints personalizados4 GB (incluye MongoDB y búsqueda)
DifyCrear apps de IA, flujos de trabajo, bases de conocimiento y una API para otros sistemasLa mayoría de proveedores mediante plugins4-8 GB (muchos contenedores)

Práctica: Open WebUI + LiteLLM con Docker Compose

Este stack ofrece una sola interfaz de chat y una pasarela compatible con OpenAI que enruta a OpenAI, Claude y Gemini.

En un JUSTG Tokyo Cloud VPS nuevo con Ubuntu 24.04 y Docker instalado, crea la carpeta del proyecto y genera claves aleatorias:

mkdir -p /opt/ai && cd /opt/ai
openssl rand -hex 32   # use output as WEBUI_SECRET_KEY
openssl rand -hex 24   # use output as LITELLM_MASTER_KEY

Crea .env (permisos chmod 600 .env):

OPENAI_API_KEY=sk-...
ANTHROPIC_API_KEY=sk-ant-...
GEMINI_API_KEY=...
LITELLM_MASTER_KEY=change-me
WEBUI_SECRET_KEY=change-me

Crea litellm.yaml:

model_list:
  - model_name: gpt-4o-mini
    litellm_params: { model: openai/gpt-4o-mini, api_key: os.environ/OPENAI_API_KEY }
  - model_name: claude-sonnet
    litellm_params: { model: anthropic/claude-sonnet-4-5, api_key: os.environ/ANTHROPIC_API_KEY }
  - model_name: gemini-flash
    litellm_params: { model: gemini/gemini-2.5-flash, api_key: os.environ/GEMINI_API_KEY }

Crea docker-compose.yml:

services:
  litellm:
    image: ghcr.io/berriai/litellm:main-stable
    command: ["--config", "/app/config.yaml", "--port", "4000"]
    env_file: .env
    volumes: ["./litellm.yaml:/app/config.yaml:ro"]
    restart: unless-stopped
  openwebui:
    image: ghcr.io/open-webui/open-webui:main
    environment:
      - OPENAI_API_BASE_URL=http://litellm:4000/v1
      - OPENAI_API_KEY=${LITELLM_MASTER_KEY}
      - WEBUI_SECRET_KEY=${WEBUI_SECRET_KEY}
      - ENABLE_SIGNUP=false
    volumes: ["webui:/app/backend/data"]
    ports: ["127.0.0.1:3000:8080"]
    depends_on: [litellm]
    restart: unless-stopped
volumes:
  webui:
docker compose up -d
docker compose logs -f openwebui

Ambos servicios escuchan solo en la red interna de Docker o en 127.0.0.1; nada queda expuesto hasta configurar el proxy inverso. Los nombres de modelo cambian con el tiempo: revisa la lista actual de cada proveedor antes de copiar los ID.

Añade HTTPS con un proxy inverso

Nunca publiques un espacio de IA por HTTP sin cifrar; Caddy obtiene automáticamente un certificado gratuito de Let's Encrypt.

Apunta un registro A como ai.example.com a la IP del VPS (por ejemplo 203.0.113.10) y un registro AAAA a su IPv6, y ejecuta:

apt install -y caddy
cat > /etc/caddy/Caddyfile <<'CFG'
ai.example.com {
    reverse_proxy 127.0.0.1:3000
    encode gzip
}
CFG
systemctl reload caddy
ufw allow 22/tcp && ufw allow 80/tcp && ufw allow 443/tcp && ufw enable

Abre https://ai.example.com. La primera cuenta creada será la de administrador; como está fijado ENABLE_SIGNUP=false, crea al resto de usuarios desde el panel de administración. Las respuestas en streaming funcionan a través de Caddy sin ajustes adicionales.

Cuentas de usuario, roles y protección de las claves API

La regla: las claves se quedan en el servidor y a las personas se les dan cuentas, no claves.

  • Una cuenta por persona; usa grupos o roles para limitar quién usa los modelos caros.
  • Guarda las claves en .env con permisos 600; no las pegues en la interfaz desde equipos compartidos ni las subas a Git.
  • Usa claves distintas por proyecto para poder revocar una sin afectar a las demás.
  • Limita SSH a autenticación por clave (PasswordAuthentication no) e instala fail2ban.
  • Si tu empresa usa SSO, Open WebUI, LibreChat y Dify admiten inicio de sesión OAuth/OIDC.
  • Como el VPS tiene una IP nativa fija, puedes añadirla a listas blancas en los paneles de proveedores que lo permitan o en tus API internas.

Control de costes y monitorización

El gasto en API crece con los usuarios y la longitud del contexto, así que fija límites antes de invitar a todo el equipo.

  • Configura presupuestos mensuales y alertas en cada consola (OpenAI, Anthropic Console, Google AI Studio / facturación de Cloud).
  • Usa claves virtuales de LiteLLM con presupuesto por clave (max_budget) y límites de velocidad por departamento.
  • Pon como predeterminado un modelo económico (nivel mini o flash) y reserva los modelos superiores para las tareas que los necesiten.
  • Limita el tamaño de los archivos subidos y el número de fragmentos RAG: el contexto largo es el principal factor de coste.
  • Revisa cada semana el uso por usuario en los paneles de administración.

Privacidad de datos y modelos locales pequeños

Autoalojar mantiene el historial, los archivos y los embeddings en un servidor que controlas, pero los prompts enviados a una API siguen llegando a ese proveedor.

  • Lee la política de uso de datos de cada API; el tráfico empresarial suele tratarse distinto que las apps de consumo, pero confirma los plazos de retención de tu plan.
  • Haz copias cifradas del volumen webui y borra conversaciones antiguas de forma programada.
  • Para borradores sensibles, ejecuta un modelo cuantizado pequeño en CPU con Ollama, por ejemplo uno de 3B-8B en formato Q4. JUSTG no ofrece GPU, así que espera unos pocos tokens por segundo: sirve para clasificar, resúmenes cortos o anonimizar, no para chat intensivo.
docker run -d --name ollama -v ollama:/root/.ollama -p 127.0.0.1:11434:11434 ollama/ollama
docker exec ollama ollama pull qwen2.5:3b

Después añade en Open WebUI una conexión Ollama con http://host.docker.internal:11434 (o el nombre del contenedor en una red compartida).

Qué plan de JUSTG encaja

Elige Tokio o Seúl según dónde estén tus usuarios y dimensiona la RAM según el stack.

RAMAdecuado paraNo adecuado para
2 GBOpen WebUI + LiteLLM, solo API, unos 10-20 usuarios ligerosDify, modelos locales, grandes bibliotecas RAG
4 GBLibreChat u Open WebUI con RAG; un modelo de 1.5B-3B en Ollama para tareas pequeñasDify completo con muchos flujos y modelos locales
8 GBDify con bases de conocimiento, u Open WebUI + modelo 7B-8B Q4 en CPUInferencia de nivel GPU o modelos grandes

Los planes de entrada de 512 MB y 1 GB se quedan cortos para estos stacks: empieza en 2 GB; la gama llega hasta 7 núcleos / 24 GB por 169,99 USD/mes. Elige el JUSTG Tokyo Cloud VPS para equipos en Japón, Taiwán y Hong Kong, o el JUSTG Seoul Cloud VPS (red KT) para equipos en Corea; ambos con rutas optimizadas para Asia. Más información en nuestra página de VPS para IA. ¿Necesitas más CPU, RAM, disco, ancho de banda o IP adicionales? Hay configuraciones personalizadas bajo pedido: contacta con ventas mediante un ticket para recibir un presupuesto. El VPS en la nube de Johannesburgo (Johannesburg, South Africa) llegará pronto (los servidores dedicados en Johannesburgo ya están disponibles desde 199 USD/mes); abre un ticket si quieres recibir aviso.

Preguntas frecuentes

¿Dónde ubicar un VPS para llamar a la API de OpenAI o Claude desde Asia?

Tokio y Seúl son regiones admitidas oficialmente por las API de OpenAI, Anthropic Claude y Google Gemini. JUSTG ofrece VPS en la nube en ambas ciudades con IP nativas locales desde 19,99 USD/mes; elige la más cercana a tus usuarios.

¿Puedo usar un VPS en Moscú para la API de ChatGPT o Claude?

No. Las API de OpenAI, Claude y Gemini no están disponibles en Rusia, por lo que un VPS en Moscú no es adecuado para estos servicios. Aloja el espacio de IA en un JUSTG Tokyo Cloud VPS o JUSTG Seoul Cloud VPS.

¿Necesito un servidor con GPU para autoalojar un chat con IA?

No. Open WebUI, LibreChat y Dify solo reenvían las peticiones a API en la nube, así que basta un VPS con CPU y 2-4 GB de RAM. JUSTG no ofrece GPU; los modelos cuantizados pequeños con Ollama en CPU solo sirven para tareas ligeras.

¿Es más privado un espacio de IA autoalojado que usar ChatGPT directamente?

Mantiene el historial, los archivos y las cuentas en tu propio servidor y las claves fuera del alcance de los empleados. Los prompts siguen llegando al proveedor de la API, así que revisa sus condiciones de retención y usa un modelo local para lo que nunca deba salir de tu servidor.

Empieza ya

Un espacio de IA privado con HTTPS, cuentas de usuario y límites de presupuesto puede estar en marcha en menos de una hora. Despliega un JUSTG Tokyo Cloud VPS o un JUSTG Seoul Cloud VPS, sigue los pasos anteriores y, si necesitas ayuda, nuestro soporte 24/7 te atiende por ticket.

¿Le ha resultado útil esta respuesta?
Centro de ayuda
AlipayUnionPayVISAMastercardPayPalUSDTstripe