RemarkableCloud

Hosting VPS administrado de LiteLLM

LiteLLM, en línea en minutos.
En un servidor que es solo tuyo.

One API gateway for 100+ LLM providers: unified OpenAI-format calls, spend tracking, rate limits, and failover, self-hosted.

  • SLA de 500%
  • Garantía de 30 días
  • Snapshots diarios gratis
  • Firewall e IDS

Qué es

LiteLLM es el controlador de tráfico de las APIs de IA: una pasarela autoalojada que habla formato OpenAI y enruta a más de 100 proveedores, con control de gasto por clave, límites de tasa, reintentos y failover. Apunta todas tus apps a una URL y gestiona el caos en un solo lugar.

RAM mínima

1 GB

Fits on SC-1GB; SC-2GB is the comfortable pick with room to stack.

Qué instalamos

Nuestro playbook despliega el proxy LiteLLM con almacén de claves respaldado en PostgreSQL, HTTPS emitido y forzado, y una clave de administrador generada para ti. Agregas claves de proveedores, acuñas claves virtuales por app o compañero, listo.

Cada plan incluye

Hostname instantáneo con TLS, base de datos creada y conectada, snapshots diarios, firewall e IDS. Agrega Fully Managed cuando quieras y nuestros ingenieros operan el servidor completo por ti.

Elige tu servidor

Elige un plan para LiteLLM.

LiteLLM necesita al menos 1 GB de RAM. Cada plan es tu propio VPS privado, y el mismo servidor corre tantas apps como quepan.

SC-1GB

$5 /mo
  • 1 vCPU
  • 1 GB RAM
  • 25 GB NVMe
  • 2.5 TB transferencia
  • Acceso Root Completo
  • Cores No Sobrevendidos
  • Almacenamiento 100% NVMe
  • Firewall de Red/IDS
  • Snapshots Diarios Gratis
  • Red con Protección DDoS
  • Dual Backups (Opcional)
  • Fully Managed (Opcional)
Ordenar SC-1GB

Garantía de 30 días

SC-2GB

$8 /mo
  • 1 vCPU
  • 2 GB RAM
  • 50 GB NVMe
  • 5 TB transferencia
  • Acceso Root Completo
  • Cores No Sobrevendidos
  • Almacenamiento 100% NVMe
  • Firewall de Red/IDS
  • Snapshots Diarios Gratis
  • Red con Protección DDoS
  • Dual Backups (Opcional)
  • Fully Managed (Opcional)
Ordenar SC-2GB

Garantía de 30 días

SC-4GB

$16 /mo
  • 2 vCPU
  • 4 GB RAM
  • 100 GB NVMe
  • 10 TB transferencia
  • Acceso Root Completo
  • Cores No Sobrevendidos
  • Almacenamiento 100% NVMe
  • Firewall de Red/IDS
  • Snapshots Diarios Gratis
  • Red con Protección DDoS
  • Dual Backups (Opcional)
  • Fully Managed (Opcional)
Ordenar SC-4GB

Garantía de 30 días

SC-6GB

$24 /mo
  • 3 vCPU
  • 6 GB RAM
  • 150 GB NVMe
  • 15 TB transferencia
  • Acceso Root Completo
  • Cores No Sobrevendidos
  • Almacenamiento 100% NVMe
  • Firewall de Red/IDS
  • Snapshots Diarios Gratis
  • Red con Protección DDoS
  • Dual Backups (Opcional)
  • Fully Managed (Opcional)
Ordenar SC-6GB

Garantía de 30 días

LiteLLM se instala solo en el primer arranque con TLS, hostname y su base de datos conectada. Fully Managed y Dual Backups son addons opcionales en el carrito.

¿Prefieres alojarlo tú mismo? La imagen exacta de LiteLLM que desplegamos es pública y gratis de descargar, con una guía completa de producción.

Por qué aquí

Por qué correr LiteLLM en RemarkableCloud.

Tu propio VPS privado

No es un contenedor en una caja compartida. Un servidor virtual real con recursos dedicados y tu propia IP, sin nadie más adentro.

Apila apps, un precio

Agrega tantas apps como quepan en tu servidor desde el área de cliente, a un clic cada una. Sin cargo por app, nunca.

Un SLA de 500% que paga

1 hora caído = 5 horas acreditadas, automáticamente, desde el primer minuto. Mientras otros acreditan después de umbrales, nosotros acreditamos desde el minuto uno.

Hardware no sobrevendido

Infraestructura dedicada empresarial, 100% NVMe, recursos que nunca se venden dos veces. Tu LiteLLM rinde igual en el peor día que en el mejor.

Humanos desde 2001

Ingenieros reales responden, a cualquier hora. Veinticinco años operando servidores de producción, y ningún muro de chatbots entre tú y ellos.

Migración gratis, hecha por nosotros

¿Traes un LiteLLM existente? Lo migramos, lo verificamos y te lo entregamos funcionando, sin costo. Tu host anterior sigue activo hasta que apruebes.

Hecho para

Lo que la gente corre en un VPS de LiteLLM aquí.

Una API key para todos los modelos

Tus apps llaman un solo endpoint compatible con OpenAI; LiteLLM enruta a cualquier proveedor detrás.

Control de gasto entre proveedores

Presupuestos, límites y logs de uso por llave, para que los costos de IA dejen de ser un misterio.

Failover entre proveedores

Cuando un API se degrada, las reglas de ruteo pasan a otro sin tocar el código de la app.

Gestión de llaves por equipo

Dale a cada proyecto una llave virtual con sus propios límites en vez de compartir llaves crudas de proveedor.

Los detalles

LiteLLM aquí, en palabras simples.

¿Por qué poner una pasarela frente a los proveedores de IA?

Porque cinco apps con cinco claves API incrustadas es como nacen las sorpresas de gasto y las caídas. LiteLLM le da a cada app una clave virtual con su presupuesto y su límite, rastrea el gasto por clave y conmuta a un segundo proveedor cuando el primero tiene un mal día.

¿Qué significa realmente compatible con OpenAI?

Cualquier herramienta que hable con la API de OpenAI puede hablar con tu URL de LiteLLM sin cambios, mientras la pasarela traduce a Anthropic, Google, Mistral, Ollama o cien más por detrás. Cambiar de proveedor pasa a ser una línea de configuración, no un cambio de código.

¿Cuánto servidor necesita LiteLLM?

Es la app más ligera de nuestro estante de IA: 1 GB corre el proxy para tráfico personal o de equipo pequeño. Casi siempre comparte servidor con las apps que lo llaman, que es exactamente para lo que existe el medidor del carrito.

¿LiteLLM ve mis prompts?

Las solicitudes pasan por tu pasarela en tu servidor camino al proveedor que elegiste; no se registra nada más allá de lo que tú habilites. Ese es el punto de autoalojar el plano de control.

Todo alrededor de LiteLLM, en una lista honesta.

Todo lo no marcado viene con cada plan. Los elementos con asterisco son addons pagos opcionales, con precio claro, que agregas en el carrito o cuando quieras.

Snapshots diarios (24h, más bajo demanda)
Certificados SSL gratis
Hostname instantáneo, tu dominio a un asistente de distancia
Protección DDoS
Firewall alimentado con datos de amenazas en vivo
Detección de intrusiones (IDS)
Análisis centralizado de logs
Acceso root por SSH
Migración gratis, hecha por nosotros
Monitoreo de uptime, estado público
SLA de 500%, créditos automáticos
Garantía de 30 días
Soporte humano 24/7
Monitoreo proactivo, 24/7 *
Parches de seguridad programados *
Actualizaciones y hardening del SO *
Optimización y tuning del servidor *
Relay de correo saliente (MailChannels) *
Filtrado antispam entrante *
Respaldos dobles fuera de sitio (PBS + S3) *
Verificación semanal de respaldos *
Restauraciones asistidas por humanos *

* Addon pago opcional: parte de Fully Managed o Dual Backups. Un precio por plan, addons con precio claro, sin sorpresas al renovar.

Apílalo

LiteLLM funciona bien con.

Mismo servidor, sin costo extra por app. Instálalas juntas o agrégalas después desde tu área de cliente.

LibreChat

+4 GB

A private ChatGPT-style interface for every major model provider. One clean UI, your API keys, your conversation history on your server.

Flowise

+2 GB

Drag-and-drop builder for LLM apps and agents. Prototype chatbots and pipelines visually, then serve them as APIs from your own server.

PostgreSQL

+1 GB

The engineers’ database. Installed, tuned for your RAM, and backed up twice offsite.

Cómo funciona

Siete sistemas trabajando para que tú no.

Cada servidor administrado corre la misma pila por debajo. Elige un sistema para ver qué hace realmente.

Los problemas terminan antes de que te enteres.

Cada minuto revisamos más de 200 parámetros de tu servidor y sus servicios: servidor web, base de datos, correo, disco, memoria y la ruta de red hacia él. En cuanto algo se sale de rango, nuestro personal de soporte recibe la alerta, investiga y lo corrige.

Este es monitoreo interno, más profundo que cualquier chequeo público de uptime: vigila el interior de tu servidor, no solo si responde. La mayoría de los incidentes los encuentra y corrige nuestro equipo antes de que alguien afuera los note.

  • 200+ parámetros revisados cada minuto
  • Las alertas llegan a ingenieros, no a colas de tickets
  • Chequeos dentro del servidor, no solo ping
  • Humanos responden en minutos, a cualquier hora
Tu VPS web db mail disk + 200 parámetros más cada minuto fuera de rango Equipo alertado investiga y lo corrige corregido, a menudo antes de que lo notes

Lo que dicen los clientes

Más reseñas: Trustpilot
“Excellent webhosting company. I really love all their products and services. Thank you so much.”
Fernando Garibay via Trustpilot
“The tech support is excellent, and they offer very competitive pricing. They also migrate my cPanel VPS to a DirectAdmin VPS without noticeable downtime.”
Carlos Reyes via Trustpilot
“I've been hosting several websites with them, and I can honestly say their support is outstanding. They are incredibly patient, knowledgeable, and genuinely committed to solving problems, even the most difficult and unusual ones.”
Juan Gabriel “Juangui” Verano via Trustpilot

Preguntas frecuentes

¿Quién debería correr LiteLLM?

Cualquiera con más de una app que consume IA o más de un compañero con claves de proveedor sueltas. Es el compañero natural de LibreChat, Flowise y OpenClaw en el mismo servidor, todos a $0 aquí.

¿La pasarela agrega latencia?

Milisegundos de un dígito en el mismo servidor, que desaparecen junto al tiempo de inferencia del modelo medido en segundos. El failover y los reintentos suelen ahorrar mucho más tiempo del que cuesta el salto.

¿Cuánto cuesta alojar LiteLLM?

La app cuesta $0; un servidor de 1 GB empieza en $4.17/mo en facturación anual y lo corre con espacio de sobra, gestión y respaldos opcionales. El uso de proveedores factura con cada proveedor mediante tus propias claves.

¿Funciona con mi código cliente de OpenAI actual?

Sí, ese es el punto: apunta la base URL a tu LiteLLM y el código con SDK de OpenAI corre sin cambios mientras gana ruteo, presupuestos y logs.

¿Puede enrutar a modelos locales también?

Sí, Ollama y otros endpoints locales se registran como proveedores junto a los APIs comerciales, así que la misma llave puede servir modelos privados y hosted por regla.

¿Esto es LiteLLM en un VPS o en hosting compartido?

Un VPS. LiteLLM corre en tu propio servidor virtual privado con recursos dedicados, no sobrevendidos, y su propia IP. Aislamiento y rendimiento reales, con el setup, el TLS y el hardening resueltos por nosotros.

¿Puedo correr otras apps en el mismo servidor?

Sí. Agrega cualquier otra app del catálogo a este servidor desde tu área de cliente, a un clic cada una, sin cargo por app. Cuánto cabe es cuestión de RAM, y redimensionar toma minutos.

¿Migran mi LiteLLM existente?

Sí, la ayuda de migración es gratis. Abre un ticket con acceso a la instalación actual y la movemos, la verificamos y te la entregamos funcionando. Nada cambia hasta que apruebes.

¿Puedo subir o bajar de plan después?

Cuando quieras. Los planes se redimensionan desde el área de cliente en minutos, la facturación anual mantiene su descuento plano de 17% en cada tamaño, y nunca hay cuota por cambiar de nivel.

¿Dimensionando tu stack? La calculadora de dimensionamiento VPS te recomienda un plan según tus apps y tráfico, con la cuenta a la vista.

Tu servidor corre. Tú duermes.

Hosting totalmente administrado por gente que hace esto desde 2001.