Hosting VPS administrado de Ollama
Ollama, en línea en minutos.
En un servidor que es solo tuyo.
Run open LLMs on your own server. Honest requirement: real models want real RAM, and the meter will route you to the right plan.
- SLA de 500%
- Garantía de 30 días
- Snapshots diarios gratis
- Firewall e IDS
Qué es
Ollama corre modelos de lenguaje grandes en tu propio servidor: Llama, Mistral, Qwen y el mundo de modelos abiertos tras una API local limpia, con tus prompts sin salir jamás de la máquina.
RAM mínima
16 GB
Fits on SC-16GB; SC-48GB is the comfortable pick with room to stack.
Qué instalamos
El playbook despliega el Ollama actual con la API ligada en privado por defecto, tus modelos iniciales descargados, memoria dimensionada al plan y el servicio supervisado. Open WebUI al lado es un checkbox más.
Cada plan incluye
Hostname instantáneo con TLS, base de datos creada y conectada, snapshots diarios, firewall e IDS. Agrega Fully Managed cuando quieras y nuestros ingenieros operan el servidor completo por ti.
Elige tu servidor
Elige un plan para Ollama.
Ollama necesita al menos 16 GB de RAM. Cada plan es tu propio VPS privado, y el mismo servidor corre tantas apps como quepan.
SC-16GB
- 6 vCPU
- 16 GB RAM
- 400 GB NVMe
- 40 TB transferencia
- Acceso Root Completo
- Cores No Sobrevendidos
- Almacenamiento 100% NVMe
- Firewall de Red/IDS
- Snapshots Diarios Gratis
- Red con Protección DDoS
- Dual Backups (Opcional)
- Fully Managed (Opcional)
Garantía de 30 días
SC-24GB
- 8 vCPU
- 24 GB RAM
- 600 GB NVMe
- 60 TB transferencia
- Acceso Root Completo
- Cores No Sobrevendidos
- Almacenamiento 100% NVMe
- Firewall de Red/IDS
- Snapshots Diarios Gratis
- Red con Protección DDoS
- Dual Backups (Opcional)
- Fully Managed (Opcional)
Garantía de 30 días
SC-48GB
- 12 vCPU
- 48 GB RAM
- 1200 GB NVMe
- 120 TB transferencia
- Acceso Root Completo
- Cores No Sobrevendidos
- Almacenamiento 100% NVMe
- Firewall de Red/IDS
- Snapshots Diarios Gratis
- Red con Protección DDoS
- Dual Backups (Opcional)
- Fully Managed (Opcional)
Garantía de 30 días
SC-64GB
- 16 vCPU
- 64 GB RAM
- 1600 GB NVMe
- 160 TB transferencia
- Acceso Root Completo
- Cores No Sobrevendidos
- Almacenamiento 100% NVMe
- Firewall de Red/IDS
- Snapshots Diarios Gratis
- Red con Protección DDoS
- Dual Backups (Opcional)
- Fully Managed (Opcional)
Garantía de 30 días
Ollama se instala solo en el primer arranque con TLS, hostname y su base de datos conectada. Fully Managed y Dual Backups son addons opcionales en el carrito.
Por qué aquí
Por qué correr Ollama en RemarkableCloud.
Tu propio VPS privado
No es un contenedor en una caja compartida. Un servidor virtual real con recursos dedicados y tu propia IP, sin nadie más adentro.
Apila apps, un precio
Agrega tantas apps como quepan en tu servidor desde el área de cliente, a un clic cada una. Sin cargo por app, nunca.
Un SLA de 500% que paga
1 hora caído = 5 horas acreditadas, automáticamente, desde el primer minuto. Mientras otros acreditan después de umbrales, nosotros acreditamos desde el minuto uno.
Hardware no sobrevendido
Infraestructura dedicada empresarial, 100% NVMe, recursos que nunca se venden dos veces. Tu Ollama rinde igual en el peor día que en el mejor.
Humanos desde 2001
Ingenieros reales responden, a cualquier hora. Veinticinco años operando servidores de producción, y ningún muro de chatbots entre tú y ellos.
Migración gratis, hecha por nosotros
¿Traes un Ollama existente? Lo migramos, lo verificamos y te lo entregamos funcionando, sin costo. Tu host anterior sigue activo hasta que apruebes.
Hecho para
Lo que la gente corre en un VPS de Ollama aquí.
LLMs privados para trabajo real
Llama, Mistral, Qwen y compañía respondiendo en tu servidor. Prompts y salidas nunca lo abandonan.
Un API para tus aplicaciones
Endpoints compatibles con OpenAI significan que tu código casi no cambia; solo cambian la factura y la privacidad.
Flujos con documentos confidenciales
Resume contratos y documentos internos con un modelo que no puede filtrarlos a un proveedor.
Experimentación con modelos
Descarga, compara y cambia modelos libremente. El medidor es tu servidor, que no mide.
Los detalles
Ollama aquí, en palabras simples.
¿Qué incluye el hosting Ollama administrado?
Un servidor de modelos locales funcionando, dimensionado con honestidad, actualizado y asegurado por defecto, a precio plano sin nada por token. La API es tuya; el medidor no existe.
¿Qué puede correr realmente un servidor de CPU?
La respuesta honesta: modelos pequeños y medianos. Los de clase 7B corren aceptablemente para chat y borradores en 16 GB; un 13B cuantizado cabe con paciencia; los modelos grandes quieren GPUs que no vendemos, y lo diremos antes que venderte decepción. Para resúmenes, extracción y chat privado, un 7B servido por CPU es genuinamente útil.
¿Por qué correr modelos localmente?
Privacidad y forma del costo. Documentos de clientes, contratos y datos internos se procesan sin salir de tu servidor, lo que convierte conversaciones enteras de cumplimiento en un encogimiento de hombros. Y un precio plano de servidor le gana al cobro por token en cuanto el uso se vuelve rutina.
¿Qué se empareja con Ollama?
Open WebUI para una interfaz estilo ChatGPT encima, y n8n para automatización que llama a los modelos: resumir correo entrante, borrar respuestas, clasificar tickets, todo por localhost, todo privado. El kit IA Privada empaqueta exactamente esto.
Todo alrededor de Ollama, en una lista honesta.
Todo lo no marcado viene con cada plan. Los elementos con asterisco son addons pagos opcionales, con precio claro, que agregas en el carrito o cuando quieras.
* Addon pago opcional: parte de Fully Managed o Dual Backups. Un precio por plan, addons con precio claro, sin sorpresas al renovar.
Apílalo
Ollama funciona bien con.
Mismo servidor, sin costo extra por app. Instálalas juntas o agrégalas después desde tu área de cliente.
Open WebUI
+2 GBThe chat interface for Ollama. Together they are a private ChatGPT on hardware nobody shares.
n8n
+2 GBSelf-hosted workflow automation: connect your apps and let the flows run 24/7 on a server that is monitored for you.
Cómo funciona
Siete sistemas trabajando para que tú no.
Cada servidor administrado corre la misma pila por debajo. Elige un sistema para ver qué hace realmente.
Los problemas terminan antes de que te enteres.
Cada minuto revisamos más de 200 parámetros de tu servidor y sus servicios: servidor web, base de datos, correo, disco, memoria y la ruta de red hacia él. En cuanto algo se sale de rango, nuestro personal de soporte recibe la alerta, investiga y lo corrige.
Este es monitoreo interno, más profundo que cualquier chequeo público de uptime: vigila el interior de tu servidor, no solo si responde. La mayoría de los incidentes los encuentra y corrige nuestro equipo antes de que alguien afuera los note.
- 200+ parámetros revisados cada minuto
- Las alertas llegan a ingenieros, no a colas de tickets
- Chequeos dentro del servidor, no solo ping
- Humanos responden en minutos, a cualquier hora
Lo que dicen los clientes
Más reseñas: Trustpilot“Excellent webhosting company. I really love all their products and services. Thank you so much.”
“The tech support is excellent, and they offer very competitive pricing. They also migrate my cPanel VPS to a DirectAdmin VPS without noticeable downtime.”
“I've been hosting several websites with them, and I can honestly say their support is outstanding. They are incredibly patient, knowledgeable, and genuinely committed to solving problems, even the most difficult and unusual ones.”
Preguntas frecuentes
¿Cuánta RAM necesita Ollama?
16 GB es el mínimo honesto para uso cómodo de clase 7B, y el medidor lo exige. Más RAM significa modelos más grandes o menos cuantizados.
¿Qué modelos puedo descargar?
Lo que esté en la biblioteca de Ollama o sea importable como GGUF: Llama, Mistral, Qwen, Gemma, Phi y el resto del mundo abierto.
¿La API está expuesta?
No por defecto: se liga en privado, las apps del mismo servidor la alcanzan por localhost, y el acceso remoto pasa por WireGuard o un permiso deliberado de firewall.
¿Qué modelos caben en mi RAM?
Regla rápida: modelos cuantizados de 7 a 8B van cómodos en 16 GB, la clase 13B quiere más margen. Los planes más grandes abren modelos más grandes; redimensionar toma minutos cuando crece la curiosidad.
¿Qué tan rápida es la inferencia en CPU, honestamente?
Usable para chat y trabajos de fondo con modelos pequeños: varios tokens por segundo en cores dedicados, más con más de ellos. No es velocidad de GPU, y para muchas cargas privadas no necesita serlo.
¿Esto es Ollama en un VPS o en hosting compartido?
Un VPS. Ollama corre en tu propio servidor virtual privado con recursos dedicados, no sobrevendidos, y su propia IP. Aislamiento y rendimiento reales, con el setup, el TLS y el hardening resueltos por nosotros.
¿Puedo correr otras apps en el mismo servidor?
Sí. Agrega cualquier otra app del catálogo a este servidor desde tu área de cliente, a un clic cada una, sin cargo por app. Cuánto cabe es cuestión de RAM, y redimensionar toma minutos.
¿Migran mi Ollama existente?
Sí, la ayuda de migración es gratis. Abre un ticket con acceso a la instalación actual y la movemos, la verificamos y te la entregamos funcionando. Nada cambia hasta que apruebes.
¿Puedo subir o bajar de plan después?
Cuando quieras. Los planes se redimensionan desde el área de cliente en minutos, la facturación anual mantiene su descuento plano de 17% en cada tamaño, y nunca hay cuota por cambiar de nivel.
¿Dimensionando tu stack? La calculadora de dimensionamiento VPS te recomienda un plan según tus apps y tráfico, con la cuenta a la vista.
Servidores Shared CPU
El hogar correcto para Ollama y la mayoría de stacks: vCPU de 3.0+ GHz, desde $4.17/mes.
Ver Shared CPU →Servidores Dedicated CPU
Para stacks exigentes de CPU y bases de datos ocupadas: cores que son físicamente tuyos.
Ver Dedicated CPU →Todos los planes y precios
Cada plan, ambas familias, un precio honesto con todo incluido.
Ver precios →Tu servidor corre. Tú duermes.
Hosting totalmente administrado por gente que hace esto desde 2001.