Hosting VPS y el principio de tolerancia a fallos (Parte 1)

Publicado: Sep 22, 2025
VPS Seguridad

AlojamientoVPS tenía 15 días de haberse lanzado oficialmente, en el equipo éramos 3 personas que habíamos dado todo para que el servicio fuera perfecto y los clientes, además de emocionados, tenían altas expectativas por eso moderno y potente que se les había vendido.

Y se cayó.

Y se jodió.

En los primeros días.

Todo era muy raro…

Los servidores: bien.

El panel: bien.

Las webs: bien.

Pero sin razón ni motivo en particular… todo comenzaba a ir mal en las webs.

Tan mal, que la web daba error por cosas tan simples como crear un usuario. Cambiar una contraseña. Aprobar un comentario. Editar un post.

Y todo iba a peor.

Yo, como pollo sin cabeza, reiniciaba los servidores, miraba logs, pasaba test antimalware, creaba nuevos servidores, volvía a hacer todo de nuevo, una y otra vez en busca del error.

En paralelo, escribía como alma en pena al soporte de Vultr, respondía llamadas, contestaba correos, atendía por WhatsApp y me jalaba los pelos de la barba, porque soy calvo.

Todo era un caos. ¡TODO!

Se hablaron de demandas legales.

Se habló de pérdidas y daños irreparables a la reputación de varias marcas.

Varios clientes al ver la situación pidieron volver a su proveedor anterior: INMEDIATAMENTE.

Un cliente muy ofendido me dijo que no era justo que experimentara con ellos, que si no tenía algo listo para producción y que realmente funcionara, que no lo vendiera.

Un cliente me dijo mentiroso. Que cualquier hosting pedorro era mejor que los VPS que yo vendía.

¡Ojo!

“El VPS que yo vendía”

“El VPS”

“¡¡¡EL VPS!!!”

Repliqué y revisé paso por paso. Perdí la cuenta de cuántas veces lo hice en servidores en producción y en nuevos que iba creando.

Estaba tan cegado por “el partner” que no pensé que el error pudiera venir del proveedor.

Todos los servidores los estaba creando en Madrid y New York.

Puse a punto uno en Alemania y funcionó. ¡Funcionó!

Pero al par de horas volvió el problema.

¡A la mierda el partner!

Puse todo a punto en servidores nuevos de UpCloud…

Y todo funcionó con normalidad.

Pasaban las horas y funcionaba con normalidad.

Pasaron los días y todo seguía funcionando con normalidad.

Si Alex del 2023 hubiera tenido una idea del Principio de Tolerancia a Fallos, si hubiera creado un método con procesos para no caer en el caos y si hubiera tenido el control con pasos claros para situar el problema y triangular la causa… se hubiera dado cuenta en los primeros 30 minutos de que el problema venía del VPS y no de su implementación.

Mi yo del 2023 no podía saberlo.

Le faltaba experiencia e hilar fino.

Era impetuoso y quería comerse el mundo.

Todos los errores me han hecho entender: El buen funcionamiento y el servicio de calidad no trata de evitar los fallos. Tiene una estrategia para no perder el control cuando ocurren.

Hoy, cada vez que algo falla, aplico mi método. No reacciono con pánico, sino con pasos.

Primero respiro. Luego aplico:

S: Sitúo el problema T: Triangulo la causa O: Ordeno opciones de resolución P: Preparo contingencias

Y si algo no funciona como debería, no culpo al proveedor, ni al VPS, ni al panel, ni al cliente, ni al destino: reviso si estoy preparado para tolerar el fallo.

Porque los sistemas no colapsan por fallar…

Colapsan cuando nadie sabe qué hacer cuando fallan.

© 2026 Alex Ávalos - Especialista en servidores y Hosting VPS.

LinkedIn Mastodon YouTube