
DISEÑADO PARA FUNCIONAR.
HECHO PARA DURAR.
Durante muchos años hemos estado construyendo y operando Albgott, una plataforma private cloud — mejorándola paso a paso, aprendiendo de lo que funciona, y haciéndola mejor con cada iteración.
ALBGOTT es un private cloud construido desde cero y operado internamente.Empezó como infraestructura para ejecutar unos pocos servicios. Tres años después, ha crecido hasta convertirse en una plataforma completa — con redes aisladas, compute dedicado, su propio modelo de acceso, y observability en todas las capas.Lleva en producción desde 2023, y sigue evolucionando una mejora cada vez.
- Compute03 NODOS
- Red08 SEGMENTOS
- Workloads38 SERVICIOS
- ObservabilitySTACK COMPLETO · 24/7
- AutomatizaciónEN CURSO
Los principios detrás de esto
Arquitectura
Aislamiento por diseño. Redes, sistemas y servicios tienen sus propios límites. Nada comparte una capa sin motivo.
Explorar →02Seguridad
La confianza no se da por supuesta. Estar conectado no significa estar autorizado. Cada conexión está definida, controlada y limitada explícitamente a lo que realmente hace falta.
Explorar →03Operaciones
Construido para seguir funcionando. Los sistemas se monitorizan de forma continua, los fallos se detectan pronto, y la infraestructura sigue mejorando con el tiempo.
Explorar →Topología del sistema
Trade-offs
deliberados
Aislamiento antes que comodidad. Algunas decisiones hacen las cosas más difíciles de operar. También hacen los errores más pequeños, el acceso más controlado, y los fallos más fáciles de contener.
- 01Roles de nodo asimétricosEl compute va donde pertenece la workload — no simplemente donde resulta más cómodo.
- 02Sin confianza implícitaDos redes no se comunican solo porque ambas se consideren «internas». El acceso es explícito por diseño.
- 03Acceso dividido por rolAdministradores y desarrolladores usan rutas de acceso separadas, manteniendo credenciales, permisos y radio de impacto separados.
Nada entra por accidente.
# postura por defecto deny * → * # solo excepciones explícitas allow public→ app :443 allow internal→ tools, trusted net only allow corp-tunnel→ internal allow admin-tunnel→ mgmt console # identidad rollout sso, secrets→ in progress, not finished
Cómo se controla
la confianza
Estar en la red no es lo mismo que tener permiso para usarla. Cada límite de abajo existe a propósito.
- 01Denegación por defecto, permiso explícitoCada conexión entre segmentos existe porque quedó escrita, no porque fuera conveniente.
- 02Niveles de confianza, no un único router haciéndolo todoEl tráfico público, las herramientas internas y la gestión del hardware están detrás de tres puntos de entrada separados, cada uno con su propio radio de impacto.
- 03Identidad, todavía en despliegueEl single sign-on y los secrets centralizados existen y funcionan hoy — adoptarlos en todas partes es trabajo honesto y en curso, no una migración terminada.
OBSERVAR.AUTOMATIZAR.ALERTAR.
Cada capa se monitoriza, se mide y se instrumenta para detectar problemas pronto, antes de que se conviertan en deuda operativa.
Lo último del log
Recuperación ante desastres antes de backups reales
Runbooks frente a guías, un flujo de triaje de fallos, y por qué la documentación es un control compensatorio, no un sustituto de los backups.
Leer →Niveles de aislamiento de clientes
Qué cambia cuando una plataforma personal empieza a alojar la carga de un tercero externo, y por qué onboarding y offboarding son el mismo proceso al revés.
Leer →Fatiga de alertas por diseño
Usar reglas de inhibición para que una alerta crítica silencie su propio eco en nivel de advertencia, en lugar de avisar dos veces al on-call por una misma causa raíz.
Leer →No está terminado. Y se dice en voz alta.
Hoy no hay ningún sistema de backup en marcha. Si un nodo se cae, lo que solo vivía ahí desaparece — no se degrada, desaparece. Esa carencia es pública a propósito, igual que todo lo demás que sigue abierto.
- ✓Dividir la red en zonas aisladas
- ✓Construir un pipeline completo de CI/CD
- ✓Vigilar todo el stack — métricas y alertas
- Activar el SSO en todos los servicios
- Conseguir que los backups corran automáticamente
- Hacer que el stack de monitoring sobreviva a la caída de un nodo
- Trasladar el hardware a un rack como es debido
Construido a la vista de todos, errores incluidos.
Cada caída, cada decisión equivocada, y cada pieza sin terminar se escribe donde pasó — no se maquilla después.
— A.M.
¿TIENES ALGO QUE TIENE QUE FUNCIONAR?
Si trabajas en infraestructura, plataformas o servicios donde la fiabilidad importa más allá del primer día, nos gustaría saber qué estás construyendo.