Migrar de three-tier a spine-leaf: caso de estudio con costos y downtime realista (no marketing)
Hay una pregunta que los proveedores evitan cuando te ofrecen migrar de three-tier a spine-leaf: cuánto te va a costar realmente el tiempo de inactividad planificado y los parches que nadie factura. Te lo desgrano con números que se repiten en proyectos reales, no con slides de marketing.
El costo que SÍ aparece en la orden de compra
Antes de tocar un cable, hay tres líneas que se repiten en cualquier proyecto serio de migración:
- Cableado: substituir el acceso tradicional por fibra MPO/MTP trunk entre Leaf y Spine. En un closet de 8 racks con 24 servidores por rack, son ~48 cables de 10 m por rack; precio de mercado USD 200-450 por enlace terminado.
- Switches Leaf y Spine: dos switches por rack (Leaf) más dos Spine en el row. Equipos enterprise 48 puertos 25G más uplinks 100G están en USD 18-35k por Leaf y USD 40-80k por Spine.
- Mano de obra y tiempo de inactividad planificado: dos ventanas de mantenimiento (corte de un uplink a la vez) más pruebas de failover. Calcula USD 8-15k en un DC mediano, más 2-4 horas de indisponibilidad por servidor migrado si no se hace en caliente.
El costo que NADIE factura (y por eso te pega)
El verdadero sangrado está en lo que aparece meses después:
- Reentrenamiento del equipo de operaciones: los scripts Ansible, los runbooks de NetBox, los templates de Terraform, todo asume tres capas. Migrar implica reescribir el 20-40% de la automatización.
- Pérdida de visibilidad durante el cutover: las herramientas de monitoring tradicionales (Nagios, Zabbix clásico) no descubren automáticamente topologías L3 con ECMP. Vas a tener 4-6 semanas de monitorización ciega hasta reescribir las reglas.
- Riesgo de oversubscription mal calculado: spine-leaf te da más paths pero también más complejidad para calcular oversubscription ratio. Un error del 30% en el cálculo inicial te cuesta otro cambio de switches en 18 meses.
Desglose del Impacto: Presentación de Ventas vs. Realidad de Campo
| Dimensión Operativa | Promesa Comercial (Slide) | Realidad Técnica (Campo) | Impacto Financiero / Riesgo |
|---|---|---|---|
| Infraestructura Física | "Reemplazo de switches de acceso y núcleo" | Cambio masivo a cableado trunk MPO/MTP entre Leaf y Spine | $200 – $450 USD por enlace MPO/MTP terminado |
| Equipamiento (Hardware) | "Modernización de red a 25G/100G" | 2 switches Leaf por rack + 2 Spine por hilera (row) | $18k – $35k USD por Leaf / $40k – $80k USD por Spine |
| Despliegue y Mano de Obra | "Migración transparente en caliente" | 2 ventanas de corte (corte de uplink) y pruebas de failover | $8k – $15k USD + 2-4 hrs inactividad por servidor no redundado |
| Automatización (Scripts) | "Integración con software existente" | Reescritura del 20% al 40% de la automatización | Costo en horas-hombre (Ansible, Terraform, NetBox) |
| Monitoreo y Control | "Visibilidad de red simplificada" | Ceguera de 4 a 6 semanas en Nagios/Zabbix ante flujos ECMP L3 | Riesgo operativo por pérdida de telemetría |
| Saturación (Oversubscription) | "Crecimiento horizontal ilimitado" | Cálculo complejo de relación de sobresuscripción | Error del 30% exige cambiar switches en 18 meses |
| Umbral de ROI | "Beneficio inmediato para el Data Center" | Sin ROI si el tráfico Norte-Sur domina (>80%) | Retorno a 24-36 meses solo con tráfico Este-Oeste >60% |
Cómo calcular el ROI honestamente
El beneficio real del spine-leaf es ancho de banda este-oeste predecible y crecimiento horizontal sin re-cablear. Si tu tráfico norte-sur sigue siendo el 80% del total, three-tier te va a durar 5 años más sin problema. Si ya estás viendo saturación de enlaces entre Access y Distribution (más del 60% sostenido en horario laboral), entonces la migración paga en 24-36 meses. Debajo de ese umbral, el ROI no existe.
Lo que necesitas tener claro ANTES de firmar
Tres preguntas que tu proveedor debería responder sin dudar: (1) cuántos saltos L3 tiene un paquete entre dos servidores del mismo rack, (2) cuál es la oversubscription ratio real entre Leaf y Spine en tu caso, (3) cómo se ve la red durante un actualización de firmware. Si titubea, no ha hecho este proyecto antes.
Fuentes
- Cisco — centro de datos bitácora (publicaciones técnicas oficiales). https://blogs.cisco.com/datacenter
- Arista Networks — centro de datos and Cloud Networking (página de soluciones). https://www.arista.com/en/solutions/data-center-and-cloud-networking
- Panduit — centro de datos Solutions (catálogo oficial de cableado estructurado). https://www.panduit.com/en/solutions/data-center.html
¿Quieres dominar este tema?
Noxtel Academy →