Resumen

  • Weil desarrolló Ceph en un programa de investigación colectiva en UC Santa Cruz y completó su doctorado en 2007, tras publicar los artículos fundacionales de Ceph y CRUSH en 2006.
  • CRUSH calcula la ubicación a partir de mapas, pesos, topología y reglas; RADOS distribuye objetos, réplicas, detección de fallos y recuperación entre monitores y OSD.
  • Ceph ofrece bloque mediante RBD, objetos mediante RGW y un sistema de archivos de estilo POSIX mediante CephFS sobre la misma base, aunque con rutas de funcionamiento distintas.
  • Weil cofundó Inktank en 2012, y Red Hat anunció el 30 de abril de 2014 su compra por unos 175 millones de dólares.
  • Weil se apartó del trabajo diario en Ceph y lidera Civic Media. La autoridad actual está en los mantenedores y en las estructuras de gobernanza contemporáneas, no en el fundador histórico.

La matriz de almacenamiento que se convirtió en algoritmo

Ceph eliminó una tabla de ubicación central del flujo de datos habitual. CRUSH calcula los dispositivos a partir de un mapa y una regla; los OSD almacenan en RADOS, intercambian estado, replican y se recuperan bajo mapas de confianza mantenidos por los monitores. El trabajo se distribuye, pero la autoridad no desaparece.

El resultado depende de los pesos, la jerarquía y los dominios de fallo reales. Un mapa desactualizado reproduce fielmente una mala ubicación. El algoritmo reduce las búsquedas y el movimiento innecesario, pero el operador debe representar correctamente el mundo físico.

Un equipo de investigación, no un inventor solitario

Ceph nació en el Storage Systems Research Center de la UC Santa Cruz. Weil fue diseñador y constructor central, pero los supervisores, coautores, estudiantes, la financiación y los entornos de prueba conformaron el proyecto. Los artículos de 2006 llevan varios nombres, entre ellos Scott Brandt, Ethan Miller, Carlos Maltzahn y Darrell Long, según el artículo.

La atribución colectiva no reduce el papel de Weil; explica cómo una tesis se convirtió en infraestructura. Otros tuvieron que entender, criticar y mantener el sistema para que sobreviviera a su creador.

CRUSH: calcular dónde pertenecen los datos

CRUSH usa buckets jerárquicos, pesos y reglas para elegir una lista ordenada de dispositivos. Una regla puede imponer réplicas en bastidores distintos o seleccionar una clase de medio. Cuando el clúster cambia, solo una parte de los objetos se reasigna, en lugar de recurrir a una tabla central por objeto.

Las reglas son política ejecutable. Un peso erróneo o un bastidor mal representado distorsionan la distribución y la recuperación. Antes de un cambio conviene simular el movimiento de datos, revisar la capacidad libre y entender la carga de red.

RADOS y la decisión de distribuir la reparación

RADOS convierte una gran cantidad de OSD en una base única. Los monitores mantienen el quórum y los mapas; los OSD almacenan objetos, comparan estado, replican y reparan. La recuperación ocurre cerca de los componentes que conocen los datos, en lugar de depender de un controlador central para cada transferencia.

Un fallo generalizado puede provocar una tormenta de reconstrucción que compite con los clientes por la red y el disco. La disponibilidad depende del margen, la limitación de velocidad (throttling), la salud de los dispositivos y el tiempo de expulsión de un OSD. La distribución no significa gratuidad ni automatismo.

Un almacén de objetos único y tres interfaces de almacenamiento

RBD ofrece volúmenes para bloque, RGW expone APIs para objetos y CephFS construye un sistema de archivos de estilo POSIX con servidores de metadatos. Las interfaces comparten RADOS y los mecanismos de ubicación y recuperación.

Pero los cuellos de botella difieren. RGW añade identidad y pasarelas; CephFS añade una capa de metadatos; RBD depende de clientes y cachés. El éxito de un patrón no demuestra la idoneidad de otro.

Placement groups, recuperación y el coste de un fallo

Los placement groups agrupan objetos para que la ubicación, el peering y la recuperación sean manejables. Su distribución determina el equilibrio y el trabajo posterior a un fallo. Cuando se pierde un OSD, el clúster reasigna y reconstruye según la política.

La falta de espacio libre o un error de topología prolongan el estado degradado. Hay que vigilar los objetos sucios (unclean), el backfill, la latencia, el ancho de banda y el tiempo de recuperación. La replicación no sustituye a las copias de seguridad frente al borrado lógico o la corrupción.

De la tesis doctoral a la infraestructura de Linux

Pasar de una tesis a Linux y OpenStack requirió años de empaquetado, compatibilidad, documentación, pruebas de actualización y corrección de fallos. La integración con el kernel y las distribuciones llevó Ceph a las nubes y a los productos. El trabajo operativo poco visible importó tanto como los artículos científicos.

La apertura permitió elegir hardware y dio lugar a múltiples ofertas, pero multiplicó las combinaciones de red, dispositivo, kernel y versión. El upstream publica una rama; el integrador y el operador asumen la responsabilidad de la combinación real.

Inktank, Red Hat y la responsabilidad comercial

Inktank se fundó en 2012, vendió soporte y reunió ingeniería. Red Hat anunció el 30 de abril de 2014 la adquisición por unos 175 millones de dólares, lo que introdujo Ceph en una gran empresa de código abierto y en el negocio de la nube.

La financiación ayudó al mantenimiento y la expansión, pero concentró la contratación. La licencia y la comunidad limitaron el control exclusivo. Los clientes debían distinguir entre el proyecto público, el producto de Red Hat y la distribución concreta, cada uno con su hoja de ruta y sus límites de soporte.

El proyecto aprende a vivir sin su fundador

Weil dejó más tarde el trabajo a tiempo completo en Ceph y fundó Civic Media. Su biografía explica el origen, pero no determina las decisiones actuales de lanzamiento. Atribuir cada éxito o incidente actual al fundador borra el trabajo de los mantenedores, empaquetadores y operadores presentes.

Continuar sin él forma parte del éxito. La sucesión necesita estructuras que resuelvan disputas, publiquen parches y mantengan los subsistemas. La autoridad histórica merece reconocimiento, no un derecho permanente de liderazgo.