Ceph

Documentación sobre ceph

¿Alguna vez has sentido que tu infraestructura de almacenamiento se te escapa de las manos? Empiezas con un par de discos, luego necesitas un NAS, después un sistema de archivos compartido y, de repente, te encuentras gestionando un caos de hardware heterogéneo, replicaciones manuales y miedos constantes a perder datos cuando un disco falla.

Si estás buscando una solución que no solo crezca contigo, sino que sea capaz de sanarse a sí misma sin que tengas que saltar de la silla a las tres de la mañana, necesitas conocer Ceph.

Ceph es un sistema de almacenamiento distribuido diseñado para ser la columna vertebral de entornos de misión crítica. Es altamente escalable, fiable y, lo más importante, está pensado para ser auto-gestionado, auto-reparado y auto-optimizado. En resumen: es el sistema que permite que los centros de datos y las nubes privadas funcionen sin que el administrador de sistemas tenga que controlar cada bit manualmente.

Ceph Logo

Características Principales

Antes de meternos en el barro de la arquitectura, veamos qué es lo que hace que Ceph sea tan especial frente a un sistema de archivos tradicional:

  • Escalabilidad: No hay techo. Ceph puede escalar desde unos pocos nodos hasta miles, permitiendo un crecimiento horizontal sin interrupciones.
  • Fiabilidad: Gracias a la replicación y la codificación de borrado (Erasure Coding), tus datos sobreviven incluso si varios discos o nodos mueren simultáneamente.
  • Auto-gestión: El sistema detecta fallos y redistribuye los datos automáticamente para recuperar el estado de salud deseado.
  • Flexibilidad: Un solo clúster puede entregarte almacenamiento de bloques (para máquinas virtuales), objetos (estilo S3) y sistemas de archivos (CephFS).

Arquitectura de Ceph

Para entender Ceph, hay que entender que no es un programa único, sino una danza coordinada de diferentes componentes especializados. Si un componente falla, los demás saben qué hacer para mantener la coherencia.

Sus piezas fundamentales son:

  • Ceph Monitors (MON): Son los «guardianes». Mantienen el mapa del clúster y aseguran que todos los nodos estén de acuerdo sobre el estado del sistema.
  • Ceph OSD Daemons (OSD): Son el músculo. Estos procesos almacenan los datos reales y se encargan de las tareas pesadas como la replicación y la recuperación.
  • Ceph Manager Daemons (MGR): Los observadores. Proporcionan métricas, monitorización y herramientas de gestión para que sepas qué está pasando.
  • Ceph Metadata Servers (MDS): Los bibliotecarios. Son esenciales cuando usas CephFS, ya que gestionan los metadatos del sistema de archivos.

Arquitectura de Ceph

Casos de Uso

¿Dónde brilla realmente Ceph? No es una herramienta para guardar fotos personales, es una herramienta para infraestructura:

  • Almacenamiento en la Nube: Es la base de muchos proveedores de servicios que necesitan entregar almacenamiento escalable y fiable a miles de clientes.
  • Big Data: Su capacidad para manejar volúmenes masivos de datos lo convierte en el compañero ideal para arquitecturas de análisis de datos a gran escala.
  • Backup y Recuperación: Si tu prioridad es que los datos estén siempre disponibles y protegidos contra desastres, la redundancia de Ceph es tu mejor aliada.

Instalación Básica con cephadm (Versión Reef)

Si quieres entrar en el mundo de Ceph hoy mismo, la forma más moderna y recomendada es utilizar cephadm, que gestiona el despliegue mediante contenedores. Aquí tienes una guía rápida para desplegar la versión Reef:

  1. Preparar los nodos: Asegúrate de que todos los nodos tengan las dependencias necesarias instaladas y que tengan acceso a internet.
  2. Instalar cephadm: Descarga e instala cephadm en el nodo inicial.
    curl --silent --remote-name https://raw.githubusercontent.com/ceph/ceph/reef/src/cephadm/cephadm
    chmod +x cephadm
    sudo ./cephadm install
    
  3. Desplegar el clúster: Utiliza cephadm para iniciar el proceso de bootstrap.
    sudo cephadm bootstrap --mon-ip <IP_DEL_NODO_INICIAL>
    
  4. Agregar nodos adicionales: Una vez tengas el primer nodo, añade los demás al clúster.
    sudo ceph orch host add <NOMBRE_DEL_NODO> <IP_DEL_NODO>
    
  5. Configurar el clúster: Dile a Ceph que empiece a usar tus discos disponibles para crear los OSDs.
    sudo ceph orch apply osd --all-available-devices
    
  6. Verificar la instalación: El momento de la verdad. Comprueba que el estado sea HEALTH_OK.
    ceph -s
    

Recursos adicionales

Si quieres profundizar más allá de esta guía, aquí tienes los mejores puntos de partida:

Videos tutoriales

Video: Introducción a Ceph – Sistema de almacenamiento distribuido

Documentación oficial

Comunidad


¿Buscas comandos rápidos?

Consulta nuestras Recetas rápidas para comandos copy-paste comunes.

¿Problemas con Ceph?

Revisa nuestra sección de troubleshooting para soluciones a errores comunes.

Suscríbete al blog por correo electrónico

Introduce tu correo electrónico para suscribirte a este blog y recibir avisos de nuevas entradas.

Deja un comentario