¿Qué métricas debes supervisar en los sistemas de almacenamiento ftScalable?

Para las organizaciones que ejecutan cargas de trabajo de misión crítica en entornos Stratus ftServer, la matriz de almacenamiento ftScalable es un componente fundamental, diseñada específicamente para ofrecer tolerancia a fallos, alta disponibilidad y capacidad escalable. Sin embargo, incluso el hardware más confiable requiere una supervisión activa. Saber qué métricas hay que monitorear y cuándo actuar en consecuencia marca la diferencia entre una gestión proactiva del almacenamiento y una interrupción no planificada del servicio.

En esta publicación se explica a los administradores de almacenamiento y a los responsables de infraestructura cuáles son los indicadores clave de rendimiento que deben tener en cuenta en un entorno ftScalable, y cómo Sightline EDM permite actuar en función de la información obtenida al monitorear dichos indicadores.

P: ¿Qué es el almacenamiento ftScalable y por qué requiere una supervisión especializada?

La matriz de almacenamiento Stratus (Penguin Solutions) ftScalable es una solución de almacenamiento híbrido de última generación diseñada para complementar los sistemas ftServer. Admite los niveles RAID 1, 5, 6, 10 y ADAPT en hasta 248 ranuras para unidades y puede ofrecer hasta 600 000 IOPS, lo que la hace ideal para entornos de aplicaciones de alto rendimiento que funcionan de manera ininterrumpida. Su arquitectura incluye la organización de datos en niveles en tiempo real entre los niveles de rendimiento, estándar y de archivo, una reconstrucción rápida de RAID (que funciona entre 2 y 5 veces más rápido que los diseños de reconstrucción estándar) y compatibilidad con configuraciones tanto de SSD como de HDD.

Dado que los entornos ftScalable suelen sustentar aplicaciones críticas en los sectores de servicios financieros, manufactura, servicios públicos y operaciones gubernamentales, incluso las menores disminuciones en el rendimiento del almacenamiento pueden tener consecuencias desproporcionadas. La monitorización especializada es fundamental porque la complejidad del sistema —que abarca múltiples grupos RAID, almacenamiento por niveles y cargas de trabajo con altas tasas de IOPS— genera una amplia variedad de señales que las herramientas estándar de monitorización de servidores podrían no captar con la granularidad necesaria.

P: ¿Cuáles son las métricas de IOPS y rendimiento que es más importante monitorear?

Las operaciones de entrada/salida por segundo (IOPS) y el rendimiento son los principales indicadores del desempeño del almacenamiento. En un entorno ftScalable, las métricas que más conviene monitorear son:

  • Operaciones de E/S de disco por segundo, tanto a nivel de disco individual como de volumen
  • Distribución de IOPS de lectura y escritura: comprender la relación entre lectura y escritura permite identificar los patrones de las cargas de trabajo y ayuda a dimensionar la caché de forma adecuada
  • KB transferidos por segundo: en el puerto del host, el disco virtual y el controlador
  • Aciertos y fallos en la caché de escritura y en la caché de lectura: la eficiencia de la caché es un indicador clave del estado general de las operaciones de E/S
  • Profundidad de la cola: unas profundidades de cola elevadas y prolongadas a nivel del disco o del controlador suelen indicar una saturación antes de que se hagan visibles los picos de latencia

Sightline recopila todas estas métricas en tiempo real a nivel de unidad de disco, volumen, puerto de host, disco virtual y controlador, lo que ofrece a los administradores de almacenamiento una visión completa y unificada de la actividad de E/S en toda la matriz ftScalable.

P: ¿Cómo debo supervisar la latencia del disco en entornos ftScalable?

La latencia del disco es uno de los indicadores más directos del estado del almacenamiento y de la experiencia del usuario. En los sistemas ftScalable, las métricas de latencia relevantes incluyen:

  • Tiempo medio de respuesta: el tiempo total transcurrido desde la solicitud de E/S hasta su finalización
  • Tiempo medio de servicio: el tiempo de procesamiento a nivel de disco, sin tener en cuenta los retrasos en la cola
  • Tiempo medio de espera en la cola: el tiempo que las operaciones de E/S permanecen en espera antes de ser atendidas; los tiempos de espera sostenidos en la cola son un indicador adelantado de la saturación
  • Tiempo de respuesta de lectura frente a escritura: las métricas de latencia separadas para lectura y escritura permiten identificar con mayor precisión la causa raíz

Es fundamental analizar la evolución de estas métricas a lo largo del tiempo, y no limitarse a supervisar los valores puntuales. Un valor de latencia que parezca aceptable por sí solo puede convertirse en una señal de alerta si muestra una tendencia al alza constante. Las capacidades de almacenamiento de datos a lo largo del tiempo y de análisis histórico de Sightline EDM permiten a los equipos distinguir los picos transitorios de las tendencias reales de deterioro.

P: ¿Qué indicadores de estado del RAID deben vigilar los administradores de almacenamiento?

El estado del RAID es el aspecto más importante en la supervisión proactiva del almacenamiento. Los sistemas ftScalable admiten RAID 1, 5, 6 y 10, cada uno con diferentes comportamientos de reconstrucción y umbrales de tolerancia a fallos. Los indicadores críticos que se deben supervisar incluyen:

  • Estado de degradación del disco: una de las primeras señales de que un disco no está rindiendo al máximo y podría estar a punto de fallar
  • Métricas de recuento SMART P1/P2: incluyen el recuento de tiempos de espera de E/S, el recuento de falta de respuesta y el recuento de reintentos de arranque; estos indicadores SMART suelen predecir un fallo días antes de que se produzca
  • Errores relacionados con los medios y errores no relacionados con los medios: cualquier aumento repentino en cualquiera de estas categorías requiere atención inmediata
  • Reasignaciones de bloques y bloques defectuosos: la acumulación de bloques defectuosos se acelera antes de que se produzca un fallo del disco en los soportes giratorios
  • Errores fatales y errores de datos por segundo: incluso las tasas más bajas requieren una investigación en un entorno tolerante a fallos
  • Conmutaciones de recuperación por segundo: una tasa elevada indica que el sistema entra con frecuencia en un estado de recuperación para conciliar datos, lo que suele ser un indicio de un fallo total del grupo de discos

La capacidad de reconstrucción rápida de ftScalable es una ventaja arquitectónica, pero los administradores aún deben saber cuándo se está llevando a cabo una reconstrucción, cuánto tiempo tarda y si el grupo RAID está operando en estado degradado durante ese período. Las herramientas de monitoreo que muestran estas condiciones en tiempo real son esenciales para mantener el objetivo de disponibilidad del 99,999 % para el que estos sistemas han sido diseñados.

P: ¿Cómo se relaciona la supervisión con la planificación de la redundancia?

La planificación de la redundancia no es una actividad puntual, sino una disciplina operativa continua. Los datos históricos de rendimiento de su entorno ftScalable se tienen en cuenta directamente en las decisiones de planificación de la capacidad: cuándo añadir bastidores, cuándo migrar cargas de trabajo de discos obsoletos, cuándo la caché de lectura de los SSD está generando beneficios y cuándo el perfil de carga de trabajo de un grupo RAID se ha desviado de los supuestos de diseño originales.

Las capacidades de análisis predictivo y planificación de la capacidad de ForSight® de Sightline EDM permiten a los equipos de infraestructura pronosticar el crecimiento del almacenamiento, modelar la demanda futura y tomar decisiones fundamentadas sobre la ampliación o la reconfiguración antes de que las limitaciones de capacidad generen problemas de rendimiento.

P: ¿Cómo funcionan los paneles y las alertas de Sightline para la supervisión de ftScalable?

Sightline EDM es una solución de socio certificada para el almacenamiento Stratus ftScalable y recopila datos de rendimiento granulares y en tiempo real en todas las capas de la matriz: unidades de disco, volúmenes, puertos de host, discos virtuales y controladores. Entre las capacidades clave para los administradores de almacenamiento se incluyen:

  • Paneles personalizados con vistas configurables de los datos de rendimiento del almacenamiento, organizados por carga de trabajo, grupo RAID o centro
  • Alertas basadas en umbrales para cualquier métrica supervisada, lo que permite a los equipos anticiparse a los problemas antes de que afecten a las aplicaciones o a los usuarios
  • La correlación y el análisis de causas raíz de Clairvor®, que vincula los eventos de rendimiento del almacenamiento con las métricas de infraestructura relacionadas para agilizar la investigación forense
  • Almacenamiento centralizado de datos que permite el análisis de tendencias históricas y la generación de informes a lo largo del tiempo en entornos con múltiples proveedores, incluido el almacenamiento compatible con SMI-S de otros proveedores
  • Visibilidad global de toda la empresa sobre una infraestructura multiplataforma y multicomponente desde un único panel de control

Stratus comercializa y ofrece soporte técnico para Sightline EDM como solución de un socio autorizado para entornos de almacenamiento ftScalable. Para obtener una lista completa de las estadísticas de discos, las estadísticas de volúmenes y las métricas de controladores recopiladas por Sightline para ftScalable, visite stratus.com o póngase en contacto con su representante de Stratus.

Lo esencial

El almacenamiento ftScalable está diseñado para ofrecer disponibilidad continua, pero la disponibilidad se mantiene, no se da por sentada. Los administradores de almacenamiento y los responsables de infraestructura que supervisan activamente las IOPS, la latencia de los discos, los indicadores de estado del RAID y las tendencias de capacidad son quienes mantienen intacta esa promesa de disponibilidad. Al pasar de “estar atentos a las interrupciones” a “supervisar el estado del sistema”, te aseguras de que la única vez que la gente se fije en el almacenamiento sea cuando les muestres tus informes de tiempo de actividad.

No espere a que un cuello de botella acabe en los titulares. Sightline EDM ofrece visibilidad en tiempo real, un historial detallado y alertas inteligentes para que esa supervisión sea práctica y permita tomar medidas, tanto si gestiona una sola matriz ftScalable como un entorno de almacenamiento de múltiples proveedores a nivel de toda la empresa. Contáctenos hoy mismo para descubrir cómo Sightline puede reforzar su estrategia de supervisión del almacenamiento ftScalable.

Debi Ray

Debi Ray es Directora de Gestión de Productos en Sightline Systems. Con más de 20 años de experiencia en el sector tecnológico, Debi aporta al desarrollo de productos una perspectiva única centrada en el cliente, basada en su amplia experiencia en funciones de cara al cliente y su profundo conocimiento de las necesidades de los usuarios.

En su puesto actual, Debi supervisa la gestión del ciclo de vida del producto para las soluciones de Sightline que abarcan múltiples sectores, incluida la expansión de la empresa a la acuicultura con AQUA Sightline. Trabaja en estrecha colaboración con equipos multifuncionales para traducir los conocimientos del mercado y los comentarios de los clientes en mejoras de los productos que impulsen el valor empresarial y la eficiencia operativa.

La amplia experiencia de Debi en soporte postventa, formación y servicios de consultoría le proporciona una visión muy valiosa de los retos y casos de uso de los clientes en el mundo real. Esta experiencia práctica con implantaciones empresariales ha dado forma a su enfoque de la gestión de productos, garantizando que las nuevas funciones y capacidades respondan a las necesidades reales del mercado. Ha impartido formación y ha realizado presentaciones en conferencias de usuarios y eventos corporativos en todo el mundo, manteniendo estrechas relaciones con la base global de clientes de Sightline.

Su liderazgo estratégico en la gestión de productos combina el análisis de mercado, la inteligencia competitiva y la defensa del cliente para guiar la evolución de los productos de Sightline y apoyar el crecimiento continuo de la empresa en diversos sectores verticales.

Acerca de Sightline Systems

Sightline Systems es una empresa de inteligencia de datos de la Industria 4.0 con sede en Fairfax, Virginia. Durante más de tres décadas, Sightline ha ayudado a las empresas a convertir grandes volúmenes de datos de máquinas y sistemas en inteligencia clara y útil. Su plataforma insignia, Sightline EDM (Enterprise Data Manager), unifica el monitoreo en tiempo real, la detección de anomalías, el análisis de causas raíz y las predicciones basadas en aprendizaje automático en operaciones de TI, el Internet de las Cosas Industrial (IIoT), la manufactura y la acuicultura. Sightline brinda apoyo a empresas y organizaciones de nivel Fortune en más de 15 países y mantiene una tasa de renovación de clientes del 98%.