Quelles sont les mesures à surveiller dans les systèmes de stockage ftScalable ?

Pour les entreprises qui exécutent des charges de travail critiques dans des environnements ftServer Stratus, la baie de stockage ftScalable est un composant essentiel, conçu pour la tolérance aux pannes, la haute disponibilité et la capacité évolutive. Mais même le matériel le plus fiable nécessite une surveillance active. Savoir quelles mesures suivre, et quand agir en conséquence, est la différence entre une gestion proactive du stockage et une panne imprévue.

Ce billet présente aux administrateurs de stockage et aux responsables d'infrastructure les principaux indicateurs de performance à surveiller dans un environnement ftScalable et explique comment la GED Sightline rend le suivi de ces indicateurs actionnable.

Q : Qu'est-ce que le stockage ftScalable, et pourquoi nécessite-t-il une surveillance particulière ?

La baie de stockage ftScalable Stratus (Pengiun Solutions) est une solution de stockage hybride de nouvelle génération conçue pour compléter les systèmes ftServer. Elle supporte les niveaux RAID 1, 5, 6, 10 et ADAPT sur un maximum de 248 emplacements de disques et peut délivrer jusqu'à 600 000 IOPS, ce qui la rend bien adaptée aux environnements d'applications performants et toujours actifs. Son architecture comprend une hiérarchisation des données en temps réel entre les niveaux de performance, standard et d'archivage, une reconstruction RAID rapide (2 à 5 fois plus rapide que les conceptions de reconstruction standard) et la prise en charge des configurations SSD et HDD.

Les environnements ftScalable étant souvent à la base d'applications critiques dans les services financiers, l'industrie manufacturière, les services publics et les opérations gouvernementales, la moindre dégradation des performances de stockage peut avoir des conséquences considérables. Une surveillance spécialisée est nécessaire car la complexité du système, qui englobe plusieurs groupes RAID, un stockage hiérarchisé et des charges de travail à IOPS élevé, produit un large éventail de signaux que les outils de surveillance de serveur standard ne peuvent pas capturer avec la granularité requise.

Q : Quelles sont les mesures d'IOPS et de débit les plus importantes à suivre ?

Les IOPS (opérations d'entrée/sortie par seconde) et le débit sont les principaux indicateurs de performance du stockage. Dans un environnement ftScalable, les paramètres à suivre de près sont les suivants :

  • Entrées/sorties de disque par seconde - au niveau des disques individuels et des volumes
  • Répartition des IOPS en lecture/écriture - la compréhension du rapport lecture/écriture révèle les modèles de charge de travail et permet de dimensionner le cache de manière appropriée.
  • Octets transférés par seconde - au niveau du port hôte, du disque virtuel et du contrôleur
  • Les hits/misses du cache d'écriture et les hits/misses du cache de lecture - l'efficacité du cache est un indicateur majeur de la santé globale des E/S.
  • Profondeur de la file d'attente - une profondeur de file d'attente élevée au niveau du disque ou du contrôleur signale souvent une saturation avant que les pics de latence ne deviennent visibles.

Sightline collecte toutes ces mesures en temps réel au niveau de l'unité de disque, du volume, du port hôte, du disque virtuel et du contrôleur, offrant ainsi aux administrateurs de stockage une vue complète et unifiée de l'activité E/S sur l'ensemble de la baie ftScalable.

Q : Comment dois-je surveiller la latence des disques dans les environnements ftScalable ?

La latence des disques est l'une des mesures les plus directes de la santé du stockage et de l'expérience de l'utilisateur. Dans les systèmes ftScalable, les mesures de latence pertinentes incluent :

  • Temps de réponse moyen - temps total écoulé entre la demande d'E/S et sa réalisation
  • Temps de service moyen - temps de traitement au niveau du disque, isolé des délais d'attente.
  • Temps d'attente moyen - temps d'attente des E/S avant d'être traitées ; des temps d'attente soutenus sont un indicateur avancé de saturation.
  • Temps de réponse en lecture et en écriture - des mesures séparées de la latence en lecture et en écriture permettent d'identifier plus précisément les causes profondes.

Il est essentiel de suivre l'évolution de ces paramètres dans le temps, et pas seulement de surveiller des valeurs ponctuelles. Un chiffre de latence qui semble acceptable pris isolément peut constituer un signal d'alarme lorsqu'il représente une tendance constante à la hausse. Les capacités de stockage et d'analyse historique des données de Sightline EDM permettent aux équipes de distinguer les pics transitoires des véritables tendances à la dégradation.

Q : Quels sont les indicateurs de santé du RAID que les administrateurs de stockage doivent surveiller ?

Les systèmes ftScalable supportent les RAID 1, 5, 6 et 10, chacun avec des comportements de reconstruction et des seuils de tolérance aux pannes différents. Les indicateurs critiques à suivre sont les suivants

  • État de dégradation du disque - l'un des premiers signaux indiquant qu'un disque ne fonctionne pas bien et qu'il est peut-être sur le point de tomber en panne.
  • Mesures SMART P1/P2 - y compris le nombre de temps d'attente E/S, le nombre de non-réponses et le nombre de tentatives d'essorage ; ces indicateurs SMART permettent souvent de prédire les défaillances plusieurs jours avant qu'elles ne se produisent.
  • Erreurs médiatiques et erreurs non médiatiques - une augmentation soudaine de l'une ou l'autre catégorie justifie une attention immédiate.
  • Réaffectation des blocs et blocs défectueux - l'accumulation de blocs défectueux s'accélère avant la défaillance d'un disque sur un support rotatif.
  • Erreurs fatales et erreurs de données par seconde - même les taux les plus bas nécessitent une investigation dans un environnement tolérant aux pannes
  • Commutations de récupération par seconde - un taux élevé indique que le système entre fréquemment dans un état de récupération pour réconcilier les données, ce qui est souvent le signe précurseur d'une défaillance totale d'un groupe de disques.

La capacité de reconstruction rapide de ftScalable est un avantage architectural, mais les administrateurs ont toujours besoin de savoir quand une reconstruction se produit, combien de temps elle prend, et si le groupe RAID fonctionne dans un état dégradé pendant cette période. Les outils de surveillance qui font apparaître ces conditions en temps réel sont essentiels pour maintenir l'objectif de disponibilité de cinq neuf que ces systèmes sont censés offrir.

Q : Comment la surveillance est-elle liée à la planification de la redondance ?

La planification de la redondance n'est pas une activité ponctuelle, c'est une discipline opérationnelle permanente. Les données historiques de performance de votre environnement ftScalable alimentent directement les décisions de planification de la capacité : quand ajouter des étagères, quand migrer les charges de travail des broches vieillissantes, quand le cache de lecture SSD fournit des rendements, et quand le profil de la charge de travail d'un groupe RAID s'est éloigné de ses hypothèses de conception initiales.

Les capacités d'analyse prédictive et de planification de la capacité ForSight® de Sightline EDM permettent aux équipes d'infrastructure de prévoir la croissance du stockage, de modéliser la demande future et de prendre des décisions fondées sur des preuves concernant l'expansion ou la reconfiguration avant que les contraintes de capacité n'entraînent des problèmes de performance.

Q : Comment les tableaux de bord et les alertes de Sightline fonctionnent-ils pour le monitoring ftScalable ?

Ligne de mire EDM est une solution partenaire certifiée pour le stockage Stratus ftScalable et collecte des données de performance granulaires en temps réel à travers toutes les couches de la baie : unités de disques, volumes, ports hôtes, disques virtuels et contrôleurs. Les principales fonctionnalités pour les administrateurs de stockage sont les suivantes

  • Tableaux de bord personnalisés avec des vues configurables des données de performance du stockage, organisées par charge de travail, groupe RAID ou installation.
  • Des alertes basées sur des seuils pour toutes les mesures suivies, permettant aux équipes d'anticiper les problèmes avant qu'ils n'aient un impact sur les applications ou les utilisateurs.
  • La corrélation et l'analyse des causes profondes Clairvor®, qui relie les événements de performance de stockage aux mesures d'infrastructure connexes pour accélérer les enquêtes judiciaires.
  • Stockage centralisé des données permettant l'analyse des tendances historiques et l'établissement de rapports à long terme dans des environnements multifournisseurs, y compris le stockage conforme à la norme SMI-S d'autres fournisseurs.
  • Visibilité à l'échelle de l'entreprise de l'infrastructure multiplateforme et multicomposant dans un seul et même panneau de verre

Sightline EDM est vendu et pris en charge par Stratus en tant que solution partenaire autorisée pour les environnements de stockage ftScalable. Pour une liste complète des statistiques de disques, de volumes et de contrôleurs capturées par Sightline pour ftScalable, visitez le site stratus.com ou contactez votre représentant Stratus.

Le bilan

Le stockage ftScalable est conçu pour une disponibilité continue, mais la disponibilité est maintenue, pas supposée. Les administrateurs du stockage et les responsables de l'infrastructure qui surveillent activement les IOPS, la latence des disques, les indicateurs de santé des RAID et les tendances en matière de capacité sont ceux qui maintiennent intacte cette promesse de disponibilité. En passant de la surveillance des interruptions à la surveillance de la santé, vous vous assurez que la seule fois où les gens remarquent le stockage, c'est lorsque vous présentez vos rapports sur le temps de fonctionnement.

N'attendez pas qu'un goulot d'étranglement fasse la une des journaux. Sightline EDM offre une visibilité en temps réel, une profondeur historique et une intelligence d'alerte qui rendent cette surveillance pratique et exploitable, que vous gériez une seule baie ftScalable ou un environnement de stockage multifournisseur à l'échelle de l'entreprise. Contactez-nous dès aujourd'hui pour découvrir comment Sightline peut renforcer votre stratégie de surveillance du stockage ftScalable.

Debi Ray

Debi Ray est directrice de la gestion des produits chez Sightline Systems. Avec plus de 20 ans d'expérience dans le secteur technologique, Debi apporte au développement des produits une perspective unique centrée sur le client, nourrie par sa vaste expérience dans des fonctions en contact avec la clientèle et par sa profonde compréhension des besoins des utilisateurs.

Dans son rôle actuel, Debi supervise la gestion du cycle de vie des produits pour les solutions de Sightline couvrant plusieurs industries, y compris l'expansion de l'entreprise dans l'aquaculture avec AQUA Sightline. Elle travaille en étroite collaboration avec des équipes interfonctionnelles pour traduire les idées du marché et les commentaires des clients en améliorations de produits qui génèrent de la valeur commerciale et de l'efficacité opérationnelle.

L'expérience complète de Debi en matière d'assistance après-vente, de formation et de services de conseil lui permet d'acquérir une connaissance inestimable des défis et des cas d'utilisation des clients dans le monde réel. Cette expérience pratique de la mise en œuvre en entreprise a façonné son approche de la gestion des produits, en veillant à ce que les nouvelles fonctionnalités et capacités répondent aux besoins réels du marché. Elle a assuré des formations et des présentations lors de conférences d'utilisateurs et d'événements d'entreprise dans le monde entier, entretenant ainsi des liens étroits avec la clientèle mondiale de Sightline.

Son leadership stratégique dans la gestion des produits combine l'analyse du marché, la veille concurrentielle et la défense des intérêts des clients pour guider l'évolution des produits de Sightline et soutenir la croissance continue de l'entreprise dans divers secteurs verticaux.

À propos de Sightline Systems

Sightline Systems est une entreprise spécialisée dans l'intelligence des données dans le cadre de l'Industrie 4.0, dont le siège social est situé à Fairfax, en Virginie. Depuis plus de trois décennies, Sightline aide les entreprises à transformer de grands volumes de données issues de machines et de systèmes en informations claires et exploitables. Sa plateforme phare, Sightline EDM (Enterprise Data Manager), regroupe la surveillance en temps réel, la détection des anomalies, l’analyse des causes profondes et les prévisions basées sur l’apprentissage automatique dans les domaines de l’informatique, de l’Internet des objets industriel (IIoT), de la fabrication et de l’aquaculture. Sightline accompagne des entreprises et des organisations du classement Fortune dans plus de 15 pays et affiche un taux de renouvellement de ses contrats de 98%.