Aperçu
Points clés
- L’informatique élastique met à l’échelle dynamique le calcul, la mémoire et le stockage selon les fluctuations de la demande, supprimant ainsi l’intervention administrative manuelle.
- La suppression des ressources inactives lorsque la demande diminue est aussi cruciale que la montée en puissance ; l’efficacité de la réduction de l’échelle dicte directement les économies de coûts dans le cloud.
- « Calcul élastique » et « élasticité cloud » font référence à la même capacité opérationnelle et sont utilisés de manière interchangeable dans l’architecture cloud d’entreprise.
- L’élasticité offre un ROI maximal pour les charges IA/analytiques rapides, saisonnières et ad hoc. Les charges de travail de reporting continues et en état stable bénéficient bien moins.
- Sans limites strictes de mise à l’échelle, télémétrie en temps réel et attribution des coûts au niveau des départements, l’auto-mise en valeur dynamique peut générer des dépenses opérationnelles non gérées.
Calcul élastique, défini
La planification traditionnelle de la capacité d’entreprise repose sur des prévisions statiques : les équipes d’infrastructure estiment les besoins en ressources de pointe, achètent du matériel physique ou des instances réservées pour couvrir ce pic, et absorbent le coût financier de la capacité inactive pendant les périodes hors pointe.
L’informatique élastique remplace la prévision statique par une boucle de rétroaction opérationnelle continue. La plateforme cloud surveille la télémétrie active des charges de travail et fournit ou déprovisionne dynamiquement les ressources en temps réel.
Deux attributs déterminants séparent l’informatique élastique authentique de l’infrastructure réservée statique.
- Automatisation : Les ajustements des ressources se font de manière programmatique en fonction des déclencheurs d’utilisation en temps réel, sans nécessiter aucune intervention humaine.
- Bidirectionnalité : La capacité se contracte automatiquement lorsque la concurrence des requêtes diminue, réduisant directement les coûts variables de l’infrastructure cloud.
Dans le cloud data warehousing, les data lakehouses et l’analytique d’entreprise, cette propriété architecturale est également appelée élasticité cloud. Les deux termes décrivent le mécanisme sous-jacent de l’adaptation de l’offre de calcul à la demande de traitement en temps réel.
Fonctionnement de l’informatique élastique
Ce qui évolue réellement
Dans les plateformes de données d’entreprise et les architectures d’IA, l’élasticité s’étend sur trois couches d’infrastructure distinctes — chacune s’ajustant à des vitesses différentes.
- Calcul : Capacité de traitement provisionnée via des nœuds virtuels isolés ou des clusters d’exécution. Le calcul est la couche la plus rapide à ajuster et sert de cadran principal pour gérer les pics de charge de travail.
- Mémoire : Mise à l’échelle avec les instances de calcul, la RAM système est fréquemment le goulot d’étranglement opérationnel pour les jointures analytiques complexes, les recherches vectorielles à haute concurrence et les algorithmes d’apprentissage automatique distribué.
- Stockage : Les architectures de données cloud modernes découplent le calcul du stockage, en tirant parti des niveaux de stockage d’objets partagés. Cette séparation permet aux ressources de calcul de s’étendre et de se contracter dynamiquement sans repartitionner ni déplacer physiquement les ensembles de données sous-jacents au sein de la base de données Teradata.
Qu’est-ce qui déclenche un événement de mise à l’échelle
Les actions de mise à l’échelle sont régies par des moteurs de surveillance au niveau du système qui suivent les indicateurs opérationnels par rapport à des seuils de politique prédéfinis. Les déclencheurs opérationnels courants incluent :
- Utilisation soutenue du CPU ou du nœud dépassant les limites définies (par exemple, une utilisation de 85 % sur une fenêtre de trois minutes).
- Augmentation des profondeurs de file d’attente de requête ou des limites de concurrence lors de pics de trafic inattendus.
- Des pics dans les pipelines d’ingestion de données en streaming ou les requêtes API en temps réel.
- Un système de notation de modèles à haute concorrence, l’ingénierie des fonctionnalités ou les flux de travail agents initiés via les capacités d’analyse intégrées à la base de données Teradata.
Les plateformes d’entreprise permettent aux administrateurs système de définir des seuils limites supérieurs et inférieurs explicites, garantissant ainsi que l’auto-mise à l’échelle fonctionne strictement dans des paramètres pré-approuvés.
La réduction de la taille est la partie la plus difficile
L’expansion de la capacité lors d’une poussée de demande est simple ; la contraction est là où le ROI économique cloud est gagné ou perdu. Si les nœuds de calcul se déprovisionnent de manière trop agressive, les rafales de requête suivantes rencontrent une latence de démarrage à froid. Si les nœuds restent provisionnés longtemps après l’exécution terminée, les économies anticipées sur les coûts cloud disparaissent rapidement.
Avec 84 % des dirigeants dirigeants citant la gestion des dépenses cloud comme un obstacle opérationnel principal, des politiques efficaces de démantèlement des nœuds sont essentielles. Pour une vue d’ensemble opérationnelle approfondie du provisionnement des instances, du démantèlement des nœuds et de l’isolation des charges de travail, consultez la documentation About Teradata Elastic Compute .
Un exemple pratique de calcul élastique
Considérez une organisation de distribution mondiale exécutant des analyses d’entreprise dimensionnées pour les volumes transactionnels quotidiens. Lors d’un événement promotionnel annuel, le trafic utilisateur simultané explose de dix fois alors que les équipes de la chaîne d’approvisionnement, du marketing, des stocks et de l’expérience client exécutent simultanément des requêtes analytiques ad hoc. Parallèlement, les modèles automatisés de recommandation s’exécutent en continu plutôt que par lots nocturnes hors pointe.
Sans informatique élastique, l’entreprise fait face à deux choix coûteux.
- Surapprovisionnement : Dimensionner de façon permanente l’infrastructure pour le volume promotionnel de pointe laisse jusqu’à 70 % de la capacité de calcul inactive pendant les semaines ouvrables standard.
- Sous-provision : Dimensionner l’infrastructure en fonction de la demande quotidienne médiane entraîne des délais d’attente dans les files d’attente des requêtes, une dégradation des performances du portail et une perte potentielle de revenus pendant les heures de pointe promotionnelles.
Cependant, avec une architecture cloud élastique, les clusters de calcul indépendants s’étendent automatiquement à l’extérieur à mesure que la concurrence des requêtes augmente, maintiennent le débit pendant les heures de pointe et se terminent automatiquement lorsque le trafic se normalise. L’entreprise paie pour une capacité de calcul accrue strictement pendant les heures d’activité actives.
Élasticité et évolutivité ne sont pas la même chose
Bien que souvent utilisés de façon synonyme, la scalabilité et l’élasticité répondent à des objectifs d’ingénierie fondamentalement différents :
| Dimension des caractéristiques | Évolutivité | Élasticité |
|---|---|---|
| Focus principal | La capacité structurelle maximale à gérer une croissance cumulative de la charge de travail au fil du temps. | La vitesse en temps réel et l’automatisation de l’expansion et de la contraction des ressources. |
| Modèle d’ajustement | Augmenter la capacité (verticalement via du matériel plus gros ou horizontalement via des nœuds supplémentaires). | Provisionnement automatique dynamique basé sur les politiques et déprovisionnement automatique. |
| Objectif opérationnel | Soutenir une expansion prévisible et à long terme des volumes d’affaires et de données. | Des pics de demande à court terme et fluctuants correspondants sans payer trop cher pour du matériel inactif. |
| Vitesse de provisionnement | De quelques minutes à plusieurs jours (souvent impliquant un provisionnement manuel administratif ou un approvisionnement). | Des secondes à des minutes (pilotées automatiquement par les déclencheurs de télémétrie du système). |
Un système peut être très évolutif sans être élastique. Les entrepôts de données sur site s’étendent souvent à des pétaoctets de stockage, mais augmenter la capacité de calcul nécessite l’acquisition matérielle et une installation permanente.
Pour une analyse comparative complète, lisez notre guide détaillé sur l’élasticité du cloud vs. la scalabilité du cloud.
Où l’informatique élastique rapporte
- Charges de travail explosives et imprévisibles : Lorsque les applications subissent une variation substantielle entre la demande de ressources de base et la demande de pointe, les organisations peuvent constater des retours financiers immédiats en mettant en œuvre une allocation de calcul à la demande.
- Science des données, IA et entraînement de modèles : L’entraînement de modèles d’apprentissage automatique, l’exécution de recherches vectorielles par génération augmentée par récupération (RAG) et l’exécution d’exploration ad hoc de la data science nécessitent un calcul massif pendant des durées limitées. Les clusters de calcul élastiques permettent aux équipes de lancer des nœuds dédiés pour exécution et de les désactiver immédiatement après leur achèvement.
- Traitement saisonnier et événementiel : Les clôtures financières mensuelles, les dépôts réglementaires trimestriels et les ventes promotionnelles au détail créent des pics prévisibles, mieux servis par une allocation dynamique que par une expansion matérielle permanente. Ces tendances sont déjà documentées dans les chiffres de l’année dernière, ce qui en fait les cas d’élasticité les plus faciles à justifier.
Considérations d’entreprise
Prévisibilité des coûts et garde-fous
Des recherches récentes des entreprises indiquent que 29 % des dépenses en infrastructure cloud publique sont perdues au profit du gaspillage — principalement causé par une mise à l’échelle non gérée et des environnements de développement inactifs. Pour maintenir la prévisibilité budgétaire, les équipes FinOps doivent appliquer des garde-fous clairs à l’infrastructure : les modèles de tarification cloud basés sur la consommation rendent ces dépenses visibles, et une estimation des coûts au niveau de la charge de travail montre ce que coûte réellement un mélange avant d’être provisionné.
Considérez ces garde-fous d’infrastructure.
- Plages d’échelle définies : Configuration de limites supérieures et inférieures strictes pour la création automatique d’instances afin d’éviter des dépenses de calcul incontrôlées lors d’anomalies de requête.
- Télémétrie et alertes en temps réel : Enregistrer les événements de mise à l’échelle pour offrir aux administrateurs de plateforme une visibilité instantanée sur les raisons pour lesquelles les extensions de ressources sont déclenchées.
- Attribution des coûts et mise en démonstration : Étiquetter les instances de calcul dynamique par département, projet ou unité métier afin de faire respecter la responsabilité financière.
Gouvernance et contrôle d’accès
L’auto-scaling non gouverné crée des risques opérationnels et de sécurité. Les déploiements cloud d’entreprise doivent imposer un contrôle d’accès basé sur les rôles (RBAC), garantir que les politiques de chiffrement des données s’étendent automatiquement à travers les clusters de calcul dynamique, et enregistrer tous les événements de mise à l’échelle pour l’audit de conformité.
Quand l’élasticité est la mauvaise réponse
L’informatique élastique n’est pas une solution universelle pour tous les profils de charge de travail d’entreprise et peut ne pas avoir de sens dans ces situations.
- Traitement de base prévisible : Les requêtes de base d’entrepôt de données d’entreprise fonctionnant à une utilisation constante et élevée fonctionnent bien plus économiquement sur une capacité de calcul dédiée et réservée.
- SLAs à latence ultra-basse : Les charges de travail incapables de tolérer la latence d’initialisation brève nécessaire pour lancer de nouveaux nœuds de calcul nécessitent une infrastructure préallouée et toujours activée.
- Goulots d’étranglement liés au stockage ou aux E/S : Ajouter des clusters de calcul à une application limitée par le débit réseau ou les entrées/sorties disques de stockage n’améliorera pas la vitesse d’exécution.
Pour évaluer les compromis structurels entre une infrastructure de base dédiée et le calcul dynamique, explorez notre analyse de The Always-On Reality.
Calcul élastique sur Teradata
Les architectures modernes de données d’entreprise doivent soutenir les rapports métier en régime stable parallèlement à des analyses imprévisibles et à forte concurrence concurrente. Teradata Cloud unifie les deux modèles de calcul sous un seul cadre de gestion des charges de travail :

- Calcul actif Teradata : Fournit des nœuds de calcul dédiés et toujours actifs pour un entrepôt de données d’entreprise prévisible, des rapports opérationnels et des tableaux de bord core à des taux stables.
- Calcul élastique Teradata : Fournit une mise à l’échelle dynamique et à la demande de clusters de calcul pour la science des données exploratoire, l’analyse départementale ad hoc et l’exécution de modèles IA. Ces clusters isolés évoluent indépendamment du stockage d’objets sous-jacent (y compris les formats de table ouverte tels qu’Iceberg et Delta) et se déprovisionnent automatiquement à la fin des charges de travail.
En coordonnant le calcul actif et le calcul élastique sous une gestion unifiée de la charge de travail, les organisations éliminent la contention des ressources, maintiennent des limites strictes de coûts et alimentent l’analytique continue sans surprovisionner l’infrastructure.
La même gestion de la charge de travail s’applique partout où la plateforme est déployée sur AWS, Microsoft Azure et Google Cloud.
Conclusion
L’informatique élastique a redéfini la manière dont les entreprises modernes architectent et paient pour l’analytique cloud. En adaptant dynamiquement l’offre de calcul à la demande de traitement en temps réel, les organisations éliminent le besoin de surapprovisionner des infrastructures coûteuses pour de brèves pics d’utilisation. Cependant, saisir les véritables avantages financiers de l’élasticité cloud nécessite une gouvernance opérationnelle délibérée. Sans limites strictes de mise à l’échelle, de télémétrie en temps réel et d’attribution claire des coûts, les capacités d’auto-mise en valeur peuvent rapidement aggraver le gaspillage des dépenses cloud.
Les stratégies de données d’entreprise les plus efficaces combinent une mise à l’échelle élastique avec un calcul de base dédié, garantissant que les analyses rapides et les charges de travail d’IA évoluent à la demande tandis que les rapports en régime permanent s’exécutent de manière prévisible à une efficacité maximale des coûts efficaces.
Prêt à optimiser votre architecture de données cloud ?
Construire une base de données évolutive et contrôlée par les coûts
Découvrez comment équilibrer des charges de travail d’entreprise prévisibles avec une mise à l’échelle dynamique à la demande sur la plateforme Teradata Autonomous Knowledge. Explorez Teradata Cloud ou consultez la documentation About Teradata Elastic Compute pour construire une infrastructure de données hautement évolutive et contrôlée par les coûts.
Questions fréquemment posées
Quel est un exemple d’informatique élastique ?
Quel est un exemple d’informatique élastique ?
Un exemple clair est une plateforme de données de détail qui fournit automatiquement des clusters de calcul supplémentaires lorsque le volume de requêtes augmente lors des événements promotionnels de pointe, puis déprovisionne ces clusters lorsque la demande se normalise — garantissant que l’entreprise ne paie que pour les heures de calcul actives.
Que voulez-vous dire par calcul élastique ?
Que voulez-vous dire par calcul élastique ?
L’informatique élastique désigne les capacités des plateformes cloud qui provisionnent et déprovisionnent automatiquement en temps réel les ressources de calcul, mémoire et stockage en fonction de la demande opérationnelle fluctuante.
Quelle est la différence entre élasticité et évolutivité ?
Quelle est la différence entre élasticité et évolutivité ?
La scalabilité est la capacité structurelle maximale d’un système à gérer une croissance à long terme en ajoutant des ressources au fil du temps. L’élasticité est la capacité d’un système à augmenter et réduire automatiquement sa capacité en temps réel pour répondre à la demande fluctuante.
L’informatique élastique est-elle la même chose que l’élasticité du cloud ?
L’informatique élastique est-elle la même chose que l’élasticité du cloud ?
Oui. Dans l’architecture cloud d’entreprise, l’ingénierie des données et les opérations fin-ops, « calcul élastique » et « élasticité cloud » sont des termes synonymes utilisés pour décrire l’échelle automatisée du calcul.