View a markdown version of this page

Étapes de la recette de science des données - AWS Glue DataBrew Guide du développeur

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Étapes de la recette de science des données

Utilisez ces étapes de recette pour tabuler et résumer les données sous différents angles, ou pour effectuer des transformations avancées.

SCALE

Redimensionne ou normalise la plage de données d'une colonne numérique.

Parameters
  • sourceColumn : nom d’une colonne existante.

  • strategy— L'opération à appliquer aux valeurs des colonnes :

    • MIN_MAX— Redimensionne les valeurs dans une plage de [0,1]

    • SCALE_BETWEEN— Redimensionne les valeurs dans une plage de 2 valeurs spécifiées.

    • MEAN_NORMALIZATION— Redimensionne les données pour avoir une moyenne (μ) de 0 et un écart type (σ) de 1 dans une plage de [-1, 1]

    • Z_SCORE— Ajustez linéairement les valeurs des données pour qu'elles aient une moyenne (μ) de 0 et un écart type (σ) de 1. Idéal pour gérer les valeurs aberrantes.

  • targetColumn— Le nom de la colonne qui doit contenir les résultats.

Exemple Exemple

{ "Action": { "Operation": "NORMALIZATION", "Parameters": { "sourceColumn": "all_votes", "strategy": "MIN_MAX", "targetColumn": "all_votes_normalized" } } }