View a markdown version of this page

Connessione ai dati in un file di testo con DataBrew - AWS Glue DataBrew Guida per gli sviluppatori

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Connessione ai dati in un file di testo con DataBrew

È possibile configurare le seguenti opzioni di formato per i file di input DataBrew supportati:

  • Comma-separated file di valore (CSV)

    • delimitatori

      Il delimitatore predefinito è una virgola per i file.csv. Se il file utilizza un delimitatore diverso, scegli il delimitatore per il delimitatore CSV nella sezione Configurazioni aggiuntive quando crei il set di dati. I seguenti delimitatori sono supportati per i file.csv:

      • Virgola (,)

      • Due punti (:)

      • Semi-colon (;)

      • Barra verticale (|)

      • Tabulazione (\t)

      • Cursore (^)

      • Barra rovesciata (\)

      • Spazio

    • Valori dell'intestazione delle colonne

      Il file CSV può includere una riga di intestazione come prima riga del file. In caso contrario, DataBrew crea automaticamente una riga di intestazione.

      • Se il file CSV include una riga di intestazione, scegli Tratta la prima riga come intestazione. In tal caso, la prima riga del file CSV viene considerata come contenente i valori dell'intestazione della colonna.

      • Se il file CSV non include una riga di intestazione, scegli Aggiungi intestazione predefinita. In tal caso, DataBrew crea una riga di intestazione per il file e non considera la prima riga di dati come contenente valori di intestazione. Le intestazioni DataBrew create sono costituite da un carattere di sottolineatura e da un numero per ogni colonna del file, nel formato Column_1 e così Column_2 viaColumn_3.

  • File JSON

    DataBrew supporta due formati per i file JSON, JSON Lines e il documento JSON. I file JSON Lines contengono una riga per riga. Nei file di documento JSON, tutte le righe sono contenute in un'unica struttura JSON o in un array. Puoi specificare il tipo di file JSON nella sezione Configurazioni aggiuntive quando crei un set di dati JSON. Il formato predefinito è JSON Lines.

  • File Excel

    Quanto segue si applica ai fogli Excel in DataBrew:

    • Caricamento di fogli Excel

      Per impostazione predefinita, DataBrew carica il primo foglio del file Excel. Tuttavia, è possibile specificare un numero di foglio o un nome di foglio diverso nella sezione Configurazioni aggiuntive quando si crea un set di dati Excel.

    • Valori di intestazione delle colonne

      I tuoi fogli Excel possono includere una riga di intestazione come prima riga del file, ma in caso contrario, DataBrew creerà automaticamente una riga di intestazione.

      • Se i tuoi fogli Excel includono una riga di intestazione, scegli Considera la prima riga come intestazione. In tal caso, la prima riga dei fogli Excel viene considerata come contenente i valori dell'intestazione della colonna.

      • Se il file Excel non include una riga di intestazione, scegli Aggiungi intestazione predefinita. In questo modo, specifichi che DataBrew deve creare una riga di intestazione per il file e non trattare la prima riga di dati come contenente valori di intestazione. Le intestazioni DataBrew create sono costituite da un carattere di sottolineatura e da un numero per ogni colonna del file, nel formato Column_1 e così Column_2 viaColumn_3.