Écriture fichier
Écrit le flux d'entrée en fichiers vers n'importe quelle connexion storage. Le format est choisi sur la brick : une même connexion peut servir plusieurs formats. Cette brick unifiée remplace les anciennes bricks CSV / JSON / Excel / Parquet / XML Export.
La brick consomme l'entrée in et n'a pas de port de sortie. La connexion se
choisit dans le panneau de configuration, voir
Créer une connexion.
Paramètres communs
| Paramètre | Type | Requis | Description |
|---|---|---|---|
connection_id | String | Oui | Connexion storage utilisée. |
file_format | Enum | Oui | csv, json, excel, parquet, xml, flat (texte brut). |
filename | String | Oui | Nom du fichier de sortie (défaut export). |
overwrite_mode | Enum | Non | overwrite (écraser, défaut), append (compléter si existe), error (échouer si existe). |
output_mode | Enum | Non | single (un fichier, défaut), split_rows, split_size, split_column. |
Découpage en plusieurs fichiers
| Mode | Paramètre | Description |
|---|---|---|
split_rows | split_rows (défaut 10 000) | Un fichier par tranche de N lignes, suffixe _0001, _0002… |
split_size | split_size_mb (défaut 100) | Découpage par taille cible en Mo (approximé par nombre de lignes). |
split_column | split_column_name | Un fichier par valeur distincte de la colonne, suffixée au nom. |
Les options spécifiques au format s'affichent selon le file_format choisi ;
détail par format ci-dessous.
CSV
Écriture via DataFrame.to_csv.
| Paramètre | Défaut | Description |
|---|---|---|
encoding | utf-8 | utf-8, utf-16, latin1, iso-8859-1, cp1252, ascii. |
delimiter | , | Séparateur : virgule, point-virgule, tabulation, pipe ou espace. |
header | true | Écrire la ligne d'en-têtes. |
quotechar | " | Caractère de citation (" ou '). |
decimal | . | Séparateur décimal (. ou ,). |
JSON
Écriture via DataFrame.to_json.
| Paramètre | Défaut | Description |
|---|---|---|
encoding | utf-8 | Encodage du fichier. |
json_orient | records | Orientation : records, index, columns, values, split, table. |
json_lines | false | Format JSON Lines (un objet par ligne). |
Excel
Écriture via DataFrame.to_excel (openpyxl, fichiers .xlsx).
| Paramètre | Défaut | Description |
|---|---|---|
sheet_name | Sheet1 | Nom de la feuille. |
header | true | Écrire la ligne d'en-têtes. |
XML
Écriture via DataFrame.to_xml.
| Paramètre | Défaut | Description |
|---|---|---|
encoding | utf-8 | Encodage du fichier. |
xml_root_name | root | Nom de l'élément racine. |
xml_row_name | row | Nom de l'élément par ligne. |
Parquet
Écriture via DataFrame.to_parquet (pyarrow). Aucun paramètre spécifique : le
schéma est porté par le fichier.
Brut / texte plat
Écrit une ligne de texte par ligne du flux, à partir de la première colonne du DataFrame.
| Paramètre | Défaut | Description |
|---|---|---|
encoding | utf-8 | Encodage du fichier. |
En mode itération
Placée en aval d'une Source fichier en mode itérer, la brick reprend automatiquement le nom du fichier source (en conservant l'extension configurée) : chaque fichier d'entrée produit son fichier de sortie homonyme.
Combinez split_column avec une colonne métier (agence, pays, mois…) pour
produire un fichier par valeur, par exemple export_FR.csv,
export_DE.csv.