La sortie File (Fichier) écrit des jeux de données d’un pipeline de données dans un fichier CSV, GeoJSON ou Apache Parquet dans votre contenu. Vous pouvez créer un nouveau fichier ou remplacer un fichier existant.
Paramètres
Le tableau suivant décrit les paramètres utilisés dans la sortie File (Fichier) :
| Paramètre | Description |
|---|---|
Jeu de données en entrée | Jeu de données à écrire sous forme de fichier. |
Méthode de génération de la sortie | Indique la méthode permettant d’écrire les résultats en sortie. Les options sont Create (Créer) (par défaut) et Overwrite (Remplacer). |
Format de fichier | Format du fichier qui sera écrit. Les options sont CSV, GeoJSON et Apache Parquet. |
Champ de géométrie | Champ de géométrie qui sera représenté dans le fichier GeoJSON obtenu. Ce paramètre n’est pas disponible pour les formats de fichier CSV et Apache Parquet. |
Format géospatial | Format géospatial utilisé pour écrire un fichier Apache Parquet en sortie. Actuellement, la seule option est GeoParquet 1.1. Ce paramètre n’est pas disponible pour les formats de fichier CSV et GeoJSON. |
Champ de géométrie principale | Champ de géométrie principale utilisé pour écrire un fichier Apache Parquet en sortie. Un champ de géométrie principale est requis pour les spécifications GeoParquet 1.1. Ce paramètre n’est pas disponible pour les formats de fichier CSV et GeoJSON. |
Titre | Titre de l’élément de fichier en sortie. |
Remplacer si l’élément existe déjà | Indique si un élément existant portant le nom en sortie spécifié doit être remplacé (coché). Le remplacement est activé par défaut. |
Dossier | Dossier en sortie dans lequel le fichier sera enregistré. |
Élément de fichier | Fichier existant à remplacer à la prochaine exécution du pipeline de données. Cette option est disponible uniquement si le paramètre Output method (Méthode de génération de la sortie) est défini sur Overwrite (Remplacer). |
Remarques sur l’utilisation
Pour exécuter un pipeline de données, au moins une sortie doit être configurée.
Utilisez le paramètre Input dataset (Jeu de données en entrée) pour identifier le jeu de données à écrire sous forme de fichier.
Utilisez le paramètre Output method (Méthode de génération de la sortie) pour spécifier la manière dont les résultats du pipeline de données seront écrits. Les options sont les suivantes :
- Create (Créer) : un nouveau fichier sera créé dans votre contenu. Si vous le souhaitez, vous pouvez utiliser le paramètre Overwrite if item already exists (Remplacer si l’élément existe déjà) pour remplacer le fichier à chaque fois que le pipeline de données est exécuté.
- Overwrite (Remplacer) : si le fichier existe, il est intégralement remplacé.
Les paramètres suivants sont disponibles lorsque la méthode de génération de la sortie Create (Créer) est sélectionnée :
- Le paramètre File format (Format de fichier) détermine le type de fichier à écrire. Les options sont CSV, GeoJSON et Apache Parquet.
- Le paramètre Geometry field (Champ de géométrie) est disponible uniquement pour les formats de fichier GeoJSON et est utilisé pour déterminer la géométrie du fichier GeoJSON obtenu. Les fichiers GeoJSON prennent en charge uniquement le système de coordonnées WGS84 (4326). Si le champ de géométrie utilise un système de coordonnées autre que WGS84 (4326), il est projeté automatiquement avant l’écriture des données.
- Le paramètre Primary geometry field (Champ de géométrie principale) détermine quel champ de géométrie utiliser lors de l’écriture d’un fichier Apache Parquet. Ce paramètre est disponible uniquement pour les formats de fichier Apache Parquet et est requis par les spécifications GeoParquet 1.1. Actuellement, GeoParquet 1.1 est la seule option prise en charge pour le paramètre Geospatial format (Format géospatial).
- Le paramètre Title (Titre) spécifie le nom de l’élément à créer ou remplacer.
- Le paramètre Overwrite if item already exists (Remplacer si l’élément existe déjà) vous permet de réexécuter le pipeline de données sans modifier le nom en sortie. Cette opération remplace intégralement un fichier portant le titre spécifié et stocké dans le dossier spécifié. Ce paramètre est activé par défaut.
- Le paramètre Folder (Dossier) détermine dans quel dossier le résultat nouvellement créé doit être stocké ou dans quel dossier l’élément à remplacer est actuellement stocké.
Lorsque la méthode de génération de la sortie Overwrite (Remplacer) est sélectionnée, le paramètre File item (Élément de fichier) est disponible. Utilisez ce paramètre pour accéder à l’élément à remplacer et le sélectionner. Vous pouvez remplacer des éléments qui vous appartiennent ou des éléments qui ont été partagés avec vous dans un groupe de mise à jour partagée. Si l’élément sélectionné est de type GeoJSON ou Apache Parquet, un paramètre de champ de géométrie est disponible pour spécifier quelle géométrie du jeu de données en entrée sera utilisée lors du remplacement du fichier existant.
Pour planifier des mises à jour automatisées des fichiers, il est recommandé d’utiliser la méthode de génération de la sortie Overwrite (Remplacer) au lieu de l’option Overwrite if item already exists (Remplacer si l’élément existe déjà).
Pour modifier les propriétés de l’élément, comme le résumé ou les balises, accédez à la page de contenu de votre portail et mettez à jour l’élément directement.
En savoir plus sur les détails des éléments dans ArcGIS Online
Limitations
Les limitations connues de la sortie File (Fichier) sont les suivantes :
- Les sorties de fichier au format CSV sont toujours tabulaires. Pour stocker les représentations de chaîne d’une géométrie dans un fichier CSV, utilisez l’outil Mettre à jour les champs pour convertir le champ de géométrie en chaîne. Pour supprimer des champs de géométrie dans un jeu de données avant de l’écrire dans un fichier CSV, utilisez l’outil Sélectionner des champs.
- Les sorties de fichier au format GeoJSON requièrent une géométrie et stockent toujours les géométries dans le système de coordonnées WGS84 (4326) pour se conformer aux spécifications GeoJSON officielles. Si le champ de géométrie utilise un système de coordonnées autre que WGS84 (4326), il est projeté automatiquement avant l’écriture de l’élément. Si le système de coordonnées est une chaîne WKT personnalisée, sa transformation en système de coordonnées WGS1984 (4326) peut échouer. Utilisez la sortie Feature layer (Couche d’entités) à la place.
- Les sorties de fichier au format Apache Parquet stockent toujours la géométrie dans une colonne binaire. Certains systèmes de coordonnées personnalisés (WKT) ne sont pas pris en charge par les sorties de fichier au format Apache Parquet et l’écriture du fichier peut échouer. Utilisez la sortie Feature layer (Couche d’entités) à la place.
- Les opérations de remplacement ne sont pas annulées lorsque l’écriture échoue, ce qui peut entraîner la perte de l’élément jusqu’à la prochaine exécution du pipeline de données.
- Les types de champ pris en charge à partir des sources en entrée ne sont pas tous conservés lors de l’écriture des résultats dans des fichiers. Les types de champ sont convertis automatiquement en vue de leur compatibilité avec le format de fichier sélectionné.
- Vous ne pouvez pas utiliser l’option Overwrite (Remplacer) pour les fichiers qui ne vous appartiennent pas sauf si vous êtes un administrateur ou si le fichier est partagé dans un groupe de mise à jour partagée dont vous êtes membre.
- Lorsque vous utilisez une combinaison des options de génération de la sortie Create (Créer) et Overwrite if item already exists (Remplacer si l’élément existe déjà), les limitations suivantes s’appliquent :
- Cette option n’est pas recommandée pour les exécutions planifiées ou automatisées. Pour des mises à jour planifiées des fichiers plus fiables, utilisez la méthode de génération de la sortie Overwrite (Remplacer) et accédez explicitement à la valeur File item (Élément de fichier) à remplacer.
- L’élément à remplacer doit vous appartenir et être stocké dans le dossier spécifié. Si le fichier porte le même nom dans un autre dossier, il n’est pas remplacé.
- Les opérations de remplacement ne sont pas annulées lorsque l’écriture échoue, ce qui peut entraîner la perte de l’élément jusqu’à la prochaine exécution du pipeline de données.
Licences requises
Les licences et configurations suivantes sont requises :
- Type d’utilisateur Creator ou Professional
- Rôle d’éditeur, de facilitateur ou d’administrateur, ou rôle personnalisé équivalent
Afin d’en savoir plus sur la configuration requise pour Data Pipelines, reportez-vous à la rubrique Conditions requises.
Rubriques connexes
Pour des informations supplémentaires, consultez les rubriques suivantes :
- Pour apprendre à mettre à jour des éléments selon une planification automatisée, reportez-vous à la rubrique Planifier une tâche de pipeline de données.
- Pour en savoir plus sur les éléments, reportez-vous à la rubrique Éléments pris en charge dans ArcGIS Online.
Vous avez un commentaire à formuler concernant cette rubrique ?