Afficher, filtrer et nettoyer des données CSV
Afficher les lignes d’un CSV, rechercher dans les colonnes sélectionnées, supprimer les lignes de sortie en double et télécharger les colonnes sélectionnées.
Comment utiliser Visualisation et nettoyage CSV
- 01Choisissez un fichier CSV.
- 02Recherchez dans les lignes, sélectionnez des colonnes et choisissez de supprimer ou non les lignes en double dans le résultat.
- 03Téléchargez le CSV sélectionné.
Foire aux questions
Quelles sont les limites ?
La première ligne est traitée comme l’en-tête. Le choix du délimiteur, les guillemets, les sauts de ligne intégrés, les noms de colonnes dupliqués, les largeurs de lignes incohérentes, l’encodage des caractères et l’interprétation des formules de tableur peuvent modifier la façon dont une autre application lit le même texte. Le filtrage et la sélection de colonnes n’établissent pas de schéma. Vérifiez les en-têtes, le nombre de lignes, des enregistrements représentatifs, les valeurs échappées, les zéros initiaux, les dates et le fichier téléchargé dans sa destination avant de remplacer la source.
Que dois-je vérifier avant d’utiliser le résultat ?
Vérifiez les aspects qui déterminent la signification du résultat : clés, noms de champs, types de valeurs, imbrication, nombre de lignes et de colonnes, délimiteurs, guillemets, échappement, fins de ligne et encodage des caractères. Pour les résultats de comparaison, examinez les ajouts et les suppressions plutôt que de lire uniquement le résumé surligné. Pour Base64, distinguez le texte encodé des données binaires arbitraires. Pour les sommes de contrôle, comparez chaque caractère et confirmez le nom de l’algorithme. Validez les résultats importants avec le système destinataire, car des données syntaxiquement valides peuvent toujours violer un schéma, un champ obligatoire, une règle d’unicité ou une contrainte métier.
Quelle est la différence entre le formatage et la validation ?
Le formatage et la validation répondent à des questions différentes. Le formatage analyse des données valides et les réécrit avec une indentation ou une mise en page cohérente afin de permettre une inspection plus facile. La validation vérifie si la syntaxe peut être analysée, mais elle ne confirme pas automatiquement que les valeurs satisfont un schéma ou une règle métier. La minification supprime les espaces inutiles sans modifier la valeur analysée. L’inspection résume la structure et la profondeur. Pour XML et YAML, le formatage peut normaliser les espaces insignifiants ou les choix de représentation. Comparez donc les valeurs sémantiques plutôt que de vous attendre à ce que le style textuel d’origine reste identique.
Pourquoi des données d’apparence valide peuvent-elles encore produire une erreur ?
Des données d’apparence valide peuvent contenir un délimiteur invisible, une espace insécable, un guillemet non fermé, un marqueur structurel dupliqué, une séquence d’échappement mal formée, des fins de ligne mixtes, un encodage non pris en charge ou une fonctionnalité propre au format qui modifie l’analyse. Commencez par la ligne, la colonne ou le chemin indiqué, s’il est disponible. Réduisez l’entrée à la plus petite section qui échoue encore, puis restaurez progressivement les enregistrements environnants. Pour CSV, confirmez le délimiteur et l’hypothèse d’en-tête. Pour JSON, XML ou YAML, vérifiez les crochets, l’indentation, les guillemets, les entités et l’imbrication. Conservez une copie de la source pendant le diagnostic afin qu’une correction ne supprime pas d’informations valides.
Dois-je installer quelque chose ?
Aucune installation ni inscription n’est requise pour utiliser les utilitaires de données répertoriés. Ouvrez l’action correspondant à la tâche, ajoutez ou collez la source, choisissez le mode approprié, puis copiez ou téléchargez le résultat. Avant de remplacer un fichier important, conservez l’original et testez la sortie avec l’application destinataire. L’installation n’est pas la principale question de compatibilité : les attentes du schéma, l’encodage, les délimiteurs, les fonctionnalités du classeur et la syntaxe prise en charge déterminent toujours si un autre système acceptera le résultat.