Fonctionnement
Ajoutez votre fichier Apache ORC. MimiFile vérifie son format, le convertit en Apache Parquet puis propose le résultat en téléchargement temporaire.
Convertissez ORC en Apache Parquet pour intégrer les données à un pipeline analytique, un data lake ou un outil qui standardise ses fichiers colonnaires sur Parquet.
ORC → PARQUET
Glissez-déposez ou collez un fichier, ou choisissez-le sur votre appareil.
Les fichiers sont temporaires et supprimés automatiquement.
Limites : 50 MB par fichier · 128 MB au total par lot.
Ajoutez votre fichier Apache ORC. MimiFile vérifie son format, le convertit en Apache Parquet puis propose le résultat en téléchargement temporaire.
ORC et Parquet sont tous deux des formats colonnaires typés, mais leurs représentations de schéma et leurs détails d’encodage ne sont pas identiques. Contrôlez les colonnes complexes et types spécifiques après migration.
Limite actuelle du fichier source : 50 MB par fichier. Jusqu’à 10 fichiers peuvent être envoyés dans un même lot, dans la limite globale autorisée.
La conversion peut être utile lorsqu’un moteur, une plateforme de données ou un échange inter-outils attend spécifiquement Apache Parquet.
Les types courants se traduisent naturellement, mais certains champs imbriqués, décimaux, temporels ou binaires peuvent être représentés différemment selon les deux formats.
Comparez noms et types de colonnes, valeurs nulles, timestamps, champs imbriqués et lecture du fichier Parquet par le moteur analytique cible.
Lorsqu’une destination tabulaire ne peut pas représenter directement des listes ou des objets, les valeurs imbriquées sont sérialisées en texte JSON lorsque cela est possible.
Les valeurs nulles et temporelles sont conservées lorsque la destination le permet. Les données binaires peuvent être représentées en Base64 dans les sorties texte ou tableur.
Vérifiez les types de colonnes, valeurs nulles, dates et champs imbriqués avant d’utiliser le fichier converti dans un pipeline de données en production.