Come funziona
Aggiungi il file CSV. MimiFile controlla il formato, lo converte in Apache Parquet e rende il risultato disponibile con un download temporaneo.
Converti CSV in Parquet per ottenere un file colonnare tipizzato e compresso, più adatto a query analitiche, archivio dati e flusso di elaborazione rispetto a una tabella di testo.
CSV → PARQUET
Trascina o incolla un file, oppure selezionalo dal dispositivo.
I file sono temporanei e vengono eliminati automaticamente.
Limiti: 50 MB per file · 128 MB totali per gruppo.
Aggiungi il file CSV. MimiFile controlla il formato, lo converte in Apache Parquet e rende il risultato disponibile con un download temporaneo.
MimiFile accetta CSV UTF-8, rileva virgola, punto e virgola, tab o pipe e inferisce lo schema prima di scrivere Parquet 2.6 con compressione Zstandard, dizionario e statistiche.
Limite attuale del file sorgente : 50 MB per file. È possibile inviare fino a 10 file per lotto entro il limite globale.
L'ingresso deve essere UTF-8. Il motore di elaborazione prova a rilevare tra virgola, punto e virgola, tabulazione e pipe; se non riconosce il separatore usa la virgola.
CSV non include uno schema tipizzato completo. PyArrow inferisce i tipi dalle colonne lette, quindi numeri, date, null e identificatori vanno controllati prima di usare il risultato in produzione.
MimiFile genera Parquet 2.6 con Zstandard, codifica a dizionario e statistiche di colonna, invece di limitarsi a rinominare l'estensione del CSV.
Quando una destinazione tabellare non può rappresentare direttamente liste o oggetti, i valori annidati vengono serializzati come testo JSON quando possibile.
I valori nulli e temporali vengono conservati quando la destinazione li supporta. I dati binari possono essere rappresentati in Base64 nelle uscite testuali o di foglio di calcolo.
Controlla tipi di colonna, valori nulli, date e campi annidati prima di usare il file convertito in una pipeline dati di produzione.