Funcionamento
Adicione o seu ficheiro JSON Lines / NDJSON. O MimiFile verifica o formato, converte-o para Apache Parquet e disponibiliza o resultado através de uma transferência temporária.
Converta dados estruturados de JSON Lines / NDJSON para Apache Parquet online. O MimiFile lê os registos de origem, converte os valores compatíveis e disponibiliza uma transferência temporária.
JSONL → PARQUET
Arraste ou cole um ficheiro, ou selecione-o no dispositivo.
Os ficheiros são temporários e eliminados automaticamente.
Limites: 50 MB por ficheiro · 128 MB no total por lote.
Adicione o seu ficheiro JSON Lines / NDJSON. O MimiFile verifica o formato, converte-o para Apache Parquet e disponibiliza o resultado através de uma transferência temporária.
Colunas tipadas, aninhadas ou binárias não têm a mesma representação em todos os formatos. Verifique o resultado quando o destino tiver um sistema de tipos mais simples.
Limite atual do ficheiro de origem : 50 MB por ficheiro. Podem ser enviados até 10 ficheiros por lote dentro do limite global.
Parquet, Avro, ORC e Arrow podem manter esquemas fortemente tipados, enquanto CSV e folhas de cálculo são mais planos. O MimiFile preserva tipos compatíveis e simplifica os restantes valores.
Quando um destino tabular não consegue representar diretamente listas ou objetos, os valores aninhados são serializados como texto JSON sempre que possível.
Valores nulos e temporais são preservados quando o destino os suporta. Dados binários podem ser representados em Base64 em saídas de texto ou folha de cálculo.
Verifique tipos de coluna, valores nulos, datas e campos aninhados antes de usar o ficheiro convertido num pipeline de dados em produção.
JSONL, também chamado JSON Lines ou NDJSON, guarda um valor JSON por linha e é comum em logs, exportações e pipelines. Converter JSONL para Parquet faz sentido quando precisa de transformar registos JSONL em armazenamento colunar com esquema para análise e pipelines de dados; valide sempre estrutura e tipos no formato de destino.
Escolha Parquet quando o objetivo for transformar registos JSONL em armazenamento colunar com esquema para análise e pipelines de dados. Preserve o JSONL original até confirmar que todos os registos e campos importantes foram representados corretamente.
JSONL é orientado a registos e permite estruturas flexíveis; Parquet organiza dados por colunas e utiliza um esquema tipado. Diferenças entre registos, datas, números, nulos, listas e objetos aninhados exigem uma representação coerente no destino.
JSONL pode misturar campos opcionais, objetos, listas e tipos diferentes entre linhas. Formatos mais tabulares ou fortemente tipados exigem uma representação mais regular; confira os casos que não seguem a estrutura dominante.
Inspecione o esquema Parquet e compare número de registos, nomes de campos, tipos, valores nulos, datas, precisão numérica, listas e estruturas aninhadas antes de usar o ficheiro em produção.
Adicione o ficheiro .jsonl ou .ndjson, escolha Parquet, aguarde o processamento e transfira o resultado. Depois, compare registos, campos e tipos com a origem.
Sim. Os dois nomes são usados para dados JSON delimitados por novas linhas, normalmente com um valor JSON independente por linha.
Podem receber outra representação dependendo do destino. Reveja especialmente objetos aninhados, listas, nulos, datas, números e campos opcionais antes de usar a saída num pipeline.