Funcionamento
Adicione o seu ficheiro JSON. O MimiFile verifica o formato, converte-o para Apache Parquet e disponibiliza o resultado através de uma transferência temporária.
Converta dados estruturados de JSON para Apache Parquet online. O MimiFile lê os registos de origem, converte os valores compatíveis e disponibiliza uma transferência temporária.
JSON → PARQUET
Arraste ou cole um ficheiro, ou selecione-o no dispositivo.
Os ficheiros são temporários e eliminados automaticamente.
Limites: 16 MB por ficheiro · 128 MB no total por lote.
Adicione o seu ficheiro JSON. O MimiFile verifica o formato, converte-o para Apache Parquet e disponibiliza o resultado através de uma transferência temporária.
Colunas tipadas, aninhadas ou binárias não têm a mesma representação em todos os formatos. Verifique o resultado quando o destino tiver um sistema de tipos mais simples.
Limite atual do ficheiro de origem : 16 MB por ficheiro. Podem ser enviados até 10 ficheiros por lote dentro do limite global.
Parquet, Avro, ORC e Arrow podem manter esquemas fortemente tipados, enquanto CSV e folhas de cálculo são mais planos. O MimiFile preserva tipos compatíveis e simplifica os restantes valores.
Quando um destino tabular não consegue representar diretamente listas ou objetos, os valores aninhados são serializados como texto JSON sempre que possível.
Valores nulos e temporais são preservados quando o destino os suporta. Dados binários podem ser representados em Base64 em saídas de texto ou folha de cálculo.
Verifique tipos de coluna, valores nulos, datas e campos aninhados antes de usar o ficheiro convertido num pipeline de dados em produção.
JSON é flexível e representa objetos, listas, números, texto, booleanos e valores nulos sem impor um esquema colunar fixo. Parquet foi concebido para armazenamento analítico colunar e inclui tipos e metadados de esquema. A conversão é útil para pipelines e análise, mas o esquema de destino deve ser validado.
Escolha Parquet quando precisa de armazenamento colunar para análise, data lakes, motores SQL ou pipelines que beneficiam de colunas tipadas. Mantenha o JSON original até validar completamente a saída.
Objetos JSON podem variar entre registos e conter listas ou estruturas aninhadas. Parquet organiza os dados num esquema tipado; campos opcionais, números, datas, nulos e estruturas complexas precisam de uma representação coerente no ficheiro de destino.
JSON distingue texto, número, booleano, null, listas e objetos, mas não define tipos especializados como um esquema Parquet. Confirme sobretudo inteiros grandes, precisão decimal, datas, campos opcionais, listas e objetos aninhados.
Inspecione o esquema Parquet e compare número de registos, nomes de campos, tipos, valores nulos, datas, precisão numérica, listas e estruturas aninhadas com a origem JSON.
Adicione o ficheiro JSON, escolha Parquet, aguarde o processamento e transfira a saída. Depois, inspecione o esquema e compare os registos com o JSON original.
JSON é flexível e não impõe um esquema colunar único. Parquet utiliza tipos e metadados de coluna, por isso valores heterogéneos ou opcionais podem exigir uma representação de destino específica.
Parquet suporta estruturas complexas, mas a correspondência concreta depende dos dados e do fluxo de conversão. Verifique listas, objetos aninhados e campos opcionais antes de usar a saída em produção.