कैसे काम करता है
अपनी CSV डेटा फ़ाइल जोड़ें। MimiFile फ़ॉर्मेट की जाँच करता है, उसे Apache Parquet डेटा में बदलता है और परिणाम अस्थायी डाउनलोड के रूप में उपलब्ध कराता है।
CSV को Parquet में बदलें जब आपको विश्लेषण के लिए कॉलम-आधारित, टाइप-युक्त डेटा फ़ाइल चाहिए। CSV में स्पष्ट स्कीमा नहीं होता, इसलिए Parquet लिखते समय पढ़े गए मानों से उपयुक्त कॉलम टाइप बनते हैं।
CSV → PARQUET
फ़ाइल को खींचकर छोड़ें, पेस्ट करें या अपने डिवाइस से चुनें।
फ़ाइलें अस्थायी हैं और अपने आप हटा दी जाती हैं।
सीमाएँ: प्रति फ़ाइल 50 MB · प्रति बैच कुल 128 MB।
अपनी CSV डेटा फ़ाइल जोड़ें। MimiFile फ़ॉर्मेट की जाँच करता है, उसे Apache Parquet डेटा में बदलता है और परिणाम अस्थायी डाउनलोड के रूप में उपलब्ध कराता है।
Parquet टाइप-युक्त स्कीमा रखता है, जबकि CSV आम तौर पर केवल डिलिमिटर और टेक्स्ट मान देता है। खासकर तारीख, शुरुआती शून्य वाले ID, मिश्रित मान वाले कॉलम और खाली सेल के अनुमानित टाइप को अगले चरण के उपयोग से पहले जाँचें।
वर्तमान स्रोत सीमा : 50 MB प्रति फ़ाइल. कुल सीमा के भीतर एक बैच में अधिकतम 10 फ़ाइलें भेजी जा सकती हैं।
CSV हेडर कॉलम नाम देते हैं और पढ़े गए मानों से संगत टाइप बनाए जाते हैं। यदि किसी पहचानकर्ता को संख्या की बजाय टेक्स्ट रहना चाहिए, तो परिणाम को विश्लेषण पाइपलाइन में डालने से पहले उसका टाइप जाँचें।
CSV सपाट तालिका-आधारित स्रोत है। Parquet नेस्टेड संरचनाएँ संभाल सकता है, लेकिन यह रूपांतरण ऐसी सूचियाँ या ऑब्जेक्ट नहीं बनाता जो स्रोत तालिका में मौजूद नहीं हैं।
बदली हुई फ़ाइल को प्रोडक्शन डेटा पाइपलाइन में इस्तेमाल करने से पहले कॉलम टाइप, null, समय और नेस्टेड फ़ील्ड जाँचें।