कैसे काम करता है
अपनी Apache Arrow IPC डेटा फ़ाइल जोड़ें। MimiFile फ़ॉर्मेट की जाँच करता है, उसे Apache Parquet डेटा में बदलता है और परिणाम अस्थायी डाउनलोड के रूप में उपलब्ध कराता है।
Apache Arrow डेटा को Parquet में बदलें जब मेमोरी-केंद्रित या आदान-प्रदान-केंद्रित टाइप-युक्त तालिका को स्थायी कॉलम-आधारित विश्लेषण फ़ाइल के रूप में चाहिए।
ARROW → PARQUET
फ़ाइल को खींचकर छोड़ें, पेस्ट करें या अपने डिवाइस से चुनें।
फ़ाइलें अस्थायी हैं और अपने आप हटा दी जाती हैं।
सीमाएँ: प्रति फ़ाइल 50 MB · प्रति बैच कुल 128 MB।
अपनी Apache Arrow IPC डेटा फ़ाइल जोड़ें। MimiFile फ़ॉर्मेट की जाँच करता है, उसे Apache Parquet डेटा में बदलता है और परिणाम अस्थायी डाउनलोड के रूप में उपलब्ध कराता है।
Arrow और Parquet दोनों टाइप-युक्त कॉलम डेटा के साथ काम करते हैं, लेकिन उनके टाइप सिस्टम एक जैसे नहीं हैं। संगत मान अच्छी तरह मैप हो सकते हैं; विशेष Arrow टाइप और मेटाडेटा को हमेशा पूरी तरह समान राउंड-ट्रिप मानना उचित नहीं है।
वर्तमान स्रोत सीमा : 50 MB प्रति फ़ाइल. कुल सीमा के भीतर एक बैच में अधिकतम 10 फ़ाइलें भेजी जा सकती हैं।
कॉलम नाम और संगत टाइप को Parquet स्कीमा में लिखा जा सकता है। Arrow और Parquet के टाइप सिस्टम में हर टाइप के लिए एक-से-एक मैपिंग उपलब्ध नहीं होती, इसलिए विशेष कॉलम जाँचें।
Arrow अक्सर मेमोरी/आदान-प्रदान परत के रूप में उपयोग होता है, जबकि Parquet स्थायी कॉलम-आधारित स्टोरेज के लिए बनाया गया है। यह रूपांतरण तालिका को उस स्टोरेज फ़ॉर्मेट में लिखता है।
बदली हुई फ़ाइल को प्रोडक्शन डेटा पाइपलाइन में इस्तेमाल करने से पहले कॉलम टाइप, null, समय और नेस्टेड फ़ील्ड जाँचें।