PDF मा कुनै टेबल मार्कअप छैन
HTML को विपरित, PDF मा <table> ट्याग छैनन्। टेबल केवल विजुअली पोजिसन्ड टेक्स्टको रूपमा अवस्थित छन्। टुलले टेक्स्ट पोजिसनबाट पंक्ति र कलम पुनर्निर्माण गर्छ।
PDF Table Extraction · 100% स्थानीय
स्वचालित संरचना पहिचानसहित PDF फाइलबाट टेबल पत्ता लगाउनुहोस् र निकाल्नुहोस्। प्रिभ्यू, सम्पादन, र Excel, CSV, JSON, Markdown, वा Text मा निर्यात गर्नुहोस्। कुनै अपलोड छैन, पूर्ण निःशुल्क।
तपाईंको PDF यहाँ छोड्नुहोस्
वा ब्राउज गर्न क्लिक गर्नुहोस् — टेबल स्वचालित रूपमा पहिचान हुन्छ
टेक्स्ट-आधारित र स्क्यान गरिएका PDF समर्थित, अधिकतम ५० एमबी
वेब पेजबाट टेबल निकाल्न चाहनुहुन्छ? Table Extractor एक्सटेन्सन प्रयोग गर्नुहोस्।
एक्सटेन्सन लिनुहोस्टेबल एक्सट्र्याक्सन चुनौती
PDF ले टेबल संरचना भण्डारण गर्दैन — केवल पोजिसन्ड टेक्स्ट। एक्सट्र्याक्टरले टेक्स्ट निर्देशांकबाट लजिकल टेबल ग्रिड पुनर्निर्माण गर्छ, तपाईंलाई संरचित डेटा दिन्छ।
HTML को विपरित, PDF मा <table> ट्याग छैनन्। टेबल केवल विजुअली पोजिसन्ड टेक्स्टको रूपमा अवस्थित छन्। टुलले टेक्स्ट पोजिसनबाट पंक्ति र कलम पुनर्निर्माण गर्छ।
एउटा कलम कहाँ अन्त्य हुन्छ र अर्को कहाँ सुरु हुन्छ भन्ने निर्धारण गर्न सबै पंक्तिमा x-निर्देशांक विश्लेषण आवश्यक छ। टुलले कलम सीमा पत्ता लगाउन पोजिसन क्लस्टर गर्छ।
एउटै विजुअल पंक्तिमा PDF टेक्स्ट आइटमको थोरै फरक y-निर्देशांक हुन सक्छ। टुलले सानो ठाडो भिन्नताको सहनशीलतासहित तिनीहरूलाई समूहबद्ध गर्छ।
एउटा PDF पेजमा एकाधिक टेबल हुन सक्छ। टुलले हरेक टेबल स्वतन्त्र रूपमा पत्ता लगाउँछ र तपाईंलाई कुन निर्यात गर्ने चयन गर्न दिन्छ।
स्वचालित एक्सट्र्याक्सनमा अन्धाश्रद्धिले भरोसा नगर्नुहोस्। पत्ता लगाइएको टेबल हेर्नुहोस्, सेल इनलाइन सम्पादन गर्नुहोस्, मिसअलाइनमेन्ट मिलाउनुहोस्, त्यसपछि आफ्नो मनपर्ने ढाँचामा निर्यात गर्नुहोस्।
Excel (.xls), CSV, JSON, प्लेइन टेक्स्ट, वा Markdown बाट चयन गर्नुहोस्। एउटा टुल, पाँच आउटपुट ढाँचा — ट्याब क्लिकमा स्विच गर्नुहोस्।
कसरी काम गर्छ
BAngleTools PDF Table Extractor ले Mozilla को pdf.js इन्जिन प्रयोग गर्छ Web Worker मा तपाईंको PDF पार्स गर्न। इन्जिनले हरेक टेक्स्ट आइटम यसको पोजिसनल डेटासहित निकाल्छ — हरेक अक्षरको x र y निर्देशांक छन्। एक्सट्र्याक्टरले त्यसपछि टेक्स्ट आइटमलाई पंक्तिमा समूहबद्ध गरेर (y-निर्देशांक निकटताको आधारमा) र कलम सीमा पत्ता लगाएर (सबै पंक्तिमा x-पोजिसन क्लस्टरिङद्वारा) टेबल संरचना पुनर्निर्माण गर्छ।
पत्ता लगाउने एल्गोरिदमले जाँच गर्छ कि पंक्तिको एउटा समूह टेबलजस्तो देखिन्छ कि छैन: कम्तिमा 60% पंक्तिमा यस्ता आइटम हुनुपर्छ जुन कम्तिमा 2 कलममा म्याप हुन्छन्। यसले प्याराग्राफ र हेडिङलाई फिल्टर गर्छ जुन वास्तविक टेबलसँगै एउटै पेजमा हुन्छन्।
टेबल पत्ता लागेपछि, तपाईं हरेकको प्रिभ्यू गर्न सक्नुहुन्छ, सेल इनलाइन सम्पादन गरेर कुनै पनि पत्ता लगाउने त्रुटि मिलाउन सक्नुहुन्छ, र आफ्नो मनपर्ने ढाँचामा निर्यात गर्न सक्नुहुन्छ। सबै प्रोसेसिङ तपाईंको ब्राउजरमा स्थानीय रूपमा हुन्छ — तपाईंको PDF फाइल कहिल्यै तपाईंको डिभाइस छोड्दैन।
कसले प्रयोग गर्छ
वार्षिक रिपोर्ट PDF बाट ब्यालेन्स सिट, P&L विवरण र क्याश फ्लो टेबल निकाल्नुहोस् Excel वा वित्तीय मोडेलिङ टुलमा विश्लेषणको लागि।
अनुसन्धान पत्रबाट तथ्याङ्कीय टेबल, सर्वेक्षण नतिजा र प्रयोगात्मक डेटा निकाल्नुहोस् मेटा-अनालिसिस र सिस्टेमेटिक रिभ्युको लागि।
PDF ड्यासबोर्डबाट KPI टेबल, सेल्स समरी र प्रदर्शन मेट्रिक्स निकाल्नुहोस् Tableau वा Power BI जस्ता BI टुलमा आयातको लागि।
कानूनी फाइलिङ, नियामक कागजात र कम्प्लाइअन्स रिपोर्टबाट ट्याबुलर डेटा निकाल्नुहोस् संरचित विश्लेषण र तुलनाको लागि।
इन्जिनियरिङ PDF कागजातबाट स्पेसिफिकेसन टेबल, मेटेरियल लिस्ट र प्राविधिक प्यारामिटर निकाल्नुहोस् CAD वा PLM सिस्टममा आयातको लागि।
सरकारी रिपोर्ट, जनगणना डेटा र सार्वजनिक क्षेत्र PDF बाट तथ्याङ्कीय टेबल निकाल्नुहोस् ओपन डेटा पहल र सिभिक टेक प्रोजेक्टको लागि।
चरण-चरण
प्रश्नोत्तर
हो, BAngleTools PDF Table Extractor पूर्ण रूपमा निःशुल्क छ — कुनै प्रयोग सीमा छैन, कुनै दर्ता छैन, कुनै वाटरमार्क छैन। तपाईंले जति चाहेन्या उति नै PDF बाट टेबल निकाल्न सक्नुहुन्छ।
होइन। सबै प्रोसेसिङ पूर्ण रूपमा तपाईंको ब्राउजरमा JavaScript Web Worker ले हुन्छ। तपाईंको PDF फाइल कहिल्यै कुनै सर्भरमा अपलोड हुँदैन। टुल गोपनीय कागजातको लागि सुरक्षित छ।
टुलले PDF बाट पोजिसनल डेटासहित टेक्स्ट आइटम पढ्छ। यसले आइटमलाई y-निर्देशांक निकटताको आधारमा पंक्तिमा समूहबद्ध गर्छ, कलम सीमा पत्ता लगाउन x-पोजिसन क्लस्टर गर्छ, र जाँच गर्छ कि कम्तिमा 60% पंक्ति 2+ कलममा म्याप हुन्छन्। यसले टेबलजस्ता संरचनाहरू स्वचालित रूपमा पहिचान गर्छ।
एक्सट्र्याक्टरले पाँच निर्यात ढाँचा समर्थन गर्छ: Excel (.xls), CSV, JSON, प्लेइन टेक्स्ट (.txt), र Markdown (.md)। ढाँचाबीच स्विच गर्न ट्याब बार प्रयोग गर्नुहोस् — साझेदारीको लागि URL अपडेट हुन्छ तर पेज स्टेट सुरक्षित रहन्छ।
हो। प्रिभ्यूले हरेक पत्ता लगाइएको टेबल सम्पादन योग्य सेलसहित देखाउँछ। निर्यात अघि कुनै पनि सेल क्लिक गरेर मान सच्याउनुहोस्, कलम अलाइनमेन्ट मिलाउनुहोस्, वा डेटा सफा गर्नुहोस्।
PDF मा कुनै पत्ता लगाउन योग्य टेबल संरचना नभएमा, टुलले 'No tables found' देखाउँछ। यो हुन सक्छ यदि PDF मा केवल प्याराग्राफ छन् भने, वा यो टेक्स्ट लेयर बिनाको स्क्यान PDF हो भने। स्क्यान PDF को लागि, OCR सहित Scanned PDF to Excel टुल प्रयास गर्नुहोस्।
टुलले हरेक पेजमा स्वतन्त्र रूपमा टेबल पत्ता लगाउँछ। एकाधिक पेजमा फैलिएका टेबल छुट्टाइ प्रति-पेज टेबलको रूपमा पत्ता लगाइन्छ। तपाईं हरेक एकलाइ निर्यात गर्न र म्यानुअल रूपमा संयोजन गर्न सक्नुहुन्छ।
अधिकतम PDF फाइल साइज 50MB हो। यो सीमा यस कारणले छ किनभने सम्पूर्ण फाइल तपाईंको ब्राउजरको मेमोरीमा प्रोसेस हुन्छ।
सम्बन्धित टुल
फाइल अपलोड गर्नुहोस्, टेबल पत्ता लगाउनुहोस्, प्रिभ्यू र सम्पादन गर्नुहोस्, त्यसपछि कुनै पनि ढाँचामा निर्यात गर्नुहोस्। नो साइनअप, नो अपलोड, पूर्ण निःशुल्क।