PDF এ কোনো টেবিল মার্কআপ নেই
HTML এর বিপরীতে, PDF এ <table> ট্যাগ নেই। টেবিল শুধু ভিজ্যুয়ালি পজিশনড টেক্সট হিসেবে থাকে। টুল টেক্সট পজিশন থেকে সারি ও কলাম পুনর্নির্মাণ করে।
PDF Table Extraction · 100% লোকাল
স্বয়ংক্রিয় কাঠামো সনাক্তকরণসহ PDF ফাইল থেকে টেবিল সনাক্ত ও বের করুন। প্রিভিউ, এডিট, এবং Excel, CSV, JSON, Markdown, বা Text এ এক্সপোর্ট করুন। কোনো আপলোড নেই, সম্পূর্ণ বিনামূল্যে।
আপনার PDF এখানে ছাড়ুন
বা ব্রাউজ করতে ক্লিক করুন — টেবিল স্বয়ংক্রিয়ভাবে সনাক্ত হয়
টেক্সট-ভিত্তিক এবং স্ক্যান করা PDF সমর্থন করে, সর্বোচ্চ ৫০ মেগাবাইট
ওয়েব পেজ থেকে টেবিল বের করতে চান? Table Extractor এক্সটেনশন চেষ্টা করুন।
এক্সটেনশন নিনটেবিল এক্সট্র্যাকশন চ্যালেঞ্জ
PDF টেবিল কাঠামো সংরক্ষণ করে না — শুধু পজিশনড টেক্সট। এক্সট্র্যাক্টর টেক্সট কোঅর্ডিনেট থেকে লজিক্যাল টেবিল গ্রিড পুনর্নির্মাণ করে, আপনাকে কাঠামোগত ডেটা দেয়।
HTML এর বিপরীতে, PDF এ <table> ট্যাগ নেই। টেবিল শুধু ভিজ্যুয়ালি পজিশনড টেক্সট হিসেবে থাকে। টুল টেক্সট পজিশন থেকে সারি ও কলাম পুনর্নির্মাণ করে।
একটি কলাম কোথায় শেষ এবং অন্যটি কোথায় শুরু তা নির্ধারণ করতে সব সারিতে x-কোঅর্ডিনেট বিশ্লেষণ প্রয়োজন। টুল কলাম বাউন্ডারি খুঁজতে পজিশন ক্লাস্টার করে।
একই ভিজ্যুয়াল সারিতে PDF টেক্সট আইটেমের সামান্য আলাদা y-কোঅর্ডিনেট থাকতে পারে। টুল সামান্য উল্লম্ব ভিন্নতার সহনশীলতা সহ সেগুলোকে গ্রুপ করে।
একটি PDF পেজে একাধিক টেবিল থাকতে পারে। টুল প্রতিটি টেবিল স্বাধীনভাবে সনাক্ত করে এবং আপনাকে কোনটি এক্সপোর্ট করবেন তা নির্বাচন করতে দেয়।
স্বয়ংক্রিয় এক্সট্র্যাকশনে অন্ধভাবে বিশ্বাস করবেন না। সনাক্ত করা টেবিল দেখুন, সেল ইনলাইন এডিট করুন, বিকৃতি ঠিক করুন, তারপর পছন্দের ফরম্যাটে এক্সপোর্ট করুন।
Excel (.xls), CSV, JSON, প্লেইন টেক্সট, বা Markdown থেকে নির্বাচন করুন। একটি টুল, পাঁচটি আউটপুট ফরম্যাট — ট্যাব ক্লিকে স্যুইচ করুন।
যেভাবে কাজ করে
BAngleTools PDF Table Extractor Mozilla এর pdf.js ইঞ্জন ব্যবহার করে Web Worker এ আপনার PDF পার্স করে। ইঞ্জন প্রতিটি টেক্সট আইটেম তার পজিশনাল ডেটাসহ বের করে — প্রতিটি অক্ষরের x এবং y কোঅর্ডিনেট আছে। এক্সট্র্যাক্টর তারপর টেক্সট আইটেমগুলোকে সারিতে গ্রুপ করে (y-কোঅর্ডিনেট নিকটতার ভিত্তিতে) এবং কলাম বাউন্ডারি সনাক্ত করে (সব সারিতে x-পজিশন ক্লাস্টারিং দ্বারা) টেবিল কাঠামো পুনর্নির্মাণ করে।
সনাক্তকরণ অ্যালগরিদম চেক করে একটি সারি গ্রুপ টেবিলের মতো দেখায় কিনা: কমপক্ষে 60% সারিতে এমন আইটেম থাকতে হবে যা কমপক্ষে 2 কলামে ম্যাপ করে। এটি প্যারাগ্রাফ এবং হেডিং ফিল্টার করে যা আসল টেবিলের একই পেজে থাকে।
টেবিল সনাক্ত হওয়ার পর, আপনি প্রতিটি প্রিভিউ করতে পারেন, সেল ইনলাইন এডিট করে যেকোনো সনাক্তকরণ ত্রুটি ঠিক করতে পারেন, এবং পছন্দের ফরম্যাটে এক্সপোর্ট করতে পারেন। সব প্রসেসিং আপনার ব্রাউজারে লোকালি হয় — আপনার PDF ফাইল কখনো আপনার ডিভাইস ছাড়ে না।
কারা ব্যবহার করে
বার্ষিক রিপোর্ট PDF থেকে ব্যালেন্স শিট, P&L স্টেটমেন্ট এবং ক্যাশ ফ্লো টেবিল বের করুন Excel বা ফাইনান্সিয়াল মডেলিং টুলে বিশ্লেষণের জন্য।
গবেষণা পত্র থেকে পরিসংখ্যান টেবিল, জরিপ ফলাফল এবং পরীক্ষামূলক ডেটা বের করুন মেটা-অ্যানালাইসিস এবং সিস্টেমেটিক রিভিউয়ের জন্য।
PDF ড্যাশবোর্ড থেকে KPI টেবিল, সেলস সামারি এবং পারফরম্যান্স মেট্রিক্স বের করুন Tableau বা Power BI এর মতো BI টুলে ইম্পোর্টের জন্য।
আইনি ফাইলিং, রেগুলেটরি ডকুমেন্ট এবং কমপ্লায়েন্স রিপোর্ট থেকে ট্যাবুলার ডেটা বের করুন কাঠামোগত বিশ্লেষণ ও তুলনার জন্য।
ইঞ্জিনিয়ারিং PDF ডকুমেন্ট থেকে স্পেসিফিকেশন টেবিল, ম্যাটেরিয়াল লিস্ট এবং টেকনিক্যাল প্যারামিটার বের করুন CAD বা PLM সিস্টেমে ইম্পোর্টের জন্য।
সরকারি রিপোর্ট, সেনসাস ডেটা এবং পাবলিক সেক্টর PDF থেকে পরিসংখ্যান টেবিল বের করুন ওপেন ডেটা ইনিশিয়েটিভ এবং সিভিক টেক প্রজেক্টের জন্য।
ধাপে ধাপে
প্রশ্নোত্তর
হ্যাঁ, BAngleTools PDF Table Extractor সম্পূর্ণ বিনামূল্যে — কোনো ব্যবহারের সীমা নেই, কোনো রেজিস্ট্রেশন নেই, কোনো ওয়াটারমার্ক নেই। আপনি যত খুশি PDF থেকে টেবিল বের করতে পারেন।
না। সব প্রসেসিং সম্পূর্ণভাবে আপনার ব্রাউজারে JavaScript Web Worker দিয়ে হয়। আপনার PDF ফাইল কখনো কোনো সার্ভারে আপলোড হয় না। টুলটি গোপনীয় ডকুমেন্টের জন্য নিরাপদ।
টুল PDF থেকে পজিশনাল ডেটাসহ টেক্সট আইটেম পড়ে। এটি আইটেমগুলোকে y-কোঅর্ডিনেট নিকটতার ভিত্তিতে সারিতে গ্রুপ করে, কলাম বাউন্ডারি সনাক্ত করতে x-পজিশন ক্লাস্টার করে, এবং যাচাই করে যে কমপক্ষে 60% সারি 2+ কলামে ম্যাপ করে। এটি টেবিলের মতো কাঠামো স্বয়ংক্রিয়ভাবে সনাক্ত করে।
এক্সট্র্যাক্টর পাঁচটি এক্সপোর্ট ফরম্যাট সমর্থন করে: Excel (.xls), CSV, JSON, প্লেইন টেক্সট (.txt), এবং Markdown (.md)। ফরম্যাটের মধ্যে স্যুইচ করতে ট্যাব বার ব্যবহার করুন — শেয়ারিংয়ের জন্য URL আপডেট হয় কিন্তু পেজ স্টেট সংরক্ষিত থাকে।
হ্যাঁ। প্রিভিউ প্রতিটি সনাক্ত টেবিল এডিটেবল সেলসহ দেখায়। এক্সপোর্টের আগে যেকোনো সেল ক্লিক করে ভ্যালু সংশোধন, কলাম অ্যালাইনমেন্ট ঠিক বা ডেটা পরিষ্কার করতে পারেন।
PDF এ কোনো সনাক্তযোগ্য টেবিল কাঠামো না থাকলে, টুল 'No tables found' দেখাবে। এটি হতে পারে যদি PDF শুধু প্যারাগ্রাফ ধারণ করে, বা এটি কোনো টেক্সট লেয়ার ছাড়া স্ক্যান PDF হয়। স্ক্যান PDF এর জন্য, OCR সহ Scanned PDF to Excel টুল চেষ্টা করুন।
টুল প্রতিটি পেজে স্বাধীনভাবে টেবিল সনাক্ত করে। একাধিক পেজে বিস্তৃত টেবিল আলাদা পেজ-প্রতি টেবিল হিসেবে সনাক্ত হয়। আপনি প্রতিটি আলাদাভাবে এক্সপোর্ট করতে এবং ম্যানুয়ালি কম্বাইন করতে পারেন।
সর্বোচ্চ PDF ফাইল সাইজ 50MB। এই সীমাটি এই কারণে যে সম্পূর্ণ ফাইল আপনার ব্রাউজারের মেমরিতে প্রসেস হয়।
সম্পর্কিত টুল
ফাইল আপলোড করুন, টেবিল সনাক্ত করুন, প্রিভিউ ও এডিট করুন, তারপর যেকোনো ফরম্যাটে এক্সপোর্ট করুন। নো সাইনআপ, নো আপলোড, সম্পূর্ণ বিনামূল্যে।