PDF টেবিল ভিজ্যুয়াল, কাঠামোগত নয়
PDF প্রিন্টিংয়ের জন্য ডিজাইন করা হয়েছিল, ডেটা এক্সট্র্যাকশনের জন্য নয়। টেবিল পজিশনড টেক্সট হিসেবে থাকে, সারি ও কলাম হিসেবে নয়। কনভার্টার লজিক্যাল কাঠামো পুনর্নির্মাণ করে।
PDF → CSV · 100% লোকাল
PDF ফাইল থেকে টেবিল বের করে পরিষ্কার CSV হিসেবে এক্সপোর্ট করুন। ডেটাবেস, Python, R এবং ডেটা পাইপলাইনের জন্য আদর্শ। সব প্রসেসিং আপনার ব্রাউজারে হয় — কোনো আপলোড নেই, সম্পূর্ণ বিনামূল্যে।
আপনার PDF এখানে ছাড়ুন
বা ব্রাউজ করতে ক্লিক করুন — টেবিল স্বয়ংক্রিয়ভাবে সনাক্ত হয়
টেক্সট-ভিত্তিক এবং স্ক্যান করা PDF সমর্থন করে, সর্বোচ্চ ৫০ মেগাবাইট
ওয়েব পেজ থেকে টেবিল বের করতে চান? Table Extractor এক্সটেনশন চেষ্টা করুন।
এক্সটেনশন নিনPDF থেকে CSV কেন কঠিন
CSV হলো সার্বজনীন ডেটা ফরম্যাট, কিন্তু PDF থেকে CSV এ যাওয়া সাধারণত এলোমেলো কপি-পেস্ট বা দামি সফটওয়্যার বোঝায়। BAngleTools সেই শূন্যতা পূরণ করে।
PDF প্রিন্টিংয়ের জন্য ডিজাইন করা হয়েছিল, ডেটা এক্সট্র্যাকশনের জন্য নয়। টেবিল পজিশনড টেক্সট হিসেবে থাকে, সারি ও কলাম হিসেবে নয়। কনভার্টার লজিক্যাল কাঠামো পুনর্নির্মাণ করে।
PDF টেবিল সিলেক্ট করে টেক্সট এডিটরে পেস্ট করলে ভাঙা সারি ও মিসিং সেলসহ ট্যাব-সেপারেটেড ভ্যালু পাওয়া যায়। টুল সঠিক এসকেপিংসহ প্রপার CSV আউটপুট দেয়।
বেশিরভাগ অনলাইন PDF-টু-CSV টুল আপনার ফাইল সার্ভারে পাঠায়। BAngleTools সবকিছু লোকালি প্রসেস করে — আপনার ডেটা কখনো ব্রাউজার ছাড়ে না।
কনভার্টার কমা, কোট, নিউলাইন এবং ইউনিকোড (UTF-8 with BOM) সঠিকভাবে হ্যান্ডল করে। আপনার CSV Excel, Python pandas, R বা যেকোনো ডেটাবেস ইম্পোর্ট টুলে পরিষ্কার খোলে।
কোন সনাক্ত করা টেবিল CSV হিসেবে এক্সপোর্ট করবেন তা নির্বাচন করুন। প্রতিটি পেজের প্রতিটি টেবিল আলাদাভাবে সনাক্ত হয়, তাই আপনি ঠিক যে ডেটা দরকার তাই পান।
সনাক্ত করা টেবিল প্রিভিউ করে ডাউনলোডের আগে যেকোনো সেল ঠিক করুন। বিকৃত কলাম ঠিক করুন, OCR ত্রুটি দূর করুন, তারপর পরিষ্কার CSV এক্সপোর্ট করুন।
যেভাবে কাজ করে
BAngleTools PDF থেকে CSV কনভার্টার Mozilla-এর pdf.js ইঞ্জন ব্যবহার করে Web Worker-এর ভেতরে আপনার PDF পার্স করে। এটি পজিশনাল কোঅর্ডিনেটসহ টেক্সট লেয়ার পড়ে, y-প্রক্সিমিটি দ্বারা টেক্সট আইটেমগুলোকে সারিতে গ্রুপ করে, x-পজিশন ক্লাস্টারিং দ্বারা কলাম বাউন্ডারি সনাক্ত করে, এবং ফলাফল প্রপারলি এসকেপড CSV ফাইল হিসেবে আউটপুট করে।
CSV আউটপুট UTF-8 এনকোডিং BOM (Byte Order Mark) সহ ব্যবহার করে, যা Microsoft Excel-এ আন্তর্জাতিক অক্ষরের সঠিক প্রদর্শন নিশ্চিত করে। সেল ভ্যালুর ভেতরে কমা, ডাবল কোট বা নিউলাইন RFC 4180 অনুযায়ী সঠিকভাবে এসকেপ করা হয়।
সব প্রসেসিং আপনার ব্রাউজারে লোকালি হওয়ায়, আর্থিক রিপোর্ট, মেডিকেল রেকর্ড বা আইনি ফাইলিংয়ের মতো সংবেদনশীল ডকুমেন্টের জন্য এই টুল ব্যবহার করতে পারেন ডেটা ফাঁসার চিন্তা ছাড়াই। PDF ফাইল মেমোরিতে পড়া হয়, পার্স করা হয়, এবং ফলাফল ডাউনলোড হিসেবে দেওয়া হয় — কিছুই নেটওয়ার্কে পাঠানো হয় না।
কারা ব্যবহার করে
PDF রিপোর্ট থেকে ট্যাবুলার ডেটা CSV তে বের করে Python pandas, R ডেটাফ্রেম বা Jupyter নোটবুকে ইম্পোর্ট করুন বিশ্লেষণ ও ভিজ্যুয়ালাইজেশনের জন্য।
PDF টেবিল কে CSV ফরম্যাটে রূপান্তর করুন MySQL, PostgreSQL, SQLite বা যেকোনো ডেটাবেস সিস্টেমে বাল্ক ইম্পোর্টের জন্য।
ব্যাংক স্টেটমেন্ট PDF কে লেনদেন রেকর্ডসহ CSV ফাইলে পরিণত করুন QuickBooks, Xero বা GnuCash-এর মতো হিসাব সফটওয়্যারে ইম্পোর্টের জন্য।
একাডেমিক PDF পেপার থেকে পরীক্ষামূলক ফলাফল, পরিসংখ্যান টেবিল এবং গবেষণা ডেটা CSV তে বের করুন পুনরাবৃত্তিযোগ্য বিশ্লেষণের জন্য।
PDF পণ্য ক্যাটালগ এবং মূল্য তালিকা কে CSV তে রূপান্তর করুন ই-কমার্স প্ল্যাটফর্ম, ERP সিস্টেম বা ইনভেন্টরি ম্যানেজমেন্ট টুলে ইম্পোর্টের জন্য।
PDF রিপোর্ট থেকে CSV ফাইল তৈরি করুন n8n, Zapier, Make বা কাস্টম স্ক্রিপ্টের ইনপুট হিসেবে যা ডেটা প্রসেসিং ওয়ার্কফ্লো অটোমেট করে।
ধাপে ধাপে
প্রশ্নোত্তর
হ্যাঁ, BAngleTools PDF থেকে CSV কনভার্টার সম্পূর্ণ বিনামূল্যে — কোনো ব্যবহারের সীমা নেই, কোনো রেজিস্ট্রেশন নেই, কোনো ওয়াটারমার্ক নেই। আপনি যত খুশি PDF কনভার্ট করতে পারেন, এবং কোনো প্রিমিয়াম টিয়ার বা সাবস্ক্রিপশন নেই।
না। সব PDF প্রসেসিং সম্পূর্ণভাবে আপনার ব্রাউজারে JavaScript Web Worker দিয়ে হয়। আপনার PDF ফাইল কখনো কোনো সার্ভারে আপলোড হয় না। এটি আর্থিক বিবৃতি, মেডিকেল রেকর্ড এবং আইনি ফাইলিংয়ের মতো সংবেদনশীল ডকুমেন্টের জন্য টুলটিকে নিরাপদ করে।
হ্যাঁ। CSV আউটপুট UTF-8 এনকোডিং BOM (Byte Order Mark) সহ ব্যবহার করে আন্তর্জাতিক অক্ষরের সঠিক প্রদর্শন নিশ্চিত করতে। কমা, ডাবল কোট বা নিউলাইনযুক্ত সেল ভ্যালু RFC 4180 অনুযায়ী সঠিকভাবে এসকেপ করা হয়।
অবশ্যই। আউটপুট CSV Python এর pandas লাইব্রেরির (pd.read_csv()), R এর read.csv() এবং যেকোনো স্ট্যান্ডার্ড CSV ফাইল গ্রহণকারী টুলের সাথে সংগত। UTF-8 BOM সঠিক এনকোডিং সনাক্ত নিশ্চিত করে।
টুল প্রতিটি পেজে আলাদাভাবে টেবিল সনাক্ত করে। টেবিল পেজ জুড়ে চললে প্রতিটি পেজের অংশ আলাদা টেবিল হিসেবে সনাক্ত হয়। আপনি প্রতিটি ড্রপডাউন থেকে নির্বাচন করে আলাদাভাবে এক্সপোর্ট করতে পারেন, বা ম্যানুয়ালি কম্বাইন করতে পারেন।
হ্যাঁ। প্রিভিউতে বের করা টেবিল এডিটেবল সেলসহ দেখায়। CSV ফাইল ডাউনলোডের আগে যেকোনো সেল ক্লিক করে ভ্যালু সংশোধন, কলাম অ্যালাইনমেন্ট ঠিক বা অনাকাঙ্ক্ষিত ডেটা অপসারণ করতে পারেন।
সর্বোচ্চ PDF ফাইল সাইজ 50MB। এই সীমাটি এই কারণে যে সম্পূর্ণ ফাইল আপনার ব্রাউজারের মেমোরিতে প্রসেস হয়। বড় ফাইলের জন্য আগে PDF ভাগ করার কথা ভাবুন।
টেক্সট-ভিত্তিক PDF এর জন্য টুল সরাসরি টেক্সট লেয়ার পড়ে। স্ক্যান (ইমেজ-ভিত্তিক) PDF এর জন্য Scanned PDF to Excel টুল ব্যবহার করুন যাতে ইমেজ থেকে টেক্সট চেনার জন্য OCR (Optical Character Recognition) আছে।
সম্পর্কিত টুল
ফাইল আপলোড করুন, টেবিল প্রিভিউ করুন, প্রয়োজনে এডিট করুন, এবং CSV ডাউনলোড করুন। নো সাইনআপ, নো আপলোড, সম্পূর্ণ বিনামূল্যে।