PDF থেকে টেক্সট বের করুন

PDF-এর বিদ্যমান লেখা বের করুন বা ইংরেজি, স্প্যানিশ ও সরলীকৃত চীনা মুদ্রিত স্ক্যান ও ছবির জন্য স্থানীয় OCR বেছে নিন।

যখন এই সরঞ্জামটি দরকারী

ডিজিটালি তৈরি প্রতিবেদনে, প্রবন্ধ, চালান এবং নোট থেকে পড়ার যোগ্য টেক্সট কপি করা সার্চ বা সম্পাদনার জন্য।

স্থানীয় প্রক্রিয়াকরণ কীভাবে কাজ করে

সাধারণ নিষ্কাশন: ব্রাউজার প্রতিটি পৃষ্ঠার টেক্সট আইটেম পড়ে, প্রায়শই পাঠক্রমে যুক্ত করে, পৃষ্ঠাগুলি আলাদা করে এবং একটি UTF-8 প্লেইন-টেক্সট ডাউনলোড তৈরি করে। দস্তাবেজ ব্রাউজারের মেমরিতেই থাকে। OCR কোড ও নির্বাচিত ভাষার মডেল এই সাইট থেকে ডাউনলোড হয়; এটি ফাইল আপলোড নয়। পৃষ্ঠা ছাড়লে বা মুছলে দস্তাবেজ ও ফলাফল বাদ যায়। এই পৃষ্ঠাগুলো OCR ছাড়াই কপি হয়। স্ক্যানের শুধু শিরোনাম লেখা হলে এবং বাকি অংশ শনাক্ত করতে হলে এটি বন্ধ করুন।

কিভাবে এটি ব্যবহার করবেন

  1. উৎস প্রস্তুত করুন: ডিজিটালি তৈরি প্রতিবেদনে, প্রবন্ধ, চালান এবং নোট থেকে পড়ার যোগ্য টেক্সট কপি করা সার্চ বা সম্পাদনার জন্য।
  2. স্থানীয়ভাবে প্রসেস করুন: সাধারণ নিষ্কাশন: ব্রাউজার প্রতিটি পৃষ্ঠার টেক্সট আইটেম পড়ে, প্রায়শই পাঠক্রমে যুক্ত করে, পৃষ্ঠাগুলি আলাদা করে এবং একটি UTF-8 প্লেইন-টেক্সট ডাউনলোড তৈরি করে। দস্তাবেজ ব্রাউজারের মেমরিতেই থাকে। OCR কোড ও নির্বাচিত ভাষার মডেল এই সাইট থেকে ডাউনলোড হয়; এটি ফাইল আপলোড নয়। পৃষ্ঠা ছাড়লে বা মুছলে দস্তাবেজ ও ফলাফল বাদ যায়। এই পৃষ্ঠাগুলো OCR ছাড়াই কপি হয়। স্ক্যানের শুধু শিরোনাম লেখা হলে এবং বাকি অংশ শনাক্ত করতে হলে এটি বন্ধ করুন।
  3. ডাউনলোড করুন এবং যাচাই করুন: ব্যবহারের আগে শনাক্ত লেখা ও PDF মূলের সঙ্গে মিলিয়ে দেখুন। আস্থার স্কোর একটি অনুমান, নির্ভুলতার নিশ্চয়তা নয়।

গুরুত্বপূর্ণ সীমাবদ্ধতা

শুধু মুদ্রিত লেখার জন্য। OCR অক্ষর ভুল পড়তে পারে; সম্পাদনাযোগ্য বিন্যাস, সারণি বা হাতের লেখা পুনর্গঠন করে না। OCR পৃষ্ঠা অদৃশ্য লেখার স্তরসহ ছবি হয়; সেই পৃষ্ঠার লিংক, ফর্ম, টীকা ও স্বাক্ষর থাকে না। এটি PDF/A সনদ নয়।

ডাউনলোড করা ফলাফল যাচাই করুন

ব্যবহারের আগে শনাক্ত লেখা ও PDF মূলের সঙ্গে মিলিয়ে দেখুন। আস্থার স্কোর একটি অনুমান, নির্ভুলতার নিশ্চয়তা নয়।

নকশা দ্বারা ব্যক্তিগত

আপনার ফাইলগুলি এই ব্রাউজারে থাকে। সরঞ্জামটি আমাদের সার্ভারগুলিতে উত্স বা আউটপুট আপলোড করে না।

প্রশ্ন ও উত্তর

এই সরঞ্জামটি কখন উপকারী?

ডিজিটালি তৈরি প্রতিবেদনে, প্রবন্ধ, চালান এবং নোট থেকে পড়ার যোগ্য টেক্সট কপি করা সার্চ বা সম্পাদনার জন্য।

ব্রাউজার আসলে কী করে?

সাধারণ নিষ্কাশন: ব্রাউজার প্রতিটি পৃষ্ঠার টেক্সট আইটেম পড়ে, প্রায়শই পাঠক্রমে যুক্ত করে, পৃষ্ঠাগুলি আলাদা করে এবং একটি UTF-8 প্লেইন-টেক্সট ডাউনলোড তৈরি করে। দস্তাবেজ ব্রাউজারের মেমরিতেই থাকে। OCR কোড ও নির্বাচিত ভাষার মডেল এই সাইট থেকে ডাউনলোড হয়; এটি ফাইল আপলোড নয়। পৃষ্ঠা ছাড়লে বা মুছলে দস্তাবেজ ও ফলাফল বাদ যায়। এই পৃষ্ঠাগুলো OCR ছাড়াই কপি হয়। স্ক্যানের শুধু শিরোনাম লেখা হলে এবং বাকি অংশ শনাক্ত করতে হলে এটি বন্ধ করুন।

কোন সীমাগুলি আমাকে বুঝতে হবে?

শুধু মুদ্রিত লেখার জন্য। OCR অক্ষর ভুল পড়তে পারে; সম্পাদনাযোগ্য বিন্যাস, সারণি বা হাতের লেখা পুনর্গঠন করে না। OCR পৃষ্ঠা অদৃশ্য লেখার স্তরসহ ছবি হয়; সেই পৃষ্ঠার লিংক, ফর্ম, টীকা ও স্বাক্ষর থাকে না। এটি PDF/A সনদ নয়।

ফলাফল কীভাবে যাচাই করা উচিত?

ব্যবহারের আগে শনাক্ত লেখা ও PDF মূলের সঙ্গে মিলিয়ে দেখুন। আস্থার স্কোর একটি অনুমান, নির্ভুলতার নিশ্চয়তা নয়।

সংক্রান্ত সরঞ্জাম