FileCarpenter
কিছু PDF টেক্সট সম্পাদনাযোগ্য আর কিছু নয় কেন
PDF হলো পৃষ্ঠার বর্ণনা দেওয়ার ফরম্যাট, Word ডকুমেন্ট নয়। দেখতে একই রকম দুটি পৃষ্ঠায় ভেতরে টেক্সট সম্পূর্ণ ভিন্নভাবে সংরক্ষিত থাকতে পারে, তাই নির্ভরযোগ্য সম্পাদনা শুরু হয় পৃষ্ঠার অবজেক্ট বোঝা থেকে।
PDF-এ স্বাভাবিকভাবে “প্যারাগ্রাফ” থাকে না
PDF পৃষ্ঠা সাধারণত বলে দেয় প্রতিটি গ্লিফ কোথায় আঁকা হবে। কিছু সফটওয়্যার ফন্ট, অক্ষর ম্যাপিং ও স্পেসিংয়ের যথেষ্ট তথ্য রাখে; অন্যগুলো একটি শব্দকে অনেক ছোট টেক্সট অপারেটরে ভেঙে দেয় বা গ্লিফ কোড অস্বাভাবিকভাবে পুনর্ব্যবহার করে।
কখন কাঠামোগতভাবে টেক্সট বদলানো যায়
নির্বাচনযোগ্য টেক্সটের ফন্ট ম্যাপিং ব্যবহারযোগ্য হলে প্রায়ই কাঠামোগত সম্পাদনা সম্ভব। FileCarpenter টেক্সট রান, ফন্ট, স্পেসিং ও আশেপাশের অবজেক্ট পরীক্ষা করে। কাঠামো খুব অস্পষ্ট হলে পরিবর্তন প্রত্যাখ্যান করা বা compatibility workflow ব্যবহার করা নীরবে পৃষ্ঠা নষ্ট করার চেয়ে নিরাপদ।
স্ক্যান ও আউটলাইনে রূপান্তরিত অক্ষর আলাদা
স্ক্যান করা পৃষ্ঠায় শুধু পিক্সেল থাকতে পারে; অদৃশ্য OCR layer টেক্সট নির্বাচন করতে দিলেও দৃশ্যমান ছবির সঙ্গে পুরোপুরি মিলতে নাও পারে। কিছু ডিজাইন PDF অক্ষরকে vector outline-এ বদলে দেয়, যা টেক্সট নয় বরং shape।
সম্পাদনার পরে কী পরীক্ষা করবেন
লাইন ব্রেক, ফন্ট, স্পেসিং, clipping, tags ও কাছের graphics তুলনা করুন। গুরুত্বপূর্ণ নথিতে মূল ফাইল আলাদা রাখুন এবং export করা PDF যে viewer বা system-এ ব্যবহৃত হবে সেখানে আবার খুলে দেখুন।