PDF معمولی و اسکن چه فرقی دارن؟
PDF معمولی داخل خودش متن واقعی داره و میشه فونت، اندازه، عکس و جدولش رو مستقیم خوند. PDF اسکنشده در اصل چندتا عکسه؛ برای همین بتول روی اون صفحهها OCR فارسی و انگلیسی اجرا میکنه تا نوشتهها قابل ویرایش بشن.
فایل معمولی باشه متن و چیدمانش رو درمیاریم؛ عکس یا اسکن باشه OCR فارسی و انگلیسی خودکار روشن میشه. آخرش یک فایل DOCX قابل ویرایش میگیری که توی Word باز میشه.
صفحه اسکنشده رو خودکار تشخیص میدیم و متنش رو قابل ویرایش درمیاریم.
خروجی DOCX توی Microsoft Word، LibreOffice و برنامههای مشابه باز میشه.
توی PDF متنی، جدول و عکس رو پیدا میکنیم و جهت نوشته فارسی رو نگه میداریم.
PDF معمولی داخل خودش متن واقعی داره و میشه فونت، اندازه، عکس و جدولش رو مستقیم خوند. PDF اسکنشده در اصل چندتا عکسه؛ برای همین بتول روی اون صفحهها OCR فارسی و انگلیسی اجرا میکنه تا نوشتهها قابل ویرایش بشن.
توی PDFهای متنی، جدولها و عکسها شناسایی و وارد DOCX میشن. جای عناصر رو تا جایی که ساختار Word اجازه بده نزدیک نگه میداریم؛ ولی فایل چندستونه، فرم خیلی پیچیده یا اسکن کج ممکنه بعدش یکم مرتبکاری بخواد.
PDF متنی سریعتره. فایل اسکنشده چون هر صفحه با OCR خونده میشه بیشتر زمان میبره. وضعیت آپلود و پردازش رو همونجا میبینی.
نه. اول رمز فایل رو بردار و بعد دوباره بفرست.
برای تبدیل نه؛ فقط برای باز کردن فایل DOCX به Word، LibreOffice یا یک برنامه مشابه نیاز داری.