اجازه ندهید روند پیش چاپ دوباره کند شود! ابزارهایی که خودمان{0}}توسعه داده ایم کارایی را تقریباً 10 برابر افزایش داده اند
زمینه توسعه: نشات گرفته از نیازهای واقعی تولید
پردازش سند پیش از چاپ در چاپ دیجیتال زمان زیادی را می طلبد. پس از برقراری ارتباط با اپراتورهای خط مقدم، سه نیاز اصلی شناسایی و روشن شد.
(1) تعداد صفحات سند چک دسته ای: در طول چاپ و طرح بندی، اغلب لازم است اطمینان حاصل شود که سند دارای تعداد صفحات زوج است. در غیر این صورت، به راحتی می تواند منجر به هدر رفتن مواد چاپی یا خطاهای صحافی شود.
(2) مدیریت خودکار اسناد صفحه فرد-: برای اسناد دارای صفحات فرد، صفحات خالی باید در پایان اضافه شوند، در حالی که صفحات زوج بدون تغییر باقی می مانند.
(3) دستهای بررسی کنید که آیا متن منحنی است یا خیر: برای جلوگیری از خطاهای چاپی ناشی از فونتهای از دست رفته، تأیید کنید که متن در سند به منحنی تبدیل شده است (یعنی "منحنی").
از طریق تحقیق بر روی Adobe Acrobat و پلاگین های مختلف پردازش PDF موجود در بازار، مشخص شد که ابزارهای موجود یا از نظر عملکردی اضافی و پیچیده هستند یا با فرآیندهای تولید واقعی شرکت مطابقت ندارند، به خصوص با خطرات پنهان در امنیت پردازش وارونه. مهمتر از همه، ابزارهای مشابه داخلی اغلب نیاز به پرداخت دارند، که در نتیجه هزینههای طولانیمدت استفاده- بیشتر میشود. بر اساس این مسائل عملی، این شرکت تصمیم گرفت تا یک ابزار تخصصی سبک وزن، دقیق و داخلی طراحی کند.
ابزار بررسی و پردازش تعداد صفحات PDF
01
توابع اصلی و منطق قضاوت
هدف اصلی این ابزار اطمینان از این است که تمام اسنادی که قرار است چاپ شوند دارای تعداد صفحات زوج باشند. رویکرد قضاوت و اجرا به شرح زیر است.
(1) مکانیسم تشخیص صفحه: فراداده اسناد PDF را از طریق کتابخانه PyMuPDF می خواند تا به طور مستقیم اطلاعات کل صفحه را به دست آورد.
(2) قضاوت منطقی برابری: از عملیات مدول (شماره صفحه %2) برای تعیین برابری استفاده کنید. اگر نتیجه 1 باشد، مشخص می شود که صفحات فرد هستند. اگر 0 باشد، زوج در نظر گرفته می شود.
(3) استراتژی پردازش متمایز: برای صفحات فرد-با شماره، به طور خودکار یک صفحه خالی در انتهای سند اضافه کنید که با اندازه سند اصلی مطابقت دارد. برای اسناد صفحه زوج، محتوا را بدون تغییر نگه دارید و مستقیماً در فهرست خروجی کپی کنید.
(4) اصل مدیریت امنیت: تمام اسناد پردازش شده در فهرست مشخص شده "Processed Files" ذخیره می شوند و فایل های اصلی حفظ می شوند تا از آسیب به فایل ناشی از عملکرد نادرست جلوگیری شود، همانطور که در شکل 1 نشان داده شده است.
شکل 1 واسط ابزار پردازش شمارش صفحات PDF
02
نکات اجرایی فنی
این ابزار از Tkinter برای ساخت رابط گرافیکی استفاده می کند و عمدتاً شامل سه ماژول کاربردی است.
(1) ماژول انتخاب دایرکتوری: از انتخاب بصری دایرکتوری فایل منبع و دایرکتوری خروجی پشتیبانی می کند، با دایرکتوری خروجی پیش فرض یک زیر پوشه در زیر پوشه منبع است.
(2) ماژول پردازش دستهای: از فناوری چند رشتهای برای انجام پردازش پسزمینه استفاده میکند، از انجماد رابط اجتناب میکند و به طور همزمان پیشرفت پردازش را از طریق نوار پیشرفت نمایش میدهد.
(3) ماژول نمایش نتایج: نتایج پردازش هر فایل را در قالب جدول، از جمله تعداد صفحات اصلی، عملکرد پردازش، و اطلاعات وضعیت ارائه میکند و حالتهای موفق و ناموفق را با رنگ تشخیص میدهد.
ابزار بررسی تبدیل منحنی PDF
01
توابع اصلی و منطق قضاوت
ابزار بررسی تبدیل منحنی بر تعیین اینکه آیا متن در یک سند به منحنی تبدیل شده است یا خیر تمرکز دارد. منطق قضاوت اصلی آن مبتنی بر تجزیه و تحلیل اطلاعات فونت در سند PDF است.
(1) تشخیص وجود متن: با استخراج متن از صفحات مشخص می کند که آیا سند دارای متن قابل ویرایش است یا خیر.
(2) تجزیه و تحلیل اطلاعات فونت: فهرست فونت های تعبیه شده در سند را تجزیه می کند. اگر اطلاعات فونت وجود داشته باشد، نشان می دهد که متن به منحنی تبدیل نشده است.
(3) قواعد قضاوت جامع: اگر محتوای متنی وجود داشته باشد و اطلاعات قلم وجود نداشته باشد، نشان دهنده تبدیل متن به منحنی (علامت سبز) است. اگر محتوای متنی وجود نداشته باشد، نیازی به تبدیل نیست (علامت سبز). اگر محتوای متن و اطلاعات فونت وجود داشته باشد، متن به منحنی (علامت قرمز) تبدیل نشده است، همانطور که در شکل 2 نشان داده شده است.
این ابزار به طور ویژه در حالت "فقط بررسی، تبدیل نکنید" طراحی شده است. دلیل اصلی این است که، طبق بازخورد اپراتور، انجام تبدیل منحنی بر روی فایلهای حاوی مهر و موم رسمی ممکن است به راحتی باعث از بین رفتن مهر و موم یا سایر گرافیکها شود، بنابراین ابزار فقط عملکرد بررسی را حفظ میکند.

شکل 2 ابزار بررسی منحنی PDF
02
نکات کلیدی اجرایی فنی
این ابزار همچنین از Tkiner برای ساخت رابط، با سه نکته فنی کلیدی استفاده می کند.
(1) استخراج اطلاعات فونت: با استفاده از تابع تجزیه و تحلیل بلوک متن PyMuPDF، همه نام فونت ها و تعداد وقوع آنها را در سند بدست آورید.
(2) تجسم نتیجه: از نماهای درختی برای نمایش نتایج بازرسی استفاده کنید و حالت های مختلف را به طور مستقیم از طریق رنگ ها و نمادها متمایز کنید.
(3) تابع آمار وضعیت: به طور خودکار تعداد اسنادی را که الزامات را برآورده می کنند محاسبه می کند و به اپراتورها کمک می کند تا وضعیت کلی بازرسی را سریع درک کنند.
چالش ها و راه حل ها در طول فرآیند توسعه
به عنوان یک توسعهدهنده غیرحرفهای، در طول توسعه ابزار با چالشهای فنی زیادی مواجه شدم. مشکلات و راه حل های خاص به شرح زیر است.
(1) مشکل عمق تجزیه PDF: کتابخانه اولیه PDF نمی تواند اطلاعات فونت را به طور دقیق استخراج کند، اما پس از پیشنهاد هوش مصنوعی، تغییر به کتابخانه PyMu PDF مشکل را حل کرد.
(2) مشکل تاخیر رابط: هنگام پردازش تعداد زیادی فایل به صورت دستهای، رابط اغلب پاسخگو نمیشود. تحت هدایت هوش مصنوعی، یک راه حل پردازش چند رشته ای پیاده سازی شد که به طور موثر این مشکل را حل کرد.
(3) متن آشفته چینی: با پیکربندی پارامترهای فونت و تنظیمات رمزگذاری، مشکل نویسههای چینی آشفته نمایش داده شده در رابطها و فایلهای صادر شده حل میشود.
(4) مکانیسم رسیدگی به استثنا: برای رسیدگی به مشکل خرابی های برنامه ناشی از فایل های PDF خراب، مکانیسم ضبط استثنا بهبود یافته است تا اطمینان حاصل شود که شکست یک فایل روی فرآیند کلی تأثیر نمی گذارد.
در طول فرآیند توسعه، ابزارهای هوش مصنوعی نقش مهمی را به عنوان مشاور فنی ایفا کردند و نه تنها نمونههای کد کلیدی را ارائه کردند، بلکه اصول تجزیه فرمت فایل PDF را نیز توضیح دادند و به توسعهدهندگان کمک کردند تا دانش تخصصی را به سرعت درک کنند.
ارزش و چشم انداز برنامه های کاربردی ابزار
بکارگیری این دو ابزار بهبودهای قابل توجهی را در کار تولید به ارمغان آورده است که به طور خاص در دو جنبه زیر منعکس شده است.
(1) صرفه جویی در زمان: بازرسی های دستی که قبلاً 1 ساعت طول می کشید، اکنون می توانند در 5 دقیقه تکمیل شوند و کارایی را تقریباً 10 برابر افزایش دهند.
(2) ثبات کیفیت بهبود یافته: به طور موثر از نظارت بر بازرسی دستی جلوگیری می کند و کیفیت چاپ ثابت را تضمین می کند.
مستندسازی روند توسعه این دو گجت با هدف انتقال فلسفه کاری «اکتشاف و نوآوری»، تمرکز بر حل مشکلات خاص در تولید واقعی، بهینهسازی جریانهای کاری سنتی از طریق ابزارهای فنی، و در نهایت دستیابی به کاهش هزینه و بهبود کارایی است.

