تقسیم آنلاین PDF: استخراج بازههای صفحه، جداسازی صفحات تکی و PDF-Lib درون مرورگر
⚡چگونه یک سند PDF را در مرورگر تقسیم کنیم
سند PDF خود را وارد کنید
PDF خود را به ناحیه آپلود بکشید یا برای انتخاب از دستگاه کلیک کنید. موتور سند را تجزیه و تعداد صفحات و تصاویر بندانگشتی را نمایش میدهد.
حالت تقسیم را انتخاب کنید
«بازه سفارشی» را برای استخراج صفحات مشخص (مثلاً 1-5، 8، 12)، «انفجار صفحات تکی» را برای جدا کردن تکتک صفحات یا «تقسیم بر اساس فاصله صفحه» را انتخاب کنید.
صفحات انتخابی را بیدرنگ پیشنمایش کنید
شبکه تعاملی تصاویر بندانگشتی را بررسی کنید تا تأیید شود بازه صفحه انتخابی دقیقاً بخشها و مدارکی را که میخواهید استخراج کنید در بر میگیرد.
PDF تقسیمشده را خروجی بگیرید و دانلود کنید
روی «تقسیم PDF» کلیک کنید. موتور سند استخراجشده را در حافظه کامپایل و پیوند دانلود فوری (یا بایگانی ZIP برای چند فایل) ارائه میدهد.
اسناد PDF بزرگ و یکپارچه بخشی همیشگی از زندگی حرفهای مدرناند. مشخصات پروژههای معماری چندصدصفحهای، بستههای جامع مدارک حقوقی، گزارشهای سالانه شرکتها، فصلهای اسکنشده کتاب و صورتحسابهای ماهانه انبوه اغلب دهها صفحه نامرتبط پیرامون بخشی دارند که واقعاً به آن نیاز دارید. ارسال ایمیلی یا بایگانی کل یک پرونده ۱۵۰ مگابایتی وقتی همکارتان فقط به صفحات ۱۲ تا ۱۸ نیاز دارد، پهنای باند را هدر میدهد، فضای ذخیرهسازی مشترک را شلوغ میکند و با افشای بخشهای نامرتبط محرمانگی را به خطر میاندازد.
ابزار «تقسیم PDF بر اساس صفحه» ما که در مرورگر اجرا میشود، استخراج دقیق سند را مستقیماً درون مرورگر شما فراهم میکند. بازههای صفحه سفارشی (مثلاً `1-5, 8, 11-14`) را استخراج کنید، کل یک سند را به PDFهای تکصفحهای جداگانه تقسیم کنید یا پروندههای بزرگ را در چند ثانیه به فصلهای چندصفحهای ثابت تقسیم کنید. موتور ما با پیمایش هوشمند درخت اشیا، هرس منابع بدون ارجاع و حفظ بدون اتلاف جریانها، اسناد PDF سبک و کاملاً قالببندیشده را بدون هیچ افت کیفیتی خروجی میدهد. چون ۱۰۰٪ بهصورت محلی در مرورگر شما از طریق WebAssembly و PDF-Lib کار میکند، پروندههای خصوصی مدارک حقوقی و حسابرسیهای مالی شما بدون هیچ آپلودی به سرور کاملاً محرمانه میمانند.
خواندن راهنمای فنی کامل
چالش مهندسی تقسیم PDF: حل گرافهای شیء مشترک
تقسیم یک سند PDF بسیار پیچیدهتر از بریدن یک ویدیو یا قطعهقطعه کردن یک فایل متنی است. در مشخصات ISO 32000، یک PDF شبکهای بههمپیوسته از اشیای غیرمستقیم است. صفحات فونتها، پروفایلهای رنگ یا تصاویر خود را بهصورت محلی ذخیره نمیکنند؛ به واژهنامههای منابع مشترکی که جای دیگری در سند قرار دارند ارجاع میدهند.
برای مثال، یک تصویر لوگوی مشترک شرکت (`/XObject`) ممکن است یک بار بهعنوان شیء ۴۲ تعریف و در همه ۲۰۰ صفحه ارجاع داده شود. هنگام استخراج فقط صفحات ۱۰ تا ۱۵، یک اسکریپت تقسیم آماتور یا در کپی شیء ۴۲ شکست میخورد (که باعث ناپدید شدن تصاویر و از کار افتادن رندر میشود) یا کورکورانه همه ۵٬۰۰۰ شیء کل سند را در خروجی ۵ صفحهای کپی میکند. نقص دوم باعث میشود یک گزیده ۵ صفحهای دقیقاً همان ۱۰۰ مگابایت فایل اصلی ۲۰۰ صفحهای را وزن داشته باشد! موتور ما این مشکل را با تحلیل وابستگی عمقاول و استخراج فقط اشیای مشخصی که صفحات هدف لازم دارند حل میکند.
حالتهای استخراج: بازههای سفارشی، صفحات تکی و قطعات ثابت
ابزار ما از سه گردشکار همهکاره تقسیم متناسب با خط لولههای حرفهای اسناد پشتیبانی میکند: • بازههای صفحه سفارشی: فواصل دقیق صفحه را با نحو استاندارد مشخص کنید (مثلاً `1-3, 7, 12-15`). برای جدا کردن یک بند مشخص قرارداد، استخراج خلاصه مدیریتی یا جداسازی صفحات مدارک غیرمتوالی عالی است. • انفجار به PDFهای تکصفحهای: بهطور خودکار تکتک صفحات سند منبع را به فایل PDF مستقل خود تقسیم میکند (`document-page-001.pdf`، `document-page-002.pdf`). برای پردازش صورتحسابهای اسکنشده انبوه، چکها، درخواستهای آزمایشگاه پزشکی و برگههای امتحان دانشجویان برای نمایهسازی خودکار ایدهآل است. • قطعات صفحه ثابت: اسناد بزرگ را به فواصل یکنواخت (مثلاً هر ۵ یا هر ۱۰ صفحه) تقسیم میکند و راهنماهای عظیم و فصلهای کتاب درسی را برای توزیع موبایل قابل مدیریت میکند.
هرس اشیای یتیم و بهینهسازی حجم بایتی
هنگام استخراج زیرمجموعه کوچکی از صفحات یک PDF عظیم، کمینه کردن حجم نهایی فایل نیازمند هرس تهاجمی اشیای یتیم است. در گردشکارهای PDF بهینهنشده، صفحات استخراجشده بار زیرمجموعههای فونت TrueType جاسازیشده بیاستفاده، گرافیکهای پسزمینه پروضوح از فصلهای حذفشده و تاریخچههای بهروزرسانی افزایشی منسوخ را با خود حمل میکنند.
موتور ما گراف اشیا را صرفاً از مدخلهای `/Resources` واژهنامههای صفحات انتخابی آغاز و پیمایش میکند. فقط فونتها، XObjectها، الگوهای سایهزنی و وضعیتهای گرافیکی توسعهیافته (`/ExtGState`) که صفحات استخراجشده فعالانه به آنها ارجاع میدهند در سند جدید سریالسازی میشوند. اشیای بدون ارجاع کاملاً کنار گذاشته میشوند. یک گزیده ۱۰ صفحهای استخراجشده از یک فایل اصلی متورم ۱۵۰ مگابایتی بهطور معمول به کمتر از ۱.۵ مگابایت میرسد و برای تحویل فوری ایمیلی آماده است.
حفظ هندسه صفحه، سیستمهای مختصات و چرخشها
اسناد اغلب جهتهای ترکیبی و مرزهای کاغذ سفارشی دارند: نقشههای معماری قالببندیشده بهصورت برگههای افقی ۲۴×۳۶ اینچی اندازه D که در میان برگههای مشخصات عمودی استاندارد ۸.۵×۱۱ اینچی قرار گرفتهاند.
موتور تقسیم ما سلسلهمراتب کامل کادرهای مرزی را برای هر صفحه استخراجشده صراحتاً حفظ میکند: `/MediaBox` (مرزهای فیزیکی کاغذ)، `/CropBox` (نمای قابلمشاهده)، `/BleedBox` و `/TrimBox`. افزون بر این، پرچمهای چرخش بومی (`/Rotate`) دقیقاً بازتاب داده میشوند و تضمین میکنند نقشههای افقی در حالت افقی باز شوند و اسکنهای چرخیده جهت بصری درست خود را حفظ کنند.
بستهبندی دستهای ZIP برای انفجار صفحات تکی
هنگام انفجار یک سند ۱۰۰ صفحهای به PDFهای تکصفحهای جداگانه، دانلود ۱۰۰ فایل جداگانه از طریق پنجرههای دانلود مرورگر باعث فعال شدن مسدودسازیهای امنیتی مرورگر میشود و پوشه دانلودهای کاربر را پر میکند.
ابزار ما بایگانی ZIP درون حافظه سمت کاربر (JSZip) را یکپارچه کرده است. وقتی «انفجار صفحات تکی» انتخاب شود، موتور هر PDF مستقل را در RAM دستگاه کامپایل میکند، همه فایلها را در یک بایگانی `.zip` مرتب با نامهای فایل متوالی صفرپرشده (`page-001.pdf` تا `page-100.pdf`) بستهبندی میکند و یک دانلود واحد بایگانی را آغاز میکند.
کشف مدارک حقوقی، پژوهش دانشگاهی و گردشکارهای کسبوکار
تقسیم PDFها قابلیتی ضروری در بخشهای مختلف سازمانی و دانشگاهی است: • کشف مدارک حقوقی و دعاوی: تیمهای دعاوی باید پیش از ارائه فایلها به وکیل طرف مقابل، مدارک محرمانه مشخص را از هزاران صفحه اسناد کشف احضاریهشده سیاهکاری و جدا کنند. • پژوهش دانشگاهی: دانشجویان و استادان کتابهای درسی دیجیتال سنگین ۸۰۰ صفحهای را برای تکالیف هفتگی برنامه درسی به خوانشهای فصلبهفصل جداگانه تقسیم میکنند. • حسابداری مالی: بخشهای حسابداری صورتحسابهای ماهانه بانکی را تقسیم میکنند تا سوابق تراکنش بخشهای مشخص را برای تطبیق هزینهها جدا کنند.
امنیت ۱۰۰٪ سمت کاربر درون مرورگر برای فایلهای ممتاز
تقسیم اسناد اغلب با اطلاعات حساس و ممتاز سروکار دارد: قراردادهای حقوقی محرمانه، درخواستهای ثبت اختراع اختصاصی، پروندههای پزشکی بیماران و ترازنامههای داخلی شرکت. آپلود این اسناد در تقسیمکنندههای ابری آنلاین PDF خطرات جدی عدم انطباق مقرراتی تحت GDPR، HIPAA و سیاستهای محرمانگی سازمانی ایجاد میکند.
ابزار «تقسیم PDF بر اساس صفحه» ما ۱۰۰٪ بهصورت محلی درون مرورگر وب شما اجرا میشود. این ابزار بر پایه WebAssembly سمت کاربر و PDF-Lib ساخته شده و همه تجزیه دودویی، حل گراف وابستگی و سریالسازی سند صرفاً در RAM دستگاه فیزیکی شما انجام میشوند. هیچ صفحه، متن یا فرادادهای هرگز رایانه شما را ترک نمیکند و حریم خصوصی کامل و امنیت مطلق تضمین میشود.
💡بهترین شیوههای حرفهای برای تقسیم PDFها
- •از نحو خط تیره و ویرگول استفاده کنید: بازهها را بهراحتی مشخص کنید: `1-5, 8, 10-12` صفحات ۱ تا ۵، صفحه ۸ و صفحات ۱۰ تا ۱۲ را در یک سند جدید استخراج میکند.
- •برای OCR خودکار منفجر کنید: دستههای اسکنشده چندصفحهای را برای پردازش خودکار OCR در گردشکارهای نمایهسازی اسناد به PDFهای تکصفحهای منفجر کنید.
- •هرس فایلها را کوچک نگه میدارد: ابزار ما فونتها و تصاویر بدون ارجاع را کنار میگذارد و تضمین میکند گزیده ۲ صفحهای از یک فایل ۱۰۰ مگابایتی فقط چند صد کیلوبایت وزن داشته باشد.
- •پس از تقسیم فشرده کنید: اگر باید تصاویر پروضوح را برای پیوست ایمیل بهینه کنید، PDF استخراجشده را از ابزار «فشردهسازی فایل PDF» ما عبور دهید.
- •صفحات افقی را بررسی کنید: اگر بخش استخراجشده شما نقشههای افقی دارد، ابزار ما برچسب `/Rotate` را حفظ میکند تا صفحات در همه نمایشگرها درست باز شوند.
- •صفحات امضا را استخراج کنید: صفحات امضاشده را بهراحتی از قراردادهای ۵۰ صفحهای برای چکلیستهای اختتامیه و تأییدیههای مشتری جدا کنید.
- •حریم خصوصی کامل سمت کاربر: با خیال راحت بدانید مدارک حقوقی و اسناد مالی محرمانه شما ۱۰۰٪ بهصورت محلی روی رایانهتان پردازش میشوند.
🛡️مشخصات فنی و معماری استخراج اشیا
موتور تقسیم PDF درون مرورگر یک خط لوله پرسرعت استخراج اشیای ISO 32000 را پیادهسازی میکند: ۱. تجزیه دودویی و نگاشت صفحات: PDF منبع از یک `ArrayBuffer` درون حافظه تجزیه میشود. موتور جدول ارجاع متقابل را میخواند و درخت ریشه `/Pages` را حل میکند و یک آرایه صفحات با نمایه از صفر `[0 ... N-1]` میسازد. ۲. ارزیابی بازه صفحه: رشتههای ورودی کاربر (مثلاً `'1-3, 5'`) به یک آرایه نمایه صفحه از صفر `[0, 1, 2, 4]` کامپایل میشوند. بررسی مرزها از استثناهای خارج از بازه جلوگیری میکند. ۳. پیمایش و کپی گراف وابستگی: یک `PDFDocument` مقصد جدید راهاندازی میشود. فراخوانی `copyPages(sourceDoc, pageIndices)` پیمایش عمقاول گراف اشیا را آغاز میکند. الگوریتم فقط اشیای غیرمستقیمی را که از واژهنامههای صفحات انتخابی قابل دسترسیاند (Fonts، XObjects، ExtGStates و Content Streams) کپی و شناسههای شیء متوالی جدید در سند مقصد تخصیص میدهد. ۴. مونتاژ کاتالوگ و XRef: سند مقصد یک Document Catalog تازه، یک واژهنامه `/Pages` تمیز با `/Count` مطابق کل صفحات استخراجشده و یک جدول XRef دقیق در سطح بایت میسازد. ۵. سریالسازی خروجی: برای بازههای تکی، Blob دودویی مستقیماً دانلود میشود. برای حالتهای انفجار، چند Blob مستقل به JSZip فرستاده میشوند و یک بایگانی `.zip` فشردهنشده یا فشرده با deflate تولید میشود.
فناوری: WebAssembly • Web Workers چندرشتهای • HTML5 Canvas API
حریم خصوصی: فایلها از دستگاه شما خارج نمیشوند و در فضای ابری ذخیره نمیشوند؛ آمار فقط با رضایت شما اجرا میشود.
ابزارهای مکمل این روند کار
این ابزارهای مرورگری را برای روند کاری پربازده با هم ترکیب کنید.
ادغام اسناد PDF
چندین سند PDF را در چند ثانیه در یک سند مرتب ترکیب کنید.
چرخش صفحات PDF
جهت عمودی و افقی صفحات PDF را ۹۰، ۱۸۰ یا ۲۷۰ درجه بچرخانید.
تغییر ترتیب صفحات PDF
با کشیدن و رها کردن تصاویر بندانگشتی، صفحات را به هر ترتیبی مرتب کنید.
حذف صفحات از PDF
صفحات ناخواسته، برگههای خالی یا جلدها را از اسناد حذف کنید.