ไทย

เอกสาร · PDF ชุดเครื่องมือ

จะเกิดอะไรขึ้นภายใต้ประทุนเมื่อคุณรวม PDF ในเบราว์เซอร์

· มันทำงานอย่างไร

pdf ไฟล์รูปแบบ การประมวลผลเบราว์เซอร์

แผนผังหน้า PDF สองรายการป้อนเข้าสู่เอกสาร PDF ใหม่
ภาพประกอบเวกเตอร์ต้นฉบับ ToolAcre

การรวม PDF ดูเหมือนเป็นการเย็บเล่ม แต่จริงๆ แล้วเครื่องมือนี้คือการคัดลอกวัตถุหน้า แบบอักษร และรูปภาพจากกราฟวัตถุหนึ่งไปยังอีกวัตถุหนึ่ง และเขียนตารางตัวอ้างอิงโยงใหม่ โพสต์นี้จะอธิบายกระบวนการดังกล่าวเมื่อเกิดขึ้นภายในแท็บเบราว์เซอร์

สิ่งสำคัญที่ไม่ใช่ — เหตุใด PDF สองไฟล์จึงไม่สามารถต่อกันเป็นไบต์ได้ง่ายๆ และเครื่องมือผสานต้องสร้างใหม่อย่างไร

PDF สองไฟล์แต่ละไฟล์มีส่วนหัว หมายเลขวัตถุ แผนผังหน้า และข้อมูลอ้างอิงโยงของตัวเอง การต่อท้ายไบต์ของไฟล์ที่สองหลังจากไฟล์แรกไม่ได้เพิ่มหน้าลงในแผนผังหน้าของเอกสารแรก การควบรวมกิจการจะต้องเขียน PDF ใหม่พร้อมการอ้างอิงที่ชี้ไปที่ออบเจ็กต์ของตนเอง

การอ่านแต่ละไฟล์ลงในหน่วยความจำ — วิธีที่เบราว์เซอร์โหลด PDF ของคุณเป็นอาร์เรย์ไบต์ผ่านไฟล์ API โดยไม่ต้องอัปโหลดใดๆ

ตัวเลือกไฟล์จะให้ออบเจ็กต์ไฟล์ของเบราว์เซอร์ ไม่ใช่ URL ของเซิร์ฟเวอร์ อินเทอร์เฟซ PDF อ่านแต่ละไฟล์ที่เลือกด้วย file.arrayBuffer() และส่งไบต์ Uint8Array ไปยังการดำเนินการประมวลผล การผสานไม่ได้อัปโหลดไฟล์ สิ่งนี้แตกต่างจากการอ้างว่าการเข้าชมเว็บไซต์ไม่เคยส่งคำขอเครือข่าย กล่าวคือ การโหลดไซต์นั้นจำเป็นต้องมีการเชื่อมต่อ

การแยกวิเคราะห์กราฟวัตถุ - ส่วนหัว, วัตถุที่มีหมายเลข, แผนผังหน้าและตารางตัวอ้างอิงโยงที่ parser ต้องสร้างขึ้นใหม่

ไลบรารี PDF โหลดเอกสารต้นฉบับแต่ละฉบับและแก้ไขดัชนีหน้า หน้าต่างๆ อ้างถึงออบเจ็กต์ในส่วนอื่นๆ ในไฟล์ รวมถึงแบบอักษร รูปภาพ และสถานะกราฟิก ส่วนอ้างอิงโยงหรือสตรีมช่วยให้ผู้อ่านค้นหาวัตถุทางอ้อม ไม่ใช่รายการหน้าที่จะรวมเข้าด้วยกัน อินพุตที่เสียหายหรือเข้ารหัสสามารถป้องกันการแยกวิเคราะห์ได้

การคัดลอกหน้าและทรัพยากร — เพราะเหตุใดแบบอักษร รูปภาพ และกราฟิกทุกตัวจึงระบุว่าการอ้างอิงหน้าต้องเดินทางไปด้วย

การใช้งานจะเรียก PDFDocument.create() จากนั้น out.copyPages(source, source.getPageIndices()) สำหรับแต่ละอินพุตตามลำดับ และเพิ่มแต่ละหน้าที่คัดลอกไปยังเอาต์พุต ไลบรารีจะถ่ายโอนโครงสร้างอ้างอิงที่จำเป็นสำหรับแต่ละหน้า มันไม่ได้สร้างภาพหน้าจอบิตแมป อย่าถือว่าคุณลักษณะระดับเอกสารทุกรายการจะย้ายไปพร้อมกับหน้าต่างๆ

การเขียนไฟล์ที่ผสาน — การกำหนดหมายเลขวัตถุใหม่ การสร้างแผนผังหน้าใหม่และตารางตัวอ้างอิงโยง จากนั้นมอบการดาวน์โหลดให้กับคุณ

หลังจากเพิ่มหน้า ไลบรารีจะบันทึกอาร์เรย์ไบต์ PDF ใหม่ ตัวเขียนจะจัดการการอ้างอิงอ็อบเจ็กต์และการทำให้เป็นอนุกรม แทนที่จะเชื่อมไฟล์ต้นฉบับเข้าด้วยกัน แอปพลิเคชันเสนอผลลัพธ์เป็นการดาวน์โหลด เนื่องจากนี่เป็นเอกสารใหม่ ขนาดไบต์จึงไม่จำเป็นต้องเท่ากับผลรวมของอินพุต

ตัวอย่างการทำงาน — การรวมจดหมายปะหน้าสามหน้าเข้ากับข้อตกลงที่สแกนสิบสองหน้าเข้าด้วยกัน และลำดับและขนาดของหน้าผลลัพธ์บอกคุณว่าอย่างไร

สมมติว่าผู้ดูแลระบบสำนักงานเลือกจดหมายปะหน้าสามหน้าก่อนและข้อตกลงสิบสองหน้าที่สอง ผลลัพธ์ควรมีสิบห้าหน้า: ครอบคลุมหน้า 1–3 จากนั้นจึงตกลงหน้า 4–15 ตรวจสอบหน้าแรกและหน้าสุดท้ายและยอดรวมก่อนส่งไฟล์ ข้อตกลงที่สแกนอาจทำให้เอาต์พุตมีขนาดใหญ่เนื่องจากหน้าต่างๆ มีทรัพยากรรูปภาพ

สิ่งที่ไม่ครอบคลุม ได้แก่ บุ๊กมาร์ก ช่องแบบฟอร์ม และข้อมูลเมตาของเอกสาร ซึ่งการจัดการขึ้นอยู่กับกฎของเครื่องมือและได้รับการบันทึกไว้ในหน้าเครื่องมือ

การคัดลอกหน้าไม่รับประกันการเก็บรักษาบุ๊กมาร์ก ฟิลด์แบบฟอร์ม ข้อมูลเมตา หรือลายเซ็น โดยเฉพาะอย่างยิ่ง อย่าถือว่าลายเซ็นการเข้ารหัสยังคงใช้ได้หลังจากเขียนโครงสร้างใหม่ เก็บต้นฉบับและตรวจสอบข้อกำหนดในการลงนามทางกฎหมายแยกกัน ไฟล์ใหม่ไม่ใช่ต้นฉบับที่ลงนาม

นำไปใช้ — การรวมเป็นการเขียนโครงสร้างใหม่ ไม่ใช่การต่อข้อมูล และชุดเครื่องมือ PDF จะดำเนินการเขียนใหม่ในแท็บโดยที่ไฟล์จะไม่ออกจากอุปกรณ์ของคุณ

การผสาน PDF เป็นการเขียนโครงสร้างใหม่ ชุดเครื่องมือ PDF อ่านไบต์ที่เลือกในแท็บ คัดลอกหน้าตามลำดับไฟล์ที่เลือก และเขียนไฟล์ใหม่ หากต้องการตรวจสอบขอบเขตการประมวลผลเฉพาะที่ระหว่างเซสชันของคุณ ให้ตรวจสอบแผงเครือข่ายของเบราว์เซอร์ขณะรวมเข้าด้วยกัน แยกความแตกต่างระหว่างการโหลดเนื้อหาเว็บไซต์จากการอัพโหลดเอกสารของคุณ