PDF เป็นข้อความ
เนื้อหาของ PDF ในรูปข้อความธรรมดาที่นำกลับไปใช้ได้
ไฟล์ของคุณไม่เคยออกจากอุปกรณ์วาง PDF ของคุณที่นี่
ระบบดึงข้อความโดยอัตโนมัติทันทีที่วางไฟล์
วิธีดึงข้อความจาก PDF ทีละขั้นตอน
เครื่องมือเก็บข้อความที่มีอยู่จริงในไฟล์ ทีละหน้า เพื่ออ่านซ้ำหรือนำไปใช้ที่อื่น ไม่มีสิ่งใดถูกส่งออกนอกเบราว์เซอร์ของคุณ
วาง PDF
ลากไฟล์มาวางในพื้นที่วางไฟล์ หรือคลิกเพื่อเลือกไฟล์ของคุณ การดึงข้อความเริ่มทันที โดยไม่มีปุ่มให้คลิก
ให้ VellumPDF ไล่อ่านทุกหน้า
ข้อความของแต่ละหน้าถูกเก็บแล้วเชื่อมกับหน้าถัดไปด้วยเครื่องหมาย “———— หน้า n ————” ตามลำดับที่ปรากฏในไฟล์
ตรวจทานผลลัพธ์ที่แสดง
ข้อความทั้งหมดปรากฏในกรอบที่เลื่อนได้ พร้อมจำนวนอักขระและจำนวนคำอยู่ด้านบน
ดาวน์โหลดหรือคัดลอกข้อความ
“ดาวน์โหลด .txt” บันทึกไฟล์ข้อความที่ตั้งชื่อตาม PDF ต้นฉบับ “คัดลอก” วางผลลัพธ์ในคลิปบอร์ดเพื่อนำไปวางที่อื่น
PDF ที่ป้องกันด้วยรหัสผ่านจะถูกปฏิเสธทันทีพร้อมข้อความเฉพาะ ต้องลบการป้องกันด้วยเครื่องมือปลดล็อกก่อนจึงกลับมาที่นี่
คำถามที่พบบ่อย
ข้อความที่ดึงจาก PDF อยู่ในรูปแบบใด
ข้อความถูกส่งให้ในไฟล์ .txt จัดเรียงทีละหน้า นำไปใช้ต่อในโปรแกรมประมวลผลคำหรือเครื่องมืออื่นได้ ข้อความที่เก็บคือข้อความที่มีอยู่จริงในไฟล์ โดยไม่มีการจัดรูปแบบ
เครื่องมือนี้ใช้กับ PDF ที่สแกนได้หรือไม่
ไม่ การดึงข้อความอาศัยข้อความที่มีอยู่ในไฟล์ PDF แล้วเท่านั้น ไม่ใช่การรู้จำภาพ หากเอกสารเป็นภาพสแกนที่ไม่มีข้อความอยู่ข้างใต้ จะไม่ได้ข้อความใดเลย โปรดนำไปผ่านเครื่องมือ OCR ของ VellumPDF ก่อน
บริการนี้ฟรีหรือไม่ และเอกสารถูกส่งออนไลน์หรือไม่
ใช่ เครื่องมือฟรีและไม่จำกัดการใช้งาน การดึงข้อความเกิดขึ้นทั้งหมดในเบราว์เซอร์ของคุณ โดยไม่ส่ง PDF ไปยังเซิร์ฟเวอร์
ข้อความที่ดึงออกมายังคงเลย์เอาต์หรือไม่
ไม่ และเป็นลักษณะของรูปแบบนี้ คุณได้ข้อความ ไม่ใช่เลย์เอาต์ คอลัมน์ไล่ต่อกันทีละคอลัมน์ ตารางสูญเสียเส้นตาราง หากโครงสร้างสำคัญ การส่งออกเป็น Markdown จะคงหัวเรื่องไว้อย่างน้อย หากเลย์เอาต์สำคัญ ต้องส่งออกไปยัง Word
ข้อความจากหน้าสองคอลัมน์ออกมาตามลำดับใด
ตามลำดับที่ประกาศไว้ในไฟล์ ซึ่งโดยทั่วไปตามการอ่านตามธรรมชาติ แต่ไม่เสมอไป ในโบรชัวร์หรือหนังสือพิมพ์ บางครั้งกล่องข้อความแทรกอยู่กลางย่อหน้า การอ่านทบทวนอย่างรวดเร็วก็พอจะสังเกตเห็น
ทำไมการดึงข้อความจึงไม่ได้อะไรเลยกับบางไฟล์
เพราะเอกสารไม่มีชั้นข้อความ เป็นภาพของหน้า โดยทั่วไปเป็นภาพสแกนหรือรูปถ่าย จึงไม่มีสิ่งใดให้ดึง จริง ๆ แล้ว ให้นำไฟล์ไปผ่านการรู้จำอักขระก่อน ซึ่งเพิ่มชั้นนี้ แล้วเริ่มการดึงข้อความใหม่