การรู้จำข้อความ (OCR)
ภาพสแกนของคุณกลายเป็นข้อความ การวิเคราะห์อยู่บนเครื่องของคุณ
ไฟล์ของคุณไม่เคยออกจากอุปกรณ์วาง PDF หรือรูปภาพที่นี่
PDF ที่สแกนหรือรูปถ่าย — JPG, PNG
วิธีรู้จำข้อความจาก PDF ที่สแกนทีละขั้นตอน
OCR เปลี่ยนภาพสแกนเป็นข้อความที่ใช้งานได้ โดยโหลดเครื่องมือรู้จำข้อความในเบราว์เซอร์ของคุณโดยตรง เอกสารไม่เคยถูกส่งออนไลน์
วาง PDF ที่สแกนหรือรูปถ่าย
ลาก PDF หรือรูปภาพ JPG/PNG มาวางในพื้นที่วางไฟล์ หรือคลิกเพื่อเลือก
เลือกภาษาของเอกสาร
เลือกใน “ภาษาของเอกสาร” โดยภาษาของเว็บไซต์อยู่ต้นรายการ ตามด้วยอีกกว่าร้อยภาษา ซึ่งดาวน์โหลดโมเดลเมื่อใช้ครั้งแรก การรู้จำจะแม่นยำน้อยลงมากหากภาษาที่เลือกไม่ตรงกับข้อความจริง “ภาษาที่สอง” ใช้กับเอกสารสองภาษา
จำกัดช่วงหน้า หากไฟล์เป็น PDF
ช่องรับช่วง เช่น “1-3, 5, 8-10” หากเว้นว่าง จะวิเคราะห์ทุกหน้า
คลิก “เริ่มการรู้จำข้อความ”
เครื่องมือรู้จำข้อความ (ประมาณ 4 MB) ดาวน์โหลดเพียงครั้งเดียวจากเซิร์ฟเวอร์ของเรา พร้อมโมเดลของภาษานั้น สำหรับภาษาที่ไม่ได้รวมไว้ จะแจ้งขนาดของโมเดลก่อนเริ่ม จากนั้นการวิเคราะห์เองเกิดขึ้นทั้งหมดบนอุปกรณ์ของคุณ
อ่านผลลัพธ์และระดับความมั่นใจ
ข้อความที่รู้จำได้จะแสดงพร้อมจำนวนคำและความมั่นใจเฉลี่ย ความมั่นใจต่ำบ่งชี้ว่าภาพสแกนน่าจะเอียงหรือคุณภาพไม่ดี
ดาวน์โหลดข้อความหรือ PDF ที่ค้นหาได้
ไฟล์ .txt มีข้อความธรรมดา ส่วน PDF ที่ค้นหาได้คงเลย์เอาต์เดิมไว้ พร้อมชั้นข้อความที่มองไม่เห็นซ้อนอยู่ด้านบน ทำให้เอกสารเลือกข้อความและค้นหาด้วยคำสำคัญได้
ใน PDF ที่ค้นหาได้ หน้าที่สแกนยังคงรูปภาพเดิมและได้ชั้นข้อความที่มองไม่เห็นซึ่งใช้ได้กับทุกระบบการเขียน รวมถึงกรีก ซีริลลิก อาหรับ และจีน ส่วนหน้าที่มีข้อความอยู่แล้วจะถูกจัดวางใหม่เป็นรูปภาพ เพื่อไม่ให้มีสองชั้น
คำถามที่พบบ่อย
OCR ของ VellumPDF รับทั้ง PDF และรูปถ่ายหรือไม่
ใช่ วาง PDF ที่สแกนหรือรูปภาพรูปแบบ JPG หรือ PNG โดยตรงได้ ในทั้งสองกรณี เครื่องมือสร้าง PDF ที่ค้นหาได้ซึ่งเลือกและคัดลอกข้อความได้
การรู้จำข้อความทำงานกับภาษาใดบ้าง
กว่าร้อยภาษา ภาษาของเว็บไซต์รวมอยู่และ VellumPDF ให้บริการเอง ภาษาอื่น (เช็ก กรีก ฮีบรู เปอร์เซีย และอื่น ๆ) เลือกจากรายการเดียวกัน “ภาษาของเอกสาร” และโมเดลของภาษานั้นดาวน์โหลดหนึ่งครั้งเมื่อใช้ครั้งแรก “ภาษาที่สอง” ใช้กับเอกสารสองภาษา การเลือกภาษาที่ถูกต้องช่วยให้ผลลัพธ์น่าเชื่อถือขึ้นอย่างมาก
เอกสารที่สแกนของฉันถูกส่งไปยังบริการปัญญาประดิษฐ์ออนไลน์หรือไม่
ไม่ เครื่องมือรู้จำข้อความทำงานในเบราว์เซอร์ของคุณ สำหรับภาษาของเว็บไซต์ ไฟล์ของเครื่องมือมาจากโดเมนของ VellumPDF สำหรับภาษาอื่น มีเพียงโมเดลที่ถูกดาวน์โหลดจาก raw.githubusercontent.com ซึ่งเป็นคลังสาธารณะของโครงการ Tesseract หลังมีประกาศบนหน้าจอ การดาวน์โหลดนี้ไปทางเดียว เอกสารไม่ออกจากอุปกรณ์ของคุณ และไม่มีการเรียกบริการปัญญาประดิษฐ์ใด
โมเดลรู้จำข้อความถูกดาวน์โหลดทุกครั้งที่ใช้หรือไม่ และมีน้ำหนักเท่าใด
แต่ละภาษามีโมเดลของตัวเอง สำหรับภาษาของเว็บไซต์ที่ VellumPDF โฮสต์ไว้ ตั้งแต่ 0.4 ถึง 3 MB แบบบีบอัดตามภาษา (ประมาณ 700 KB สำหรับฝรั่งเศส เกือบ 3 MB สำหรับอังกฤษ) แคชปกติของเบราว์เซอร์ช่วยไม่ให้ต้องดาวน์โหลดซ้ำ สำหรับภาษาอื่น ระหว่าง 0.4 ถึง 12 MB ตามภาษา โดยแสดงน้ำหนักก่อนเริ่ม เมื่อดาวน์โหลดแล้ว เบราว์เซอร์เก็บโมเดลไว้ และการใช้ครั้งที่สองไม่ดาวน์โหลดอะไรอีก
จะรู้ได้อย่างไรว่าผลลัพธ์เชื่อถือได้ เช่น กับภาพสแกนที่เอียงหรือคุณภาพไม่ดี
เปอร์เซ็นต์ความมั่นใจเฉลี่ยแสดงพร้อมผลลัพธ์ คำนวณจากทุกคำที่รู้จำได้ หากต่ำกว่า 70% จะมีคำเตือนว่าการรู้จำไม่แน่นอนและภาพสแกนอาจเอียงหรือคุณภาพต่ำ ซึ่งเป็นสัญญาณให้สแกนใหม่ แทนที่จะเชื่อข้อความที่ได้
จะเกิดอะไรขึ้นหากฉันวาง PDF ที่ป้องกันด้วยรหัสผ่าน
การรู้จำข้อความถูกปฏิเสธทันที พร้อมข้อความอธิบายว่า PDF ที่เข้ารหัสทำ OCR ไม่ได้ ต้องลบการป้องกันของเอกสารก่อนวางที่นี่
ทำ OCR หลายเอกสารในครั้งเดียวได้หรือไม่
ไม่ เครื่องมือประมวลผลทีละไฟล์ ได้แก่ PDF ที่สแกนหรือรูปภาพ หากมีหลายเอกสาร ต้องทำซ้ำสำหรับแต่ละฉบับ