Langsung ke konten utama

PDF ke teks

Isi PDF Anda, menjadi teks polos yang dapat digunakan kembali.

Berkas Anda tidak pernah keluar dari perangkat Anda

Seret PDF Anda ke sini

Teks diekstrak secara otomatis saat berkas diunggah

Cara mengekstrak teks dari PDF, langkah demi langkah

Alat ini mengambil teks yang benar-benar ada dalam berkas, halaman demi halaman, untuk dibaca ulang atau digunakan kembali di tempat lain. Tidak ada yang dikirim keluar dari peramban Anda.

  1. Unggah PDF

    Seret berkas ke area unggah, atau klik untuk menelusuri berkas Anda. Ekstraksi langsung dimulai, tanpa tombol yang perlu diklik.

  2. Biarkan VellumPDF menelusuri setiap halaman

    Teks setiap halaman diambil lalu disambungkan dengan halaman berikutnya menggunakan penanda «———— Halaman n ————», sesuai urutan kemunculannya dalam berkas.

  3. Tinjau ulang hasil yang ditampilkan

    Teks lengkap muncul dalam bingkai yang dapat digulir, dengan jumlah karakter dan kata tepat di atasnya.

  4. Unduh atau salin teksnya

    «Unduh .txt» menyimpan berkas teks bernama sesuai PDF asli; «Salin» menempatkan hasilnya di papan klip untuk ditempelkan di tempat lain.

PDF yang dilindungi kata sandi langsung ditolak, dengan pesan khusus: Anda perlu menghapus perlindungannya terlebih dahulu dengan alat buka kunci sebelum kembali ke sini.

Pertanyaan yang sering diajukan

Bagaimana bentuk teks yang diekstrak dari PDF?

Teks disajikan dalam berkas .txt, disusun per halaman, dapat digunakan kembali dalam pengolah kata atau alat lainnya. Yang diambil adalah teks yang benar-benar ada dalam berkas, tanpa pemformatan.

Apakah alat ini berfungsi pada PDF hasil pindai?

Tidak, ekstraksi hanya bergantung pada teks yang sudah ada dalam berkas PDF, bukan pengenalan gambar. Jika dokumen adalah pindaian tanpa teks yang mendasarinya, tidak ada teks yang akan dihasilkan: jalankan dokumen itu terlebih dahulu melalui alat OCR VellumPDF.

Apakah layanan ini gratis dan apakah dokumen dikirim secara daring?

Ya, alat ini gratis dan tanpa batas penggunaan. Ekstraksi dilakukan sepenuhnya di peramban Anda, tanpa mengirim PDF ke server.

Apakah teks yang diekstrak mempertahankan tata letak?

Tidak, dan itu memang sifat dasar formatnya: Anda mendapatkan teksnya, bukan tata letaknya. Kolom-kolom akan berjajar berurutan satu demi satu, tabel kehilangan kisi-kisinya. Jika strukturnya penting, ekspor ke Markdown setidaknya mempertahankan judul; jika tata letaknya yang penting, gunakan ekspor ke Word.

Dalam urutan apa teks keluar dari halaman dua kolom?

Sesuai urutan yang tercantum dalam berkas, yang umumnya mengikuti alur baca alami tetapi tidak selalu. Pada brosur atau surat kabar, terkadang ada kotak sisipan di tengah paragraf. Pembacaan ulang sekilas cukup untuk mengenalinya.

Mengapa ekstraksi tidak menghasilkan apa pun pada beberapa berkas?

Karena dokumen itu tidak memiliki lapisan teks: itu adalah gambar halaman, biasanya hasil pindai atau foto. Tidak ada apa pun untuk diekstrak, secara harfiah. Jalankan berkas itu terlebih dahulu melalui pengenalan karakter, yang menambahkan lapisan tersebut, lalu ulangi ekstraksi.