Nirmion
Membantu Temukan alat

PDF dan dokumen kerja

Membuat scan PDF Halaman yang dapat dicari dengan bahasa Inggris OCR.

Render setiap halaman, mengenali teks bahasa Inggris dengan lokal Tesseract dan membangun kembali sebuah gambar yang didukung PDF dengan lapisan teks yang tidak terlihat yang dapat dicari.

1 PDF sampai 50 halaman10 MB dengan batas gabunganyang dapat dicari OCR PDF
Ruang yang siap10 MB digabungkan

Tembak satu PDF di sini

Pilih salah satu yang tertutup PDF. Sumber tetap tidak berubah dan hasilnya diunduh secara terpisah.

Fail hanya dikirim ketika Anda menjalankan alat; tidak ada sejarah pekerjaan di sisi server yang dibuat.

Langkah 2 / Konfigurasi dan Run

Untuk konfigurasi OCR PDF

Mengkonfirmasi bahasa Inggris sebagai bahasa pengenalan, kemudian tetap halaman terbuka saat setiap halaman diputar dan diakui.

Untuk memeriksa prosesor ini...

Layanan lokal saat ini memiliki model pengenalan bahasa Inggris yang dipasang.
Permintaan untuk pengendalianyang lokal API memproses permintaan ini dalam memori, mengembalikan muat turun dengan Cache-Control: no-store dan tidak membuat sejarah pekerjaan di sisi server.

Kontrak Produk

Memahami OCR PDF Sebelum prosesnya

Render setiap halaman, mengenali teks bahasa Inggris dengan lokal Tesseract dan membangun kembali sebuah gambar yang didukung PDF dengan lapisan teks yang tidak terlihat yang dapat dicari.

01

Apa yang Anda berikan

Satu yang tertutup PDF sampai ke 10 MB dan 50 halaman. Model pengenalan yang dipasang mendukung bahasa Inggris dalam rilis ini.

02

Apa yang Anda terima

Salah satu _nirmion_tools_ocr_searchable.pdf dengan gambar halaman dan pencarian OCR Layer teks

03

Apa yang harus dipertimbangkan

Pengenalan dapat salah pada tulisan tangan, skim, kontras rendah, tabel kompleks dan bahasa campuran. OCR Produksi tidak merupakan transeksi yang disertifikasi.

aliran kerja

Dari sumber ke download yang diperiksa

Ruang kerja memeriksa file dan persiapan prosesor sebelum memungkinkan operasi.

1 . Pilih yang

Satu yang tertutup PDF sampai ke 10 MB dan 50 halaman. Model pengenalan yang dipasang mendukung bahasa Inggris dalam rilis ini.

2 . Untuk konfigurasi

Mengkonfirmasi bahasa Inggris sebagai bahasa pengenalan, kemudian tetap halaman terbuka saat setiap halaman diputar dan diakui.

3. Periksa saja

Cari dan salin sampel teks dari hasil, kemudian bandingkan nama, jumlah, tanggal dan tata bahasa hukum terhadap gambar halaman yang terlihat.

penggunaan umum

kapan saja OCR PDF itu berguna

Membuat scan PDF Halaman yang dapat dicari dengan bahasa Inggris OCR.

01

Membuat perjanjian yang dipindai dapat dicari sebelum diperiksa.

02

Siapkan gambar-hanya invois untuk ekstraksi teks atau tabel.

03

Mencipta teks yang dapat disalin dari halaman bahasa Inggris yang dipotret.

batas yang penting

OCR Selalu diperlukan verifikasi manusia.

Jangan bergantung pada teks yang diakui untuk data hukum, medis, keuangan atau identitas tanpa memeriksa pemindaian yang terlihat.

Bantuan praktis

Pertanyaan sebelum Anda melakukannya

yang dilakukan OCR Terjemahkan dokumen tersebut?

Tidak Ini mengenali karakter bahasa Inggris dan menyimpan gambar halaman yang terlihat.

Mengapa produksi lebih besar?

Setiap halaman dikonversi menjadi image-backed searchable PDF.

Bisakah ia membaca tulisan tangan?

Ketepatan tulisan tangan tidak dijanjikan; gunakan teks cetak yang jelas untuk hasil terbaik.

Proses kerja dokumen

menggunakan OCR PDF Online dengan lokal terbatas API.

Render setiap halaman, mengenali teks bahasa Inggris dengan lokal Tesseract dan membangun kembali sebuah gambar yang didukung PDF dengan lapisan teks yang tidak terlihat yang dapat dicari. Satu yang tertutup PDF sampai ke 10 MB dan 50 halaman. Model pengenalan yang dipasang mendukung bahasa Inggris dalam rilis ini.

Salah satu _nirmion_tools_ocr_searchable.pdf dengan gambar halaman dan pencarian OCR Layer teks Pengenalan dapat salah pada tulisan tangan, skim, kontras rendah, tabel kompleks dan bahasa campuran. OCR Produksi tidak merupakan transeksi yang disertifikasi. Setelah muat turun, formulir kembali dan tiga hasil memori tab tetap tersedia untuk muat ulang.