Nhận dạng văn bản từ PDF scan, dạng ảnh ngay trên trình duyệt — đa ngôn ngữ, chọn phạm vi trang, xuất TXT. Không tải lên bất kỳ máy chủ nào, hoàn toàn miễn phí, không cần đăng ký.
Cách sử dụng
1
Tải lên một tệp PDF đã quét
Tải lên một tệp PDF đã quét hoặc dạng ảnh, sau đó chọn ngôn ngữ và phạm vi trang
2
Nhận dạng cục bộ
Các trang được kết xuất và OCR từng trang một trong trình duyệt của bạn — không có gì được tải lên, tiến trình hiển thị trực tiếp
3
Sao chép hoặc tải xuống
Kết quả chảy vào phần xem trước — sao chép hoặc tải xuống dưới dạng TXT, không cần đăng nhập
Câu hỏi thường gặp
Tại sao mỗi trang mất 5-15 giây?
Công cụ OCR chạy hoàn toàn bên trong trình duyệt của bạn (không có máy chủ tham gia). Mỗi trang cần kết xuất, tiền xử lý và nhận dạng, vì vậy tốc độ phụ thuộc vào thiết bị của bạn. Lần chạy đầu tiên cho một ngôn ngữ cũng tải dữ liệu ngôn ngữ của ngôn ngữ đó một lần (được lưu vào bộ nhớ đệm sau đó).
Công cụ này khác gì so với PDF sang Văn bản?
PDF sang Văn bản đọc lớp văn bản tích hợp sẵn của tệp — tức thì, nhưng bản quét không có lớp đó. Công cụ này đọc hình ảnh trang qua OCR, được thiết kế cho tài liệu quét và chụp ảnh. Hai công cụ bổ trợ cho nhau.
Độ chính xác thế nào?
Văn bản in sạch sẽ nhận dạng tốt; chữ viết tay, ảnh mờ và bảng phức tạp làm giảm độ chính xác. Hãy chọn đúng ngôn ngữ, quét ở 300 DPI và kiểm tra lại các con số và tên quan trọng sau đó.
Các tệp của tôi có được tải lên máy chủ không?
Không. Việc kết xuất và nhận dạng diễn ra hoàn toàn trong trình duyệt của bạn. Tệp không bao giờ rời khỏi thiết bị của bạn và bộ nhớ được xóa khi làm mới. Giới hạn: 30 MB và 30 trang mỗi tệp.
Bạn quyết định công cụ nào chúng tôi xây dựng tiếp theoGửi điều ước →