Đọc tài liệu mà không gửi tài liệu
OCR local là việc Documents, bên trong tình cờ dùng một mô hình. Câu hỏi sản phẩm là ‘có lấy được chữ và PDF tìm được mà không xếp hàng upload không’ — không phải mô hình mây nào thông minh hơn.
Xem lại gần nhất: 17 tháng 9 2026
Dùng vào việc gì
- Screenshot và ảnh điện thoại của biển, slide, chat.
- Hóa đơn, biên lai — tổng tiền là thứ phải đối lại trước.
- PDF scan không có lớp chữ thật, xuất thành PDF tìm được chữ.
- PDF có chữ gốc thì tái sử dụng chữ nhúng khi được, trừ khi bạn bật Force OCR.
Ngôn ngữ
Gói nhận dạng: tiếng Anh, Trung giản thể, Trung phồn thể, tiếng Nhật. Bạn chọn ngôn ngữ trước khi chạy. Auto không dò chữ viết; nó rơi về tiếng Anh. Để Auto trên bản scan tiếng Trung thì nhận được rác lệch Anh, không phải phép màu.
Quyền riêng tư và giới hạn
Nhận dạng chạy trong tab sau khi bạn bắt đầu. Runtime tải từ origin này, không phải API OCR bên thứ ba. PDF mã hóa bị từ chối; chúng tôi không bypass mật khẩu.
Độ chính xác giảm với JPEG nén mạnh, trang lệch, chữ UI nhỏ, chữ viết tay, hóa đơn lẫn. Không quảng cáo một con số % chính xác.
Lớp chữ PDF tìm được dùng hộp từ Tesseract. Xuất CJK cần font đi kèm. Force OCR trên PDF số có thể chồng lớp OCR lên lớp chữ gốc — giới hạn đó được nêu trong công cụ.