Tìm kiếm trong hồ sơ scan
Tạo lớp chữ để tra tên, mã số hoặc cụm từ trong tài liệu ảnh.
Công cụ PDF
Đang chuẩn bị…
Vui lòng chờ trong giây lát.
Nhận dạng chữ trong PDF scan để có thể tìm kiếm nội dung.
Nội dung kỹ thuật do Tools.4PDF.Net biên tập • Cập nhật 08/09/2026Chọn một tệp · tối đa 256 MB
Tệp được bảo mật và tự động xóaHướng dẫn
Làm theo ba bước để nhận tệp kết quả ở định dạng bạn cần.
Chọn việc bạn muốn làm với tài liệu.
Thả tệp hoặc chọn trực tiếp từ thiết bị.
Chờ xử lý xong rồi tải tệp PDF về.
Không cần tạo tài khoản hay cài đặt.
Chỉ phiên làm việc này mới truy cập được tệp.
Tệp đầu vào và kết quả hết hạn sau một giờ.
Tìm hiểu công cụ
OCR PDF thêm lớp văn bản có thể tìm kiếm vào tài liệu scan. Bạn có thể chọn Tiếng Việt, Tiếng Anh hoặc Anh + Việt để bộ nhận dạng xử lý đúng hệ chữ và dấu. Công cụ có ba chế độ: bỏ qua trang đã có chữ, OCR toàn bộ và tự động. Tùy chọn chỉnh nghiêng dành cho bản scan bị lệch. Sau khi xử lý, bạn có thể tìm kiếm, sao chép và tiếp tục xử lý phần văn bản dễ hơn.
Độ chính xác của OCR phụ thuộc nhiều vào bản scan. Chữ đủ lớn, tương phản rõ, trang thẳng và ít bóng nền thường dễ nhận dạng hơn ảnh mờ hoặc lem. Với tiếng Việt, cần kiểm tra kỹ dấu; tài liệu song ngữ nên chọn Anh + Việt. OCR có thể thay đổi tệp đầu ra, bố cục hoặc lớp văn bản, nhất là khi ép OCR toàn bộ. Hãy giữ bản gốc và rà lại tên riêng, con số cùng mã hồ sơ trước khi dùng dữ liệu.
Tạo lớp chữ để tra tên, mã số hoặc cụm từ trong tài liệu ảnh.
Chọn Anh + Việt cho hợp đồng hoặc hướng dẫn có nội dung song ngữ.
Bật tự động chỉnh nghiêng trước khi nhận dạng các trang đặt lệch.
Kinh nghiệm thực tế
Mỗi lần xử lý dùng một phiên ẩn danh riêng. Cách chúng tôi xử lý dữ liệu được nêu trong Quyền riêng tư và trang Bảo mật.
Câu hỏi thường gặp
Nếu phần lớn nội dung là tiếng Việt và chỉ có vài thuật ngữ quen thuộc, Tiếng Việt thường là lựa chọn hợp lý để ưu tiên dấu. Với hợp đồng, bảng biểu hoặc hướng dẫn có hai ngôn ngữ xuất hiện thường xuyên, chọn Anh + Việt. Dù chọn chế độ nào, hãy rà lại tên riêng, viết tắt và chuỗi mã.
Bỏ qua trang đã có chữ chỉ tập trung vào các trang chưa có lớp văn bản, phù hợp PDF trộn giữa trang điện tử và trang scan. Ép OCR toàn bộ xử lý lại mọi trang, kể cả trang đã có chữ, nên có thể thay đổi lớp văn bản hoặc đầu ra nhiều hơn. Chế độ tự động để hệ thống quyết định theo trang.
Ảnh mờ, độ tương phản thấp, trang nghiêng, phông nhỏ, nền có họa tiết hoặc nếp gấp đều làm ký tự khó phân biệt. Hãy chọn ngôn ngữ có Tiếng Việt, bật chỉnh nghiêng khi cần và dùng bản scan rõ hơn nếu có. OCR không nên là nguồn duy nhất cho số tiền, mã hồ sơ hoặc dữ liệu pháp lý.
Liên kết truy cập hết hạn sau một giờ, còn hệ thống dọn dữ liệu năm phút một lần. Hãy tải tệp kết quả về thiết bị trước khi liên kết hết hạn.