OCR PDF: biến bản scan thành PDF tìm kiếm được

Bạn cần tìm, bôi đen và sao chép chữ trong một file PDF scan? Hãy tải bản scan lên: Linnk đọc từng trang rồi dựng lại thành PDF tìm kiếm được với chữ thật, còn ảnh, con dấu và chữ ký được đặt lại đúng vị trí cũ. Hợp đồng cũ, biểu mẫu gửi qua fax, báo cáo lưu trữ hay ảnh chụp trang giấy bằng điện thoại đều dùng được. Cùng lần xử lý đó còn cho bạn Markdown, văn bản thuần và bảng tính theo bố cục, kèm file Word nếu bạn yêu cầu.
Định dạng đầu ra
Bạn cũng sẽ nhận được Word · Markdown · Văn bản thuần · Bảng tính (bố cục)
Ngôn ngữ đầu ra
Mã hóa & bảo mật 154 ngôn ngữ và phương ngữ Bảng vẫn là bảng Tệp xóa sau 72h

Làm thế nào để chuyển PDF scan thành PDF tìm kiếm được?

OCR PDF là dùng công nghệ nhận dạng ký tự quang học (OCR) để đọc hình ảnh của từng trang, biến các con chữ thành ký tự thật mà bạn có thể tìm kiếm, bôi đen và sao chép. Bản scan chỉ là một bức ảnh chụp trang giấy: Ctrl+F không tìm thấy gì và bạn không sao chép được dù chỉ một dòng. Công cụ OCR PDF của Linnk đọc mọi trang bằng các mô hình AI (Linnk sử dụng các mô hình của ChatGPT, Claude và Gemini), dựng lại trang thành văn bản có cấu trúc rồi xuất ra một file PDF mới dạng văn bản. Ảnh, logo, con dấu và chữ ký được cắt từ bản scan và đặt lại đúng vị trí. Xin nói rõ: đây không phải một lớp chữ ẩn phủ lên ảnh gốc của bạn. File PDF được dựng lại, nên trông gần giống bản gốc chứ không giống đến từng điểm ảnh. Với bản scan bị mờ, ố hay chụp lệch, điều này thường lại tốt hơn, vì chữ ra sạch và thẳng hàng thay vì nhòe theo bản gốc. Số liệu, ngày tháng và mã số được chép lại từng chữ số một, còn phần OCR không đọc được sẽ được đánh dấu chứ không bị đoán mò. Dù vậy, bạn vẫn nên xem nhanh những trang mờ hoặc bị cong.

Chữ thậtdựng lại từ mọi trang
Giữ lạiảnh, con dấu và chữ ký
Nguyên gốcngôn ngữ của tài liệu
Miễn phíxem trước, không cần tài khoản

Last updated: tháng 9 năm 2026

Cách OCR file PDF scan thành PDF tìm kiếm được

Ba bước để đi từ ảnh chụp trang giấy đến PDF có chữ thật.

1

Tải bản scan lên

Thả vào một file PDF scan, hoặc ảnh chụp trang giấy dạng JPG, PNG, WEBP, HEIC hay HEIF; mỗi ảnh được tính là bản scan một trang. Định dạng PDF tìm kiếm được đã được chọn sẵn, và chữ vẫn giữ nguyên ngôn ngữ gốc.

2

Để OCR đọc từng trang

Các mô hình AI đọc hình ảnh của từng trang và dựng lại thành văn bản, thường mất chưa đến một phút mỗi trang. Trong lúc xử lý, trang web hiển thị thời gian ước tính theo phút, và bạn có thể xem trước miễn phí những trang đầu mà không cần tài khoản.

3

Tải về PDF tìm kiếm được

Đăng ký miễn phí để tải về PDF tìm kiếm được. Markdown, văn bản thuần và bảng tính theo bố cục đến từ cùng lần chuyển đổi, còn file Word có thể được tạo theo yêu cầu, mất thêm vài phút.

Công cụ OCR PDF này làm được gì

Dành cho bản scan, bản fax và ảnh chụp điện thoại — những file vốn không có chữ nào bên trong.

Chữ thật, không phải ảnh của chữ

Mỗi từ trong file PDF mới đều là ký tự thật. Ctrl+F tìm thấy được, bạn có thể bôi đen và sao chép cả đoạn, và hệ thống tìm kiếm tài liệu của bạn có thể lập chỉ mục cho file.

Ảnh, con dấu và chữ ký về đúng chỗ

Hình ảnh trên trang được cắt từ bản scan và đặt lại đúng vị trí, nên hợp đồng đã ký thường vẫn giữ chữ ký và giấy chứng nhận vẫn giữ con dấu.

Chữ sạch từ những bản scan cũ

Vì trang được dựng lại chứ không phải tô đè lên, một bản scan bị lệch, mờ hay dính vết cà phê thường cho ra chữ thẳng hàng, dễ đọc. Những trang quá nhòe có thể vẫn cần kiểm tra nhanh.

Số liệu chép lại từng chữ số

Số tiền, ngày tháng, mã số và số tham chiếu được chép lại từng chữ số một. Chữ số nào OCR không đọc ra được sẽ được đánh dấu bằng dấu chấm hỏi, đoạn không đọc được sẽ được ghi là [illegible], nên không có gì bị âm thầm đoán mò.

Thêm định dạng từ cùng một lần xử lý

Một lần chuyển đổi còn cho bạn Markdown, văn bản thuần và bảng tính theo bố cục, mỗi trang một sheet. Cần Word? File được tạo theo yêu cầu và thường mất vài phút.

Giữ ngôn ngữ gốc, hoặc dịch luôn

Theo mặc định, kết quả giữ nguyên ngôn ngữ gốc của tài liệu. Chuyển “Giữ nguyên ngôn ngữ gốc” sang “Dịch sang…” và PDF tìm kiếm được sẽ trả về bằng ngôn ngữ khác ngay trong cùng lần xử lý.

OCR PDF: những thông tin chính

Những điều nên biết trước khi tải bản scan lên.

Đầu vào

PDF scan
Đọc từng trang
Ảnh chụp điện thoại
JPG, PNG, WEBP, HEIC, HEIF
PDF kỹ thuật số
Cũng được chấp nhận
Word, PowerPoint, Excel
Không nhận ở đây

Đầu ra

PDF tìm kiếm được
Dựng lại thành chữ thật
Ảnh, con dấu, chữ ký
Đặt lại đúng vị trí
Cùng lần xử lý
Markdown, văn bản, bảng tính theo bố cục
File Word
Tạo theo yêu cầu

Độ chính xác

Số liệu và ngày tháng
Chép lại từng chữ số
Chữ số không rõ
Đánh dấu bằng dấu chấm hỏi
Đoạn không đọc được
Đánh dấu [illegible]
Trang mờ hoặc bị cong
Nên kiểm tra nhanh

Tốc độ và quyền truy cập

Tốc độ thông thường
Thường dưới một phút mỗi trang
Xem trước
Miễn phí, không cần tài khoản
Tải về
Tài khoản miễn phí
Tài liệu dài hơn
Các gói trả phí

So sánh các cách OCR file PDF scan

Cách làm của Linnk khác gì so với những cách thường dùng để có PDF tìm kiếm được, kể cả những điểm mà các cách khác làm tốt hơn.

FeatureLinnk OCR PDFPhần mềm PDF trên máy tínhTrang OCR online miễn phíOCR trong ứng dụng scan
Cách chữ được đưa vào PDFTrang được dựng lại thành chữ thậtThường là lớp chữ ẩn nằm dưới bản scanThường là lớp chữ ẩn; tùy từng trang webLớp chữ hoặc xuất văn bản riêng
Trang trông thế nào sau khi xử lýGần giống bản gốc, không giống đến từng điểm ảnhGiữ nguyên ảnh scan gốcGiữ nguyên ảnh scan gốcGiữ ảnh gốc, thường được cắt và làm phẳng
Bản scan mờ hoặc bị lệchRa chữ sạch, thẳng hàngTrang hiển thị giữ nguyên như khi scanTrang hiển thị giữ nguyên như khi scanMột số ứng dụng làm thẳng ảnh
Chữ không đọc đượcĐánh dấu [illegible] hoặc bằng dấu chấm hỏiTùy trường hợpTùy trường hợpTùy trường hợp
Định dạng khácWord, Markdown, văn bản thuần, bảng tính theo bố cụcThường có Word và các định dạng xuất khácTùy trang, thường là Word hoặc văn bảnThường là PDF hoặc văn bản
Chạy ở đâuTrên trình duyệt, không cần cài đặtPhần mềm cài trên máy, thường phải trả phíTrên trình duyệtỨng dụng điện thoại

So sánh tại thời điểm tháng 9 năm 2026. Tính năng khác nhau tùy sản phẩm và gói; bảng mô tả cách hoạt động thường gặp của từng nhóm.

Ai cần biến PDF scan thành PDF tìm kiếm được

Bất kỳ ai cần tìm thông tin trong một tài liệu được scan chứ không phải được đánh máy.

Luật sư và trợ lý pháp lý

OCR hợp đồng, hồ sơ tòa án và tài liệu vụ việc đã scan, để tìm ra một điều khoản, một ngày tháng hay tên một bên chỉ bằng một lần tìm kiếm thay vì đọc từng trang.

Văn phòng và bộ phận lưu trữ

Biến những thư mục thư từ, hóa đơn và biểu mẫu đã scan thành PDF tìm kiếm được, để ổ đĩa dùng chung hay hệ thống quản lý tài liệu thực sự tìm được nội dung bên trong.

Nhà nghiên cứu và sinh viên

Sao chép trích dẫn từ các chương sách, tài liệu lưu trữ và luận văn cũ đã scan thay vì gõ lại, trong khi hình ảnh trên trang vẫn giữ nguyên chỗ.

Kế toán

Tìm một số tiền hay số tham chiếu trong sao kê và biên lai đã scan; các con số được chép lại từng chữ số từ trang giấy.

Nhân sự và hành chính

Lưu thư mời nhận việc và hồ sơ tiếp nhận nhân viên đã ký dưới dạng PDF tìm kiếm được, chữ ký vẫn hiện rõ trên trang.

Bất kỳ ai scan bằng điện thoại

Chụp một lá thư, một thông báo hay một biểu mẫu bằng điện thoại và nhận lại file PDF có thể tìm kiếm và sao chép, chứ không chỉ là một tấm ảnh.

Câu hỏi thường gặp về OCR PDF

OCR PDF là gì?
File PDF scan chứa hình ảnh của các trang, nên bên trong không có chữ nào để tìm kiếm hay sao chép. OCR PDF nghĩa là dùng công nghệ nhận dạng ký tự để đọc những hình ảnh đó và tạo ra một file PDF mới, trong đó các con chữ là ký tự thật. Việc này còn được gọi là chuyển PDF scan thành PDF tìm kiếm được.
Làm sao để file PDF tìm kiếm được?
Tải bản scan lên đây, giữ nguyên lựa chọn PDF tìm kiếm được và tải kết quả về khi các trang đã được đọc xong. File PDF xuất từ Word hay phần mềm khác thường đã tìm kiếm được sẵn; công cụ này dành cho những file PDF thực chất là bản scan hoặc ảnh chụp.
Ảnh, logo, con dấu và chữ ký sẽ được xử lý ra sao?
Chúng được cắt từ bản scan và đặt lại đúng chỗ trên trang. Chữ ký tay vẫn là hình ảnh của chữ ký chứ không bị gõ lại thành chữ, nên tài liệu đã ký hoặc đóng dấu thường vẫn hiển thị chữ ký và con dấu.
Có thể OCR PDF online mà không cần cài đặt gì không?
Có. Linnk chạy trên trình duyệt của máy tính hoặc điện thoại, nên bạn không cần cài đặt gì. Hãy tải bản scan lên, theo dõi các trang được chuyển đổi và xem trước PDF tìm kiếm được trước khi tạo tài khoản.
OCR file PDF scan chính xác đến mức nào?
Bản scan sạch, thẳng và đủ sáng sẽ cho kết quả tốt nhất. Số liệu, ngày tháng và mã số được chép lại từng chữ số; chữ số không rõ được đánh dấu bằng dấu chấm hỏi và đoạn không đọc được được ghi là [illegible] thay vì bị đoán. Những trang mờ, bị cong hoặc nhòe có thể cần kiểm tra nhanh.
Tôi có thể tải lên những file nào?
PDF (scan hoặc kỹ thuật số), JPG, PNG, WEBP, HEIC và HEIF. Mỗi ảnh được xử lý như bản scan một trang. File Word, PowerPoint và Excel không được nhận ở đây vì bản thân chúng đã có chữ.
OCR đọc được những ngôn ngữ nào?
Các mô hình AI đứng sau OCR đọc được hầu hết các ngôn ngữ và hệ chữ phổ biến. PDF tìm kiếm được vẫn giữ ngôn ngữ gốc của tài liệu, nên một hợp đồng tiếng Anh sẽ trả về thành PDF tiếng Anh.
Tôi có thể nhận Word, Markdown hoặc văn bản thuần không?
Có. Cùng một lần chuyển đổi cho bạn Markdown, văn bản thuần và bảng tính theo bố cục bên cạnh PDF tìm kiếm được, còn file Word có thể được tạo theo yêu cầu trong vài phút. Nếu bản scan có bảng, bạn cũng có thể chọn bảng tính dạng bảng hoặc CSV.
OCR một file PDF scan mất bao lâu?
Thường dưới một phút mỗi trang, khoảng nửa phút với một bản scan thông thường. Trang web hiển thị thời gian ước tính theo phút trong lúc xử lý. File Word mất thêm vài phút vì được tạo sau khi chuyển đổi.
Công cụ có miễn phí không, và có giới hạn độ dài không?
Bản xem trước miễn phí và không cần tài khoản, còn việc sao chép phần chữ đã nhận dạng luôn miễn phí. Để tải về PDF tìm kiếm được và các file khác, bạn cần một tài khoản miễn phí. Những trang đầu của tài liệu được chuyển đổi miễn phí; tài liệu dài hơn thuộc các gói trả phí tại linnk.ai/pricing.
File của tôi có được giữ riêng tư không?
File được truyền qua kết nối mã hóa, và file sau khi chuyển đổi sẽ tự động bị xóa sau 72 giờ (thông tin này được ghi trên trang kết quả), vì vậy hãy tải về những gì bạn cần trước khi hết thời hạn đó. Như với mọi công cụ online, hãy kiểm tra quy định của tổ chức bạn trước khi tải lên những tài liệu đặc biệt nhạy cảm.

Biến PDF scan thành PDF có chữ thật

Thả bản scan hoặc ảnh chụp điện thoại vào và xem trước PDF tìm kiếm được trước khi đăng ký.