Bỏ qua điều hướng
Module Số hóa tài liệu

EZDOC

Số hóa nhanh hơn, nhập liệu ít hơn, kiểm soát tốt hơn.

Hệ thống tổ chức, điều phối và kiểm soát toàn bộ quy trình số hóa tài liệu khối lượng lớn. OCR và AI làm phần việc lặp lại, đội nhập liệu chỉ rà soát và hiệu chỉnh.

  • Tự tách tài liệu, AI điền sẵn các trường
  • Triển khai tại chỗ, không cần Internet
  • Đối soát khối lượng, đóng gói SIP/AIP/DIP
Video giới thiệu EZDOC (bản rút gọn)
Bài toán số hóa

Chi phí lớn nhất không nằm ở máy scan, mà ở đội nhập liệu

Trong các dự án số hóa hàng chục nghìn đến hàng triệu trang, thời gian và chi phí lớn nhất thường nằm ở khâu đọc từng văn bản, gõ lại từng trường thông tin rồi kiểm tra lại. Người quản lý khó nắm tiến độ thực tế và khó đối soát khối lượng khi nghiệm thu.

EZDOC tự làm các công đoạn xử lý ban đầu, sau đó phân phiếu cho người nhập liệu tập trung rà soát, hiệu chỉnh và hoàn thiện những thông tin chưa chính xác.

Phương thức truyền thống
  1. Đọc tài liệu
  2. Nhập từng trường
  3. Kiểm tra lại
Với EZDOC
  1. Hệ thống bóc tách
  2. Người nhập liệu rà soát
  3. Sửa trường sai
  4. Hoàn thành
Quy trình tổng thể

Một dây chuyền khép kín từ scan đến bàn giao

Máy làm phần việc lặp lại: đồng bộ, nhận dạng, phân phiếu. Đội của bạn chỉ làm phần cần đến con người: kiểm tra và xác nhận.

  1. 1Scan
  2. 2Đồng bộ
  3. 3Nhận dạng / Bóc tách
  4. 4Phân phiếu
  5. 5Rà soát
  6. 6Kiểm duyệt
  7. 7Đóng gói
  8. 8Xuất dữ liệu
Vì sao chọn EZDOC

Không chỉ là công cụ OCR

Công cụ OCR đơn lẻ chỉ chuyển ảnh thành văn bản. EZDOC quản lý trọn dây chuyền: đồng bộ dữ liệu, tự tách tài liệu, phân phiếu, kiểm duyệt nhiều cấp, báo cáo khối lượng phục vụ nghiệm thu và đóng gói dữ liệu bàn giao.

≈ 1 giây
OCR mỗi trang
≈ 3.600
trang mỗi giờ
≈ 29.000
trang mỗi ca 8 giờ
30
người nhập liệu đồng thời

Năng lực trên một máy cấu hình phổ thông: CPU 16 nhân, RAM 32 GB, ổ hệ thống SSD 150 GB. Khi dùng OCR phân tán, năng lực OCR tăng thêm theo số máy nhập liệu tham gia.

Liên thông Chỉnh lý ↔ Số hóa

Import Mục lục hồ sơ, Mục lục tài liệu từ khâu chỉnh lý để điền sẵn số hồ sơ, tiêu đề, thời hạn bảo quản, số ký hiệu, ngày tháng, trích yếu, tác giả. Chiều ngược lại, dữ liệu đã số hóa xuất lại thành Mục lục theo biểu mẫu.

Đối soát khối lượng minh bạch

Thống kê số trang theo khổ giấy, quy đổi A4, xuất Excel làm căn cứ nghiệm thu và thanh toán.

Đóng gói theo chuẩn lưu trữ

Tạo các gói SIP, AIP, DIP theo mô hình OAIS, sẵn sàng nộp vào hệ thống lưu trữ số.

Triển khai tại chỗ, độc lập Internet

Mọi công đoạn, kể cả OCR và bóc tách bằng AI, đều xử lý cục bộ. Dữ liệu không gửi ra bên ngoài.

Tính năng

Tự động hóa mọi công đoạn trước nhập liệu

01

Đồng bộ tài liệu, giữ nguyên cấu trúc hồ sơ

Dữ liệu scan được tổ chức theo thư mục của từng hồ sơ trên máy trạm. Công cụ đồng bộ cho phép chọn thư mục và đồng bộ theo lô; cấu trúc thư mục được dùng để hình thành cấu trúc hồ sơ và gán thông tin mặc định.

  • Kiểm soát đồng bộ lại, bỏ qua đồng bộ file vật lý
  • Theo dõi tiến độ, số file mới, file trùng, file lỗi
  • Nhật ký đồng bộ chi tiết
Đồng bộ tài liệu: trạng thái, thống kê file và nhật ký.
02

Scan liền cả hồ sơ, EZDOC tự tách tài liệu

Khi cả hồ sơ được scan thành một file PDF lớn, EZDOC phân tích nội dung, xác định ranh giới giữa các văn bản và tách thành các file riêng, vẫn giữ liên kết với hồ sơ gốc. Các file sau khi tách tiếp tục đi vào bước phân loại, OCR, bóc tách và phân phiếu.

Nhân viên scan ưu tiên được tốc độ, không cần dừng lại để tách từng văn bản.

Một file hồ sơ được tự tách thành nhiều file văn bản.
03

OCR & AI bóc tách thông tin

EZDOC nhận dạng và bóc tách thông tin nghiệp vụ, đưa kết quả thẳng vào các trường trên giao diện xử lý, đặt cạnh tài liệu gốc: loại văn bản, số, ký hiệu, cơ quan ban hành, ngày tháng, trích yếu, nơi nhận, người ký…

  • Nhận dạng văn bản tiếng Việt
  • Nhận dạng trường dữ liệu theo từng loại tài liệu
  • Hỗ trợ nhận dạng chữ viết tay
  • Trường thông tin cấu hình theo loại hình tài liệu
Metadata nghiệp vụ được bóc tách, hiển thị bên cạnh tài liệu gốc.
04

Bấm “Bắt đầu” là có việc

Người nhập liệu không phải chọn tài liệu. Hệ thống tự phân phiếu theo hàng đợi, ưu tiên tài liệu cùng một hồ sơ để xử lý liền mạch trong cùng ngữ cảnh. Làm xong số phiếu được giao, hệ thống tự phân tiếp.

Bắt đầu → Tự động phân phiếu → Ưu tiên tài liệu cùng hồ sơ → Rà soát → Hoàn thành → Phân tiếp

Phiếu được phân tự động, ưu tiên tài liệu trong cùng hồ sơ.
05

Rà soát thay vì gõ lại

Các trường đã được điền sẵn. Người nhập liệu đối chiếu với bản gốc, sửa hoặc bổ sung trường chưa đúng rồi chọn “Xong”, hoặc “Báo lỗi” khi phát hiện vấn đề. Họ tập trung vào chất lượng dữ liệu, thời gian xử lý mỗi phiếu được rút ngắn.

Tài liệu gốc và các trường tự điền trên cùng một màn hình.
06

Kiểm duyệt nhanh, nhiều cấp

Phiếu đã rà soát chuyển sang kiểm duyệt. Người duyệt xem tài liệu gốc và thông tin nghiệp vụ trên cùng giao diện, quyết định đồng ý hoặc từ chối. Có thể tổ chức nhiều cấp duyệt (Duyệt 1, Duyệt 2) tùy yêu cầu chất lượng của từng dự án.

Giao diện Duyệt 1: đối chiếu và quyết định ngay trên một màn hình.
Quản lý tiến độ & năng suất

Biết rõ khối lượng tồn ở từng công đoạn

Dashboard và báo cáo lọc theo Phòng, Hộp, Hồ sơ/Bộ và khoảng ngày. Mọi báo cáo đều xuất được Excel để đối soát, nghiệm thu và báo cáo với khách hàng.

Xuất dữ liệu & đóng gói

Đầu ra phục vụ chỉnh lý, nghiệm thu, bàn giao và lưu trữ

Mục lục văn bản, tài liệu

Tổng hợp số ký hiệu, ngày tháng, tên loại và trích yếu, tác giả, bản gốc/bản sao, độ mật, trang số, ghi chú theo biểu mẫu của từng dự án.

Bìa hồ sơ theo mẫu

Sinh bìa với mã hồ sơ, tiêu đề, thời gian, số tờ, phông, mục lục số, số hồ sơ, thời hạn bảo quản…

Danh sách tài liệu (Excel)

Xuất metadata để rà soát, chỉnh sửa hàng loạt rồi Import trở lại hệ thống.

Hồ sơ → Tài liệu → Tệp

Xuất theo cấu trúc phân cấp để bàn giao, tích hợp sang hệ thống quản lý tài liệu/lưu trữ khác.

SIP
Submission Information Package

Nộp và tiếp nhận dữ liệu vào hệ thống lưu trữ số: hồ sơ, tài liệu số, metadata, cấu trúc hồ sơ.

AIP
Archival Information Package

Lưu trữ và bảo quản dữ liệu số lâu dài: nội dung, metadata mô tả/quản lý, thông tin kỹ thuật.

DIP
Dissemination Information Package

Cung cấp, khai thác và trao đổi dữ liệu tài liệu số.

Triển khai, bảo mật

Chạy ngay tại kho lưu trữ, không cần Internet

Hồ sơ lưu trữ thường chứa thông tin nhạy cảm và không được đưa ra ngoài phạm vi quản lý của đơn vị. EZDOC được thiết kế cho đúng yêu cầu đó.

  • Cài trực tiếp tại điểm thi công: trên máy trạm hoặc PC, không cần máy chủ riêng hay hạ tầng cloud.
  • Không cần Internet: từ đồng bộ, tách tài liệu, OCR, bóc tách AI đến báo cáo và đóng gói đều chạy cục bộ.
  • Cả hệ thống trên một máy: ứng dụng, cơ sở dữ liệu, kho file và bộ máy OCR; các máy nhập liệu nối qua mạng nội bộ (LAN).
  • Bàn giao, xóa theo biên bản: dữ liệu nằm trọn trong thiết bị do đơn vị quản lý; kết thúc dự án, toàn bộ dữ liệu được bàn giao và xóa theo biên bản.

Lợi ích cho đơn vị thi công

  • Chủ đầu tư dễ chấp thuận phương án thi công vì không phải đánh giá rủi ro kết nối ra ngoài
  • Không phụ thuộc hạ tầng mạng của khách hàng
  • Không phát sinh chi phí máy chủ hay đường truyền
  • Chuyển máy giữa các điểm thi công, rút ngắn thời gian chuẩn bị dự án

OCR phân tán: mở rộng bằng chính máy sẵn có

Ngoài máy cài đặt chính, các máy nhập liệu trong mạng LAN cài OCR Client và đóng vai trò OCR Worker: tự nhận task, nhận file, thực hiện OCR và trả kết quả về EZDOC Server. Server điều phối, xử lý nghiệp vụ (mapping, phân loại, tách hồ sơ) và cập nhật trạng thái.

  • Tăng hiệu suất nhờ xử lý đồng thời nhiều tài liệu
  • Giảm chi phí khi tận dụng máy tính hiện có
  • Không cần thêm hạ tầng riêng
  • Mở rộng linh hoạt khi bổ sung người dùng
Kiến trúc OCR phân tán trong mạng nội bộ.
Video

Xem EZDOC vận hành trong gần 3 phút

Dùng thử EZDOC trên chính dữ liệu của đơn vị bạn

Đăng ký demo để đánh giá tốc độ và độ chính xác thực tế.

Bạn cần tư vấn tài chính hoặc muốn trải nghiệm EZDOC?

Để lại thông tin, đội ngũ Huyền Thư sẽ liên hệ lại với bạn.