Tài liệu giấy khó khai thác & xuống cấp
Bản gốc quý hiếm hư hỏng dần qua mỗi lần mượn đọc; muốn tra một chi tiết phải lật từng trang. Không số hóa thì tri thức bị "khóa" trong kho, chỉ phục vụ được số ít người tại chỗ.
Số hóa toàn bộ vốn tài liệu — sách, báo, tạp chí, luận văn, bản đồ, tư liệu quý — xây dựng kho đối tượng số tra cứu toàn văn, đọc trực tuyến có kiểm soát bản quyền và liên thông theo chuẩn. Phần mềm chuyên về khai thác nội dung số, phục vụ bạn đọc mọi lúc, mọi nơi.
Kho tư liệu lớn nhưng khó tìm, khó tiếp cận và xuống cấp theo thời gian — trong khi bạn đọc ngày càng mong muốn khai thác trực tuyến mọi lúc, mọi nơi.
Bản gốc quý hiếm hư hỏng dần qua mỗi lần mượn đọc; muốn tra một chi tiết phải lật từng trang. Không số hóa thì tri thức bị "khóa" trong kho, chỉ phục vụ được số ít người tại chỗ.
Sinh viên, cán bộ, nhà nghiên cứu muốn đọc và tra cứu trực tuyến ngoài giờ hành chính. Nếu tài liệu số không có cổng khai thác thân thiện trên web và mobile, giá trị số hóa gần như bằng không.
File PDF nằm rải rác trên ổ đĩa, không metadata, không tra được toàn văn, không liên thông. Yêu cầu hiện đại là kho số chuẩn Dublin Core, OAI-PMH, tra cứu toàn văn và kiểm soát bản quyền chặt chẽ.
Thiết kế module hóa, bật/tắt từng phân hệ theo nhu cầu. Kiến trúc đa đơn vị: một đầu mối quản lý nhiều kho số, chia sẻ tài nguyên dùng chung, cô lập dữ liệu từng đơn vị.
Từ số hóa đầu vào đến phục vụ bạn đọc trực tuyến. Mỗi nhóm là một mô-đun độc lập, bật/tắt và cấu hình theo quy mô đơn vị.
Quét tài liệu theo lô, nhận dạng ký tự (OCR) tiếng Việt, xuất PDF/A hai lớp (ảnh + văn bản có thể chọn/tìm), tự động cắt lề, xoay và làm sạch ảnh.
Lưu trữ đa định dạng: sách, báo, tạp chí, luận văn, bản đồ, ảnh, âm thanh, video. File số lưu ngoài CSDL, gắn với biểu ghi biên mục, phân bộ sưu tập.
Tìm chính xác trong toàn bộ nội dung tài liệu số đã OCR, không dấu cũng ra kết quả; lọc theo bộ sưu tập, năm, tác giả, chủ đề, định dạng.
Đọc PDF/flipbook ngay trên trình duyệt, phát trực tuyến audio–video, xem ảnh độ phân giải cao — không cần tải file hay cài phần mềm.
Chính sách đọc theo dải IP, số lượt, phần trăm nội dung cho xem; chống tải, chèn thủy vân, phân quyền theo nhóm bạn đọc để bảo vệ tài liệu.
Tổ chức tài liệu theo bộ sưu tập, chuyên đề, môn học; dựng trang trưng bày số (digital exhibit) cho tài liệu quý, tài liệu địa chí, tư liệu nội bộ.
Bạn đọc đăng ký, đăng nhập SSO, đánh dấu tài liệu yêu thích, lịch sử đọc, trích dẫn và tải bản được phép — trải nghiệm cá nhân hóa trên web và mobile.
Dashboard trực quan: lượt truy cập, tài liệu được đọc nhiều, bộ sưu tập nổi bật, công suất khai thác kho số; xuất báo cáo định kỳ cho lãnh đạo.
Bốn nhóm năng lực tạo khác biệt — từ chuẩn số hóa và liên thông đến trải nghiệm khai thác và lớp AI thông minh.
Nhận dạng chính xác tiếng Việt có dấu, xuất PDF/A hai lớp đúng chuẩn lưu trữ dài hạn — tra được toàn văn, giữ nguyên bản chụp gốc.
Mô tả tài liệu số theo Dublin Core / METS / MODS, ánh xạ sang MARC21 — dữ liệu chuẩn để trao đổi và liên thông giữa các thư viện.
Lưu ảnh master độ phân giải cao và bản phái sinh phục vụ đọc nhanh; kiểm soát chất lượng theo lô, đối chiếu số trang, phát hiện thiếu/lỗi.
Bản in và bản số dùng chung một biểu ghi thư mục, không nhân bản, không lệch dữ liệu — tra cứu trả về kết quả gộp thống nhất.
Tìm trong toàn bộ nội dung đã OCR, gõ không dấu vẫn ra kết quả, làm nổi bật đoạn khớp — tra cứu nhanh trong kho tài liệu lớn.
Trình đọc PDF/flipbook, xem ảnh phóng to, phát audio–video ngay trên trình duyệt; giao diện tương thích máy tính, máy tính bảng và điện thoại.
Sinh trích dẫn chuẩn, tạo liên kết bền (permalink) tới từng tài liệu, chia sẻ trang trưng bày — thuận tiện cho nghiên cứu và học tập.
Bạn đọc truy cập tài liệu số mọi lúc, mọi nơi mà không cần đến thư viện; hoạt động liên tục 24/7, sẵn sàng IPv6, đa trình duyệt (gồm Cốc Cốc).
Chia sẻ và thu thập metadata qua OAI-PMH theo Dublin Core — sẵn sàng đóng góp vào thư viện số dùng chung và các cổng tổng hợp tài nguyên.
Đăng nhập một lần với hệ thống tài khoản của đơn vị, tích hợp AD/LDAP — bạn đọc dùng chung một tài khoản cho nhiều dịch vụ số.
Kiểm soát truy cập theo IP, số lượt, phần trăm nội dung; chèn thủy vân, chống tải; phân quyền chi tiết theo nhóm bạn đọc và loại tài liệu.
Mã hóa HTTPS, nhật ký truy cập chỉ ghi thêm (non-repudiation), sao lưu tự động, rà quét mã độc định kỳ — sẵn sàng hồ sơ ATTT cấp độ 2.
Vector hóa nhan đề, tóm tắt và nội dung — tìm theo ý nghĩa chứ không chỉ khớp từ khóa, gợi ý tài liệu liên quan cho bạn đọc.
Nhận dạng tài liệu cũ, chất lượng thấp; hỗ trợ xử lý tư liệu Hán–Nôm và văn bản địa chí để đưa vào kho số khai thác được.
Tự sinh tóm tắt và gợi ý chủ đề/từ khóa cho tài liệu mới số hóa — hỗ trợ thủ thư biên mục nhanh và nhất quán.
Bạn đọc hỏi tự nhiên về vốn tài liệu; câu trả lời trích dẫn nguồn từ chính kho số, lấy tình trạng qua tool-call nên luôn cập nhật.
Kho tài liệu số được xây dựng theo chuẩn mô tả và trao đổi dữ liệu quốc tế (Dublin Core, METS/MODS, OAI-PMH), lưu trữ dài hạn PDF/A, và tuân thủ các quy định về thư viện, an toàn thông tin hiện hành tại Việt Nam.
Phần mềm sẵn sàng demo trực tiếp để chứng minh từng chức năng, kèm tài liệu kỹ thuật chi tiết cho đơn vị đánh giá.
| Chuẩn / Văn bản áp dụng | Đáp ứng |
|---|---|
| Dublin Core · METS · MODS (metadata tài liệu số) | |
| OAI-PMH — liên thông & thu thập metadata | |
| PDF/A — lưu trữ dài hạn · OCR tiếng Việt | |
| MARC21 — ánh xạ với biểu ghi thư mục | |
| Luật Thư viện; TT 16/2022/TT-BGDĐT | |
| NĐ 85/2016 + TT 12/2022 — ATTT cấp độ 2 | |
| Web-based, đa trình duyệt (gồm Cốc Cốc), IPv6, 24/7 | |
| DRM — kiểm soát bản quyền tài liệu số |
* Đối chiếu theo chuẩn số hóa – thư viện số quốc tế và quy định hiện hành tại Việt Nam.
Ba nhóm khách hàng chính với nhu cầu số hóa và khai thác nội dung khác nhau.
Số hóa tài liệu quý, tư liệu địa phương, báo chí cũ; xây kho số phục vụ cộng đồng trực tuyến và đóng góp vào thư viện số dùng chung qua OAI-PMH.
Số hóa luận văn, giáo trình, tạp chí khoa học; tra cứu toàn văn, đọc online có DRM và trích dẫn chuẩn cho hàng nghìn sinh viên, giảng viên.
Số hóa hồ sơ, tài liệu kỹ thuật, thư viện nội bộ; kiểm soát truy cập chặt, tìm toàn văn nhanh và khai thác an toàn trong tổ chức.
Quy trình 4 bước, linh hoạt theo hình thức mua đứt hoặc thuê dịch vụ nhiều năm.
Đánh giá vốn tài liệu, ưu tiên số hóa, chọn định dạng và bộ sưu tập; thống nhất chuẩn metadata và chính sách bản quyền.
Quét theo lô, OCR, xuất PDF/A, biên mục metadata Dublin Core và kiểm tra chất lượng theo checklist trước khi công bố.
Cài đặt cổng khai thác, cấu hình DRM, tích hợp SSO và liên thông OAI-PMH; đào tạo thủ thư và quản trị hệ thống.
Bảo hành, hỗ trợ theo SLA; dữ liệu luôn thuộc về đơn vị, xuất được toàn bộ metadata và file gốc bất cứ lúc nào.
Do đội ngũ trong nước phát triển, Việt hóa hoàn toàn, chủ động cập nhật khi nghiệp vụ hay quy định thay đổi — không phụ thuộc lịch phát hành nước ngoài.
Cung cấp đồng thời dịch vụ số hóa (quét, OCR, biên mục) và nền tảng khai thác — không phải ghép nhiều nhà cung cấp, dữ liệu vào thẳng kho số vận hành được ngay.
Chính sách DRM linh hoạt theo IP, số lượt, phần trăm nội dung, chèn thủy vân và phân quyền chi tiết — yên tâm mở tài liệu ra phục vụ mà vẫn kiểm soát.
Tài liệu kỹ thuật chi tiết, thống kê khai thác phong phú; lớp AI (tìm ngữ nghĩa, OCR chữ cổ, chatbot RAG) tạo trải nghiệm tra cứu vượt các kho số truyền thống.
Phần mềm thư viện số tập trung vào số hóa và khai thác nội dung số: quét tài liệu, OCR, kho đối tượng số, tra cứu toàn văn và đọc trực tuyến có DRM. Phần mềm quản lý thư viện (ILS) quản lý toàn bộ nghiệp vụ back-office: biên mục MARC21, lưu thông mượn–trả, bạn đọc, RFID/SIP2. Hai sản phẩm dùng chung một biểu ghi và có thể triển khai độc lập hoặc kết hợp.
Có. Hệ thống hỗ trợ quét theo lô, OCR tiếng Việt có dấu, tự cắt lề – xoay – làm sạch ảnh và xuất PDF/A hai lớp (ảnh gốc + văn bản tra được). Với tài liệu cũ, chất lượng thấp hoặc tư liệu Hán–Nôm, lớp AI hỗ trợ nhận dạng nâng cao.
Bạn đọc đọc trực tiếp trên trình duyệt (PDF/flipbook, ảnh phóng to, audio–video) mà không cần tải file. Chính sách DRM cho phép giới hạn theo dải IP, số lượt đọc, phần trăm nội dung được xem, chèn thủy vân và phân quyền theo nhóm bạn đọc để bảo vệ tài liệu.
Có. Sau khi OCR, toàn bộ nội dung tài liệu được lập chỉ mục để tìm toàn văn — gõ không dấu vẫn ra kết quả, hệ thống làm nổi bật đoạn khớp và cho lọc theo bộ sưu tập, năm, tác giả, chủ đề, định dạng.
Có, qua giao thức OAI-PMH với metadata Dublin Core. Kho số có thể chia sẻ hoặc thu thập metadata với các cổng tổng hợp và thư viện số dùng chung; đồng thời hỗ trợ SSO để dùng chung tài khoản bạn đọc.
Có. Dữ liệu số và metadata luôn thuộc về đơn vị; hệ thống hỗ trợ xuất toàn bộ ở định dạng phổ biến, tái sử dụng được bất cứ lúc nào — dù triển khai theo hình thức mua đứt hay thuê dịch vụ.
Đăng ký xem demo trực tiếp hoặc nhận tài liệu kỹ thuật chi tiết. Đội ngũ kỹ thuật sẽ phản hồi trong ngày làm việc.