Là bản dịch sang tiếng Việt tài liệu của Michael Weinberg, do GLAM-E Lab xuất bản tháng 6/2025, giấy phép CC BY 4.0.
“Giới thiệu
Vào cuối năm 2024, bắt đầu xuất hiện những báo cáo lẻ tẻ từ các bộ sưu tập di sản văn hóa trực tuyến riêng lẻ. Các báo cáo này mô tả tình trạng máy chủ và hệ thống lưu trữ bị quá tải – và đôi khi gặp sự cố – do sự tấn công dồn dập của các chương trình tự động (bot). Các bot này được cho là đang thu thập toàn bộ dữ liệu từ các bộ sưu tập để xây dựng tập dữ liệu huấn luyện cho các mô hình trí tuệ nhân tạo (AI). Hoạt động này gây áp lực quá lớn lên các hệ thống vốn được thiết kế để duy trì sự hiện diện trực tuyến của các bộ sưu tập đó.
Mặc dù đáng lo ngại, nhưng chưa thể khẳng định ngay liệu những báo cáo này có phản ánh một xu hướng rộng lớn hơn hay không. Liệu chúng có đại diện cho trải nghiệm của đa số các bộ sưu tập trực tuyến? Chúng chỉ là những trường hợp cá biệt? Hay là những dấu hiệu cảnh báo sớm?
GLAM-E Lab đã công bố báo cáo này nhằm giải đáp các câu hỏi trên và bắt đầu phác họa bức tranh toàn cảnh lớn hơn. Báo cáo tập trung đặc biệt vào các bộ sưu tập đã được số hóa và dữ liệu liên quan đến các tổ chức GLAM – bao gồm Phòng trưng bày (Galleries), Thư viện (Libraries), Cơ quan lưu trữ (Archives) và Bảo tàng (Museums).
Vào tháng 4 năm 2025, GLAM-E Lab đã gửi một bản khảo sát ngắn qua các danh sách thư điện tử (listserv) dành cho những người làm việc trong lĩnh vực di sản và công nghệ tại các tổ chức GLAM, bao gồm cả những người trong và ngoài giới học thuật. Cộng đồng này mang tính quốc tế và bao gồm các cơ sở với quy mô đa dạng, từ các cơ quan lưu trữ quốc gia hàng đầu cho đến các bảo tàng địa phương.
Chúng tôi đã đặt câu hỏi cho các tổ chức sở hữu bộ sưu tập trực tuyến – bất kể các bộ sưu tập đó có được cấp phép mở hay không – về trải nghiệm của họ liên quan đến các bot thu thập dữ liệu để huấn luyện AI. Các câu hỏi tập trung vào tác động kỹ thuật mà các bot gây ra (hoặc không gây ra) đối với cơ sở hạ tầng trực tuyến của họ. Mục tiêu của chúng tôi là tìm hiểu xem liệu những báo cáo ban đầu về sự cố có đại diện cho tình hình chung của cộng đồng GLAM hay không, đồng thời hiểu rõ hơn và chi tiết hơn về các vấn đề kỹ thuật mà các bộ sưu tập mở đang gặp phải do bot, và cuối cùng là bắt đầu định hình các giải pháp khả thi….”
Tự do tải về bản dịch sang tiếng Việt của tài liệu có 51 trang tại địa chỉ:
Xem thêm:
Blogger: Lê Trung Nghĩa
letrungnghia.foss@gmail.com
Tác giả: Nghĩa Lê Trung
Ý kiến bạn đọc
Những tin cũ hơn
Blog này được chuyển đổi từ http://blog.yahoo.com/letrungnghia trên Yahoo Blog sang sử dụng NukeViet sau khi Yahoo Blog đóng cửa tại Việt Nam ngày 17/01/2013.Kể từ ngày 07/02/2013, thông tin trên Blog được cập nhật tiếp tục trở lại với sự hỗ trợ kỹ thuật và đặt chỗ hosting của nhóm phát triển...
Sổ tay Nghiên cứu Mở của Mạng lưới Cao học Toàn cầu Tài nguyên Giáo dục Mở - GO-GN (Global OER - Graduate Network)
DigComp 3.0: Khung năng lực số châu Âu
Các bài toàn văn trong năm 2025
Các bài trình chiếu trong năm 2025
Các lớp tập huấn thực hành ‘Khai thác tài nguyên giáo dục mở’ tới hết năm 2025
Tập huấn thực hành ‘Khai thác tài nguyên giáo dục mở’ cho giáo viên phổ thông, bao gồm cả giáo viên tiểu học và mầm non tới hết năm 2025
Các tài liệu dịch sang tiếng Việt tới hết năm 2025
Loạt bài về AI và AI Nguồn Mở: Công cụ AI; Dự án AI Nguồn Mở; LLM Nguồn Mở; Kỹ thuật lời nhắc;
Tổng hợp các bài của Nhóm các Nhà cấp vốn Nghiên cứu Mở (ORFG) đã được dịch sang tiếng Việt
Tổng hợp các bài của Liên minh S (cOAlition S) đã được dịch sang tiếng Việt
Hướng dẫn kỹ thuật lời nhắc. Kỹ thuật viết lời nhắc. Lời nhắc Tái Hành động (ReAct)
DigComp 3.0: Khung năng lực số châu Âu
Thông cáo báo chí của Liên minh S về Truy cập Mở trong giai đoạn 2026-2030 - bản dịch sang tiếng Việt
Tài nguyên Giáo dục Mở trong kỷ nguyên AI
Các bài trình chiếu trong năm 2025
Hướng dẫn kỹ thuật lời nhắc. Giới thiệu. Các thành phần của lời nhắc
Tập huấn thực hành ‘Khai thác tài nguyên giáo dục mở’ cho giáo viên phổ thông, bao gồm cả giáo viên tiểu học và mầm non tới hết năm 2025
Hướng dẫn kỹ thuật lời nhắc. Các tác nhân. Giới thiệu các tác nhân AI
cOAlition S củng cố cam kết Truy cập Mở trong khi thúc đẩy giai đoạn chiến lược tiếp theo
10 mô hình ngôn ngữ lớn (LLM) nguồn mở hàng đầu cho năm 2025. 4. Mistral-8x22b
Các bài toàn văn trong năm 2025
Các tài liệu dịch sang tiếng Việt tới hết năm 2025
‘Chiến lược 2026-2030 của Liên minh S’ - bản dịch sang tiếng Việt
Sổ tay Phương pháp Nghiên cứu. Giới thiệu các phương pháp nghiên cứu
Hướng dẫn Khung khái niệm. Vị thế (Positionality)
DigComp 3.0: Khung năng lực số châu Âu. Tóm lược
Schmidt Sciences ra nhập Nhóm các Nhà cấp vốn Nghiên cứu Mở (ORFG)
Hướng dẫn Khung khái niệm. Khung khái niệm và triển vọng nghiên cứu
DigComp 3.0: Khung năng lực số châu Âu
Hội thảo ‘Cập nhật phong trào Mở tại Việt Nam từ góc nhìn nghiên cứu và thực hành’ do GO-GN ASIA PACIFIC tổ chức tại Hà Nội ngày 1/12/2025 Hà Nội