Là bản dịch sang tiếng Việt tài liệu của Michael Weinberg, do GLAM-E Lab xuất bản tháng 6/2025, giấy phép CC BY 4.0.
“Giới thiệu
Vào cuối năm 2024, bắt đầu xuất hiện những báo cáo lẻ tẻ từ các bộ sưu tập di sản văn hóa trực tuyến riêng lẻ. Các báo cáo này mô tả tình trạng máy chủ và hệ thống lưu trữ bị quá tải – và đôi khi gặp sự cố – do sự tấn công dồn dập của các chương trình tự động (bot). Các bot này được cho là đang thu thập toàn bộ dữ liệu từ các bộ sưu tập để xây dựng tập dữ liệu huấn luyện cho các mô hình trí tuệ nhân tạo (AI). Hoạt động này gây áp lực quá lớn lên các hệ thống vốn được thiết kế để duy trì sự hiện diện trực tuyến của các bộ sưu tập đó.
Mặc dù đáng lo ngại, nhưng chưa thể khẳng định ngay liệu những báo cáo này có phản ánh một xu hướng rộng lớn hơn hay không. Liệu chúng có đại diện cho trải nghiệm của đa số các bộ sưu tập trực tuyến? Chúng chỉ là những trường hợp cá biệt? Hay là những dấu hiệu cảnh báo sớm?
GLAM-E Lab đã công bố báo cáo này nhằm giải đáp các câu hỏi trên và bắt đầu phác họa bức tranh toàn cảnh lớn hơn. Báo cáo tập trung đặc biệt vào các bộ sưu tập đã được số hóa và dữ liệu liên quan đến các tổ chức GLAM – bao gồm Phòng trưng bày (Galleries), Thư viện (Libraries), Cơ quan lưu trữ (Archives) và Bảo tàng (Museums).
Vào tháng 4 năm 2025, GLAM-E Lab đã gửi một bản khảo sát ngắn qua các danh sách thư điện tử (listserv) dành cho những người làm việc trong lĩnh vực di sản và công nghệ tại các tổ chức GLAM, bao gồm cả những người trong và ngoài giới học thuật. Cộng đồng này mang tính quốc tế và bao gồm các cơ sở với quy mô đa dạng, từ các cơ quan lưu trữ quốc gia hàng đầu cho đến các bảo tàng địa phương.
Chúng tôi đã đặt câu hỏi cho các tổ chức sở hữu bộ sưu tập trực tuyến – bất kể các bộ sưu tập đó có được cấp phép mở hay không – về trải nghiệm của họ liên quan đến các bot thu thập dữ liệu để huấn luyện AI. Các câu hỏi tập trung vào tác động kỹ thuật mà các bot gây ra (hoặc không gây ra) đối với cơ sở hạ tầng trực tuyến của họ. Mục tiêu của chúng tôi là tìm hiểu xem liệu những báo cáo ban đầu về sự cố có đại diện cho tình hình chung của cộng đồng GLAM hay không, đồng thời hiểu rõ hơn và chi tiết hơn về các vấn đề kỹ thuật mà các bộ sưu tập mở đang gặp phải do bot, và cuối cùng là bắt đầu định hình các giải pháp khả thi….”
Tự do tải về bản dịch sang tiếng Việt của tài liệu có 51 trang tại địa chỉ:
Xem thêm:
Blogger: Lê Trung Nghĩa
letrungnghia.foss@gmail.com
Không có nhận xét nào:
Đăng nhận xét
Lưu ý: Chỉ thành viên của blog này mới được đăng nhận xét.