Một thành viên ban bình duyệt vừa tiết lộ thông tin gây sốc khi hai bài báo nghiên cứu khoa học bị phát hiện sử dụng tác giả giả mạo vẫn được ban tổ chức chấp nhận cho báo cáo trực tiếp (oral presentation) tại một hội nghị. Sự việc này nhanh chóng thu hút sự chú ý lớn từ cộng đồng công nghệ, cho thấy những lỗ hổng nghiêm trọng trong quy trình kiểm duyệt học thuật hiện nay trước làn sóng "rác AI" (AI slop).
Bối cảnh & Nguyên nhân
Hiện tượng "rác AI" trong nghiên cứu khoa học đang trở thành một vấn nạn nhức nhối khi các công cụ mô hình ngôn ngữ lớn (LLM) giúp việc tạo lập văn bản học thuật giả dễ dàng hơn bao giờ hết. Theo bài chia sẻ trên trang GeospatialML, tác giả vốn là một người thẩm định (reviewer) đã trực tiếp gắn cờ cảnh báo (flag) hai bài báo có dấu hiệu giả mạo thông tin tác giả. Tuy nhiên, bất chấp những cảnh báo rõ ràng này, cả hai bài viết vẫn vượt qua vòng thẩm định để nhận suất báo cáo trực tiếp — vị trí danh giá nhất vốn chỉ dành cho các nghiên cứu xuất sắc và đáng tin cậy nhất. Sự việc phản ánh áp lực xuất bản quá lớn trong giới học thuật, dẫn đến việc các đơn vị tổ chức chạy theo số lượng và bỏ qua các tiêu chuẩn xác minh cơ bản.
Phân tích kỹ thuật & Công nghệ
Sự tinh vi của các bài báo "rác AI" nằm ở khả năng qua mặt các công cụ phát hiện tự động thông thường. Các thuật toán tạo văn bản hiện đại có thể tạo ra các cấu trúc câu hoàn hảo, thuật ngữ chuyên ngành chuẩn xác và định dạng biểu đồ trông rất chuyên nghiệp. Khi các tác giả giả mạo hoặc tổ chức lừa đảo (paper mills) sử dụng AI để ngụy tạo dữ liệu, các hệ thống chống đạo văn truyền thống chỉ kiểm tra trùng lặp từ vựng sẽ hoàn toàn bất lực. Để phát hiện, người thẩm định phải đối chiếu thủ công thông tin danh tính của tác giả trên các cơ sở dữ liệu uy tín hoặc kiểm tra tính logic sâu chuỗi của các thí nghiệm. Tuy nhiên, quy trình thủ công này tốn rất nhiều thời gian và dễ bị bỏ qua trong các hệ thống bình duyệt tự động hóa một phần.
Ý kiến chuyên gia & Nhận định
Cộng đồng học thuật và công nghệ trên diễn đàn Hacker News đã bày tỏ sự thất vọng sâu sắc trước thông tin này. Nhiều ý kiến nhận định rằng hệ thống bình duyệt hiện tại đã "bị hỏng" (broken) do sự quá tải của các reviewer và sự thiếu trách nhiệm của ban tổ chức hội nghị. Một số chuyên gia cảnh báo rằng nếu các hội nghị lớn tiếp tục chấp nhận các bài báo có tác giả giả mạo, uy tín của toàn bộ hệ thống tri thức khoa học sẽ bị xói mòn nghiêm trọng. Việc các bài báo kém chất lượng, thậm chí là giả mạo hoàn toàn, giành được suất báo cáo trực tiếp sẽ cướp đi cơ hội của những nhà nghiên cứu làm việc nghiêm túc.
Tác động & Tương lai
Sự cố này là một hồi chuông cảnh tỉnh đối với các nhà tổ chức hội nghị khoa học và các nhà xuất bản học thuật trên toàn thế giới. Để đối phó với làn sóng bài báo giả mạo do AI hỗ trợ, giới khoa học cần thiết lập các quy trình xác thực danh tính tác giả nghiêm ngặt hơn, chẳng hạn như tích hợp mã định danh ORCID bắt buộc hoặc đối chiếu trực tiếp với các tổ chức nghiên cứu liên kết. Đối với độc giả và các nhà phát triển tại Việt Nam, sự việc này nhắc nhở chúng ta cần duy trì thái độ hoài nghi khoa học lành mạnh, không nên vội vàng tin tưởng hoàn toàn vào các công bố mới chỉ vì chúng xuất hiện ở các hội nghị lớn. Việc xây dựng năng lực tự thẩm định và kiểm chứng công nghệ sẽ là kỹ năng sống còn trong kỷ nguyên AI.