Mới đây, một giáo sư đại học đã áp dụng phương pháp "bẫy prompt ẩn" (invisible prompt trap) trong đề bài tập về nhà và thành công phát hiện 32 trên tổng số 35 sinh viên sử dụng AI để gian lận. Bằng cách chèn các dòng lệnh vô hình đối với mắt người nhưng dễ dàng bị các mô hình ngôn ngữ lớn (LLM) phát hiện, vị giáo sư này đã chứng minh một thực trạng đáng ngại: sinh viên đang lạm dụng AI một cách mù quáng mà không hề kiểm tra lại nội dung trước khi nộp bài.
Bối cảnh & Nguyên nhân
Vấn nạn sinh viên sử dụng các công cụ như ChatGPT hay Claude để hoàn thành bài tập về nhà không còn là điều mới mẻ. Tuy nhiên, việc phát hiện gian lận bằng các phần mềm quét AI truyền thống thường không mang lại độ chính xác cao và dễ dẫn đến những cáo buộc oan sai.
Theo báo cáo từ TechSpot, giáo sư này đã quyết định tự mình thiết kế một phương pháp kiểm chứng trực quan hơn. Ông nhận thấy học sinh thường có xu hướng sao chép toàn bộ nội dung đề bài và dán trực tiếp vào các ô nhập liệu của chatbot để yêu cầu giải quyết nhanh chóng, thay vì tự suy nghĩ hoặc ít nhất là biên tập lại câu trả lời.
Phân tích kỹ thuật & Công nghệ
Về mặt kỹ thuật, bẫy prompt ẩn hoạt động dựa trên cơ chế đọc dữ liệu thô của các mô hình LLM. Giáo sư đã chèn một đoạn văn bản ngắn có nội dung kỳ lạ bằng phông chữ màu trắng (trùng màu nền) hoặc đặt kích thước chữ về mức bằng không trong file tài liệu số của đề bài.
Đối với mắt người đọc thông thường, đoạn chữ này hoàn toàn vô hình. Tuy nhiên, khi học sinh bôi đen, sao chép toàn bộ đề bài và dán vào cửa sổ ChatGPT, đoạn văn bản ẩn này sẽ được sao chép theo dưới dạng văn bản thuần túy (plain text).
Đoạn mã ẩn chứa yêu cầu đặc biệt, ví dụ như buộc AI phải chèn một từ khóa cực kỳ lạc quẻ như "con kỳ lân" hay một câu chuyện phi lý vào bài làm. Do các LLM hoạt động theo nguyên tắc tuân thủ nghiêm ngặt chỉ dẫn trong prompt, chúng lập tức thực hiện yêu cầu này mà không hề "nghi ngờ".
Ý kiến chuyên gia & Nhận định
Kết quả của bài kiểm tra đã gây chấn động khi có tới 32 trên 35 sinh viên nộp bài làm chứa đúng từ khóa kỳ lạ được gài sẵn. Điều này chứng minh rằng phần lớn sinh viên không chỉ dùng AI để hỗ trợ mà đã phó mặc hoàn toàn cho công nghệ, thậm chí không thèm đọc lại bài làm của chính mình trước khi nhấn nút nộp.
Nhiều chuyên gia giáo dục nhận định rằng đây là một hồi chuông cảnh tỉnh cho phương pháp đánh giá năng lực hiện nay. Khi các công cụ AI ngày càng tinh vi, việc giao các bài tập lý thuyết truyền thống dưới dạng tự luận trực tuyến đã không còn hiệu quả để đánh giá thực chất kiến thức của người học.
Tác động & Tương lai
Sự việc này cho thấy ranh giới mong manh giữa việc sử dụng AI như một công cụ hỗ trợ học tập và việc lạm dụng nó để gian lận. Trong tương lai, các cơ sở giáo dục chắc chắn sẽ phải thay đổi cấu trúc đề thi, hướng tới các bài kiểm tra vấn đáp trực tiếp hoặc các bài tập thực hành yêu cầu tính tương tác cao.
Đối với cộng đồng công nghệ, phương pháp "bẫy prompt" này cũng mở ra những hướng đi mới trong việc bảo vệ bản quyền nội dung và ngăn chặn việc quét dữ liệu trái phép từ các bot AI của các công ty công nghệ lớn trên môi trường internet.