Ngày 1 tháng 9 năm 2026, Nvidia đã phát đi thông báo ngắn trên tài khoản mạng xã hội X chính thức nhằm giới thiệu SafeMind, một hệ thống AI tác tử (agentic system) được thiết kế theo hướng kết hợp cả hai cơ chế tấn công và phòng thủ.
Theo bài đăng từ @nvidia, hệ thống này được xây dựng xoay quanh mô hình tác tử kép (offensive - defensive agentic system), nhằm mục tiêu tiếp cận các bài toán bảo mật và an toàn bằng việc mô phỏng đồng thời cả vai trò tấn công lẫn phòng ngự. Khái niệm hệ thống tác tử (agentic system) trong lĩnh vực an toàn AI thường mô tả các mô hình có khả năng tự chủ lập kế hoạch, sử dụng công cụ và thực thi chuỗi hành động để tìm kiếm lỗ hổng hoặc chủ động vá các điểm yếu bảo mật.
Tuy nhiên, trong bài đăng công bố trên X, Nvidia chỉ dừng lại ở lời kêu gọi tìm hiểu thêm về SafeMind mà chưa đính kèm đầy đủ tài liệu kỹ thuật chuyên sâu. Bài đăng chưa làm rõ chi tiết kiến trúc mô hình nền tảng bên dưới, các bài kiểm thử thực tế (benchmark), phương thức triển khai hay thời điểm phát hành rộng rãi tới người dùng doanh nghiệp và giới nghiên cứu.
Hiện tại, các thông tin quan trọng như việc SafeMind sẽ được phát hành dưới dạng mã nguồn mở, dịch vụ đám mây hay tích hợp vào hệ sinh thái phần cứng và phần mềm hiện hữu của Nvidia vẫn còn bỏ ngỏ và chờ hãng đưa ra thông báo chính thức tiếp theo.