Bỏ qua đến nội dung chính
Về trang chủ
AI tools-ai Tech 2 phút đọc

Nghiên cứu cấu trúc mô-đun và độ tin cậy của mô hình AI

Nhiều nghiên cứu mới từ arXiv phân tích cấu trúc nhận thức, tính ổn định và phương pháp đánh giá độ tin cậy trong các hệ thống mô hình ngôn ngữ lớn.

Tier 2 · nguồn 99% độ tin cậy Đã được duyệt
📚 Tổng hợp từ 10 nguồn arXiv cs.AI arXiv cs.AI arXiv cs.AI +7 khác

Ngày 17/8/2026, kho lưu trữ khoa học arXiv công bố loạt nghiên cứu mới tập trung vào cơ chế vận hành nội tại và phương pháp đánh giá độ tin cậy của các mô hình ngôn ngữ lớn (LLM). Một nghiên cứu nổi bật về cấu trúc nhận thức dạng mô-đun trên arXiv (mã số 2608.13567) cho thấy các mạng nơ-ron sâu tự hình thành sự phân hóa chức năng tương tự não bộ con người. Bằng phương pháp phân tích mạch nơ-ron qua 46 tác vụ thuộc 4 miền nhận thức gồm ngôn ngữ, suy luận hình thức, nhận thức xã hội và nhận thức vật lý, nghiên cứu phát hiện các tác vụ cùng nhóm chức năng sẽ kích hoạt những cụm nơ-ron trùng lặp trong LLM, trong khi các tác vụ khác nhóm kích hoạt các cụm nơ-ron riêng biệt.

Bên cạnh cấu trúc nơ-ron, vấn đề sai số tự tin cao (high-confidence errors) được phân tích qua nghiên cứu mã số 2608.13591. Báo cáo chỉ ra rằng một số lỗi sai ở mức tự tin cao không phải do suy luận nội tại mỏng manh mà phản ánh sự lệch chuẩn ổn định (stable miscalibration). Khi áp dụng kỹ thuật nhắc tự phê duyệt (self-critical prompting) trên ba mô hình trọng số mở, độ nhạy trạng thái ẩn (hidden-state sensitivity) giảm trên các tầng nơ-ron, củng cố tính ổn định cục bộ nhưng không đồng nghĩa với việc mô hình đã hiệu chuẩn chính xác.

Ở khía cạnh đánh giá tác tử (agent), nghiên cứu mã số 2608.13598 giới thiệu chỉ số BCM (Behavioral Consistency Metric) để đo lường tính nhất quán hành vi liên tác vụ. Thử nghiệm trên khoảng 9.000 quỹ đạo thực thi từ 6 tác tử mô hình ngôn ngữ cho thấy tính nhất quán giữa các tác vụ và tính nhất quán trong cùng một tác vụ là hai trục độc lập; các hệ thống có tỷ lệ thành công tương đương vẫn có thể khác biệt lớn về tính ổn định của chiến lược hành vi.