Ngày 17/8/2026, Dharma-AI công bố bài viết chuyên sâu trên Hugging Face Blog về quản lý hạ tầng GPU, ghi nhận mức tăng 33 điểm phần trăm hiệu suất sử dụng trên cùng một cụm phần cứng chỉ nhờ thay đổi thứ tự điều phối tác vụ. Đây là phần thứ hai trong chuỗi bài viết kỹ thuật của Dharma-AI xoay quanh bài toán tối ưu hoá tài nguyên tính toán cho AI.
Theo Hugging Face Blog, thay đổi trọng tâm không nằm ở việc bổ sung thêm chip xử lý hay can thiệp vào kiến trúc mô hình, mà tập trung vào việc sắp xếp lại thứ tự thực thi công việc trên cụm máy tính sẵn có. Kết quả thu được cho thấy hiệu suất khai thác GPU (utilization rate) cải thiện thêm 33 điểm phần trăm so với quy trình trước đó, giúp tận dụng tối đa năng lực phần cứng mà không phát sinh thêm chi phí thiết bị.
Bản tóm tắt kỹ thuật hiện tại chưa cung cấp bảng đo kiểm chi tiết về chủng loại GPU thử nghiệm, quy mô cụm máy chủ cụ thể cũng như thuật toán lập lịch tác vụ được áp dụng. Dharma-AI chưa công bố mã nguồn điều phối đi kèm trong thông báo ban đầu này.