Ngày 20/8/2026, Bindu Reddy đăng tải trên mạng xã hội X thông tin cho biết mức độ ứng dụng AI mã nguồn mở đang ghi nhận đà tăng trưởng bùng nổ, trong đó lưu lượng sử dụng mô hình DeepSeek Flash đã tăng vọt từ 10 đến 100 lần. Động lực chính dẫn đến sự gia tăng mạnh mẽ này, theo bà Reddy, xuất phát từ mức chi phí suy luận một lượt (one-turn inference) siêu rẻ, thu hút sự tiếp nhận đáng kể ngay cả trong khối doanh nghiệp lớn.
Khái niệm suy luận một lượt thường được áp dụng cho các tác vụ hỏi - đáp trực tiếp, phân loại văn bản hoặc xử lý truy vấn đơn lẻ không đòi hỏi duy trì ngữ cảnh hội thoại kéo dài. Đối với các hệ thống phần mềm doanh nghiệp phải xử lý khối lượng yêu cầu khổng lồ mỗi ngày, việc cắt giảm chi phí cho từng lượt gọi mô hình đóng vai trò then chốt nhằm tối ưu hóa ngân sách vận hành. Việc các mô hình tối ưu hóa tốc độ và chi phí như DeepSeek Flash được đẩy mạnh triển khai cho thấy các tổ chức đang tìm kiếm những phương án thay thế có tính kinh tế cao hơn so với việc phụ thuộc hoàn toàn vào các API thương mại đắt đỏ.
Trong bối cảnh bài toán chi phí hạ tầng AI vẫn là rào cản lớn đối với việc mở rộng quy mô, sự dịch chuyển sang các mô hình mã nguồn mở chuyên biệt cho từng tác vụ cụ thể đang dần trở thành một hướng đi thực tế. Khả năng tự triển khai hoặc sử dụng các phiên bản tinh gọn giúp doanh nghiệp tích hợp trí tuệ nhân tạo vào nhiều quy trình nội bộ hơn mà không làm bùng nổ chi phí tính toán.
Tuy vậy, tuyên bố của Bindu Reddy vẫn để ngỏ nhiều chi tiết định lượng quan trọng. Tác giả không công bố mốc thời gian đo lường cụ thể cho mức tăng 10-100 lần, cũng như không đưa ra con số tuyệt đối về sản lượng token hay danh sách các doanh nghiệp đang sử dụng. Bên cạnh đó, các thông số kỹ thuật chi tiết, mức độ tiêu hao tài nguyên phần cứng cũng như chất lượng đầu ra thực tế của DeepSeek Flash so với các mô hình cùng phân khúc vẫn chưa được công bố kèm theo dữ liệu kiểm chứng độc lập.