Bỏ qua đến nội dung chính
Về trang chủ
Tech AI 2 phút đọc

Vercel công bố hạ tầng Fluid xử lý 1.000 tỷ request mỗi tháng

Vercel giới thiệu kiến trúc Fluid Compute, hợp nhất hạ tầng máy ảo và tối ưu hóa thời gian khởi chạy cho các tác vụ AI agent.

Tier 2 · nguồn 50% độ tin cậy Đã được duyệt
Nguồn gốc vercel.com

Vercel vừa công bố chi tiết về kiến trúc hạ tầng tính toán mới mang tên Fluid, hệ thống hiện đang xử lý hơn 15 triệu lượt build mỗi ngày, 25 triệu môi trường sandbox mỗi tuần và 1.000 tỷ request mỗi tháng. Khác với mô hình máy chủ đám mây truyền thống yêu cầu cấu hình máy ảo cố định, Fluid được thiết kế để tự động lắp ráp tài nguyên máy tính theo đúng yêu cầu thực tế của từng tác vụ theo thời gian thực.

Theo Vercel, kiến trúc Fluid vận hành dựa trên ba thành phần cốt lõi: Hive, Fluid images và Vercel Drives. Trong đó, Hive đóng vai trò là tầng điều phối phần cứng độc quyền, chịu trách nhiệm cấp phát các máy ảo cô lập (isolated VM) trong vài mili-giây trên môi trường đa người dùng (multitenant). Thay vì sử dụng container hoặc isolate tiêu chuẩn với mức độ cách ly hạn chế, Hive cung cấp máy ảo hoàn chỉnh nhằm đảm bảo tính an toàn nhưng vẫn duy trì tốc độ khởi động gần như tức thì.

Đối với môi trường thực thi, Fluid images cho phép lập trình viên tải hình ảnh tùy chỉnh lên Vercel Container Registry (VCR). Hệ thống sẽ tự động chuyển đổi chúng sang định dạng VHS (Vercel Hive Snapshot), giúp máy ảo có thể khôi phục trạng thái từ snapshot thay vì khởi động lại hệ điều hành từ đầu. Tính năng này hiện đã được ứng dụng trong công cụ sinh mã v0 để dựng môi trường phát triển tức thì. Đi kèm với đó là Vercel Drives, lớp lưu trữ di động độc lập với vòng đời của máy ảo, hiện đang thử nghiệm giới hạn (private beta) trên sandbox trước khi mở rộng ra toàn bộ hệ sinh thái.

Vercel cho biết kiến trúc này nhắm trực tiếp vào các tác vụ của AI agent — nhóm khối lượng công việc liên tục chạy mã nguồn tùy ý, yêu cầu biên giới bảo mật nghiêm ngặt và vòng đời máy ảo bật tắt liên tục. Thay vì tính tiền dựa trên thời gian máy ảo duy trì kết nối, Fluid áp dụng mô hình định giá Active CPU, chỉ tính phí khi CPU thực sự xử lý mã và không tính phí trong thời gian chờ đợi phản hồi từ cơ sở dữ liệu hoặc mô hình AI.