Nền tảng Vercel ngày 17/09/2026 đã công bố hỗ trợ chạy bộ công cụ đánh giá Harbor trực tiếp trên môi trường Vercel Sandbox, cho phép các nhà phát triển thực thi song song các bài đo hiệu năng AI quy mô lớn trên các Firecracker microVM biệt lập thay vì bị giới hạn bởi phần cứng cục bộ.
Harbor là bộ khung kiểm thử mã nguồn mở đứng sau Terminal-Bench, đồng thời hỗ trợ danh mục nhiều bộ benchmark phổ biến khác như SWE-bench, tau3-bench và OSWorld. Để kích hoạt môi trường đám mây này, người dùng chỉ cần thêm cờ cấu hình --env vercel vào câu lệnh harbor run. Mỗi lượt chạy thử nghiệm sẽ được khởi tạo trong một microVM Firecracker riêng biệt, giúp tăng tốc độ xử lý đồng thời vượt mức khả năng của máy tính cá nhân thông thường.
Về mặt bảo mật hạ tầng, chính sách mạng của từng tác vụ được kiểm soát trực tiếp tại tường lửa của sandbox nằm bên ngoài máy ảo. Tính năng chèn thông tin xác thực tùy chọn cho phép gắn các khóa bí mật vào các yêu cầu gửi ra ngoài phù hợp ngay tại lớp tường lửa này, đảm bảo dữ liệu nhạy cảm không bao giờ đi trực tiếp vào bên trong môi trường sandbox.
Khi kết hợp với dịch vụ Vercel AI Gateway, người dùng chỉ cần một khóa AI_GATEWAY_API_KEY duy nhất để kết nối tới hàng trăm mô hình từ nhiều nhà cung cấp khác nhau. Việc chuyển đổi bài benchmark sang một mô hình khác được thực hiện đơn giản bằng cách thay đổi tham số --model, ví dụ chuyển sang vercel_ai_gateway/openai/gpt-5.6-luna để kiểm thử với mô hình của OpenAI. Theo thông báo từ Vercel Blog, tính năng tích hợp này yêu cầu Harbor phiên bản 0.22.0 trở lên.