Bỏ qua đến nội dung chính
Về trang chủ
AI Tech 4 phút đọc

Poolside AI ra mắt Laguna S 2.1: Mô hình MoE 118B

Poolside AI công bố Laguna S 2.1, mô hình MoE 118B tham số với chế độ suy nghĩ linh hoạt giúp cân bằng hiệu năng và chi phí vận hành.

Tier 1 · nguồn 64% độ tin cậy Đã được duyệt
Nguồn gốc x.com

Poolside AI, startup chuyên về trí tuệ nhân tạo, vừa chính thức ra mắt Laguna S 2.1, mô hình ngôn ngữ lớn mạnh mẽ nhất của họ tính đến thời điểm hiện tại. Sự kiện công bố vào ngày 21/07/2026 đánh dấu bước đi chiến lược của công ty trong việc tối ưu hóa hiệu suất tính toán thông qua kiến trúc hỗn hợp chuyên gia (Mixture-of-Experts - MoE). Laguna S 2.1 được kỳ vọng sẽ mang lại giải pháp thay thế hiệu quả về chi phí cho các doanh nghiệp và nhà phát triển công nghệ trên toàn cầu.

Diễn biến chi tiết

Theo thông tin công bố từ Poolside, Laguna S 2.1 là phiên bản nâng cấp toàn diện được thiết kế để giải quyết bài toán cân bằng giữa chi phí vận hành và hiệu năng xử lý. Khác với các mô hình truyền thống đòi hỏi lượng tài nguyên khổng lồ cho mỗi lượt truy vấn, Laguna S 2.1 tận dụng cấu trúc MoE để phân phối tải công việc một cách thông minh.

Sự ra mắt của Laguna S 2.1 diễn ra trong bối cảnh các nhà phát triển AI đang dịch chuyển từ việc chạy đua tăng số lượng tham số đơn thuần sang tối ưu hóa khả năng suy luận thực tế. Việc Poolside đưa ra phiên bản này cho thấy tham vọng cạnh tranh trực tiếp với các ông lớn trong ngành bằng một giải pháp linh hoạt và dễ tiếp cận hơn đối với cộng đồng công nghệ toàn cầu.

Phân tích kỹ thuật & Công nghệ

Về mặt thông số, Laguna S 2.1 sở hữu tổng cộng 118 tỷ (118B) tham số, nhưng nhờ kiến trúc Mixture-of-Experts, mô hình chỉ kích hoạt đúng 8 tỷ (8B) tham số cho mỗi token được xử lý. Cơ chế này giúp giảm đáng kể năng lượng tiêu thụ và tăng tốc độ phản hồi đáng kể trong quá trình suy luận (inference).

Điểm nhấn công nghệ đáng chú ý nhất là khả năng hỗ trợ cửa sổ ngữ cảnh cực đại lên tới 1 triệu (1M) token, cho phép nạp và phân tích toàn bộ các tài liệu hoặc mã nguồn siêu dài trong một phiên làm việc duy nhất. Thêm vào đó, Laguna S 2.1 được tích hợp hai chế độ hoạt động riêng biệt: chế độ "suy nghĩ" (thinking mode) dành cho các tác vụ lập luận phức tạp, đòi hỏi thời gian phân tích sâu, và chế độ "không suy nghĩ" (no-thinking mode) tối ưu hóa cho các tác vụ yêu cầu phản hồi tức thì với độ trễ cực thấp.

Ý kiến chuyên gia & Nhận định

Phía Poolside tuyên bố Laguna S 2.1 đủ mạnh mẽ để "đọ sức trực tiếp với các mô hình lớn hơn gấp nhiều lần về kích thước". Tuy nhiên, giới quan sát công nghệ khuyến cáo người dùng cần chờ đợi các kết quả kiểm thử độc lập (benchmarks) từ cộng đồng để đánh giá chính xác năng lực thực tế của mô hình này.

Nhiều chuyên gia trong ngành nhận định rằng, hướng tiếp cận cung cấp hai chế độ "thinking" và "no-thinking" của Poolside là một bước đi thông minh. Phương pháp này không chỉ giúp người dùng tiết kiệm chi phí điện toán bằng cách chỉ sử dụng tài nguyên suy luận sâu khi thực sự cần thiết, mà còn mở đường cho các ứng dụng AI agent hoạt động tự chủ và linh hoạt hơn trong tương lai.

Tác động & Tương lai

Sự xuất hiện của Laguna S 2.1 với kiến trúc MoE tối ưu hóa có thể tạo ra tác động lớn đến cách thức các nhà phát triển tại Việt Nam và khu vực tiếp cận công nghệ AI. Việc giảm thiểu rào cản về phần cứng và chi phí vận hành sẽ giúp các startup công nghệ trong nước dễ dàng tích hợp các mô hình ngôn ngữ lớn thế hệ mới vào sản phẩm thương mại của mình.

Trong dài hạn, xu hướng phát triển các mô hình ngôn ngữ tích hợp khả năng "suy nghĩ" linh hoạt như Laguna S 2.1 hứa hẹn sẽ định hình lại thị trường AI. Các mô hình cồng kềnh, tiêu tốn nhiều năng lượng có thể sẽ dần mất đi lợi thế cạnh tranh trước các giải pháp MoE tinh gọn, hiệu quả và có khả năng tùy biến cao theo nhu cầu thực tế của người dùng.