Qwen3.8-Max là gì và vì sao đáng chú ý?
Qwen3.8-Max là mô hình AI đa phương thức quy mô 2.400 tỷ tham số do Alibaba phát triển, được tối ưu để xử lý văn bản, hình ảnh, video và tác vụ lập trình phức tạp trong cửa sổ ngữ cảnh rất dài, hướng tới các ứng dụng AI agent có thể tự hoàn thành chuỗi công việc thay vì chỉ đóng vai trò chatbot trả lời từng câu hỏi.
Alibaba vừa trình làng Qwen3.8-Max như mô hình AI mạnh nhất trong hệ Qwen của họ, đồng thời mở quyền truy cập toàn cầu cho người dùng trước khi tung phiên bản mã nguồn mở trong tuần tiếp theo. Đây là bước quay lại chiến lược mở mô hình sau giai đoạn ưu tiên các bản đóng, phản ánh việc Alibaba muốn vừa thương mại hóa, vừa tạo hệ sinh thái phát triển xoay quanh Qwen3.8-Max. Động thái này diễn ra đúng lúc cuộc đua AI tại Trung Quốc chuyển trọng tâm sang trợ lý lập trình, mô hình AI đa phương thức và các quy trình tự động hóa end-to-end, nơi Mỹ đang dẫn đầu với Claude, GPT và Gemini. Câu hỏi đặt ra: Qwen3.8-Max là cú bứt phá thực sự hay chỉ là một màn “nổ” marketing khéo?

Video 100 giờ và cửa sổ 1 triệu token: lợi thế thực hay chiêu trò?
Alibaba mô tả Qwen3.8-Max như một mô hình AI đa phương thức có thể hiểu song song văn bản, hình ảnh, video và tài liệu dài. Điểm nổi bật nhất là khả năng xử lý video và livestream kéo dài tới 100 giờ, chuyển toàn bộ thành cơ sở dữ liệu có thể tìm kiếm và tương tác. Đây là thế mạnh rõ ràng trong bối cảnh nhu cầu xử lý video AI cho giáo dục, giám sát, game và nội dung doanh nghiệp bùng nổ.
Mô hình hỗ trợ cửa sổ ngữ cảnh tới 1 triệu token, đủ để “nuốt” cùng lúc hàng nghìn trang tài liệu hoặc nhiều cuốn sách mà vẫn giữ được mạch thông tin. Về kiến trúc, Qwen3.8-Max dùng Mixture of Experts, chỉ kích hoạt khoảng 95 tỷ tham số – tức gần 4% – cho mỗi lần suy luận, một con số mà chính Alibaba công bố như ưu thế cân bằng giữa hiệu năng và chi phí. Nói cách khác, sức mạnh của Qwen3.8-Max không nằm ở việc “to” hơn, mà ở khả năng xử lý phiên làm việc dài, nhiều bước và đa phương thức – thứ mà các doanh nghiệp đang thiếu.

Sức mạnh lập trình: đứng thứ tư Arena có đủ để thách thức Mỹ?
Trong cuộc đua lập trình, Qwen3.8-Max đang ở vị thế “chiếu trên nhưng chưa phải ngôi vương”. Trên bảng xếp hạng Frontend Code của Arena, model này đứng thứ tư, chỉ xếp sau các biến thể của Claude Opus 5 và Kimi K3. Điểm số 1.668 của Qwen3.8-Max chỉ kém Claude Opus 5 (High) đúng 1 điểm, trong khi bản Opus 5 (Max) dẫn đầu với 1.705 điểm. Đây là khoảng cách ngắn nhưng mang ý nghĩa lớn: Alibaba đã bước vào cùng mâm với các ông lớn Mỹ về kỹ năng coding thực tế.
Ở các benchmark kỹ thuật phần mềm sâu, Qwen vẫn chịu lép vế trước Fable 5 khi điểm SWE-Pro và FrontierSWE đều thấp hơn đáng kể. Điều này cho thấy Qwen3.8-Max phù hợp hơn với vai trò trợ lý lập trình tổng quát, xử lý front-end, tool nội bộ và AI agent, hơn là thay thế những mô hình chuyên trị core software engineering. Dù vậy, việc vừa đứng top lập trình, vừa mạnh đa phương thức, vừa xử lý ngữ cảnh dài khiến Qwen3.8-Max trở thành lựa chọn cân bằng giữa “trí tuệ viết code” và “khả năng hiểu toàn bộ hệ thống” – điều mà nhiều đội kỹ sư cần hơn một benchmark đẹp trên giấy.
Giá API AI rẻ và chiến lược open-weight: cú đòn vào hệ sinh thái Mỹ?
Về thương mại, Qwen3.8-Max chơi chiến lược “kẹp” giữa hiệu năng cao và giá API AI rẻ hơn các đối thủ trực tiếp trong cùng phân khúc. Theo thông tin công bố, giá API của Qwen3.8-Max thấp hơn rõ rệt so với Kimi K3, cả ở đầu vào lẫn đầu ra. Dù thị trường nội địa Trung Quốc vẫn có những lựa chọn còn rẻ hơn như DeepSeek, Qwen3.8-Max nhắm tới nhóm khách hàng cần mô hình mạnh, đa phương thức, chứ không đơn thuần săn giá thấp nhất.
Quan trọng hơn, Alibaba sẽ phát hành phiên bản open-weight của Qwen3.8-Max và Qwen3.8-27B trong tuần tới, đăng tải trên các nền tảng dành cho cộng đồng mô hình. Dù không phải open-source hoàn toàn, open-weight vẫn đủ để các đội kỹ sư tải về, tinh chỉnh và triển khai trên hạ tầng riêng. Việc đây là lần đầu dòng Qwen-Max mở weights đã khiến cổ phiếu Alibaba tăng mạnh trên sàn Hồng Kông ngay sau khi thông tin được công bố. Nếu cộng đồng developer ôm lấy Qwen3.8-Max như một “GPT miễn phí hơn, linh hoạt hơn”, Alibaba sẽ có lợi thế hệ sinh thái mà các hãng Mỹ khó kiểm soát.
Kết luận: Qwen3.8-Max đã đủ để phá thế thống trị của Mỹ chưa?
Nhìn vào số liệu, Qwen3.8-Max chưa đánh bại được các model hàng đầu của Mỹ, nhưng đã tiến rất gần ở nhiều hạng mục. Mô hình đứng thứ 5 trên Text Arena, thứ 2 trên Vision Arena, và thứ 4 ở bảng Frontend Code, đồng thời chỉ kích hoạt khoảng 95 tỷ trong tổng 2.400 tỷ tham số mỗi lần suy luận. Nói cách khác, đây là một mô hình thực dụng hơn là “siêu anh hùng” trên slide marketing.
Điểm đáng kể nhất là sự kết hợp giữa: xử lý video AI dài tới 100 giờ, cửa sổ ngữ cảnh 1 triệu token, khả năng lập trình thuộc top đầu, giá API cạnh tranh và chiến lược open-weight. Với người dùng và doanh nghiệp, Qwen3.8-Max không chỉ là “Qwen3.8-Max Alibaba” với mô hình AI đa phương thức khổng lồ, mà là một lựa chọn chiến lược: chấp nhận rời xa hệ sinh thái Mỹ để đổi lấy chi phí thấp hơn, quyền kiểm soát nhiều hơn và một hệ sinh thái đang mở rộng nhanh. Thế thống trị của Mỹ chưa bị phá vỡ, nhưng Qwen3.8-Max đã biến cuộc chơi từ “một chiều” thành “song mã” rõ rệt.






