Grok 4.6 và Grok Imagine 2.0: Cặp bài trùng mới của AI agent

Grok 4.6 và Grok Imagine 2.0: Cặp bài trùng mới của AI agent
Sở thích|Khám phá ứng dụng AI

Grok 4.6 và Grok Imagine 2.0 là gì – và vì sao chúng quan trọng

Grok Imagine 2.0 và Grok 4.6 là hai thế hệ mô hình đa phương thức mới của SpaceXAI, tập trung vào AI xử lý hình ảnh chính xác, khả năng chỉnh sửa chi tiết và các Grok 4.6 agent có thể chạy lâu dài qua nhiều bước, cho thấy tham vọng biến Grok thành nền tảng mô hình ngôn ngữ lớn phục vụ cả người dùng phổ thông lẫn doanh nghiệp với mức độ tự động hóa sâu hơn nhiều so với các bản phát hành trước đây. Việc ra mắt Grok Imagine Image 2.0 ngày 7 tháng 8, với vai trò Quality Mode trên grok.com/imagine và trong ứng dụng iOS, Android, cho thấy SpaceXAI đang coi hình ảnh là mặt trận cạnh tranh chính. Chỉ vài ngày sau, Grok 4.6 trở thành mô hình chủ lực mới, được thiết kế cho agent chạy dài hơi và các tác vụ tương tác, trực quan tham vọng hơn.

Grok Imagine 2.0: Khi chỉnh sửa hình ảnh trở thành “tính năng gốc”

Grok Imagine 2.0 không chỉ là một công cụ AI xử lý hình ảnh, nó là tuyên bố rằng chỉnh sửa phải là năng lực trung tâm chứ không phải phần bổ sung. Bản phát hành này được xây dựng quanh chỉnh sửa như một khả năng “hạng nhất”, thay vì gắn thêm vào sau. Với công cụ “magic wand” chỉ thay đổi vùng người dùng chọn, công cụ phân vùng để lựa chọn chính xác khu vực cần chỉnh và tính năng xóa nền xuất chủ thể kèm nền trong suốt, Grok Imagine 2.0 rõ ràng hướng đến những người dùng muốn kiểm soát từng chi tiết hình ảnh. Multi-reference editing cho phép đưa tối đa năm ảnh làm tham chiếu trong một lần sinh hình, xóa bớt công đoạn ghép thủ công.

Điểm đáng nói là Grok Imagine 2.0 được huấn luyện chú trọng độ trung thực trong nhiếp ảnh, thiết kế và minh họa, với nhấn mạnh vào typography và bố cục, để hình phức tạp vẫn liền mạch và chữ nhỏ sắc nét. Điều này giải quyết một điểm yếu cố hữu của nhiều mô hình ngôn ngữ lớn đa phương thức: hình đẹp nhưng chữ méo, bố cục hỗn loạn. Không ngạc nhiên khi mô hình này được báo cáo đứng thứ hai thế giới về text-to-image và image editing trên Arena. Với các template sẵn cho ảnh sản phẩm, headshot, listing thương mại điện tử, asset game hay poster marketing, Grok Imagine 2.0 chỉnh sửa đang tiến gần tới vai trò “studio thiết kế bán tự động” cho người không chuyên. Vấn đề còn lại là API vẫn “coming soon”, nghĩa là cộng đồng developer chưa thể khai thác hết tiềm năng tích hợp của nó.

Grok 4.6: Agent chạy lâu dài và tầm nhìn tự động hóa sâu

Nếu Grok Imagine 2.0 là cánh tay hình ảnh, thì Grok 4.6 là bộ não suy luận và tự động hóa. Được phát hành ngày 12 tháng 8, Grok 4.6 là mô hình chủ lực mới của SpaceXAI, xây dựng dành riêng cho long‑running agents và các công việc tương tác, trực quan phức tạp. Grok 4.6 agent được mô tả là có thể “ở lại với các nhiệm vụ phức tạp qua nhiều bước”, từ nghiên cứu chủ đề, làm việc trên cả codebase đến biến ý tưởng sản phẩm thành phiên bản ứng dụng đầu tiên. Đây không còn là chatbot phản hồi từng câu hỏi, mà là công cụ đồng hành xuyên suốt một dự án.

Cải tiến của Grok 4.6 dựa trên một lần huấn luyện bổ sung dài hơn so với 4.5, sử dụng dữ liệu mô hình tự sinh được chọn lọc cho suy luận và khái niệm kỹ thuật, optimizer cải tiến và các quỹ đạo SFT do chính Grok 4.5 tái tạo, với các trace có vấn đề bị lọc tự động. Sau đó, nó được huấn luyện trên nhiều tác vụ RL mang tính agent, trong các môi trường chuyên biệt cho tối ưu kernel, phát triển web và thiết kế hỗ trợ máy tính. Kết quả, Grok 4.6 đạt điểm 65,9% trên DeepSWE v1.1, tăng mạnh từ 54% của Grok 4.5, nhưng vẫn thấp hơn GPT-5.6 Sol Max ở 73%. Đây là mô hình “bám đuổi” chứ chưa phải kẻ dẫn đầu, nhưng lợi thế lại nằm ở chiến lược phân phối và giá: nó xuất hiện ngay trong Cursor, Grok Build và API cùng ngày ra mắt, đồng thời được mô tả là cạnh tranh về chi phí so với các đối thủ biên giới.

Cuộc đua mô hình AI: Arena, benchmark và vị thế mới của SpaceXAI

Hai bản phát hành liên tiếp cho thấy SpaceXAI không muốn chỉ tham gia, mà muốn định hình lại cách chúng ta đánh giá mô hình ngôn ngữ lớn. Ở mảng hình ảnh, Grok Imagine Image 2.0 được báo cáo xếp hạng hai toàn cầu cho cả text‑to‑image lẫn image editing trên Arena, chỉ sau gpt-image-2. Ở mảng suy luận và coding, Grok 4.6 được cho là đạt điểm 61 trên Artificial Analysis Intelligence Index, ngang GPT-5.6 Sol và sát nút Fable 5 Max với 62, trong khi Grok 4.5 High ở mức 56. Đây là bước nhảy đáng kể nếu nhớ rằng thương hiệu Grok từng bị xem là “tính năng” phụ của một mạng xã hội, chứ không phải nền tảng AI riêng.

Điều thú vị là phía sau hai mô hình này là một công ty đã được tái cấu trúc gần như toàn diện: các mô hình được gắn thương hiệu SpaceXAI trên Arena, phản ánh thay đổi về cấu trúc doanh nghiệp, chứ không phải người chơi mới. Grok 4.6 là flagship đầu tiên mang tên SpaceXAI ngay từ đầu, với định vị rõ ràng: Grok không còn bị trói buộc vào X, mà trở thành nền tảng cho developer và doanh nghiệp. Trên benchmark, Grok 4.6 vẫn không dẫn đầu ở mọi chỉ số: nó kém đối thủ trên Terminal-Bench nhưng lại dẫn đầu GDPVal-AA v2 về knowledge work. Điều này nói lên chiến lược khác: họ tối ưu cho tác vụ agent và công việc tri thức dài hơi, thay vì chase điểm số đơn lẻ. Trong bối cảnh giá được mô tả là thấp hơn nhiều đối thủ biên giới, nếu SpaceXAI tiếp tục giữ nhịp nâng cấp như 4.5 → 4.6, cuộc đua sẽ chuyển từ “ai thông minh hơn” sang “ai tự động hóa thực tế tốt hơn với chi phí hợp lý hơn”.

Tương lai: AI đa phương thức và agent dài hạn sẽ định nghĩa lại công việc

Nhìn cùng lúc Grok Imagine 2.0 và Grok 4.6, bức tranh khá rõ: SpaceXAI đang xây một hệ sinh thái trong đó AI xử lý hình ảnh chính xác và agent dài hạn gắn chặt với nhau. Một bên, Grok Imagine 2.0 chỉnh sửa hình như một designer số, với editing vùng, nhiều ảnh tham chiếu, smart‑resize và template cho các kịch bản thực tế. Bên kia, Grok 4.6 agent giữ ngữ cảnh dài, tự kiểm tra, tự sửa, làm việc xuyên suốt trên codebase, website, sản phẩm. Khi API Imagine 2.0 mở và 4.6 tiếp tục được tinh chỉnh qua RL, viễn cảnh là một agent có thể lập kế hoạch, sinh code, kiểm thử, đồng thời đề xuất giao diện và asset hình phù hợp, rồi tự lặp lại vòng cải tiến. Đây không chỉ là nâng cấp tính năng, mà là sự dịch chuyển trọng tâm: từ AI trả lời câu hỏi sang AI điều hành quy trình. Và trong cuộc dịch chuyển đó, Grok 4.6 và Grok Imagine 2.0 có thể là bước ngoặt buộc các đối thủ phải suy nghĩ lại về cách họ kết nối mô hình ngôn ngữ lớn với thế giới đa phương thức và các chuỗi công việc dài hạn.

Sammfy nhận hoa hồng khi bạn mua sắm qua liên kết của chúng tôi, bạn không phải trả thêm chi phí. Bài viết này được tạo bằng AI từ các nguồn đã công bố và dữ liệu sản phẩm.

You May Also Like

Comments
Viết gì đó...
Chưa có bình luận nào. Hãy là người đầu tiên chia sẻ suy nghĩ!