Từ “siêu rẻ hơn 100 lần” đến thông báo tăng giá: câu chuyện không chỉ là tiền
“DeepSeek tăng giá API” là cụm từ tóm gọn bước ngoặt khi một nhà cung cấp AI từng gây sốc vì cực rẻ đang phải điều chỉnh mạnh biểu giá, chuyển từ chiến lược đốt tiền chiếm thị phần sang mô hình định giá AI bền vững hơn, phản ánh giới hạn hạ tầng lẫn thực tế chi phí dịch vụ AI quy mô lớn.
DeepSeek từng làm cả giới công nghệ choáng váng khi V4-Flash được đánh giá có chi phí cho mỗi tác vụ rẻ hơn Claude Fable 5 tới 100 lần. Đó không chỉ là chiến dịch marketing mà là đòn mở màn cho một cuộc đua giảm giá AI buộc các đối thủ phải phản ứng. Nhờ lợi thế giá, V4-Flash nhanh chóng vọt lên dẫn đầu về lượng token sử dụng trên OpenRouter, với khoảng 7,22 nghìn tỷ token chỉ trong một tuần. Nhưng ngay khi dư luận còn mải nói về “AI giá rẻ của Trung Quốc”, DeepSeek bất ngờ tung thông báo ngắn ngủi: sẽ điều chỉnh tăng giá toàn bộ dịch vụ API với biên độ “khá lớn” và yêu cầu khách hàng “sắp xếp sử dụng hợp lý”. Động thái này cho thấy một thông điệp lạnh lùng: cuộc chiến giá sàn luôn có điểm dừng.

Mô hình V4 Pro và cơ chế giờ cao điểm: tăng giá nhưng siết luôn lưu lượng rác
Nếu cú sốc đầu tiên đến từ giá rẻ, cú sốc thứ hai nằm ở cách DeepSeek tăng giá: không chỉ nâng mức phí mà còn tái thiết kế chiến lược định giá AI quanh khái niệm giờ cao điểm. Thay vì một biểu giá phẳng, hãng áp dụng mức phí cao gấp đôi trong các khung giờ 9:00–12:00 và 14:00–18:00 ngày làm việc, coi đây như “thuế tắc đường” trên đường cao tốc GPU. Ở giờ bình thường, V4-Flash được niêm yết 1 NDT/1 triệu token đầu vào và 2 NDT/1 triệu token đầu ra, còn mô hình V4 Pro là 3 NDT đầu vào và 6 NDT đầu ra cho mỗi triệu token. Khi cơ chế giờ cao điểm kích hoạt, những con số này bị nhân đôi, đồng nghĩa phí đầu ra V4 Pro sẽ tăng từ 6 NDT lên 12 NDT mỗi triệu token. Chiến lược này vừa tăng doanh thu, vừa chủ động đẩy bớt các tác vụ ít giá trị ra khỏi giờ cao điểm.
Ở đây, DeepSeek không giấu ý đồ kinh doanh: biến API từ mảng có biên lợi nhuận âm thành một đơn vị có lãi bằng cách chuyển chi phí thực lên người dùng nhiều nhất. Nhưng đằng sau bảng giá là một bài toán kiểm soát nhu cầu: giờ cao điểm đắt nhằm buộc các nhà phát triển điều chỉnh lịch chạy tác vụ, cắt bỏ những lượt gọi thử nghiệm, bot rác hay ứng dụng giá trị thấp. Thực tế, phân tích nội bộ cho rằng việc tăng giá mạnh, kết hợp coi mức giá giờ cao điểm là chuẩn, rồi tiếp tục nâng thêm, có thể khiến chi phí API tăng 300–400%, qua đó “loại bỏ phần lớn lưu lượng truy cập từ các bot và ứng dụng có giá trị thấp” và giúp độ ổn định hệ thống tăng hơn 50%. Đó không chỉ là tăng giá: đó là một bộ lọc kinh tế.

Nguyên nhân thực sự: 20.000 GPU H100 không đủ cho một cơn sóng thần
Việc DeepSeek quay đầu tăng giá không hề là cú “lật kèo” tùy hứng, mà là phản ứng bị ép phải chọn khi hạ tầng chạm trần. Sau khi hạ giá kịch sàn, đưa V4 Flash 0731 lên mức chi phí thấp đến mức xóa sạch lợi thế mà OpenAI đang nhắm tới, nhu cầu đã bùng nổ ngoài dự tính. Người dùng toàn cầu – từ cá nhân đến đội ngũ phát triển – đổ xô sang DeepSeek, tạo ra một “trận sóng thần” lưu lượng truy cập. Vấn đề là phòng thí nghiệm này chỉ sở hữu khoảng 20.000 GPU Nvidia H100. Với con số đó, việc gánh thêm hàng nghìn tỷ token mỗi ngày là cực kỳ tốn tài nguyên, và hệ quả đã thấy ngay: rất nhiều người dùng phản ánh tốc độ suy luận có lúc chậm như “rùa bò”. Giá rẻ đã trở thành con dao hai lưỡi cắt ngược lại chính trải nghiệm người dùng.
Chính DeepSeek cũng thừa nhận, mục tiêu của lần điều chỉnh là “sử dụng hiệu quả hơn nguồn lực tính toán và nâng cao độ ổn định của dịch vụ”. Nói cách khác, tăng giá ở đây là phanh khẩn cấp để tránh hệ thống sụp đổ. Khi chi phí vận hành mô hình lớn bao gồm GPU, điện năng, lưu trữ, băng thông, nhân lực, thì chiến lược bán API ở mức quá thấp chỉ có thể là động tác ngắn hạn để giành thị phần, không thể duy trì mãi. Theo phân tích của Goldman Sachs, nhu cầu dùng mô hình AI tại Trung Quốc vẫn rất cao trong khi tài nguyên GPU còn hạn chế, nên cả thị trường đang chuyển từ cuộc đua giảm giá sang mô hình định giá bền vững hơn. Ở điểm này, DeepSeek không phải ngoại lệ – họ chỉ là người phanh đầu tiên và phanh mạnh nhất.

Người dùng được và mất gì khi DeepSeek tăng giá API?
Với các nhà phát triển đang sống dựa vào DeepSeek API, thông báo tăng giá đồng nghĩa một điều rất thực dụng: phải làm lại bảng chi phí dịch vụ AI trong sản phẩm của mình. Ứng dụng nào margin mỏng, phụ thuộc vào khối lượng token lớn, sẽ chịu áp lực đầu tiên; báo cáo nội bộ cho thấy nếu giá tăng gấp đôi, biên lợi nhuận gộp mảng API có thể từ âm nhảy lên khoảng 30%, tức phần chi phí bị đẩy sang phía khách hàng hạ nguồn. Tuy vậy, nhiều doanh nghiệp lại tỏ ra khá bình tĩnh: họ cho rằng DeepSeek từng bán API rẻ đến mức khó có thể có lãi, và sau tăng giá, tỷ lệ hiệu năng/chi phí vẫn thấp hơn đáng kể so với nhiều mô hình hàng đầu khác trong nhiều tác vụ. Một số startup còn khẳng định chưa có kế hoạch chuyển nhà cung cấp, vì đổi mô hình rất tốn công mà lợi thế chi phí của DeepSeek vẫn còn rõ.
Ở chiều ngược lại, những người hưởng lợi bất ngờ lại là các công ty MaaS tại Trung Quốc – nhóm từng than thở rằng DeepSeek bán API quá rẻ khiến cả ngành buộc phải giảm giá, biên lợi nhuận gần như bị xóa sạch. Việc DeepSeek tăng giá giúp các nhà cung cấp khác có lý do thoát khỏi cuộc đua đạp giá sát đáy, hướng tới mô hình định giá phản ánh đúng chi phí hạ tầng. Người dùng chatbot miễn phí gần như không bị ảnh hưởng, vì đợt điều chỉnh chủ yếu áp dụng cho API thương mại, khách hàng doanh nghiệp và nhà phát triển. Đối với họ, tác động lớn nhất là gián tiếp: hệ thống ổn định hơn, ít cảnh “đơ” giờ cao điểm hơn, dù phía sau là một mức giá API đã không còn thuộc dạng “rẻ vô lý”. Câu hỏi còn lại là: khi DeepSeek bình thường hóa giá, liệu những đối thủ từng bị ép giảm giá có dám nâng lên theo hay vẫn giữ chiến thuật ăn mỏng để lấy người dùng?

Ý nghĩa với cuộc đua giảm giá AI toàn cầu: DeepSeek đang thử vạch lại mặt bằng
Từ đầu, câu chuyện DeepSeek không chỉ là một hãng Trung Quốc đánh nhau với OpenAI hay Anthropic bằng giá sàn. Nó là thí nghiệm lớn về giới hạn của chiến lược “AI cực rẻ”. Khi V4-Flash có chi phí vận hành trong các benchmark thấp hơn rất nhiều mô hình nổi tiếng khác và rẻ hơn Claude Fable 5 rất xa, giới phát triển lập tức chia lại cách dùng mô hình: tác vụ phức tạp, giá trị cao thì giao cho các model mạnh; việc lặp lại, rủi ro thấp như phân loại dữ liệu, sàng lọc mã nguồn thì đẩy sang DeepSeek. “Câu chuyện DeepSeek cho thấy một điều đơn giản: giá rẻ trên giấy tờ không có ý nghĩa nếu không quy đổi ra chi phí thực tế để hoàn thành một công việc”. Nói cách khác, thước đo không phải giá mỗi token, mà là tổng chi phí để xong việc với chất lượng chấp nhận được.
Tuy nhiên, khi mô hình giá quá thấp khiến hạ tầng nghẽn, chất lượng suy luận lao dốc, chi phí thực tế của mỗi tác vụ lại tăng – dưới dạng thời gian chờ, lỗi, retry – thì mô hình kinh doanh không còn hợp lý. Việc DeepSeek tăng giá API sau một giai đoạn dài đua giá cực thấp và tuyên bố sẽ áp dụng hệ thống giá mới sau khi chính thức phát hành mô hình V4 Pro là lời thừa nhận rằng sân chơi đã sang hiệp mới. Nhu cầu AI vẫn tăng, GPU vẫn khan hiếm, nên thị trường buộc phải rời khỏi tư duy “giảm giá vô hạn” để chuyển sang “định giá bền vững”. DeepSeek – nghịch lý thay – chính là người vừa kích hoạt cuộc đua giảm giá AI, vừa là bên sớm nhất thử chấm dứt nó. Câu trả lời cuối cùng thuộc về người dùng: nếu họ chấp nhận trả thêm để đổi lấy ổn định và chất lượng, các hãng còn lại sẽ không chần chừ nối bước.







