Cuộc chiến Giá API: DeepSeek V4 tăng giá, GLM-5.3 bám sát – Ai đang chơi ai?
Bùi Vĩnh
Hook: Một con số khiến tôi phải dừng lại. Sáng nay, dashboard của tôi flash lên: DeepSeek V4 Pro tăng giá đầu vào lên ¥9/1M tokens. Trong lúc tôi đang tính toán tác động lên chi phí Agent, thì một webhook khác báo: GLM-5.3 xuất hiện, định giá ¥8 đầu vào, ¥28 đầu ra. Cách nhau đúng 1 Yuan. Đây không phải là sự trùng hợp. Đây là một cuộc tấn công chiến lược có chủ đích. Và câu chuyện thú vị hơn những gì bạn thấy trên bề mặt.
Context: Trong 9 năm quan sát thị trường crypto và AI, tôi chưa bao giờ thấy một cuộc đối đầu nào tinh vi như thế này. DeepSeek, kẻ hủy diệt giá rẻ, bỗng nhiên tăng giá. ZhiPu, đối thủ Trung Quốc, ngay lập tức tung ra phiên bản mới với mức giá gần như tương đương, nhưng kèm theo một loạt benchmark cho thấy họ 'mạnh hơn' trong các tác vụ Coding Agent. Đây là ván cờ定价 (pricing chess) đỉnh cao. Nhưng hãy nhìn kỹ hơn vào bảng điều khiển, không phải vào màn khói benchmark.
Core: Hãy bỏ qua benchmark của ZhiPu một chút. Nó là công cụ PR, và tôi sẽ phân tích sự thiên lệch của nó sau. Điều thực sự quan trọng ở đây là cấu trúc giá. DeepSeek đã làm một điều tuyệt vời: họ phân tầng giá một cách cực kỳ thông minh. Trong giờ cao điểm, V4-Pro ngang ngửa GLM-5.3. Nhưng nhìn vào giờ thấp điểm: DeepSeek giảm một nửa, xuống ¥4.5 đầu vào. Và khoan, hãy nhìn vào cache hit: ¥0.15/1M tokens. Con số 0.15 này là thứ khiến tôi, một kẻ săn tin, phải giật mình. Nó chỉ bằng 1/60 giá đầu vào giờ cao điểm. Điều đó có nghĩa là gì? Nó có nghĩa là chi phí biên cho một lần cache hit của DeepSeek gần như bằng 0. Họ đã tối ưu hạ tầng KV-cache của mình đến mức có thể bán nó với giá rẻ như cho không. Trong khi đó, ZhiPu định giá cache hit ở mức ¥2, đắt gấp 13 lần. Đây là một lợi thế hạ tầng khổng lồ mà DeepSeek đang nắm giữ. Nó không chỉ là về mô hình; nó là về khả năng vận hành.
Contrarian: Mọi người đều nói ZhiPu mạnh hơn vì thắng 7/9 benchmark. Nhưng tôi nhìn vào 9 benchmark đó và thấy một sự lựa chọn có chủ đích. Tất cả đều là tác vụ Agent. Họ tránh hoàn toàn các bài test về hiểu ngôn ngữ tổng quát, suy luận toán học, hay khả năng đa ngôn ngữ. Tại sao? Bởi vì đó có thể là điểm yếu của GLM-5.3. Hơn nữa, biên độ chiến thắng rất mong manh. Đa số chỉ cách nhau 2-4 điểm. Một vài cái còn sát nút như 88.2 vs 87.9. Đây không phải là một 'sự vượt trội'. Đây là một 'sự tương đương' được PR thành 'chiến thắng'. Và đừng quên, DeepSeek vẫn dẫn đầu trong Terminal Bench 2.1 và NL2Repo. Vậy, ai mới thực sự là kẻ mạnh? Câu trả lời là: không ai cả. Họ đang ở cùng một đẳng cấp, nhưng đang chơi những trò chơi khác nhau. ZhiPu chơi trò PR, DeepSeek chơi trò hạ tầng.
Takeaway: Vậy, chúng ta đang theo dõi điều gì tiếp theo? Tôi sẽ không nhìn vào benchmark nữa. Tôi sẽ theo dõi tốc độ áp dụng. Cursor, Windsurf, Trae – những Coding Agent này sẽ chọn ai? Nếu họ chọn ZhiPu, đó là tín hiệu cho thấy 'sự mạnh hơn' trong benchmark thực sự có giá trị. Nếu họ chọn DeepSeek vì cache rẻ, đó là tín hiệu cho thấy hạ tầng mới là vua. Và tôi sẽ đặt cược vào điều ngược lại với những gì mọi người đang nói: trận chiến này không phải do DeepSeek thua, mà là do ZhiPu đã phải lộ bài quá sớm. Họ đã dùng hết đạn PR trong một phát súng duy nhất. Câu hỏi đặt ra là: liệu GLM-5.3 có thực sự đủ mạnh để giữ vững phong độ khi DeepSeek tung ra bản cập nhật tiếp theo không?