Theo 动察 Beating theo dõi, DeepSeek vừa thông báo sẽ tăng giá mạnh cho V4, thì Zhipu GLM-5.3 lại vừa kịp đuổi theo sát phía sau.
Giả sử GLM-5.3 giữ nguyên mức giá API của GLM-5.2, thì giá token thông thường ở giờ cao điểm của hai bên về cơ bản đã ngang nhau. GLM-5.3 mỗi triệu token đầu vào 8 tệ, đầu ra 28 tệ; V4-Pro là 9 tệ và 27 tệ. GLM rẻ hơn 1 tệ ở đầu vào, DeepSeek rẻ hơn 1 tệ ở đầu ra.
Sau khi giá đã cân bằng, khoảng cách về năng lực càng trở nên quan trọng hơn. Theo bảng so sánh cùng tiêu chí mà Zhipu công bố, hai mô hình có 9 hạng mục có thể so sánh trực tiếp, GLM-5.3 thắng 7 hạng mục. DeepSWE là 66,9 so với 62,7, Agents' Last Exam là 28,5 so với 25,7, HLE with Tools là 62,5 so với 60,0, CyberGym là 84,5 so với 83,3. DeepSeek chỉ dẫn trước ở NL2Repo và Toolathlon Verified. Terminal Bench 2.1 hai bên về cơ bản đã ngang nhau, lần lượt là 88,2 và 87,9.
Vì vậy, sau khi DeepSeek tăng giá lần này, lợi thế khi chạy Coding Agent phức tạp ở giờ cao điểm trở nên khá khó xử: V4-Pro đã không còn rẻ hơn bao nhiêu, còn GLM-5.3 lại mạnh hơn ở hầu hết các bài đánh giá cùng tiêu chí. Đặc biệt trong các tác vụ cần viết code liên tục, gọi công cụ và thực thi tác vụ dài, GLM-5.3 hiện hấp dẫn hơn.
Điểm thực sự rẻ của DeepSeek vẫn nằm ở giờ thấp điểm và bộ nhớ đệm. V4-Pro ở giờ thấp điểm đầu vào, đầu ra giảm xuống còn 4,5 tệ và 13,5 tệ, giảm trực tiếp một nửa; cache hit còn thấp hơn ở mức 0,15 tệ, ngay cả giờ cao điểm cũng chỉ 0,3 tệ, trong khi GLM là 2 tệ. Ban ngày chạy Agent độ khó cao, GLM-5.3 đáng giá hơn; nếu có thể chạy lệch giờ, hoặc tác vụ sử dụng lại cache nhiều lần, thì DeepSeek vẫn rẻ hơn đáng kể.
