动察 Beating AI tin nhanh, Artificial Analysis đã hoàn thành bài kiểm tra độc lập cho DeepSeek V4.1 Flash, chỉ số thông minh tổng hợp đạt 40 điểm. Nó đã vượt qua V4 Pro 0813 của chính mình với 36 điểm, nhưng vẫn thấp hơn 44 điểm của Kimi K3 và 45 điểm của GLM-5.3. Theo bảng xếp hạng bên thứ ba này, DeepSeek vẫn chưa giành lại vị trí số một trong các mô hình nội địa.
Nhưng khoảng cách về giá thì vô cùng lớn. V4.1 Flash chạy xong một tác vụ Intelligence Index trung bình chỉ tốn 0,27 USD, trong khi Kimi K3 và GLM-5.3 đều khoảng 2 USD, chênh lệch khoảng 7 lần. Tốc độ đầu ra đạt 197 Token/s, cũng cao hơn nhiều so với khoảng 36 Token/s của Kimi K3 và khoảng 58 Token/s của GLM-5.3.
Agent vẫn là phần mạnh nhất của nó. Trên AutomationBench-AA, V4.1 Flash đạt 69%, ngang bằng GPT-6 Astra và vượt qua 62% của GLM-5.3; bài kiểm tra ngữ cảnh dài AA-LCR cũng đạt 84%. Nhược điểm là nó đặc biệt nói nhiều, trong bài kiểm tra AA, trung bình mỗi tác vụ đầu ra khoảng 89.000 Token, nhiều hơn V4 Pro 62%, ăn mất một phần lợi thế về giá.
