Động Sát Beating AI tin nhanh, Zhipu ra mắt GLM-5.3-FlashX, có thể hiểu là phiên bản tốc độ cao của GLM-5.3-Flash, tốc độ đầu ra tối đa đạt 200 tokens/s. Lần này官方 không công bố điểm chuẩn năng lực mới hay thay đổi kiến trúc, trọng tâm cập nhật chính là tiếp tục nâng cao tốc độ suy luận.
Lần phát hành này vừa nối tiếp sau tối ưu hóa hệ thống suy luận của ngày hôm qua. Zhipu vừa tiết lộ, Infra Agent được GLM-5.3 dẫn dắt đã tham gia tối ưu hóa hạ tầng suy luận của Flash. Chưa đầy hai tuần, thông lượng đầu cuối đã tăng lên khoảng 3 lần so với ban đầu, toàn bộ dịch vụ chạy trên hơn 10 vạn chip AI nội địa.
