BlockBeats tin tức, ngày 18 tháng 8, theo MaxForAI tiết lộ, dự án AI J-Space Cognition Suite bùng nổ trên nền tảng X hôm nay đã bị cộng đồng nghi ngờ, bị chỉ trích rằng kết quả kiểm tra DeepSeek V4 mà họ quảng bá không thể tái hiện. Dự án trước đó tuyên bố rằng V4 Flash kết hợp với J-Space có thể sánh ngang GLM-5.3, còn V4 Pro có thể vượt qua Fable 5 trên nhiều Agent Benchmark, đồng thời tốc độ tăng 2,53 lần, hiệu suất Token tăng 2,21 lần.
Người dùng GitHub GoForceX đã sử dụng tập con 87 câu hỏi của Terminal Bench 2.1 để kiểm tra lại với độ đồng thời cao, và xác nhận đã tải các mô-đun liên quan của J-Space. Kết quả cho thấy, sau khi thêm J-Space, điểm Benchmark lại giảm nhẹ, lượng Token sử dụng và chi phí đều tăng, ngược hướng với hiệu suất, tốc độ và hiệu quả Token mà dự án tuyên bố.
Cộng đồng sau đó yêu cầu dự án công khai cấu hình đánh giá đầy đủ, kết quả từng câu hỏi, nhật ký chạy, thời gian xử lý ban đầu và dữ liệu tiêu thụ Token. Hiện tại dự án chủ yếu công bố kết quả tổng hợp, chưa cung cấp đủ hồ sơ thí nghiệm gốc hoàn chỉnh để xác minh các dữ liệu chính xác nêu trên. Đáng chú ý, khi đối mặt với nghi ngờ, tác giả dự án từng phản hồi rằng các dữ liệu liên quan "thực sự là phóng đại", và cho biết mức cải thiện thực tế nằm trong khoảng từ 1,6 lần đến 3 lần. Tính đến hiện tại, tác giả vẫn chưa có phản hồi chính thức về nghi ngờ của cộng đồng, một số Issue nghi ngờ liên quan đã bị xóa.
