动察 Beating AI tin nhanh, DeepSeek chính thức phát hành V4.1 Flash. Mô hình mới có tổng tham số 552B (552 tỷ), sử dụng kiến trúc Causal-Encoder-Decoder hoàn toàn mới và hỗ trợ nguyên bản khả năng hiểu hình ảnh. Đây cũng là mô hình nhỏ nhất hiện tại trong dòng kiến trúc mới này của DeepSeek.
Kiến trúc này xử lý đầu vào và đầu ra riêng biệt. Khi đọc đầu vào chỉ kích hoạt 8B (8 tỷ) tham số, khi tạo câu trả lời kích hoạt 16B (16 tỷ). DeepSeek cho biết điều này giúp mô hình lớn 552B cũng có thể giảm chi phí suy luận. Sau quá trình tiền huấn luyện mới và học tăng cường quy mô lớn hơn, V4.1 Flash đã vượt V4 Pro trong các benchmark chính thức.
Bộ nhớ đệm cũng được nén đáng kể. So với thế hệ trước, V4.1 Flash giảm nhu cầu HBM xuống còn 1/4, nhu cầu lưu trữ SSD xuống còn 1/8, chủ yếu để giảm chi phí khi ngữ cảnh dài và Agent gọi lặp lại nhiều lần.
V4.1 Flash đã đồng thời lên API, chỉ cần đổi tên mô hình thành deepseek-flash là có thể gọi.
