动察 Beating AI tin nhanh, công ty mẹ của Coding Agent Devin là Cognition đã phát hành mô hình lập trình mới SWE-2. Nó trực tiếp dựa trên Kimi K3 với 2,8T tham số của Moonshot để tiếp tục học tăng cường, sau khi huấn luyện thêm, nhiều bài đánh giá lập trình lại tăng khoảng 5 đến 6 điểm phần trăm.
Trên FrontierCode 1.1 Main của chính Cognition, SWE-2 đạt 50,0%, vượt qua 47,5% của GPT-5.6 Sol và 48,0% của Grok 4.6. Nó chỉ kém 50,9% của Fable 5.1 đúng 0,9 điểm phần trăm, nhưng chi phí thấp hơn 64%. GPT-6 Astra đạt 53,3%, SWE-2 kém nó 3,3 điểm phần trăm, với chi phí khoảng một phần tư.
SWE-2 cũng đi ít đường vòng hơn nhiều so với thế hệ trước. Ở mức suy luận trung bình, số vòng tương tác để hoàn thành nhiệm vụ giảm 58%, chi phí trung bình giảm 81%. Tuy nhiên trên Terminal-Bench 4 khó hơn, SWE-2 chỉ đạt 27,3%, thấp rõ rệt so với 57,9% của Astra và 55,8% của Fable 5.1, vẫn chưa thể nói là bắt kịp toàn diện các mô hình tiên phong.
SWE-2 đã lên Devin Desktop và CLI, đồng thời bắt đầu được đưa sang Devin Web và Fusion.
