Động Sát Beating Tin nhanh AI, OpenAI công bố dữ liệu thử nghiệm thực tế đầu tiên của chip suy luận tùy chỉnh Jalapeño, tuyên bố hiệu suất vượt trội so với NVIDIA GB300. Chip này nằm trên biên giới tối ưu Pareto ở cả ba mô hình công khai bên ngoài GPT-OSS 120B, DeepSeek R1 670B và Kimi K2.5 1T, so với các hệ thống thương mại tốt nhất hiện có, sản lượng AI đỉnh trên mỗi watt cao hơn 1,5 đến 1,9 lần, độ trễ đầu cuối giảm 1,7 đến 3,6 lần; trong các kịch bản tác tử tương tác cao, lợi thế mở rộng lên 2,1 đến 4,1 lần. Công suất định mức của Jalapeño là 700 watt, công suất liên tục đo được thực tế không vượt quá 550 watt. OpenAI nhấn mạnh, dưới tải tác tử, chi phí thực tế nên được đo bằng "khối lượng công việc AI hoàn thành trên mỗi đơn vị điện năng tiêu thụ", thay vì hiệu suất chip đơn lẻ.
Jalapeño chỉ mất 9 tháng từ thiết kế đến chế tạo thử, AI tham gia sâu vào tối ưu hóa mạch và xác minh. Nhờ Codex và GPT-Astra, nhóm chỉ mất hai tháng để tối ưu hóa ba mô hình trọng số mở không nằm trong kế hoạch ban đầu lên hiệu suất cao, một số mô-đun do AI tạo ra nhanh hơn 1,5 đến 1,8 lần so với triển khai viết tay của con người. OpenAI có kế hoạch triển khai Jalapeño vào cơ sở hạ tầng tính toán tự sở hữu trước cuối năm, đồng thời tiếp tục sử dụng quy mô lớn các bộ tăng tốc bên ngoài như NVIDIA. Đây là thế hệ đầu tiên trong lộ trình chip đa thế hệ, Gen 2 đã bước vào giai đoạn phát triển sâu, Gen 3 đang hình thành.
