BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Trang chủ
AI AI
Tin nhanh
Bài viết
Sự kiện
BlockBeats Pro
Thêm
Thông tin tài chính
Chuyên đề
Hệ sinh thái chuỗi khối
Mục nhập
Podcast
Data
OPRR

Một đêm hai hướng đi: Opus5.5 vươn lên dẫn đầu, GPT-6 cắt giảm một nửa chi phí cùng phân khúc

动察 Beating AI tin nhanh, Artificial Analysis đã hoàn thành bài kiểm thử độc lập bên thứ ba đối với một số mô hình mới ra mắt đêm qua. Claude Opus 5.5 max đạt 58 điểm trên Intelligence Index v4.3, hiện đang xếp hạng nhất. GPT-6 Astra và Fable 5.1 đều đạt 53 điểm, Opus 5 đạt 51 điểm. Opus 5.5 giành điểm cao nhất ở 6 trong số 10 bài đánh giá.


Nhưng điểm cao nhất này cũng tiêu tốn nhiều token hơn. Opus 5.5 max trung bình xuất ra khoảng 119.000 tokens mỗi tác vụ, cao hơn khoảng 60% so với 73.000 của Opus 5. Nhờ API giảm giá 20% và đọc bộ nhớ đệm giảm giá 60%, chi phí mỗi tác vụ cuối cùng là 5,98 USD, gần như ngang bằng với 5,86 USD của Opus 5. Phiên bản medium thực dụng hơn đạt 51 điểm, đã ngang bằng với Opus 5 max, trong khi chi phí mỗi tác vụ chỉ 1,34 USD.


OpenAI lại đi theo một con đường khác. GPT-6 Sol và Luna có hiệu suất Intelligence Index gần với thế hệ trước GPT-5.6, nhưng giá giảm rõ rệt. Chi phí mỗi tác vụ của Sol max giảm từ 1,99 USD xuống 1,06 USD, Luna từ 0,18 USD xuống 0,07 USD. Trong đánh giá coding Agent, Sol tăng từ 55 điểm lên 57 điểm, chi phí cũng giảm khoảng một nửa; Luna giảm từ 43 điểm xuống 41 điểm, nhưng chi phí mỗi tác vụ thấp hơn khoảng 60%.


Hai hướng đi của hai bên đã bắt đầu phân hóa: Opus 5.5 dùng nhiều suy luận hơn để đẩy giới hạn năng lực lên mức cao mới, còn GPT-6 Sol và Luna chủ yếu làm cho năng lực sẵn có trở nên rẻ hơn. Trên biểu đồ hiệu suất/chi phí của Artificial Analysis, các mô hình mới của cả hai bên đều chiếm lĩnh biên Pareto mới.

举报 Báo lỗi/Báo cáo
Báo lỗi/Báo cáo
Gửi
Thêm mới thư viện
Chỉ mình tôi có thể nhìn thấy
Công khai
Lưu
Chọn thư viện
Thêm mới thư viện
Hủy
Hoàn thành