BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Trang chủ
AI AI
Tin nhanh
Bài viết
Sự kiện
BlockBeats Pro
Thêm
Thông tin tài chính
Chuyên đề
Hệ sinh thái chuỗi khối
Mục nhập
Podcast
Data
OPRR

Sakana nâng cấp "đội hình mô hình": Ultra v2 tập trung hiệu năng, Max tối ưu chi phí

动察 Beating AI tin nhanh, công ty AI Nhật Bản Sakana AI ra mắt Fugu Max và Fugu Ultra v2.


Về bản chất, cả hai đều là "bộ điều phối mô hình": trước tiên xem xét nhiệm vụ, sau đó chọn các mô hình phù hợp để phân công, kiểm tra chéo lẫn nhau, cuối cùng tổng hợp câu trả lời.


Thế hệ Fugu đầu tiên đã dựa vào phương pháp này để cho các mô hình như GPT, Claude, Gemini lập đội, đạt được mức gần bằng thậm chí vượt qua một phần so với Fable 5 mạnh hơn vào thời điểm đó.


Lần này dòng sản phẩm được chia thành hai nhánh. Fugu Max tập trung vào tiết kiệm chi phí, bổ sung thêm nhiều mô hình trọng số mở và mô hình chuyên dụng vào nhóm mô hình, đồng thời ưu tiên chọn các mô hình đủ dùng nhưng rẻ hơn. Theo công bố chính thức, khi đạt hiệu năng gần bằng mô hình hàng đầu, chi phí chỉ khoảng 1/2 đến 1/6 so với đối phương. Fugu Ultra v2 thì chỉ theo đuổi hiệu năng cao nhất, đứng đầu hoặc đồng hạng nhất ở 5 trong 8 bài đánh giá, và trong nhóm Agent không có Fable 5, Fable 5.1 và GPT-6 Astra.


Tuy nhiên, việc chuyển đổi qua lại giữa nhiều mô hình có thể làm giảm khả năng tái sử dụng bộ nhớ đệm ngữ cảnh, còn phát sinh thêm token điều phối. Sakana không công bố tỷ lệ trúng bộ nhớ đệm của Max và tổng chi phí token cho mỗi nhiệm vụ. Fugu thế hệ đầu cũng từng bị người dùng phàn nàn là chậm và tiêu tốn hạn mức nhanh.

Báo lỗi/Báo cáo
Gửi
Thêm mới thư viện
Chỉ mình tôi có thể nhìn thấy
Công khai
Lưu
Chọn thư viện
Thêm mới thư viện
Hủy
Hoàn thành