BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Trang chủ
AI AI
Tin nhanh
Bài viết
Sự kiện
BlockBeats Pro
Thêm
Thông tin tài chính
Chuyên đề
Hệ sinh thái chuỗi khối
Mục nhập
Podcast
Data
OPRR

Hướng dẫn chính thức của Claude Code về tiết kiệm Token: 11 mẹo giúp hạn mức sử dụng lâu hơn

Theo Động Sát Beating theo dõi, Anthropic phát hành hướng dẫn tiết kiệm Token cho Claude Code. Cốt lõi chỉ một câu: ngữ cảnh càng dài, mỗi vòng sau càng đắt. Trò chuyện, tệp tin và đầu ra lệnh đều tiếp tục chiếm Token, và do đó tiêu thụ hạn mức nhanh hơn.

Tổng hợp lại, có 11 mẹo hữu ích nhất:

1. Đổi tác vụ thì /clear. Một tác vụ xong là xóa ngữ cảnh. Vẫn đang làm cùng một tác vụ, chỉ là nội dung trước đó không còn dùng nữa, thì dùng /compact để nén. Phiên dài càng về sau càng đắt, vì mỗi vòng đều mang lại nội dung trước đó.

2. Chọn model và effort ngay từ đầu. Giữa chừng thực hiện /model hoặc /effort sẽ phá vỡ prompt cache (bộ nhớ đệm lời nhắc), vòng tiếp theo cần xử lý lại toàn bộ ngữ cảnh. Fast mode cũng vậy, tốt nhất nên bật ngay từ đầu.

3. Trước khi rời đi hãy /compact. Bộ nhớ đệm của người đăng ký hết hạn khoảng 1 giờ, API Key mặc định khoảng 5 phút. Sau khi bộ nhớ đệm hết hạn quay lại, vòng tiếp theo thường phải xử lý lại toàn bộ ngữ cảnh. Nén khi bộ nhớ đệm còn hiệu lực sẽ rẻ hơn.

4. Mấy vòng gần đây đi sai hướng thì /rewind. Nó chỉ xóa vài vòng sau, bộ nhớ đệm phía trước vẫn dùng được. /compact sẽ viết lại toàn bộ cuộc trò chuyện, chi phí cao hơn.

5. Tệp tin trực tiếp dùng @ tên tệp. Claude sẽ lấy tệp ngay ở vòng đầu, tiết kiệm một lần Read hoặc tìm kiếm. Một tệp thường chỉ cần @ một lần, @ lặp lại có thể nhét thêm bản sao cùng tệp vào ngữ cảnh.

6. Prompt càng cụ thể càng tốt. Thay vì nói "test bị lỗi", hãy trực tiếp cho Claude biết test nào, tệp nào. Nếu không, nó có thể grep, tìm kiếm, đọc một loạt tệp, và những kết quả này sau đó mỗi vòng đều tiếp tục chiếm ngữ cảnh.

7. Test và log càng ít đầu ra càng tốt. Đầu ra của Build, test, git log đều ở lại trong ngữ cảnh. Có thể thêm tham số quiet, chỉ xuất lỗi, hoặc dùng tail để cắt ngắn. Claude Code với đầu ra lệnh vượt quá 30.000 ký tự sẽ tự động ghi vào tệp, chỉ để lại tóm tắt và đường dẫn trong phiên.

8. Dùng /context để kiểm tra gánh nặng khởi động. Phiên mới ngay từ đầu có thể xem CLAUDE.md, MCP và định nghĩa công cụ chiếm bao nhiêu ngữ cảnh. CLAUDE.md chỉ đặt quy tắc chung, quy trình chuyên biệt đưa vào Skill tải theo nhu cầu, MCP không dùng thì dùng /mcp để tắt.

9. Tác vụ đơn giản dùng model nhỏ hơn, effort thấp hơn. Model lớn cả đầu vào lẫn đầu ra đều đắt hơn, thinking cũng thuộc Token đầu ra. Tác vụ thuần thực thi không cần lúc nào cũng dùng model cao cấp nhất và cường độ suy luận cao nhất.

10. Log lớn giao cho subagent, tác vụ nhỏ đừng lạm dụng. Subagent có ngữ cảnh độc lập, chỉ mang kết quả cuối cùng về phiên chính, phù hợp để đọc lượng log lớn, tìm kiếm tài liệu. Nhưng nó cũng phải đọc lại tệp, tự chạy nhiều vòng, tác vụ nhỏ có thể còn đắt hơn. Tác vụ như tìm kiếm, đọc log còn có thể chỉ định Haiku hoặc Sonnet.

11. /loop tốt nhất nên mở phiên riêng. Mỗi vòng lặp là một vòng đầy đủ, sẽ lặp lại toàn bộ ngữ cảnh của phiên hiện tại. Nếu khoảng cách vượt quá thời gian bộ nhớ đệm, còn có thể cộng thêm một lần bộ nhớ đệm hết hạn. Khuyến nghị chính thức là mở terminal khác, dùng một phiên sạch riêng để chạy vòng lặp.

Khuyến nghị của Anthropic rốt cuộc là: ít nhét nội dung vô dụng, tác vụ xong thì dọn dẹp kịp thời, phiên đừng kéo dài quá lâu.

Báo lỗi/Báo cáo
Gửi
Thêm mới thư viện
Chỉ mình tôi có thể nhìn thấy
Công khai
Lưu
Chọn thư viện
Thêm mới thư viện
Hủy
Hoàn thành