Khám phá sở thích, cùng nhau

Deal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Khám phá sở thích, cùng nhauDeal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Claude Code: 4 mẹo prompt tối ưu hóa token và tránh lỗi lặp

Claude Code: 4 mẹo prompt tối ưu hóa token và tránh lỗi lặp
Sở thích|Mẹo dùng AI

Vấn đề lớn nhất của Claude Code và hiểu lầm về token

Claude Code optimization là việc kết hợp các prompt engineering tips, cấu hình ngữ cảnh và kỹ thuật tự động hóa để giảm lãng phí token, tăng độ tập trung của mô hình và hạn chế lỗi lặp lại trong các phiên làm việc dài với Claude Code. Vấn đề lớn nhất nhiều người gặp là đính kèm PDF dài vào prompt: mỗi lần upload một tài liệu nặng, Claude phải xử lý cả văn bản lẫn dữ liệu bố cục, mã hóa, hình ảnh, cấu trúc… khiến mức dùng token vọt lên rất nhanh. Điểm thú vị là vấn đề này có thể được giải quyết bằng một prompt duy nhất: yêu cầu Claude Code xây một ứng dụng web offline chuyển PDF sang Markdown, đảm bảo chạy air-gap để an toàn. Ý tưởng trọng tâm là: thay vì ném PDF vào thẳng Claude Web, bạn tạo sẵn một công cụ chuyển đổi cục bộ, rồi chỉ đưa bản Markdown gọn nhẹ vào phiên Claude Code.

Markdown nhẹ hơn PDF rất nhiều vì loại bỏ các lớp dữ liệu trình bày và cấu trúc phức tạp; trong hầu hết trường hợp, Claude dùng ít hơn một nửa số token cho file Markdown so với cùng tài liệu ở dạng PDF. Câu nói đáng trích ở đây là: “Trong hầu hết các trường hợp, Claude sử dụng ít hơn một nửa số token để xử lý file Markdown so với xử lý tài liệu PDF”. Đây không chỉ là mẹo tiết kiệm, mà là một thay đổi tư duy: thay vì đổ lỗi cho giới hạn sử dụng, hãy coi định dạng dữ liệu là một phần của prompt. Tuy nhiên, mẹo này chủ yếu áp dụng cho tài liệu văn bản thuần; nếu bạn cần giữ nguyên bố cục phức tạp hoặc hình ảnh, việc chuyển sang Markdown có thể làm mất thông tin quan trọng và khi đó PDF vẫn phù hợp hơn.

Claude Code: 4 mẹo prompt tối ưu hóa token và tránh lỗi lặp

Bốn tình huống “rò rỉ token” ẩn mà người dùng hay bỏ qua

Ngộ nhận phổ biến nhất là: token chỉ bị đốt bởi prompt bạn gõ ra. Thực tế, nhiều thiết lập mặc định và tính năng nền cũng âm thầm tiêu token từ trước khi bạn gõ chữ đầu tiên. Đầu tiên là file CLAUDE.md: mọi hướng dẫn tùy chỉnh trong đây được tự động nạp vào ngữ cảnh ngay khi phiên bắt đầu, bất kể phiên đó có liên quan đến chúng hay không. Nếu bạn nhồi cả hướng dẫn cho nhiều dự án vào cùng một file, mỗi phiên đều phải “trả thuế” ngữ cảnh. Cách xử lý là audit lại CLAUDE.md và tách các hướng dẫn nhiệm vụ hoặc dự án thành các skill riêng, thay vì giữ hết trong một file duy nhất. Đây là hành động đơn giản nhưng mang lại hiệu quả tức thì cho Claude Code optimization.

Thứ hai là các MCP servers: chúng mở rộng khả năng của Claude Code nhưng cũng bắt đầu lắng nghe và hoạt động ngay khi phiên khởi động, kể cả khi bạn không dùng đến. Thứ ba là danh sách skills: mặc định, Claude Code gửi danh sách kỹ năng và mô tả ngắn cho mô hình mỗi khi mở phiên, và chi phí này tăng theo số skill bạn cài. Cuối cùng, chính bạn thường không đo được các rò rỉ này vì không theo dõi ngữ cảnh. Các lệnh như /context, /usage và /doctor giúp bạn xem phiên đang nạp những gì và tìm chỗ tối ưu. Câu trích dẫn hữu ích: “Ngay cả khi bạn chỉ tiết kiệm được vài nghìn token, chúng vẫn góp phần vào khoản tiết kiệm về lâu dài”. Tuy vậy, đừng cực đoan: nếu bạn chỉ dùng ít skill và ít MCP, lợi ích tối ưu hóa có thể không đáng so với thời gian quản lý.

Claude Code: 4 mẹo prompt tối ưu hóa token và tránh lỗi lặp

Hook: vũ khí ngăn Claude Code lặp lại cùng một lỗi

Nếu bạn đã từng thêm hướng dẫn rất rõ vào prompt hoặc CLAUDE.md nhưng Claude Code vẫn lặp lại cùng một lỗi ở lần gọi sau, đó không phải lỗi cá nhân của bạn. Các hướng dẫn trong CLAUDE.md nằm trong ngữ cảnh, chứ không phải luật cứng: Claude có thể tuân theo trong một tác vụ rồi bỏ qua trong tác vụ kế tiếp tùy cách nó cân nhắc ngữ cảnh. Đây là lúc hooks Claude Code trở thành “game-changer”. Hooks chạy tự động khi một sự kiện xảy ra trong phiên; ví dụ, PreToolUse hook chạy trước khi Claude dùng tool để chặn lệnh không an toàn. Trong trường hợp chống lỗi lặp, một Stop hook dựa trên lệnh có thể chạy mỗi khi tác nhân chính trả lời xong, chặn lần phản hồi đầu, buộc Claude đọc danh sách lỗi cũ và rà soát lại thay đổi trước khi cho phép tiếp tục.

Bash script phía sau Stop hook còn kiểm tra xem Claude có đang trong lượt do chính hook kích hoạt hay không; nếu có, nó cho phép lượt đó kết thúc để tránh vòng lặp review vô hạn. Hooks làm Claude Code tốt hơn vì chúng cho phép bạn gắn hành vi vào các mốc sự kiện, thay vì trông chờ mô hình nhớ một đoạn hướng dẫn trong CLAUDE.md. Một câu nên trích: “Hooks hoạt động tốt hơn nhiều so với việc chỉ thêm hướng dẫn vào CLAUDE.md hoặc nhét chúng vào prompt”. Tuy vậy, không phải lúc nào cũng nên dùng Stop hook. Nếu bạn dùng Claude Code như chatbot trò chuyện, ép nó review mọi câu chào hỏi sẽ lãng phí token và thời gian. Trong các trường hợp chỉ cần kiểm soát đầu ra quan trọng, trigger TaskCompleted phù hợp hơn vì chỉ chạy khi một nhiệm vụ hoàn tất, thay vì mọi lượt phản hồi.

Kỹ thuật dấu phân cách: khiến Claude bớt hỏi lại, nhiều làm hơn

Claude có thói quen dừng lại để đặt câu hỏi làm rõ khi prompt có nhiều hướng trả lời hợp lý, và việc chọn sai hướng có thể làm thay đổi đáng kể kết quả. Đây là hành vi có ích khi bạn mơ hồ, nhưng lại gây khó chịu khi bạn cần một câu trả lời nhanh hoặc một bước triển khai cụ thể. Thay vì tìm “từ khóa ma thuật”, giải pháp là thêm một quy tắc hành vi rõ ràng vào prompt, tách riêng phần hướng dẫn và phần nhiệm vụ, rồi dùng kỹ thuật delimiter trick prompt với các thẻ kiểu XML để đánh dấu hai phần này. Văn bản ở giữa các thẻ như <instructions> và <task> không quan trọng bằng chính việc chúng là dấu phân cách, giúp mô hình hiểu đâu là luật hành vi, đâu là công việc cần làm.

Một hướng dẫn điển hình có dạng: “Answer directly and move the work forward. If some information is missing, make a reasonable assumption and briefly state it. Ask a follow-up question only if the missing information is genuinely necessary to give a useful answer”. Quy tắc này bảo Claude ưu tiên đưa ra câu trả lời và chỉ dừng lại hỏi thêm khi thiếu thông tin đến mức không thể trả lời hữu ích. Trong các yêu cầu nghiên cứu đơn giản, bạn cũng có thể thêm chỉ thị “For straightforward research requests, do not pause for clarification” để cắt bớt vòng hỏi đáp thừa. Tuy nhiên, không nên áp dụng quy tắc này ở mọi nơi: có những dự án – như sách hoặc sản phẩm phức tạp – nơi bạn muốn Claude ưu tiên hỏi lại, và khi đó nên giữ hướng dẫn này trong phạm vi project, không dùng như thiết lập toàn cục.

Kết hợp bốn mẹo để tối ưu hóa Claude Code một cách có ý thức

Bốn mẹo trên không phải những “chiêu trò” rời rạc, mà là một bộ khung Claude Code optimization có thể lặp lại. Đầu vào: chuyển PDF sang Markdown để giảm chi phí ngữ cảnh và xây sẵn một app offline phục vụ việc đó bằng một prompt duy nhất. Môi trường: audit CLAUDE.md, tách hướng dẫn thành skills, tắt MCP không cần thiết, giới hạn số skills nạp mặc định, và định kỳ dùng /context, /usage, /doctor để xem token đang bị đốt ở đâu. Hành vi: dùng hooks Claude Code để nâng các quy tắc quan trọng lên thành hành vi gắn với sự kiện, nhất là các bài toán chỉnh sửa hoặc build thứ gì đó. Giao tiếp: dùng delimiter trick prompt để nói thẳng với mô hình khi nào nên giả định, khi nào nên hỏi thêm.

Anthropic khuyến khích bạn thử nghiệm và chỉnh sửa prompt thay vì tin rằng một khung prompt sẽ dùng tốt cho mọi tình huống; bạn có thể chỉnh ngay prompt gốc và tiết kiệm token, thậm chí nhờ Claude tối ưu prompt giúp mình. Khi nhìn Claude Code như một môi trường có trạng thái với nhiều nguồn token drains Claude khác nhau, bạn sẽ thôi đổ lỗi cho giới hạn phiên và bắt đầu thiết kế trải nghiệm làm việc một cách có ý thức. Đó mới là điểm khác biệt giữa người “gọi AI” và người biết làm prompt engineering thực thụ.

Sammfy nhận hoa hồng khi bạn mua sắm qua liên kết của chúng tôi, bạn không phải trả thêm chi phí. Bài viết này được tạo bằng AI từ các nguồn đã công bố và dữ liệu sản phẩm.

You May Also Like

Comments
Viết gì đó...
Chưa có bình luận nào. Hãy là người đầu tiên chia sẻ suy nghĩ!