Phan Đông GiangPhan Đông Giang
Tất cả bài học
Cấp Độ 3Nâng cao12 phút

Đừng Để Claude Hết Lượt Giữa Chừng

Cách dùng Claude tiết kiệm và hiệu quả hơn, đỡ chạm giới hạn.

23 mẹo dùng Claude thông minh hơn để không đốt tiền quá nhanh

Bạn đang trả tiền để dùng Claude, nhưng credit thì cứ trôi tuột đi như kiểu để đèn sáng khắp nhà.

Tôi biết rõ cảm giác đó vì chính tôi cũng từng như vậy suốt nhiều tuần liền: mới 2 giờ chiều đã chạm giới hạn sử dụng, nhìn màn hình báo 'bạn đã đạt giới hạn' mà tự hỏi liệu gói 20 đô có đủ dùng không.

Tôi đã chuyển lên gói 100 đô, nhưng vẫn liên tục nhận được cùng một tin nhắn riêng từ mọi người.

Ảnh chụp tin nhắn riêng của một người dùng phàn nàn về việc bị giới hạn sử dụng Claude

Cả team của tôi cũng than phiền, nên đã đến lúc tôi giải quyết chuyện này cho mọi người luôn. Câu hỏi tôi nhận được nhiều nhất là: 'Giang, tôi gặp vấn đề với giới hạn của Claude... làm sao để tiết kiệm đây?'

Vậy nên tôi đã lập một danh sách cho team mình về cách tiết kiệm credit Claude.

Hướng dẫn miễn phí này là danh sách 23 thói quen, được xếp hạng từ ít người biết nhất đến hiển nhiên nhất.

Giờ đây tôi chỉ chạm giới hạn khoảng một lần mỗi tháng, không hơn.

Trước khi bắt đầu, tôi muốn nói một điều: đừng cố áp dụng cả 23 mẹo cùng lúc. Hãy lưu lại hướng dẫn này, chọn ra 3 thói quen để thử trong tuần này, và bạn sẽ thấy sự khác biệt ngay trước cuối tuần.

Claude tính phí theo token

Claude tính phí dựa trên token, và cách hiểu đơn giản nhất là mỗi token tương đương khoảng một từ. Mỗi khi bạn gửi một tin nhắn, Claude sẽ đọc lại toàn bộ cuộc trò chuyện từ đầu, bao gồm tất cả tin nhắn và câu trả lời trước đó.

Vì vậy tin nhắn đầu tiên tốn rất ít, nhưng đến tin nhắn thứ 30 thì Claude phải đọc lại 29 lượt trao đổi trước khi kịp nghĩ đến câu hỏi mới của bạn. Đó chính là lý do credit của bạn biến mất nhanh chóng: cuộc trò chuyện càng dài, mỗi tin nhắn càng đắt đỏ.

Minh họa khái niệm token trong Claude, mỗi token tương đương khoảng một từ

Mọi thói quen tôi chia sẻ trong bài này đều quay về đúng một ý tưởng: làm sao tránh lãng phí token, để dành chúng cho những việc thực sự quan trọng.

Những thói quen bạn (có thể) chưa biết

Đây là những thói quen đã thay đổi cách tôi dùng token. Phần lớn tôi phát hiện ra một cách tình cờ, một số khác đến từ chính tài liệu của Anthropic mà gần như chẳng ai chịu đọc.

1. Chuyển đổi file trước khi tải lên

Một trang PDF tốn khoảng 1.500 đến 3.000 token.

Ảnh chụp màn hình còn tệ hơn: một ảnh 1000x1000 đầy đủ tốn khoảng 1.300 token.

Còn file DOCX và PPTX thì mang theo cả đống metadata thừa mà bạn không nhìn thấy được.

Trước khi tải lên, hãy trích xuất phần văn bản cần thiết, copy-paste những đoạn liên quan vào một file text thuần hoặc markdown. Với ảnh chụp màn hình, hãy crop thật sát vào đúng phần quan trọng, việc này có thể giảm từ 1.300 token xuống dưới 100 token.

Nếu bạn tải cùng một file PDF 15 trang lên 4 cuộc trò chuyện khác nhau, bạn vừa đốt hơn 180.000 token cho một tài liệu mà lẽ ra chỉ cần chuyển thành 2.000 token văn bản sạch.

  1. 1.Mở một Google Doc mới (mẹo nhỏ: gõ doc.new thẳng trên thanh địa chỉ)
  2. 2.Dán phần văn bản cần tải lên Claude vào đó
  3. 3.Tải file xuống dưới định dạng markdown (.md)
Quy trình [doc.new](https://doc.new): dán văn bản vào Google Doc rồi tải xuống dưới dạng file markdown (.md)

2. Lên kế hoạch trong Chat, chỉ tạo file ở bước cuối cùng

Anthropic xác nhận rằng việc tạo file (bảng tính, tài liệu, bản trình bày) tốn nhiều giới hạn sử dụng hơn tin nhắn chat thông thường. Vì vậy đừng mở Cowork lên và nói ngay 'tạo cho tôi một mô hình tài chính'.

Thay vào đó, hãy mở Chat để lên cấu trúc, thống nhất các phần nội dung, chốt các giả định trước.

Khi đã biết chính xác mình muốn gì, hãy chuyển sang Cowork và nói 'xây dựng đúng file này'.

Nói cách khác: phần suy nghĩ làm ở sản phẩm rẻ, phần xây dựng mới chuyển sang sản phẩm đắt.

Lên kế hoạch nội dung trong Claude Chat trước khi chuyển sang Cowork để xây dựng file

3. Nói 'hãy hỏi tôi' thay vì viết một prompt dài dòng

Một prompt 500 từ sẽ tốn 500 token mỗi lần Claude đọc lại cuộc trò chuyện.

Nhưng nếu bạn viết một prompt chỉ 15 từ và để tính năng AskUserQuestion làm phần còn lại, các câu hỏi làm rõ chỉ được tạo ra một lần, còn câu trả lời của bạn chỉ là những cú click ngắn gọn.

Prompt tôi hay dùng nhất chưa tới 30 từ: 'Tôi muốn [công việc] để đạt [tiêu chí thành công]. Đọc thư mục của tôi. Hãy hỏi tôi bằng AskUserQuestion trước khi bắt đầu.'

Click vào các lựa chọn gần như không tốn gì, còn gõ cả đoạn hướng dẫn dài thì tốn rất nhiều. Hãy để Claude chủ động hỏi ngược lại bạn, thay vì bạn dồn cả bức tường văn bản vào nó.

Ví dụ prompt ngắn kết hợp tính năng AskUserQuestion để Claude tự hỏi lại thay vì viết hướng dẫn dài

4. Dùng Wispr Flow để trả lời chi tiết hơn mà không phình token

Wispr Flow là công cụ chuyển giọng nói thành văn bản. Nghe có vẻ ngược đời: nói ra câu trả lời thay vì gõ lại giúp bạn tốn ít token hơn?

Lý do là thế này: khi gõ, bạn thường viết prompt kiểu lười biếng và mơ hồ, kiểu như 'làm cho hay hơn' hay 'đổi giọng văn đi'. Claude đoán sai, rồi bạn lại gửi thêm hết tin nhắn này đến tin nhắn khác, buộc Claude phải đọc lại toàn bộ mỗi lần.

Còn khi nói, bạn tự nhiên đưa ra nhiều ngữ cảnh hơn trong một lần, kiểu như: 'Giọng văn đang cứng quá, tôi muốn nó giống như đang nhắn tin cho một người bạn điều hành công ty 200 người. Giữ nguyên số liệu nhưng làm cho nó tự nhiên hơn. Chỉ viết lại phần 2 thôi.'

Ít tin nhắn hơn đồng nghĩa với ít lần Claude phải nạp lại ngữ cảnh, và điều đó giúp tiết kiệm token.

5. Đừng bắt Claude làm lại từ đầu

Khi phần 3 của một báo cáo bị sai, đừng nói 'làm lại cả báo cáo đi'.

Hãy nói 'chỉ làm lại phần 3 thôi, giữ nguyên phần còn lại để tiết kiệm token'.

Mỗi lần yêu cầu làm lại toàn bộ nghĩa là Claude phải tạo lại toàn bộ kết quả, nếu báo cáo của bạn dài 2.000 token thì bạn vừa đốt thêm 2.000 token output nữa.

Hãy chỉ đích danh phần bị sai và nói rõ nó sai ở đâu.

Khi đã biết chính xác mình muốn gì, hãy thêm vào cuối prompt câu 'Không cần bình luận, không cần giải thích, chỉ cần kết quả.' Claude mặc định rất nhiệt tình và dài dòng, mỗi câu kiểu 'Rất vui được giúp bạn! Đây là những gì tôi đã làm...' đều là token bạn phải trả tiền.

6. Gộp nhiều việc vào một tin nhắn

Ba prompt riêng lẻ nghĩa là ba lần Claude phải nạp lại toàn bộ ngữ cảnh.

Một prompt gộp ba việc thì chỉ tốn một lần nạp.

Thay vì gửi lần lượt 'tóm tắt bài này', rồi 'liệt kê các ý chính', rồi 'gợi ý tiêu đề', hãy viết gộp: 'Tóm tắt bài này, liệt kê các ý chính, và gợi ý một tiêu đề.'

Lợi ích phụ là câu trả lời thường cũng tốt hơn, vì Claude cần nhìn thấy toàn bộ bức tranh cùng lúc, giống như một người bình thường vậy.

7. Dùng cùng một cấu trúc prompt mỗi lần

Anthropic xác nhận rằng những prompt tương tự nhau mà bạn dùng thường xuyên sẽ được cache một phần.

Họ không công bố cơ chế chính xác, nhưng điều thực tế rút ra là: hãy giữ một 'thư viện prompt' ổn định và chỉ thay đổi phần biến số.

Cá nhân tôi dùng đúng một cấu trúc 30 từ cho khoảng 80% các phiên Cowork của mình: 'Tôi muốn [công việc] để đạt [tiêu chí thành công]. Đọc thư mục của tôi. Hãy hỏi tôi bằng AskUserQuestion trước khi bắt đầu.'

8. Sửa tin nhắn thay vì gửi thêm tin nhắn mới

Đây là mẹo tôi thích nhất và dùng liên tục.

Trong Chat (khác với Cowork), bạn có thể bấm Edit trên tin nhắn gốc của mình, sửa lại, rồi tạo câu trả lời mới.

Đoạn trao đổi cũ sẽ được thay thế hoàn toàn chứ không bị cộng dồn vào lịch sử.

Mỗi lần bạn gõ 'không, ý tôi là...' hay 'thực ra hãy đổi X thành Y', bạn đang cộng thêm vào lịch sử trò chuyện; nút Edit giúp tránh hoàn toàn việc đó. Nó còn tuyệt vời khi Claude đi lệch hướng, vì bạn có thể 'quay lại' dễ dàng.

Nút Edit trên tin nhắn trước đó trong Claude Chat để sửa prompt mà không tạo thêm lịch sử trò chuyện

9. Chọn đúng sản phẩm cho đúng việc

  • Câu hỏi nhanh? Dùng Chat với Haiku.
  • Viết báo cáo dựa trên file của bạn? Dùng Cowork với Opus.
  • Dựng biểu đồ từ dữ liệu? Dùng Code với Sonnet.

Mỗi sản phẩm có chi phí token khác nhau cho mỗi lượt tương tác: Chat là nhẹ nhất, Cowork là nặng nhất.

Chọn đúng công cụ cho đúng việc nghĩa là bạn không phải trả giá của Cowork cho một việc chỉ đáng mức Chat.

Cùng logic đó, có một tính năng ít người dùng trong Chat là Research, tính năng này nghiên cứu khá sâu nhưng ngốn rất nhiều token.

Tính năng Research trong Claude Chat, nghiên cứu sâu nhưng tiêu tốn nhiều token

Những nguyên tắc cơ bản vẫn quan trọng

10. Giữ file 'About Me' dưới 2.000 từ

Cowork đọc thư mục của bạn trước mỗi tác vụ.

Nếu file giới thiệu bản thân của bạn dài 22.000 từ (trước đây file của tôi từng như vậy), đó là hàng ngàn token bị đốt trước khi công việc thật sự bắt đầu, và lặp lại ở mọi phiên, mọi tác vụ.

Tôi đã cắt file đó xuống dưới 2.000 từ.

Một mẹo hay là ở cuối mỗi phiên Cowork, hãy yêu cầu Claude 'viết một file session-notes.md ghi lại các quyết định chính và bước tiếp theo', rồi ở phiên sau bắt đầu bằng 'đọc session-notes.md trước'. Nhờ vậy bạn mang ngữ cảnh sang phiên mới mà không phải giải thích lại từ đầu.

Tải file session-notes.md xuống để mang ngữ cảnh sang phiên Cowork tiếp theo mà không tốn token

11. Bắt đầu lại cuộc trò chuyện thay vì gửi thêm tin nhắn theo sau

Khi Cowork làm sai điều gì đó, phản xạ tự nhiên là gõ 'không, ý tôi là...' và gửi thêm tin nhắn.

Nhưng mỗi tin nhắn theo sau đều cộng dồn lên toàn bộ lịch sử trò chuyện, và Claude phải đọc lại tất cả một lần nữa.

Một phiên 20 tin nhắn có thể đốt khoảng 105.000 token, còn một phiên 30 tin nhắn lên tới 232.000 token.

Vì không thể sửa prompt để quay lại trong Cowork, bạn vẫn có thể dùng tính năng 'khởi động lại cuộc trò chuyện từ đây' ở một tin nhắn trước đó, càng quay lại xa càng tiết kiệm được nhiều token. Nếu cả phiên đã đi lệch hướng hoàn toàn, tốt nhất là bắt đầu phiên mới và dán vào một dòng tóm tắt ngắn gọn về điều bạn cần.

Tính năng khởi động lại cuộc trò chuyện từ một tin nhắn trước đó trong Cowork để tiết kiệm token

12. Tóm tắt và bắt đầu lại sau mỗi 15-20 tin nhắn

Những cuộc trò chuyện dài chính là lò đốt token.

Một lập trình viên từng theo dõi mức sử dụng của mình và phát hiện tới 98,5% token bị dùng để đọc lại lịch sử, chỉ 1,5% thực sự dành cho kết quả đầu ra.

Vì vậy, khi một phiên Cowork bắt đầu dài ra, hãy yêu cầu Claude tóm tắt lại những điều quan trọng, copy phần tóm tắt đó, mở một phiên mới, và dán nó vào làm tin nhắn đầu tiên.

13. Dùng Sonnet hoặc Haiku cho việc đơn giản, để dành Opus cho việc cần đào sâu

Kiểm tra ngữ pháp, brainstorm ý tưởng, định dạng lại văn bản, trả lời ngắn gọn — Sonnet xử lý tốt tất cả những việc này với chi phí thấp hơn nhiều. Opus kết hợp Extended Thinking là loại 'máy hạng nặng', đừng dùng máy hạng nặng để dịch chuyển một cái ghế.

Nguyên tắc của tôi là: nếu một việc Claude chỉ cần dưới 30 giây để trả lời, thì nó thường không cần đến Opus. Hãy đổi model trước khi bắt đầu phiên làm việc, việc này chỉ mất 2 cú click, dù đôi khi tùy chọn model bị ẩn trong mục 'More models'.

Chuyển đổi giữa các model Claude, đôi khi các lựa chọn bị ẩn trong mục More models

14. Đừng nhồi cả thư mục vào Cowork

Tôi từng thấy nhiều người thả nguyên 50 file vào thư mục Cowork 'để phòng khi cần'.

Nhưng mỗi file Cowork đọc là token bị tiêu tốn, và nếu file của bạn quá lớn, Cowork sẽ bắt đầu tóm tắt sơ sài thay vì đọc kỹ.

Nếu Claude không cần một file cho tác vụ hiện tại, đừng để nó đọc file đó.

Với những tác vụ Cowork hoàn toàn không cần đến file nào (ví dụ soạn nhanh một email qua connector), hãy chọn 'không thư mục nào' khi bắt đầu phiên làm việc. Không thư mục nghĩa là không có ngữ cảnh file cục bộ, và token được tiết kiệm ngay trước khi bạn kịp gõ chữ đầu tiên.

Bắt đầu phiên Cowork mà không chọn thư mục nào để tiết kiệm token tối đa cho các tác vụ đơn giản

15. Mở cuộc trò chuyện mới khi đổi chủ đề

Bạn nhờ Claude giúp viết một bài LinkedIn, rồi hỏi tiếp về một đề xuất cho khách hàng, rồi lại hỏi về công thức nấu ăn, tất cả trong cùng một cuộc trò chuyện.

Đừng làm vậy.

Claude vẫn phải đọc lại cuộc trò chuyện về bài LinkedIn và đề xuất khách hàng mỗi khi nó xử lý câu hỏi về bữa tối của bạn.

Những tin nhắn cũ đó là gánh nặng chết, token bị đốt cho một ngữ cảnh chẳng giúp ích gì cho câu hỏi hiện tại.

Chủ đề mới thì luôn nên là cuộc trò chuyện mới.

16. Tắt những tính năng bạn không dùng đến

Web search, connector, và chế độ 'Explore' đều cộng thêm token vào mỗi câu trả lời, kể cả khi bạn không cần đến chúng.

  • Nếu bạn đang viết nội dung của riêng mình, hãy tắt Search và Tools.
  • Nếu chỉ kiểm tra ngữ pháp đơn giản, hãy tắt Extended Thinking.

Những tính năng này rất mạnh, nhưng đều tốn token, chỉ nên bật khi thực sự cần.

Mặc định của tôi là tắt hết, rồi bật riêng cho từng tác vụ chứ không bật sẵn cho cả tài khoản (tôi có dùng Extended Thinking gần như suốt vì tôi trả tiền gói 100 đô).

Khi dùng connector như Slack, Google Drive, Notion, hãy nói cụ thể bạn cần gì: 'tìm trên Slack trong 7 ngày qua các tin nhắn về đợt ra mắt Q2' sẽ rẻ hơn rất nhiều so với 'tìm trên Slack bất cứ gì liên quan đến ra mắt sản phẩm'. Truy xuất có lọc nghĩa là ít kết quả được nạp vào hơn, và ít token bị đốt hơn.

Bật quá nhiều tính năng như web search và connector cùng lúc khiến số token sử dụng tăng cao

17. Dùng Projects cho công việc lặp lại

Nếu bạn tải cùng một file PDF lên 5 cuộc trò chuyện khác nhau, Claude sẽ phải mã hóa lại (tokenize) tài liệu đó 5 lần riêng biệt.

Thay vào đó, hãy dùng Projects: tải file lên một lần duy nhất và nó sẽ được cache lại.

Mọi cuộc trò chuyện mới trong project đó sẽ tham chiếu đến file mà không tốn thêm token nữa.

Anthropic xác nhận rằng nội dung project được tái sử dụng không tính phí giống như khi tải file mới. Ở các gói trả phí, Projects còn dùng RAG, nghĩa là Claude chỉ truy xuất những đoạn liên quan thay vì nạp toàn bộ tài liệu vào cửa sổ ngữ cảnh.

Nếu bạn thường xuyên làm việc với hợp đồng, tài liệu thương hiệu, hay các bài nghiên cứu, riêng thói quen này có thể cắt giảm đáng kể lượng token bạn dùng.

Tải file lên một Project trong Claude, các cuộc trò chuyện sau đó dùng lại file mà không cần đọc lại

18. Tắt Memory và thiết lập User Preferences

Mỗi cuộc trò chuyện mới không lưu sẵn ngữ cảnh sẽ lãng phí 3-5 tin nhắn chỉ để giới thiệu lại kiểu 'tôi làm marketing, tôi viết theo phong cách thoải mái, tôi thích đoạn văn ngắn...'. Thay vào đó, hãy vào Settings > General > Personal preferences để thiết lập sẵn những điều này một lần cho tất cả.

Cá nhân tôi luôn tắt Memory vì không thích tính năng này, thấy nó khá kỳ lạ.

Bên cạnh đó, hãy thiết lập Styles (nằm trong bộ chọn model), chọn 'Concise' hoặc tạo một style riêng. Nó sẽ áp dụng xuyên suốt mọi cuộc trò chuyện mà không ngốn ngữ cảnh của bạn: thiết lập một lần, tiết kiệm mãi mãi.

Vào Settings > General > Personal preferences để thiết lập sẵn thông tin cá nhân cho Claude
Thiết lập Styles trong bộ chọn model của Claude Chat, chọn Concise hoặc tạo style riêng

19. Dùng scheduled tasks cho công việc định kỳ

Nếu bạn chạy cùng một báo cáo, bản tổng hợp, hay tác vụ nghiên cứu mỗi tuần, đừng làm thủ công trong một phiên Cowork ngày càng dài ra. Hãy dùng plugin /schedule để tự động hóa việc này.

Sử dụng plugin /schedule để tự động hóa các tác vụ lặp lại hằng tuần

20. Cho Claude Code một phạm vi rõ ràng trước khi bắt đầu

Nhiều người nghĩ Claude Code chỉ dành cho lập trình viên, nhưng tôi vẫn dùng nó để soạn brief cho đội kỹ thuật và dựng nhanh các biểu đồ dữ liệu.

Tuy nhiên, các phiên Code có thể đốt token nhanh hơn bất cứ thứ gì khác nếu bạn không cẩn thận, vì Code có xu hướng khám phá rộng: đọc file, duyệt thư mục, chạy kiểm tra.

Nếu bạn không nói rõ mình cần gì, nó sẽ đi tìm hiểu mọi thứ trong tầm mắt, và token bị lãng phí khắp nơi.

Hãy cụ thể, ví dụ: 'Tạo một biểu đồ cột từ file CSV này, thể hiện doanh thu theo tháng năm 2025. Lưu thành chart.png.' Đừng để Claude có cơ hội tự do khám phá.

21. Dùng file CLAUDE.md để thiết lập ngữ cảnh cố định

Claude Code sẽ đọc file CLAUDE.md (nếu có) trước mỗi tác vụ.

Hãy đặt vào đó những hướng dẫn lặp lại: làm việc trong thư mục nào, dùng ngôn ngữ gì, quy tắc đặt tên ra sao.

Đây cùng logic với Global Instructions của Cowork: viết một lần, không cần lặp lại, tiết kiệm token ở mọi phiên làm việc.

Anthropic cũng cảnh báo rằng file CLAUDE.md quá dài sẽ khiến Claude bỏ qua chính những hướng dẫn thật sự của bạn, nên hãy giữ nó ngắn gọn. Với những quy trình chỉ thỉnh thoảng mới dùng (như một định dạng báo cáo riêng), hãy chuyển chúng sang Skills thay vì để trong CLAUDE.md, vì Skills chỉ được nạp khi cần, còn CLAUDE.md thì được nạp ở mọi lần.

22. Dàn trải công việc trong ngày

Claude tính giới hạn sử dụng theo một khung 5 tiếng luân phiên (rolling window). Nếu bạn đốt hết giới hạn chỉ trong một phiên làm việc buổi sáng, phần lớn công suất còn lại trong ngày sẽ bị bỏ phí.

Hãy chia thành 2-3 phiên: sáng, chiều, tối.

Đến lúc bạn quay lại, phần sử dụng trước đó đã 'rơi khỏi' khung tính giới hạn.

Nói thì dễ hơn làm, và cá nhân tôi trả tiền gói 100 đô/tháng chính là để không phải lo chuyện này, nhưng nếu bạn đang dùng gói 20 đô thì đây là điều đáng để ý.

23. Ngừng dùng Claude cho những việc Claude không giỏi

Claude không thể tạo ảnh.

Nếu bạn đang tốn 5 tin nhắn để mô tả một hình ảnh rồi tìm cách 'lách' bằng văn bản, hãy chuyển sang Gemini, vì đó là 5 tin nhắn token bị lãng phí cho một việc Claude vốn không giải quyết được.

Claude cũng không phải lựa chọn tốt nhất cho tìm kiếm thời gian thực, Grok nhanh và chính xác hơn cho việc đó.

Gần đây ChatGPT cũng khá tốt ở cả tạo ảnh lẫn tìm kiếm, có thể xem đó là một cú lội ngược dòng đáng chú ý.

Bắt đầu từ đâu

Bạn sẽ không thể áp dụng cả 23 thói quen cùng lúc, và cũng đừng cố làm vậy. Hãy chọn ra 3 thói quen phù hợp nhất với cách bạn đang dùng Claude.

  • Nếu bạn dùng Cowork hằng ngày: bắt đầu với thói quen 1, 2 và 5 — chuyển đổi file trước khi tải lên, lên kế hoạch trong Chat trước khi xây dựng, và ngừng yêu cầu làm lại toàn bộ.
  • Nếu bạn chủ yếu dùng Chat: bắt đầu với thói quen 8, 15 và 17 — sửa tin nhắn thay vì gửi thêm tin nhắn sửa lỗi, mở chat mới cho mỗi chủ đề, và dùng Projects cho các file lặp lại.
  • Nếu bạn đang dùng gói 20 đô và liên tục chạm giới hạn: bắt đầu với thói quen 6, 13 và 22 — gộp các prompt lại, dùng model rẻ hơn, và dàn trải các phiên làm việc trong ngày.

Phan Đông Giang biên soạn và tổng hợp.