Phan Đông GiangPhan Đông Giang
Tất cả bài viết
2026-07-2314 phút

Anthropic Vừa Công Bố Cách Prompt Claude Fable 5: Càng Chỉ Dẫn Ít, AI Càng Làm Tốt Hơn

Hướng dẫn chính thức từ Anthropic về cách viết prompt và scaffolding cho Claude Fable 5 và Claude Mythos 5: kiểm soát effort, tận dụng khả năng tuân theo chỉ dẫn mạnh hơn, quản lý phiên làm việc dài, xây dựng bộ nhớ, subagent song song và nhiều mẫu prompt thực chiến.

Anthropic Vừa Công Bố Cách Prompt Claude Fable 5: Càng Chỉ Dẫn Ít, AI Càng Làm Tốt Hơn

Cách Viết Prompt Cho Claude Fable 5

Những khác biệt về hành vi và các mẫu prompt dành cho Claude Fable 5 và Claude Mythos 5, bao gồm effort, khả năng tuân theo chỉ dẫn (instruction following), các phiên làm việc dài, bộ nhớ (memory), và những thay đổi về scaffolding.

Hướng dẫn này trình bày các mẫu prompt và scaffolding dành riêng cho Claude Fable 5 và Claude Mythos 5. Để tìm hiểu về năng lực của mô hình, các thay đổi API, giá cả và mức độ khả dụng, hãy xem tài liệu "Introducing Claude Fable 5 and Claude Mythos 5" trên trang tài liệu chính thức của Anthropic. Để tìm các kỹ thuật áp dụng chung cho mọi mô hình Claude hiện tại, hãy xem tài liệu "Prompting best practices".

Claude Fable 5 giải quyết được những bài toán trước đây quá phức tạp, kéo dài hoặc mơ hồ đối với các mô hình trước, và đặc biệt hiệu quả với những công việc trọn vẹn từ đầu đến cuối mà một người phải mất hàng giờ, hàng ngày, hoặc hàng tuần để hoàn thành. Các đội nhóm đạt kết quả tốt nhất thường áp dụng Claude Fable 5 vào những bài toán khó nhất, chưa có lời giải của họ; nếu chỉ thử nghiệm trên các tác vụ đơn giản thì dễ đánh giá thấp phạm vi năng lực thực sự của mô hình. Claude Fable 5 cũng hoạt động ổn định trên các tác vụ đơn giản hơn.

Claude Fable 5 có một số khác biệt về hành vi so với Claude Opus 4.8, có thể cần cập nhật lại prompt hoặc scaffolding. Những cải tiến năng lực ở mức độ này cũng là dịp tốt để xem lại những chỉ dẫn, công cụ và rào chắn (guardrail) nào vẫn còn cần thiết. Các mẫu hình dưới đây bao quát những hành vi thường cần điều chỉnh nhất.

Về các thay đổi tham số API dành riêng cho Claude Fable 5 và Claude Mythos 5 (chỉ có adaptive thinking, đầu ra thinking chỉ ở dạng tóm tắt, không còn ngân sách extended thinking, lý do dừng "refusal" và cách xử lý fallback), hãy xem tài liệu giới thiệu Claude Fable 5 và Claude Mythos 5 của Anthropic.

Claude Fable 5 chạy các bộ phân loại an toàn (safety classifier) nhắm vào các kỹ thuật tấn công mạng mang tính tấn công (như xây dựng exploit, malware, hay công cụ tấn công), nội dung sinh học và khoa học sự sống (như phương pháp phòng thí nghiệm hay cơ chế phân tử), và việc trích xuất phần tóm tắt tư duy (thinking) của mô hình. Các công việc an ninh mạng lành tính và các tác vụ khoa học sự sống mang tính có ích cũng có thể vô tình kích hoạt các lớp bảo vệ này. Để tự động định tuyến lại các yêu cầu bị từ chối, hãy cấu hình cơ chế fallback phía server hoặc phía client sang Claude Opus 4.8.

Màn hình điện thoại hiển thị logo và tên Claude Fable
Claude Fable 5

Cải Thiện Về Năng Lực

So với Claude Opus 4.8, Claude Fable 5 có cải thiện ở:

  • Khả năng tự chủ trong thời gian dài (long-horizon autonomy). Claude Fable 5 duy trì đầu ra hiệu quả trong thời gian kéo dài, hoàn thành các phiên làm việc nhiều ngày, hướng đến mục tiêu, với khả năng ghi nhớ chỉ dẫn tốt xuyên suốt các tác vụ dài và phức tạp.
  • Độ chính xác ngay lần đầu (first-shot) với các bài toán phức tạp, được đặc tả rõ ràng. Những người dùng thử nghiệm sớm ghi nhận các lần triển khai hệ thống chỉ trong một lượt (single-pass) mà trước đây phải mất nhiều ngày lặp lại chỉnh sửa.
  • Thị giác (vision). Claude Fable 5 diễn giải các hình ảnh kỹ thuật dày đặc thông tin, ứng dụng web, và ảnh chụp màn hình chi tiết với độ chính xác cao hơn đáng kể, thường dùng ít token đầu ra hơn, và được huấn luyện để dùng công cụ bash và crop nhằm xử lý ảnh bị lật, mờ, hoặc nhiễu.
  • Quy trình doanh nghiệp (enterprise workflows). Claude Fable 5 tuân theo chỉ dẫn, giữ đúng phạm vi, và tạo ra đầu ra chuyên nghiệp cho phân tích tài chính, bảng tính, slide và tài liệu.
  • Review code và debug. Khả năng tìm ra bug (ngoài các lĩnh vực an ninh mạng mà bộ phân loại an toàn bao phủ) cao hơn rõ rệt so với Claude Opus 4.8, kể cả khi tìm kiếm xuyên suốt codebase và lịch sử repository.
  • Xử lý sự mơ hồ. Claude Fable 5 hoạt động tốt khi nhận các yêu cầu phức tạp, đa luồng và được yêu cầu tự xác định bước tiếp theo.
  • Ủy quyền và phối hợp (delegation and collaboration). Claude Fable 5 đáng tin cậy hơn đáng kể trong việc điều phối và duy trì các subagent chạy song song, quản lý tốt việc giao tiếp liên tục với các subagent chạy dài và các agent ngang hàng.

Ngoài những cải thiện cụ thể này, nhìn chung Claude Fable 5 có năng lực cao hơn các mô hình trước trên hầu hết mọi tác vụ. Claude Fable 5 không được thiết kế cho các công việc tấn công an ninh mạng hay sinh học/khoa học sự sống; các yêu cầu thuộc những lĩnh vực này có thể trả về stop_reason: "refusal".

Các Lượt Làm Việc Dài Hơn Theo Mặc Định

Với các tác vụ khó, một yêu cầu đơn lẻ có thể chạy trong nhiều phút ở các mức effort cao hơn, đặc biệt khi tác vụ đòi hỏi thu thập ngữ cảnh, xây dựng và tự kiểm chứng, và các phiên chạy tự động có thể kéo dài hàng giờ. Đây là một trong những thay đổi lớn nhất mà các đội nhóm gặp phải khi chuyển sang dùng Claude Fable 5. Hãy điều chỉnh timeout phía client, streaming, và các chỉ báo tiến trình hiển thị cho người dùng trước khi migrate, đồng thời cân nhắc tái cấu trúc harness để kiểm tra tiến trình chạy theo kiểu bất đồng bộ — ví dụ qua các job được lên lịch — thay vì chặn (blocking) chờ đợi. Để tránh việc Claude Fable 5 lập kế hoạch quá mức khi tác vụ còn mơ hồ:

Sao chép code
Khi đã có đủ thông tin để hành động, hãy hành động. Đừng suy luận lại những sự kiện đã được xác lập trong cuộc trò chuyện, đừng tranh luận lại một quyết định người dùng đã đưa ra, và đừng thuật lại trong tin nhắn gửi cho người dùng những phương án bạn sẽ không theo đuổi. Nếu đang cân nhắc một lựa chọn, hãy đưa ra một khuyến nghị, không phải một bản khảo sát đầy đủ mọi phương án. Điều này không áp dụng cho các khối thinking.

Cân Nhắc Tất Cả Các Mức Effort

Effort là cơ chế kiểm soát chính cho sự đánh đổi giữa độ thông minh, độ trễ, và chi phí trên Claude Fable 5. Dùng mức "high" làm mặc định cho hầu hết tác vụ, "xhigh" cho những khối lượng công việc nhạy cảm nhất về năng lực, và "medium" hoặc "low" cho công việc thường nhật. Các mức effort thấp hơn trên Claude Fable 5 vẫn hoạt động tốt và thường vượt qua hiệu năng "xhigh" của các mô hình trước. Hãy giảm effort nếu một tác vụ hoàn thành nhưng mất nhiều thời gian hơn cần thiết, hoặc nếu bạn muốn một phong cách làm việc nhanh và tương tác hơn.

Với công việc thường nhật ở mức effort cao hơn, Claude Fable 5 có thể thu thập ngữ cảnh và cân nhắc nhiều hơn mức tác vụ thực sự cần. Đồng thời, effort cao hơn cũng thường tạo ra hành vi kiểm chứng xuất sắc, suy luận tinh vi, và đầu ra kỹ lưỡng nhất. Để ngăn việc dọn dẹp hay refactor không được yêu cầu ở mức effort cao:

Sao chép code
Đừng thêm tính năng, refactor, hay tạo ra các lớp trừu tượng vượt quá những gì tác vụ yêu cầu. Một bản sửa lỗi không cần dọn dẹp xung quanh, và một thao tác chỉ chạy một lần thường không cần một hàm helper riêng. Đừng thiết kế cho những yêu cầu tương lai còn giả định: hãy làm theo cách đơn giản nhất mà vẫn hoạt động tốt. Tránh trừu tượng hóa sớm và những phần triển khai dang dở. Đừng thêm xử lý lỗi, fallback, hay validation cho những tình huống không thể xảy ra. Hãy tin tưởng vào code nội bộ và các đảm bảo của framework. Chỉ validate ở ranh giới hệ thống (input người dùng, API bên ngoài). Đừng dùng feature flag hay lớp tương thích ngược khi bạn có thể thay đổi code trực tiếp.

Khả Năng Tuân Theo Chỉ Dẫn Mạnh Mẽ

Khả năng tuân theo chỉ dẫn đã được cải thiện đủ tốt để bạn có thể định hướng phần lớn hành vi chỉ bằng một chỉ dẫn ngắn gọn, thay vì phải liệt kê từng hành vi một. Ví dụ, khi không được định hướng, Claude Fable 5 có thể diễn giải dài dòng hơn mức tác vụ cần, đặc biệt ở các mức effort cao hơn: liệt kê các lựa chọn mà nó sẽ không theo đuổi, giải thích nguyên nhân gốc rễ dài dòng, tạo ra mô tả PR có cấu trúc nặng nề, hoặc viết comment thuật lại việc dòng tiếp theo làm gì. Một chỉ dẫn ngắn gọn về sự súc tích cũng hiệu quả tương đương việc liệt kê từng mẫu hình một:

Sao chép code
Mở đầu bằng kết quả. Câu đầu tiên sau khi hoàn thành nên trả lời "chuyện gì đã xảy ra" hoặc "bạn đã tìm ra điều gì": đúng thứ người dùng sẽ hỏi nếu họ nói "cho tôi bản tóm tắt thôi". Chi tiết hỗ trợ và lập luận đến sau. Dễ đọc và súc tích là hai chuyện khác nhau, và dễ đọc quan trọng hơn.

Cách để giữ đầu ra ngắn gọn là chọn lọc những gì nên đưa vào (bỏ những chi tiết không làm thay đổi việc người đọc sẽ làm tiếp theo), chứ không phải nén câu chữ thành từng mảnh rời rạc, viết tắt, chuỗi mũi tên kiểu A → B → lỗi, hay biệt ngữ.

Điều tương tự cũng áp dụng cho hành vi checkpoint (điểm dừng để xác nhận) trong các quy trình chạy dài. Để Claude Fable 5 chỉ dừng lại ở những chỗ thực sự cần bạn, không cần liệt kê từng trường hợp:

Sao chép code
Chỉ dừng lại chờ người dùng khi công việc thực sự cần đến họ: một hành động mang tính phá hủy hoặc không thể đảo ngược, một thay đổi phạm vi thực sự, hoặc thông tin mà chỉ họ mới có thể cung cấp. Nếu gặp một trong các trường hợp này, hãy hỏi và kết thúc lượt, thay vì kết thúc bằng một lời hứa sẽ làm.

Neo Các Tuyên Bố Về Tiến Độ Trong Các Phiên Chạy Dài

Trong các phiên chạy tự động dài, hãy chỉ dẫn Claude Fable 5 đối chiếu tiến độ với kết quả thực tế từ công cụ. Trong thử nghiệm của Anthropic, điều này gần như loại bỏ hoàn toàn các báo cáo trạng thái bịa đặt, kể cả trên những tác vụ được thiết kế để gợi ra chúng:

Sao chép code
Trước khi báo cáo tiến độ, hãy đối chiếu từng nhận định với một kết quả công cụ thực tế trong phiên làm việc này. Chỉ báo cáo những phần việc bạn có thể chỉ ra bằng chứng; nếu điều gì đó chưa được xác minh, hãy nói rõ điều đó. Báo cáo kết quả trung thực: nếu test thất bại, hãy nói rõ kèm theo output; nếu một bước bị bỏ qua, hãy nói rõ điều đó; khi điều gì đó đã hoàn thành và được xác minh, hãy phát biểu thẳng thắn, không rào đón.

Nêu Rõ Ranh Giới

Claude Fable 5 đôi khi có thể thực hiện những hành động không được yêu cầu (soạn một email khi không ai yêu cầu, tạo các nhánh git backup phòng hờ). Hãy xác định rõ ràng những ràng buộc về việc Claude Fable 5 nên và không nên làm:

Sao chép code
Khi người dùng đang mô tả một vấn đề, đặt câu hỏi, hoặc suy nghĩ thành lời chứ không phải yêu cầu một thay đổi, thì sản phẩm bàn giao chính là đánh giá của bạn. Hãy báo cáo phát hiện của bạn rồi dừng lại. Đừng áp dụng một bản sửa cho đến khi họ yêu cầu. Trước khi chạy một lệnh làm thay đổi trạng thái hệ thống (khởi động lại, xóa, sửa cấu hình), hãy kiểm tra xem bằng chứng có thực sự ủng hộ hành động cụ thể đó hay không. Một tín hiệu khớp mẫu với một lỗi đã biết có thể có nguyên nhân khác.

Subagent Chạy Song Song

Claude Fable 5 điều phối các subagent chạy song song sẵn sàng hơn các mô hình trước. Hãy dùng subagent thường xuyên, đưa ra hướng dẫn rõ ràng về khi nào nên ủy quyền, và ưu tiên giao tiếp bất đồng bộ giữa orchestrator và subagent thay vì chặn chờ từng subagent trả kết quả. Các subagent tồn tại lâu dài, giữ nguyên ngữ cảnh xuyên suốt các subtask, giúp tiết kiệm thời gian và chi phí nhờ cache read, đồng thời tránh bị nghẽn ở subagent chậm nhất.

Sao chép code
Giao các subtask độc lập cho subagent và tiếp tục làm việc trong khi chúng chạy. Can thiệp nếu một subagent đi lệch hướng hoặc thiếu bối cảnh liên quan.

Xây Dựng Một Hệ Thống Bộ Nhớ (Memory)

Claude Fable 5 hoạt động đặc biệt tốt khi có thể ghi lại các bài học từ những lần chạy trước và tham chiếu lại chúng. Hãy cung cấp một nơi để ghi chú, đơn giản như một file Markdown:

Sao chép code
Lưu mỗi bài học vào một file riêng, với một dòng tóm tắt ở đầu. Ghi lại cả những lần sửa lỗi lẫn những cách tiếp cận đã được xác nhận, kèm lý do vì sao chúng quan trọng. Đừng lưu những gì repo hay lịch sử trò chuyện đã ghi lại sẵn; cập nhật một ghi chú đã có thay vì tạo bản trùng lặp; xóa những ghi chú hóa ra là sai.

Để khởi tạo hệ thống bộ nhớ từ lịch sử sẵn có, hãy để Claude Fable 5 xem lại các phiên làm việc trước đó:

Sao chép code
Hãy nhìn lại các phiên làm việc trước đây giữa chúng ta. Dùng subagent để xác định các chủ đề và bài học cốt lõi, và lưu chúng vào [X]. Đảm bảo bạn biết cần tham chiếu [X] cho những lần sử dụng sau này.

Các Trường Hợp Hiếm Gặp: Dừng Sớm

Vào sâu trong một phiên làm việc dài, Claude Fable 5 đôi khi có thể kết thúc một lượt chỉ bằng một câu tuyên bố ý định dạng văn bản ("Giờ tôi sẽ chạy X") mà không thực sự gọi tool tương ứng, hoặc dừng lại để xin phép trong khi đã có đủ thông tin để tiếp tục. Một câu "tiếp tục đi" hoặc "cứ làm từ đầu đến cuối luôn" là đủ. Để xác định khi nào nên dừng lại là hợp lý, hãy kết hợp điều này với chỉ dẫn checkpoint ở phần "Khả Năng Tuân Theo Chỉ Dẫn Mạnh Mẽ" bên trên. Với các pipeline tự động, hãy thêm một system reminder:

Sao chép code
Bạn đang hoạt động tự động (autonomously). Người dùng không theo dõi trực tiếp theo thời gian thực và không thể trả lời câu hỏi giữa chừng, vì vậy việc hỏi "Bạn có muốn tôi…?" hay "Tôi có nên…?" sẽ làm nghẽn công việc. Với các hành động có thể đảo ngược và bám sát yêu cầu ban đầu, hãy cứ tiến hành mà không cần hỏi. Đề xuất các bước tiếp theo sau khi công việc đã hoàn tất thì được; nhưng xin phép sau khi đã bàn bạc với người dùng trước đó mà chưa thực sự làm thì không nên. Trước khi kết thúc lượt, hãy kiểm tra lại đoạn văn cuối cùng của bạn. Nếu đó là một kế hoạch, một phân tích, một câu hỏi, một danh sách bước tiếp theo, hoặc một lời hứa về việc bạn chưa làm ("Tôi sẽ…", "để tôi báo khi…"), hãy thực hiện công việc đó ngay bằng cách gọi tool. Chỉ kết thúc lượt khi tác vụ đã hoàn tất hoặc khi bạn bị chặn lại vì cần thông tin mà chỉ người dùng mới có thể cung cấp.

Các Trường Hợp Hiếm Gặp: Lo Ngại Về Ngân Sách Context

Trong các phiên làm việc rất dài, Claude Fable 5 đôi khi có thể đề xuất một phiên làm việc mới, đề nghị tóm tắt và bàn giao lại, hoặc tự cắt bớt công việc của mình. Điều này thường xảy ra nhiều nhất khi harness hiển thị cho mô hình một bộ đếm ngược số token còn lại. Hãy tránh hiển thị con số ngân sách context cụ thể nếu có thể. Nếu harness bắt buộc phải hiển thị, một lời trấn an sẽ hữu ích:

Sao chép code
Bạn vẫn còn nhiều ngữ cảnh (context) khả dụng. Đừng dừng lại, tóm tắt, hay đề xuất một phiên làm việc mới vì lý do giới hạn context. Hãy tiếp tục công việc.

Đưa Ra Lý Do, Không Chỉ Yêu Cầu

Claude Fable 5 có xu hướng hoạt động tốt hơn khi hiểu được ý định đằng sau một yêu cầu: ngữ cảnh giúp nó kết nối tác vụ với thông tin liên quan thay vì tự suy đoán ý định. Hãy cung cấp bối cảnh về lý do bạn đưa ra yêu cầu, đặc biệt với các agent chạy dài, dựa trên nhiều luồng công việc khác nhau:

Sao chép code
Tôi đang thực hiện [công việc lớn hơn] cho [đối tượng thụ hưởng]. Họ cần [điều mà kết quả đầu ra sẽ giúp ích]. Với bối cảnh đó: [yêu cầu cụ thể].

Khả Năng Đọc Hiểu Khi Giao Tiếp Với Người Dùng

Trong các cuộc trò chuyện dài hoặc mang tính agentic (nhiều lượt gọi tool, ngữ cảnh làm việc lớn), Claude Fable 5 có thể tạo ra văn bản khó theo dõi: kiểu viết tắt dày đặc mũi tên, chi tiết triển khai quá sâu, tham chiếu đến phần tư duy mà người dùng chưa từng thấy, hoặc cách diễn đạt quá kỹ thuật. Một đoạn bổ sung về phong cách giao tiếp sẽ giảm bớt điều này:

Sao chép code
Viết tắt ngắn gọn thì ổn giữa các lần gọi tool (đó là lúc bạn đang suy nghĩ thành lời, và súc tích ở đó là tốt). Bản tóm tắt cuối cùng thì khác: nó dành cho một người đọc chưa từng thấy bất kỳ điều gì ở trên.

Nếu bạn đã làm việc một thời gian mà không có người dùng theo dõi (qua đêm, qua nhiều lần gọi tool, kể từ lần cuối họ nói chuyện), tin nhắn cuối cùng của bạn là lần đầu tiên họ nhìn thấy bất cứ điều gì trong đó. Hãy viết nó như một sự tái định hướng (re-grounding), không phải phần tiếp nối của luồng làm việc: kết quả trước tiên, sau đó là một hoặc hai điều bạn cần từ họ, mỗi điều được giải thích như thể lần đầu. Vốn từ vựng bạn xây dựng trong lúc làm việc là của bạn, không phải của họ; hãy để nó lại phía sau trừ khi bạn giới thiệu lại nó.

Khi viết bản tóm tắt ở cuối, hãy bỏ đi lối viết tắt trong lúc làm việc. Viết câu đầy đủ. Viết rõ ràng các thuật ngữ. Đừng dùng chuỗi mũi tên, các cụm từ ghép nối bằng gạch ngang, hay các nhãn bạn tự đặt ra trước đó. Khi nhắc đến file, commit, flag, hay các định danh khác, hãy dành cho mỗi cái một mệnh đề bằng ngôn ngữ thông thường riêng. Mở đầu bằng kết quả: một câu về chuyện gì đã xảy ra hoặc bạn đã tìm ra điều gì. Sau đó mới đến chi tiết hỗ trợ. Nếu phải chọn giữa ngắn gọn và rõ ràng, hãy chọn rõ ràng.

Tạo Một Công Cụ Gửi Tin Nhắn Cho Người Dùng (send-to-user)

Khi chạy các agent bất đồng bộ, dài hạn, hãy cung cấp cho agent một cách để hiển thị một tin nhắn mà người dùng phải thấy đúng y nguyên như đã viết, mà không cần kết thúc lượt của nó: một sản phẩm bàn giao (đoạn code được tạo ra hay một tin nhắn nháp), một cập nhật tiến độ kèm số liệu cụ thể, hoặc một câu trả lời trực tiếp cho câu hỏi người dùng đặt ra giữa chừng. Đầu vào của công cụ chính là tin nhắn cần hiển thị; khi Claude gọi nó, hãy hiển thị đầu vào đó trực tiếp trong giao diện của bạn và trả về một xác nhận đơn giản làm kết quả tool. Đầu vào của tool không bao giờ bị tóm tắt, nên nội dung sẽ đến nguyên vẹn.

Sao chép code
{
  "name": "send_to_user",
  "description": "Hiển thị một tin nhắn trực tiếp cho người dùng. Dùng cho các cập nhật tiến độ, kết quả một phần, hoặc nội dung mà người dùng phải thấy đúng nguyên văn trước khi tác vụ kết thúc.",
  "input_schema": {
    "type": "object",
    "properties": {
      "message": {
        "type": "string",
        "description": "Nội dung cần hiển thị cho người dùng."
      }
    },
    "required": ["message"]
  }
}

Hãy thêm công cụ này bất cứ khi nào trải nghiệm người dùng của bạn phụ thuộc vào việc gửi nội dung hoặc tương tác trực tiếp với người dùng một cách nguyên văn giữa tác vụ. Chỉ định nghĩa công cụ thôi là chưa đủ; nếu không có chỉ dẫn trong system prompt, Claude Fable 5 hiếm khi gọi nó. Với các agent chỉ thuật lại tiến trình thường nhật, phần tóm tắt của chính mô hình thường đã đủ dùng. Hãy kết hợp công cụ này với ngôn ngữ gợi mở như:

Sao chép code
Giữa các lần gọi tool, khi bạn có nội dung mà người dùng phải đọc đúng nguyên văn (một sản phẩm bàn giao một phần, một câu trả lời trực tiếp cho câu hỏi của họ), hãy gọi tool send_to_user với nội dung đó. Chỉ dùng send_to_user cho nội dung hướng đến người dùng, không dùng để thuật lại hay lập luận nội bộ.

Đừng định tuyến phần thuật lại hay suy luận nội bộ qua send_to_user; việc gọi quá tay cho những nội dung không hướng đến người dùng sẽ làm mất đi mục đích của công cụ này.

Các Thay Đổi Scaffolding Được Khuyến Nghị

  • Bắt đầu từ ngưỡng khó nhất trong phạm vi của bạn. Hãy chọn một tác vụ khó hơn những gì bạn từng giao cho các mô hình trước, và để Claude Fable 5 tự xác định phạm vi, đặt câu hỏi làm rõ, rồi thực thi.
  • Đưa việc tự kiểm chứng thành yêu cầu rõ ràng trong các prompt chạy dài. Các subagent kiểm chứng độc lập, chạy với ngữ cảnh mới, thường cho kết quả tốt hơn so với việc tự phê bình. Với các tác vụ chạy dài, hãy chỉ dẫn: "Establish a method for checking your own work at an interval of [X] as you build. Run this every [X interval], verifying your work with subagents against the specification."
  • Refactor lại các prompt và skill hiện có. Các skill được xây dựng cho các mô hình trước thường quá chi tiết/áp đặt (prescriptive) đối với Claude Fable 5 và có thể làm giảm chất lượng đầu ra. Hãy xem lại và cân nhắc loại bỏ những chỉ dẫn cũ nếu hiệu năng mặc định đã tốt hơn. Claude Fable 5 cũng làm khá tốt việc tự cập nhật skill ngay trong lúc làm việc, dựa trên những gì nó học được từ tác vụ hiện tại.
  • Đừng yêu cầu Claude thuật lại quá trình suy luận của nó trong câu trả lời. Các prompt, skill, hoặc chỉ dẫn harness yêu cầu mô hình lặp lại, chép lại, hay giải thích suy luận nội bộ của nó dưới dạng văn bản trả lời có thể kích hoạt nhóm từ chối reasoning_extraction trên Claude Fable 5, khiến việc fallback sang Claude Opus 4.8 tăng lên. Hãy rà soát lại các skill và system prompt hiện có xem có chỉ dẫn nào yêu cầu phản chiếu (reflection) hay show-your-thinking hay không khi chuyển đổi. Nếu ứng dụng của bạn cần hiển thị quá trình suy luận, hãy đọc trực tiếp các khối thinking có cấu trúc từ adaptive thinking, và dùng một công cụ send-to-user để hiển thị tiến trình trong các phiên chạy dài.
  • Tạo một công cụ send-to-user. Với các agent bất đồng bộ, chạy dài, một tool phía client sẽ gửi tin nhắn cho người dùng nguyên văn mà không cần kết thúc lượt. Xem phần "Tạo Một Công Cụ Gửi Tin Nhắn Cho Người Dùng" ở trên.