Hướng dẫn Claude Code trong Claude Fable 5: 7 tính năng mới và cách sử dụng chúng trong Claude Code

1120
19-07-2026
Hướng dẫn Claude Code trong Claude Fable 5: 7 tính năng mới và cách sử dụng chúng trong Claude Code

Claude Fable 5 là Mythos-class model đầu tiên của Anthropic được phát hành thương mại trên thị trường, một cấp độ cao hơn Claude Opus, ra mắt vào ngày 9/6/2026. Fable 5 và Claude Mythos 5 có cùng một mô hình nền tảng; Mythos chỉ dành cho các tổ chức được phê duyệt, trong khi Fable 5 được bổ sung các cơ chế an toàn nhằm hạn chế các khả năng có thể bị lạm dụng (dual-use) trước khi phát hành rộng rãi cho người dùng.

Claude Fable 5 là gì?

Giải thích ngắn gọn và trọng tâm: Claude Fable 5 là mô hình thông minh nhất của Anthropic mà mọi người có thể sử dụng. Nó vượt trội hơn hầu hết các tiêu chuẩn mà Anthropic đã thử nghiệm: software engineering, xử lý tri thức, thị giác máy tính (vision) và nghiên cứu khoa học.

Thông qua API, Claude Fable 5 có giá 10 USD cho mỗi triệu token input và 50 USD cho mỗi triệu token output (tên model: claude-fable-5). Người dùng các gói Pro, Max, Team và Enterprise có thể sử dụng miễn phí đến ngày 22/6/2026.

Tiếp theo là các tính năng, thứ tự xuất hiện theo mức độ quan trọng đối với công việc.

7 tính năng mới trong Claude Fable 5

1. Năng lực vượt trội so với dòng Mythos: bước nhảy vọt về benchmark

Hai con số nổi bật trong thông báo của Anthropic. Trên SWE-bench Pro, Fable 5 đạt 80,3% so với 58,6% của GPT-5.5 - chênh lệch 21,7 điểm trên bài test gần nhất cho software engineering trên thực tế. Và đây là model đầu tiên vượt qua mốc 90% trên bài test nội bộ của Anthropic dành cho các tác vụ phân tích  dài, phức tạp, tăng 10 điểm so với Opus.

Mặc dù các benchmark do nhà cung cấp công bố cần được đánh giá thận trọng, kết quả ban đầu từ một số nguồn đánh giá độc lập cũng cho thấy Claude Fable 5 đạt hiệu năng vượt trội trong nhiều tác vụ thực tế (Tom’s Hardware và Simon Willison).

2. Một 1M-token context window, 128K output

Fable 5 được cung cấp mặc định với 1 triệu token context window và tối đa 128K token output mỗi request, theo tài liệu API.

Đối với các developer, điều này thay đổi định nghĩa về “một tác vụ”. Một codebase tầm trung, phần docs và kế hoạch chuyển đổi giờ đây có thể nằm gọn trong một request duy nhất.

Điều đáng chú ý mà nhiều người có thể bỏ qua: với giá 10$ cho mỗi 1 triệu token input, việc lấp đầy window sẽ tốn 10$ cho mỗi lần gọi. Việc tuân thủ context vẫn mang lại hiệu quả.

3. Adaptive Thinking với tham số effort

Claude Fable 5 loại bỏ cơ chế thinking toggle trước đây và chuyển sang Adaptive Thinking. Mô hình sẽ quyết định độ khó dựa trên tác vụ, và bạn sẽ điều khiển bằng tham số effort thay vì tự quản lý ngân sách suy luận nhu trước. Nếu bạn đã điều chỉnh effort trên Opus 4.8, thì kinh nghiệm và cách sử dụng đó vẫn áp dụng được với Claude Fable 5.

Nếu chưa: có thể sử dụng mức effort thấp cho các tác vụ thông thường, mức effort cao cho các tác vụ phức tạp, có nhiều khả năng xảy ra lỗi. Để model  tự hiệu chỉnh độ sâu của nó chính là điểm mấu chốt.

4. Tóm tắt quá trình suy luận thay vì hiển thị toàn bộ chuỗi 

Chuỗi suy luận chi tiết (raw chain of thought) sẽ không còn được trả về trên Fable 5. Theo mặc định, bạn sẽ không nhận được thông tin hiển thị nào (display: "omitted"); người dùng có thể thiết lập display: "summarized" và bạn sẽ nhận được bản tóm tắt dễ đọc từ phần suy luận. Tuy nhiên, các hệ thống đánh giá (evaluation pipeline) hoặc công cụ trước đây phụ thuộc vào việc phân tích raw chain-of-thought sẽ cần được điều chỉnh để tương thích với cơ chế mới. Việc thử nghiệm và lên kế hoạch chuyển đổi sớm sẽ giúp quá trình chuyển đổi diễn ra thuận lợi hơn.

5. Bộ công cụ cho AI Agent hoạt động dài hạn

Ngay từ khi ra mắt, Claude Fable 5 đã hỗ trợ các tính năng Memory, Context Editing và Compaction.

Cùng nhau, chúng tạo nên infrastructure hỗ trợ cho Fable 5 có thể hoạt động dài ngày bên trong một hệ thống như Claude Code theo khẳng định mạnh mẽ của Anthropic, cùng với đó lduy trì ngữ cảnh qua nhiều giai đoạn và phối hợp với các tác vụ hoặc agent khác. Trong đó:

Memory giúp lưu trữ trạng thái giữa các phiên làm việc.

Context Editing loại bỏ những thông tin không còn cần thiết khỏi ngữ cảnh.

Compaction nén ngữ cảnh để các phiên làm việc dài vẫn nằm trong giới hạn context window của mô hình.

Thông điệp đưa ra là các tính năng này giúp giảm đáng kể số lượng prompt cần thiết để hoàn thành các tác vụ phức tạp. Tuy nhiên, hãy xem đây như là định hướng và hiệu quả thực tế còn cần xem xét. Dù vậy, các tính năng này hiện đã được tích hợp và sẵn sàng sử dụng thông qua API.

6. Task budgets và khám phá khả năng của mô hình

Hai bổ sung nhỏ nhưng tinh tế của Fable có thể sẽ nhận được đánh giá cao từ team production. Task budgets giới hạn lượng công việc mà model dành cho một mục tiêu. Đó là rào cản bạn cần để tránh việc AI hoạt động ngoài kiểm soát. Và Models API hiện trả về khả năng của mô hình (như max_input_tokens, max_tokens và các tính năng được hỗ trợ), giúp ứng dụng tự động xác định năng lực của mô hình thay vì phải cấu hình thủ công.

7. Bộ phân loại an toàn và cơ chế chuyển sang Opus

Fable 5 tích hợp các bộ phân loại an toàn (safety classifiers) để phát hiện các yêu cầu có nguy cơ bị lạm dụng, đặc biệt trong lĩnh vực an ninh mạng. Với một số truy vấn nhạy cảm, hệ thống sẽ chuyển sang Claude Opus 4.8 để xử lý. Theo Anthropic, cơ chế này chỉ xảy ra trong dưới 5% số phiên.

Nếu mô hình từ chối trả lời, API vẫn trả về HTTP 200, nhưng trường stop_reason sẽ có giá trị refusal và cho biết bộ phân loại nào đã được kích hoạt.

Đối với các developer, điều quan trọng là ghi lại (log) stop_reason và thông tin định tuyến mô hình, để biết phản hồi đến từ Fable 5 hay Opus và dễ dàng theo dõi, xử lý các trường hợp bị giới hạn.

SHARE