Claude Opus 4.8 – 4 tính năng thay đổi cách làm việc với Claude AI và Claude Code

2336
19-07-2026
Claude Opus 4.8 – 4 tính năng thay đổi cách làm việc với Claude AI và Claude Code

Claude Opus 4.8 mang đến các tính năng như Effort Control, Dynamic Workflows, cập nhật API ngay trong quá trình xử lý và khả năng thực hiện các tác vụ dài một cách đáng tin cậy. Điểm thay đổi lớn nhất không chỉ là mô hình mới, mà là bạn có thể giao cho Claude những công việc phức tạp hơn và để AI tự xử lý mà vẫn yên tâm về kết quả.

Lưu ý:

Nội dung là góc nhìn ban đầu dựa trên tài liệu ra mắt của Anthropic, vì Claude Opus 4.8 vừa được phát hành và chưa được kiểm chứng trong môi trường production.

Mọi số liệu được đề cập đều lấy từ Anthropic; những thông tin chưa thể xác minh sẽ được ghi rõ nguồn.

Ngoài mô hình mới, Anthropic còn giới thiệu 4 tính năng quan trọng cùng một số cập nhật sắp ra mắt. Phần tiếp theo sẽ phân tích tác động thực tế của từng tính năng đối với quá trình làm việc hằng ngày.

Những điểm mới trong Claude Opus 4.8

Claude Opus 4.8 thay thế Opus 4.7 mà không thay đổi giá API (5 USD/triệu token đầu vào và 25 USD/triệu token đầu ra). Theo Anthropic, bản nâng cấp của mô hình chỉ ở mức vừa phải, nhưng những thay đổi quan trọng nằm ở các tính năng đi kèm.

Các cập nhật nổi bật gồm:

Effort Control được triển khai trên ứng dụng cho mọi gói.

Dynamic Workflows có trong Claude Code dành cho người dùng trả phí.

Messages API bổ sung một số thay đổi cho nhà phát triển.

Fast Mode nhanh hơn và có chi phí thấp hơn.

Anthropic cũng hé lộ kế hoạch ra mắt các mô hình Opus chi phí thấp hơn và một dòng mô hình mạnh hơn trong tương lai. Tuy nhiên, tác động lớn nhất hiện nay đến từ các tính năng mới, không chỉ riêng mô hình.

Effort Control: Điều chỉnh mức độ suy luận theo từng tác vụ

Claude Opus 4.8 cho phép người dùng điều chỉnh mức độ suy luận của mô hình ngay bên cạnh phần chọn model.

Có 3 mức: High (mặc định), Extra (xhigh trong Claude Code) và Max. Mức càng cao, Claude sẽ suy luận sâu hơn, sử dụng nhiều token hơn và tiêu tốn nhiều hạn mức hơn. Ngược lại, mức thấp sẽ cho phản hồi nhanh và tiết kiệm tài nguyên.

Theo Anthropic, ở mức High, Opus 4.8 sử dụng lượng token tương đương Opus 4.7 nhưng cho chất lượng tốt hơn, giúp tối ưu chi phí mà không cần thay đổi cấu hình.

Khi nào nên dùng?

High hoặc thấp hơn: Các tác vụ đơn giản như viết email, tra cứu API hoặc đổi tên biến.

Max: Các công việc quan trọng như thiết kế kiến trúc, xử lý lỗi phức tạp hoặc review mã nguồn trước khi triển khai.

Extra: Phù hợp với các AI Agent chạy nền trong thời gian dài, vì Anthropic cũng đã tăng giới hạn Claude Code để hỗ trợ các tác vụ này.

Tính năng này giúp cân bằng giữa chi phí và chất lượng, cho phép người dùng chỉ sử dụng mức suy luận cao khi thực sự cần thiết.

Vì sao Claude Opus 4.8 đáng tin cậy hơn

Điểm cải tiến quan trọng nhất của Opus 4.8 không phải là một tính năng mới mà là cách mô hình phản hồi.

Anthropic cho biết Opus 4.8 được huấn luyện để không khẳng định những điều không có đủ bằng chứng. So với phiên bản trước, mô hình ít bỏ sót lỗi trong mã nguồn hơn và sẵn sàng thừa nhận khi chưa chắc chắn, thay vì đưa ra câu trả lời tự tin nhưng sai. Anthropic cũng cho biết Opus 4.8 đạt kết quả tốt hơn về khả năng hành động vì lợi ích của người dùng và giảm các hành vi không phù hợp.

Các số liệu này đều do Anthropic công bố và chưa được kiểm chứng độc lập. Tuy nhiên, một số kết quả được báo cáo gồm:

Đạt 84% trên bài kiểm tra Online-Mind2Web dành cho AI Agent trình duyệt.

Là mô hình đầu tiên vượt 10% trong bài đánh giá khắt khe của một nhóm phát triển AI pháp lý.

Theo Databricks, chi phí token khi suy luận trên PDF và sơ đồ giảm 61% so với Opus 4.7.

Với các nhà phát triển, điều quan trọng không chỉ là hiệu năng mà là độ tin cậy. Một AI chạy chậm chỉ tốn thời gian, nhưng một AI trả lời sai với sự tự tin có thể khiến người dùng mất cảnh giác. Ngược lại, một mô hình biết thừa nhận "Tôi chưa chắc về ba tệp này" sẽ giúp lập trình viên tập trung kiểm tra đúng những phần cần xem xét, thay vì phải rà soát lại toàn bộ. Đây cũng là nền tảng để các tính năng tự động hóa nâng cao hoạt động hiệu quả hơn.

Fast Mode: Nhanh hơn, chi phí thấp hơn

Fast Mode trong Claude Opus 4.8 nhanh hơn 2,5 lần và rẻ hơn 3 lần so với các phiên bản trước. Giá API ở chế độ này là 10 USD/triệu token đầu vào và 50 USD/triệu token đầu ra.

Fast Mode đặc biệt phù hợp với các tác vụ yêu cầu độ trễ thấp, như công cụ tương tác thời gian thực, AI Agent thực hiện nhiều lời gọi ngắn hoặc các tác vụ xử lý hàng loạt có khối lượng lớn.

Nhờ tốc độ cao hơn và chi phí thấp hơn, nhiều ý tưởng từng bị loại bỏ vì vấn đề hiệu năng hoặc chi phí nay có thể trở nên khả thi.

Dynamic Workflows: Từ một tác vụ đến cả dự án

Dynamic Workflows là tính năng thay đổi cách giao việc cho Claude. Thay vì chỉ xử lý một tác vụ, Claude giờ có thể đảm nhận toàn bộ một dự án.

Claude sẽ tự lập kế hoạch, tạo quy trình điều phối và phân chia công việc cho hàng chục đến hàng trăm AI agent chạy song song. Các agent không chỉ thực hiện nhiệm vụ mà còn kiểm tra chéo, phản biện lẫn nhau và liên tục xác minh kết quả trước khi gửi lại cho người dùng. Tiến trình được lưu lại nên nếu bị gián đoạn, công việc có thể tiếp tục mà không phải chạy lại từ đầu.

Các trường hợp sử dụng tiêu biểu:

Di chuyển hoặc nâng cấp toàn bộ codebase (framework, API, ngôn ngữ lập trình).

Kiểm tra bảo mật và tìm lỗi trên quy mô lớn với nhiều agent xác minh độc lập.

Tìm mã nguồn dư thừa và cơ hội refactor mà công cụ phân tích tĩnh có thể bỏ sót.

Đánh giá một kế hoạch bằng nhiều hướng tiếp cận và phản biện khác nhau.

Một ví dụ nổi bật là dự án chuyển Bun từ Zig sang Rust, trong đó Dynamic Workflows hỗ trợ xử lý khoảng 750.000 dòng mã, đạt 99,8% tỷ lệ vượt qua bộ kiểm thử chỉ sau 11 ngày. Tuy nhiên, Anthropic lưu ý đây mới là bản trình diễn, chưa phải quy trình production.

Những điều cần biết

Dynamic Workflows hiện ở giai đoạn Research Preview.

Có trên Claude Code CLI, Desktop, VS Code Extension, API, AWS Bedrock, Google Vertex AI và Microsoft Foundry.

Mặc định bật cho Max, Team và API; với Enterprise, quản trị viên phải kích hoạt.

Có thể khởi chạy bằng cách yêu cầu Claude tạo workflow hoặc bật chế độ ultracode, cho phép Claude tự quyết định khi nào cần dùng Dynamic Workflows.

Lưu ý

Dynamic Workflows tiêu tốn nhiều token hơn so với phiên làm việc thông thường. Trước khi áp dụng cho các dự án lớn, nên thử với các tác vụ nhỏ để đánh giá chi phí và độ tin cậy của quá trình xác minh. Khả năng tự thừa nhận sự không chắc chắn của Opus 4.8 cũng là yếu tố giúp người dùng yên tâm hơn khi để nhiều AI agent hoạt động tự động.

Cập nhật hướng dẫn ngay trong quá trình chạy (Messages API)

Đây là một trong những cập nhật ít được chú ý nhưng rất hữu ích với những ai xây dựng AI Agent.

Messages API giờ cho phép cập nhật system instructions ngay trong khi tác vụ đang chạy, mà không làm mất prompt cache và cũng không cần chèn hướng dẫn dưới dạng tin nhắn của người dùng như trước.

Trước đây, việc thay đổi hướng dẫn giữa chừng thường khiến mất cache (tăng chi phí) hoặc làm rối ngữ cảnh hội thoại. Nay, việc cập nhật được hỗ trợ trực tiếp và trở thành một phần chính thức của API.

Các trường hợp sử dụng:

Cấp thêm quyền cho agent khi cần.

Điều chỉnh giới hạn token trong quá trình chạy.

Cập nhật môi trường hoặc ngữ cảnh mới.

Chuyển agent từ chế độ phân tích/đề xuất sang thực thi mà không phải khởi động lại phiên làm việc.

Đối với các nhà phát triển AI Agent, thay đổi này giúp quản lý trạng thái dễ hơn, giữ nguyên prompt cache và giảm chi phí token, dù không phải là một tính năng nổi bật về mặt truyền thông.

Claude Opus 4.8 sẽ thay đổi công việc hằng ngày như thế nào?

Với Opus 4.8, bạn có thể giao cho Claude những dự án lớn hơn. Ví dụ, Dynamic Workflows có thể xử lý một dự án migration dài, chạy nền với mức Effort "Extra". Nếu cần thêm token trong quá trình thực hiện, bạn chỉ cần cập nhật system instruction mà không phải khởi động lại phiên làm việc.

Khi hoàn thành, Claude không chỉ trả về kết quả mà còn đánh dấu những phần chưa chắc chắn, giúp bạn chỉ cần kiểm tra các tệp đó thay vì rà soát toàn bộ. Trong khi đó, Fast Mode đảm nhiệm các tác vụ nhỏ với tốc độ cao và chi phí thấp.

Mỗi tính năng riêng lẻ không tạo ra bước nhảy vọt, nhưng khi kết hợp, chúng giúp mở rộng quy mô công việc có thể giao cho AI và tăng mức độ tin cậy của kết quả.

Tuy nhiên, mức độ tự động hóa càng cao thì chi phí token cũng càng lớn, đặc biệt với Dynamic Workflows. Thách thức không còn là viết prompt, mà là biết khi nào nên để AI tự xử lý và khi nào chi phí đó thực sự xứng đáng.

Tóm tắt tính năng Claude Opus 4.8 theo từng trường hợp sử dụng

Effort Control

Nên dùng: Thiết kế kiến trúc, xử lý lỗi phức tạp, review mã nguồn quan trọng hoặc các tác vụ AI chạy nền dài (nên chọn Extra).

Không cần dùng: Tra cứu thông tin, soạn thảo văn bản hoặc chỉnh sửa đơn giản (mức mặc định là đủ).

Lưu ý: Chọn mức suy luận dựa trên rủi ro khi sai, không chỉ dựa vào độ khó của tác vụ.

Dynamic Workflows

Nên dùng: Migration toàn bộ codebase, kiểm tra bảo mật, dọn dẹp mã nguồn, refactor quy mô lớn hoặc đánh giá nhiều phương án.

Không cần dùng: Các tác vụ nhỏ, chỉ chỉnh sửa một vài tệp hoặc khi cần tối ưu chi phí.

Lưu ý: Hãy thử với một tác vụ nhỏ trước để đánh giá chi phí token và mức độ tin cậy.

Mid-run System Entries (Messages API)

Nên dùng: Thay đổi quyền truy cập, điều chỉnh ngân sách token hoặc cập nhật ngữ cảnh trong khi AI Agent đang chạy.

Không cần dùng: Các lời gọi API ngắn hoặc tác vụ thực hiện một lần.

Lợi ích: Cập nhật hướng dẫn mà vẫn giữ nguyên prompt cache, giúp giảm chi phí.

Fast Mode

Nên dùng: Công cụ tương tác thời gian thực, AI Agent chạy nhiều vòng lặp ngắn hoặc các tác vụ xử lý số lượng lớn.

Không cần dùng: Những công việc đòi hỏi suy luận sâu hơn là tốc độ.

Lưu ý: Chi phí giảm đáng kể nên nhiều ý tưởng từng bị loại vì quá tốn kém giờ có thể đáng để xem xét lại.

Những hạn chế cần lưu ý

Một số điểm cần cân nhắc trước khi sử dụng Claude Opus 4.8:

Thông tin không dựa trên triển khai Opus 4.8 trong môi trường production, nên đây chỉ là đánh giá dựa trên tài liệu ra mắt, không phải trải nghiệm thực tế.

Dynamic Workflows vẫn đang ở giai đoạn Research Preview và tiêu tốn nhiều token hơn đáng kể so với phiên làm việc thông thường, vì vậy cần tính toán chi phí trước khi sử dụng. Trên gói Enterprise, tính năng này mặc định bị tắt cho đến khi quản trị viên kích hoạt.

Một số bảng benchmark trong tài liệu ra mắt được trình bày dưới dạng hình ảnh nên không thể xác minh độc lập, vì vậy tác giả không trích dẫn các số liệu đó.

Dòng mô hình Mythos mạnh hơn vẫn chưa được phát hành rộng rãi do còn các cơ chế kiểm soát an toàn trong lĩnh vực an ninh mạng.

Theo chính Anthropic, mức cải thiện của mô hình cốt lõi chỉ ở mức vừa phải, trong khi giá trị lớn nhất nằm ở các tính năng mới.

Vì vậy, hãy xem Opus 4.8 như một định hướng để khám phá hơn là kết luận cuối cùng. Hiệu quả thực tế vẫn cần được kiểm chứng qua quá trình sử dụng trong môi trường production.

Anthropic cũng cho biết sẽ sớm ra mắt các mô hình Opus có chi phí thấp hơn và một dòng mô hình mạnh hơn Opus trong vài tuần tới.

Cuối cùng, câu hỏi được đặt ra là: Nếu sử dụng Dynamic Workflows, bạn sẽ giao cho Claude công việc nào đầu tiên? Và điều gì sẽ khiến bạn đủ tin tưởng để chấp nhận kết quả mà không cần kiểm tra từng dòng mã?

SHARE