DEV Community

Cover image for Cách sử dụng Claude Opus 5 trong Claude Code
Sebastian Petrus
Sebastian Petrus

Posted on • Originally published at apidog.com

Cách sử dụng Claude Opus 5 trong Claude Code

Claude Opus 5 ra mắt ngày 24 tháng 7 năm 2026 và có sẵn trong Claude Code ngay từ ngày đầu. Với gói Max, đây là mô hình mặc định. Với gói Pro, đây là mô hình mạnh nhất bạn có thể dùng. Nếu gọi qua API, giá là 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, tương đương Opus 4.8.

Dùng thử Apidog ngay hôm nay

Điểm cần lưu ý là cấu hình hiện tại của bạn có thể làm Opus 5 tốn token hơn cần thiết. Mô hình này tự xác minh kết quả, có xu hướng viết dài hơn và tạo subagent dễ hơn Opus 4.8. Nếu CLAUDE.md của bạn vẫn chứa các chỉ dẫn tối ưu cho mô hình cũ, hãy cập nhật nó trước khi bắt đầu.

Bài viết này tập trung vào các bước triển khai: chọn mô hình, điều chỉnh effort, sửa CLAUDE.md và kiểm thử API bằng Apidog. Để xem phân tích tổng quan, đọc tổng quan về Claude Opus 5thông báo Claude Opus 5 của Anthropic.

Những thay đổi theo cấp độ đăng ký

Việc truy cập Opus 5 khác nhau theo gói đăng ký.

Người dùng gói Max

Opus 5 là mô hình mặc định. Bạn không cần cấu hình thêm: mở phiên Claude Code và bắt đầu làm việc.

Hệ quả thực tế: các giả định cũ về chi phí, độ dài phản hồi và mức độ tự kiểm tra có thể không còn chính xác. Hãy kiểm tra lại CLAUDE.md trước khi chạy các tác vụ dài hoặc nhiều agent.

Claude Opus 5 trong giao diện Claude Code

Người dùng gói Pro

Opus 5 là mô hình hiệu suất cao nhất có sẵn trong gói Pro. Trước đây, cấp cao nhất của Pro thấp hơn một bậc so với cấp tiên tiến; giờ đây đây là mô hình được Anthropic khuyến nghị làm mặc định trong tài liệu của họ.

Người dùng khóa API

Opus 5 có sẵn qua Claude API, Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry và GitHub Copilot.

Giá API:

Loại token Giá
Đầu vào 5 USD / 1 triệu token
Đầu ra 25 USD / 1 triệu token

Mức giá này không đổi so với Opus 4.8 và bằng một nửa mức 10 USD/50 USD của Fable 5. Xem bảng phân tích giá Opus 5 để biết giá bộ nhớ đệm và giá theo lô.

Bảng giá Claude Opus 5

Opus 5 có thời điểm cắt dữ liệu đến tháng 5 năm 2026. Fable 5 và Sonnet 5 dừng ở tháng 1 năm 2026. Khi làm việc với thư viện hoặc API mới phát hành, năm tháng dữ liệu bổ sung có thể tạo khác biệt đáng kể.

Chọn Opus 5 trong Claude Code

Trong phiên Claude Code, mở bộ chọn mô hình:

/model
Enter fullscreen mode Exit fullscreen mode

Chọn Claude Opus 5 trong danh sách.

Hoặc đặt trực tiếp bằng ID mô hình:

/model claude-opus-5
Enter fullscreen mode Exit fullscreen mode

ID chính xác là:

claude-opus-5
Enter fullscreen mode Exit fullscreen mode

Không thêm hậu tố ngày tháng hoặc phiên bản. Dùng chuỗi này khi viết script, cấu hình mặc định dự án hoặc tạo quy tắc gọi mô hình.

Tài liệu tổng quan mô hình của Anthropic liệt kê ID theo từng nền tảng, gồm Bedrock và Google Cloud.

Opus 5 hỗ trợ ngữ cảnh mặc định và tối đa 1 triệu token, không cần tiêu đề beta và không có phí phụ trội cho ngữ cảnh dài. Đầu ra tối đa là 128k token trên Messages API.

Đừng xem 1 triệu token là lý do để gửi toàn bộ repository trong mọi lượt. Chỉ đưa vào ngữ cảnh các tệp, log và hợp đồng API liên quan đến tác vụ hiện tại. Xem thêm các lệnh hữu ích trong tài liệu tham khảo nhanh Claude Code.

Cách effort hoạt động

effort là tham số API output_config.effort, có năm mức:

low
medium
high
xhigh
max
Enter fullscreen mode Exit fullscreen mode

Các giao diện người dùng thường hiển thị chúng dưới dạng bộ chọn “nỗ lực”.

1. Mặc định là high

Nếu không chỉ định effort, Opus 5 dùng:

{
  "output_config": {
    "effort": "high"
  }
}
Enter fullscreen mode Exit fullscreen mode

Không phải medium và cũng không phải chế độ thích ứng không có mức sàn.

2. Không tái sử dụng nguyên trạng cấu hình Opus 4.8

Anthropic khuyến nghị đánh giá lại các mức effort trên workload của bạn. Trên Opus 5, lowmedium mạnh hơn đáng kể so với các mô hình Opus trước đó.

Quy trình thực tế:

  1. Chọn một tập tác vụ đại diện: sửa lỗi, tạo test, tái cấu trúc, xử lý API.
  2. Chạy cùng prompt với medium, highxhigh.
  3. So sánh kết quả, thời gian, số token và số lần cần sửa lại.
  4. Chỉ nâng lên xhigh khi chất lượng ở mức thấp hơn không đủ.

Đối với công việc lập trình và tác nhân, xhigh vẫn là điểm khởi đầu được Anthropic khuyến nghị.

3. Tránh lỗi 400 khi kết hợp thinkingeffort

Cấu hình sau sẽ trả về lỗi 400:

{
  "thinking": {
    "type": "disabled"
  },
  "output_config": {
    "effort": "xhigh"
  }
}
Enter fullscreen mode Exit fullscreen mode

Lỗi cũng xảy ra với effort: "max".

Cách xử lý:

  • Giữ thinking bật và dùng mức effort phù hợp; hoặc
  • Nếu bắt buộc tắt thinking, giới hạn efforthigh.

Claude Code tự quản lý hình dạng request trong phiên tương tác. Tuy nhiên, bạn có thể gặp lỗi này khi viết script hoặc gọi SDK trực tiếp.

Nên giữ thinking bật. Khi tắt nó, Opus 5 đôi lúc có thể:

  • Viết lời gọi công cụ dưới dạng văn bản thuần thay vì thực thi.
  • Làm rò rỉ văn bản đó vào các lượt tiếp theo trong vòng lặp agent.
  • Hiển thị các thẻ XML nội bộ trong đầu ra.

Kiểm soát chi phí bằng cách giảm effort, không phải bằng cách tắt thinking. Xem hướng dẫn tham số “nỗ lực”hướng dẫn di chuyển từ Opus 4.8 để biết thêm các thay đổi gây lỗi.

Bốn chỉnh sửa prompt cần làm ngay

Các thay đổi dưới đây dựa trên hướng dẫn prompting Opus 5 của Anthropic.

1. Xóa chỉ dẫn xác minh lặp lại

Nếu CLAUDE.md có các câu như:

  • “Luôn kiểm tra kỹ công việc.”
  • “Xác minh thay đổi trước khi báo cáo.”
  • “Xác nhận test đã đạt, sau đó xác nhận lại.”

Hãy xóa chúng.

Opus 5 đã được huấn luyện để tự xác minh. Việc nhắc lại có thể khiến mô hình:

  • Đọc lại tệp đã đọc.
  • Chạy lại test đã chạy.
  • Tốn token để xác nhận kết quả đã xác nhận.

Tìm trong cả CLAUDE.md của dự án và tệp toàn cục:

grep -inE "verify|double-check|confirm" CLAUDE.md
Enter fullscreen mode Exit fullscreen mode

Sau đó xóa các chỉ dẫn chỉ yêu cầu xác minh lặp lại. Vẫn giữ các yêu cầu kiểm thử cụ thể, ví dụ: “chạy npm test trước khi hoàn tất” hoặc “gọi endpoint staging và kiểm tra status code”.

2. Giới hạn số subagent

Opus 5 dễ ủy quyền cho subagent hơn Opus 4.8. Điều này hữu ích cho nghiên cứu hoặc tác vụ song song, nhưng có thể tăng chi phí nhanh.

Thêm giới hạn rõ ràng vào CLAUDE.md:

## Ủy quyền

Không tạo subagent cho các tác vụ mà một lượt chạy có thể hoàn thành.
Sử dụng tối đa hai subagent song song. Nếu một tác vụ có vẻ cần
nhiều hơn, hãy mô tả sự phân chia và hỏi trước khi tạo.
Enter fullscreen mode Exit fullscreen mode

Mục tiêu không phải là cấm subagent, mà là yêu cầu mô hình giải thích lý do trước khi mở rộng số lượng agent. Nếu đang xây dựng hệ thống đa agent có chủ đích, đọc hướng dẫn tạo subagent Claude Code.

3. Đặt giới hạn độ dài đầu ra trong prompt

Phản hồi và tài liệu do Opus 5 tạo có xu hướng dài hơn Opus 4.8.

Giảm effort không làm đầu ra ngắn hơn. effort kiểm soát độ sâu suy luận, không phải số từ trong phần văn bản hiển thị.

Thêm quy tắc phong cách:

## Phong cách phản hồi

Báo cáo kết quả dưới 150 từ trừ khi tôi yêu cầu chi tiết.
Không tóm tắt những gì bạn vừa làm nếu tôi có thể thấy sự khác biệt.
Bỏ qua lời mở đầu. Trả lời trực tiếp.
Enter fullscreen mode Exit fullscreen mode

Với các tác vụ sửa code, bạn cũng có thể dùng prompt hẹp hơn:

Chỉ trả về:
1. Các tệp đã thay đổi.
2. Lý do thay đổi trong tối đa 3 gạch đầu dòng.
3. Lệnh test đã chạy và kết quả.
Enter fullscreen mode Exit fullscreen mode

4. Đặt ranh giới rõ ràng cho tác vụ hẹp

Opus 5 có thể chủ động mở rộng phạm vi: bạn yêu cầu sửa một hàm, mô hình có thể quyết định tái cấu trúc cả module liên quan.

Nếu chỉ muốn thay đổi một điểm, hãy mô tả nó như ràng buộc:

Sửa kiểm tra null trong parseConfig.
Không thay đổi bất kỳ hàm, tệp, tên biến, dependency hoặc hành vi nào khác.
Nếu cần thay đổi ngoài phạm vi này, hãy dừng và hỏi trước.
Enter fullscreen mode Exit fullscreen mode

Câu này hiệu quả hơn prompt mơ hồ:

Sửa kiểm tra null trong parseConfig.
Enter fullscreen mode Exit fullscreen mode

Xem thêm các prompt có thể sao chép trong bài viết chuyên sâu về prompting Opus 5.

Xây dựng API, sau đó để Opus 5 kiểm tra nó

Claude Code có thể tạo route, controller và test cơ bản. Nhưng mô hình không tự biết endpoint đang chạy có tuân thủ hợp đồng API thực tế hay không.

Quy trình nên dùng:

  1. Thiết kế endpoint, request schema và response schema trong Apidog.
  2. Tạo mock server trả về dữ liệu giống thực tế.
  3. Cung cấp schema thực tế cho Opus 5 thông qua máy chủ Apidog MCP.
  4. Để Opus 5 triển khai API dựa trên hợp đồng đó.
  5. Chạy kịch bản kiểm thử sau khi triển khai.

Ví dụ chạy test scenario:

apidog run --access-token $APIDOG_TOKEN \
  --project-id $PROJECT_ID \
  --test-scenario "user-signup-flow"
Enter fullscreen mode Exit fullscreen mode

Khi assertion thất bại, đầu ra của CLI trở thành dữ liệu đầu vào để mô hình đọc, xác định nguyên nhân và sửa lại triển khai. Đây là xác minh dựa trên hệ thống bên ngoài, đáng tin cậy hơn việc chỉ để mô hình tự kiểm tra suy luận của mình.

Thiết lập này cũng hữu ích khi gọi Claude API trực tiếp từ ứng dụng. Bạn có thể dùng Apidog để:

  • Gửi request đến claude-opus-5.
  • Theo dõi sự kiện SSE khi stream.
  • Kiểm tra payload gọi công cụ.
  • Lưu API key dưới dạng biến môi trường.
  • Chạy cùng prompt ở nhiều mức effort.
  • Đọc khối usage để xác nhận cache hit.

Tải Apidog để thiết lập dự án cục bộ.

Giới hạn thực tế

Opus 5 không phải mô hình Claude cao nhất, và cần phân biệt rõ điều này trước khi cam kết workload.

Fable 5 vẫn giữ danh hiệu “mô hình có khả năng nhất được phát hành rộng rãi” của Anthropic. Opus 5 cũng kém Mythos 5 trong khai thác an ninh mạng và nghiên cứu sinh học tự động, theo tuyên bố của Anthropic.

Nếu công việc Claude Code thuộc các lĩnh vực này, Opus 5 có thể không phải giới hạn phù hợp. Đọc bài viết giải thích mô hình lớp Mythos để hiểu mục đích của cấp độ đó.

Về hiệu suất, Anthropic báo cáo rằng Opus 5:

  • Có điểm Frontier-Bench v0.1 cao gấp đôi Opus 4.8.
  • Đạt gần gấp 3 lần mô hình tốt nhất tiếp theo trên ARC-AGI 3.
  • Chỉ kém 0,5% so với đỉnh CursorBench 3.2 của Fable 5 với một nửa giá.

Đây là số liệu do nhà cung cấp tự công bố. Tính đến ngày 25 tháng 7 năm 2026, chưa có kết quả tái tạo độc lập. Hãy dùng chúng làm lý do để tự benchmark trên codebase và workload của bạn, không phải như kết quả đã được xác nhận.

Khi nào nên dùng mô hình khác

Dùng Opus 5 cho phần lớn tác vụ Claude Code:

  • Lập trình tác nhân.
  • Tái cấu trúc nhiều tệp.
  • Tác vụ dài hạn.
  • Công việc yêu cầu chạy lệnh, đọc output và lặp lại.

Chuyển mô hình khi:

  • Workload lớn và chi phí là ưu tiên: dùng Sonnet 5 cho chỉnh sửa tiêu chuẩn.
  • Bài toán thuộc phạm vi tiên tiến nhất của Fable 5 hoặc Mythos 5.

Chuyển đổi chỉ cần một lệnh:

/model claude-sonnet-5
Enter fullscreen mode Exit fullscreen mode

Dùng cho phần việc ít tốn kém hơn, sau đó quay lại Opus 5 cho phần khó:

/model claude-opus-5
Enter fullscreen mode Exit fullscreen mode

Nếu bạn đã dùng Sonnet 5 trong Claude Code hoặc Fable 5 trong Claude Code, workflow này sẽ quen thuộc.

Mẹo thực tế

  • Kiểm tra CLAUDE.md trước. Xóa chỉ dẫn xác minh lặp lại, thêm giới hạn độ dài và giới hạn ủy quyền.
  • Đánh giá lại effort. Thiết lập từ Opus 4.8 có thể không còn tối ưu; thử lại low, medium, highxhigh.
  • Giữ thinking bật. Kiểm soát chi phí bằng effort, không phải bằng cách tắt thinking.
  • Giới hạn ngữ cảnh. 1 triệu token là không gian làm việc lớn, không phải lý do để gửi toàn bộ repository trong mọi lượt.
  • Xác minh bên ngoài. Tự xác minh là hữu ích; test thất bại dựa trên hợp đồng API thực tế còn hữu ích hơn.

Câu hỏi thường gặp

Claude Opus 5 có sẵn trong Claude Code không?

Có. Kể từ khi ra mắt ngày 24 tháng 7 năm 2026, bạn có thể chọn Opus 5 bằng:

/model
Enter fullscreen mode Exit fullscreen mode

Hoặc đặt trực tiếp:

/model claude-opus-5
Enter fullscreen mode Exit fullscreen mode

Đây là mặc định cho người dùng Max và là mô hình hiệu suất cao nhất dành cho người dùng Pro.

Tôi có cần thay đổi tệp CLAUDE.md cho Opus 5 không?

Có thể. Anthropic khuyến nghị xóa các chỉ dẫn xác minh lặp lại vì Opus 5 đã tự xác minh công việc. Bạn cũng nên thêm:

  • Quy tắc súc tích cho phản hồi.
  • Giới hạn số subagent.
  • Ranh giới rõ ràng cho các tác vụ hẹp.

Tại sao giảm effort không làm phản hồi ngắn hơn?

effort kiểm soát độ sâu suy luận, không phải độ dài đầu ra hiển thị. Nếu muốn câu trả lời ngắn hơn, hãy đặt giới hạn trực tiếp trong prompt hoặc CLAUDE.md.

Điều gì gây lỗi 400 khi đặt effortxhigh?

Lỗi xảy ra khi kết hợp:

{
  "thinking": {
    "type": "disabled"
  },
  "output_config": {
    "effort": "xhigh"
  }
}
Enter fullscreen mode Exit fullscreen mode

Hoặc với effort: "max".

Cách khắc phục: bật thinking hoặc giới hạn efforthigh. Xem hướng dẫn di chuyển để biết thêm thay đổi gây lỗi từ Opus 4.8.

Tôi có thể dùng Opus 5 trong Claude Code với gói miễn phí không?

Opus 5 có sẵn cho gói Pro, Max và thông qua API. Gói Pro cung cấp quyền truy cập vào mô hình hàng đầu ở cấp đó, còn Max đặt Opus 5 làm mặc định. Xem hướng dẫn truy cập miễn phí Opus 5 để biết các lựa chọn hợp lý và các cách trả phí rẻ nhất.

Top comments (0)