Anthropic ra mắt Claude Opus 5 vào ngày 24 tháng 7 năm 2026. Câu hỏi thực tế cho các nhóm kỹ thuật là: nếu Opus 5 tiệm cận Fable 5 với nửa giá, khi nào vẫn nên trả tiền cho Fable 5?
Các mức giá rất rõ ràng:
- Claude Opus 5: 5 USD / 1 triệu token đầu vào, 25 USD / 1 triệu token đầu ra.
- Claude Fable 5: 10 USD / 1 triệu token đầu vào, 50 USD / 1 triệu token đầu ra.
Anthropic tuyên bố Opus 5 đạt trong vòng 0,5% hiệu suất đỉnh của Fable 5 trên CursorBench 3.2 và vượt Fable 5 trên OSWorld 2.0 với một phần ba chi phí.
Để kiểm chứng trên workload của mình, hãy gửi cùng một prompt đến cả hai model ID bằng Apidog, sau đó so sánh đầu ra, độ trễ và token usage.
Tổng quan hai mô hình
| Claude Opus 5 | Claude Fable 5 | |
|---|---|---|
| ID mô hình API | claude-opus-5 |
claude-fable-5 |
| Giá đầu vào | $5 / MTok | $10 / MTok |
| Giá đầu ra | $25 / MTok | $50 / MTok |
| Cửa sổ ngữ cảnh | 1M token, mặc định và tối đa | 1M token |
| Đầu ra tối đa | 128k, 300k trên Batch với beta header | 128k |
| Giới hạn kiến thức | Tháng 5 năm 2026 | Tháng 1 năm 2026 |
| Định vị | Mặc định được Anthropic khuyến nghị | Mô hình mạnh nhất được phát hành rộng rãi |
| Tư duy | Thích ứng, bật mặc định, điều khiển qua mức nỗ lực | Luôn bật |
| Ra mắt | 24 tháng 7 năm 2026 | Đầu tháng 6 năm 2026 |
Có hai điểm cần kiểm tra trước khi chọn model.
1. Opus 5 có giới hạn kiến thức mới hơn
Opus 5 có giới hạn kiến thức đến tháng 5 năm 2026, trong khi Fable 5 dừng ở tháng 1 năm 2026.
Nếu ứng dụng của bạn phụ thuộc vào thư viện, framework hoặc API thay đổi nhanh, chênh lệch bốn tháng này có thể quan trọng hơn chênh lệch benchmark. Opus 5 vừa rẻ hơn, vừa có dữ liệu huấn luyện mới hơn.
2. Fable 5 vẫn giữ định vị “mạnh nhất”
Anthropic vẫn mô tả Fable 5 là mô hình mạnh nhất được phát hành rộng rãi. Opus 5 là model mặc định được khuyến nghị khi bạn chưa chắc nên dùng model nào.
Đây là hai tuyên bố khác nhau:
- Chọn Opus 5 cho phần lớn workload production.
- Chọn Fable 5 khi tác vụ nằm gần giới hạn khả năng và chi phí của một lần chạy lỗi cao.
Xem thêm:
Những gì Anthropic thực sự tuyên bố
| Thử nghiệm hiệu năng | Tuyên bố của Anthropic về Opus 5 |
|---|---|
| CursorBench 3.2 | Trong vòng 0,5% hiệu suất đỉnh của Fable 5, với nửa giá |
| OSWorld 2.0 | Vượt Fable 5 với một phần ba chi phí |
| Frontier-Bench v0.1 | Vượt tất cả model khác; hơn gấp đôi điểm Opus 4.8 |
| ARC-AGI 3 | Khoảng gấp 3 lần model tốt thứ hai |
| Zapier AutomationBench | Tỷ lệ vượt qua khoảng 1,5 lần model tốt thứ hai |
| Hóa hữu cơ | +10,2 điểm so với Opus 4.8 |
| Phân tích protein | +7,7 điểm so với Opus 4.8 |
Điểm cần lưu ý: toàn bộ các con số trên đều là benchmark do nhà cung cấp tự chạy.
Tính đến ngày 25 tháng 7 năm 2026, các kết quả này chưa được tái tạo độc lập. Điều đó không đồng nghĩa các số liệu sai, nhưng bạn không nên dùng chúng làm tiêu chí duy nhất cho quyết định migration.
Diễn giải thực tế:
- CursorBench 3.2: Fable 5 vẫn giữ mức đỉnh, Opus 5 rất gần.
- OSWorld 2.0: Opus 5 được Anthropic tuyên bố là tốt hơn cho tác vụ dùng máy tính.
- Benchmark khác: cho biết năng lực tổng quát, nhưng không thay thế được eval suite của chính bạn.
Xem phân tích chi tiết:
Lợi thế của Opus 5
Giảm cố định 50% chi phí token
Với cùng lượng token:
- Workload tốn 3.000 USD/tháng trên Fable 5 sẽ tốn khoảng 1.500 USD/tháng trên Opus 5.
- Không có ngưỡng cam kết hoặc tier giá được nêu ra làm giảm chênh lệch này.
Đây là lợi thế rõ nhất khi bạn chạy agent coding, xử lý tài liệu, chatbot hoặc workflow tự động hóa ở quy mô lớn.
Có thể kết hợp thêm Batch và prompt caching
Opus 5 có các đòn bẩy chi phí bổ sung:
- API Batch: 2,50 USD / 12,50 USD cho 1 triệu token input/output.
- Cache read và cache refresh: 0,50 USD / 1 triệu token.
- Prompt cache tối thiểu: 512 token, giảm từ 1.024 token trên Opus 4.8.
- Overhead system prompt khi dùng tool thấp hơn: 286 token khi
tool_choicelàautohoặcnone.
Điều này đặc biệt hữu ích cho agent có system prompt dài, tool definitions và lịch sử hội thoại lớn.
Xem thêm:
Điều chỉnh chi phí bằng output_config.effort
Opus 5 cho phép kiểm soát mức suy luận qua output_config.effort.
{
"model": "claude-opus-5",
"max_tokens": 8192,
"output_config": {
"effort": "high"
}
}
Các mức phù hợp theo loại tác vụ:
| Tác vụ | Mức effort nên thử |
|---|---|
| Phân loại, trích xuất, routing | low |
| Viết mã thông thường, phân tích tài liệu | medium |
| Refactor phức tạp, agent coding | high |
| Bài toán suy luận khó, nhiều bước | xhigh |
Thay vì dùng một mức chi phí cố định cho mọi request, bạn có thể route workload theo mức effort.
Xem hướng dẫn về tham số effort.
Là model mới hơn và là default được khuyến nghị
Opus 5 có dữ liệu mới hơn bốn tháng và được cung cấp trên Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform trên AWS, Google Cloud, Microsoft Foundry và GitHub Copilot.
Tổng quan model của Anthropic khuyến nghị bắt đầu với Opus 5 nếu bạn chưa chắc nên chọn model nào.
Lợi thế của Fable 5
Vẫn là model mạnh nhất được phát hành rộng rãi
Anthropic đã không trao danh hiệu này cho Opus 5 khi ra mắt. Đây là tín hiệu quan trọng nếu bạn đang xử lý:
- Tác vụ suy luận khó, ít request nhưng chi phí lỗi cao.
- Quy trình tự chủ dài hạn.
- Bài toán mà kết quả sai gây tốn kém hơn nhiều so với phí API.
Tham khảo thông báo ra mắt Claude Fable 5.
Tư duy luôn bật, ít biến số vận hành hơn
Fable 5 suy nghĩ trong mọi request. Opus 5 cho phép tắt tư duy, nhưng điều này tạo thêm bề mặt lỗi.
Ví dụ, khi tắt thinking trên Opus 5:
- Tool call đôi khi có thể xuất hiện dưới dạng văn bản thay vì được thực thi.
- Văn bản tool call bị rò rỉ có thể ảnh hưởng các lượt tiếp theo trong agent loop.
- Thẻ XML nội bộ đôi khi có thể xuất hiện trong output hiển thị.
Anthropic khuyến nghị giữ thinking bật và giảm chi phí bằng mức effort thấp hơn.
Ngoài ra, cấu hình sau trên Opus 5 sẽ trả về lỗi 400:
{
"thinking": {
"type": "disabled"
},
"output_config": {
"effort": "xhigh"
}
}
Tương tự với effort: "max".
Chi phí migration có thể lớn hơn khoản tiết kiệm
Nếu workflow của bạn đã ổn định trên Fable 5, hãy tính cả:
- Thời gian cập nhật prompt.
- Việc xây lại eval suite.
- Điều chỉnh
max_tokens. - Điều chỉnh effort.
- Kiểm tra tool calling và agent behavior.
- Thay đổi mô hình chi phí do độ dài output mặc định khác nhau.
“Nửa giá” là giá mỗi token, không phải chi phí migration bằng 0.
Xem thêm:
Khoảng cách giá trong một request thực tế
Giả sử một tác vụ agent coding sử dụng:
- 200.000 token đầu vào.
- 20.000 token đầu ra.
| Opus 5 | Fable 5 | |
|---|---|---|
| Input, 200k token | $1,00 | $2,00 |
| Output, 20k token | $0,50 | $1,00 |
| Mỗi tác vụ | $1,50 | $3,00 |
| 500 tác vụ/tháng | $750 | $1.500 |
| 5.000 tác vụ/tháng | $7.500 | $15.000 |
Ở 500 tác vụ/tháng, chênh lệch là 750 USD/tháng. Nếu Fable 5 tránh được một lần chạy lỗi đắt tiền, mức chênh này có thể hợp lý.
Ở 5.000 tác vụ/tháng, chênh lệch lên đến 90.000 USD/năm. Khi đó, bạn cần bằng chứng rõ ràng rằng Fable 5 tốt hơn trên workload thực tế của bạn.
Một lưu ý khác: chế độ nhanh của Opus 5 có giá 10 USD / 50 USD, bằng mức giá cơ bản của Fable 5. Nếu độ trễ là nút thắt chính, Opus 5 nhanh có thể phù hợp hơn Fable 5 chậm hơn.
Nếu dùng inference_geo: "us", mọi loại token của Opus 5 tăng thêm hệ số 1,1x.
Khung quyết định theo workload
| Khối lượng công việc | Chọn | Lý do |
|---|---|---|
| Agent coding, khối lượng lớn | Opus 5 | Anthropic báo cáo gần Fable 5 trên CursorBench với nửa giá |
| Browser automation, computer use | Opus 5 | Anthropic tuyên bố Opus 5 vượt Fable 5 trên OSWorld 2.0 |
| Công việc dùng thư viện thay đổi sau tháng 1 năm 2026 | Opus 5 | Giới hạn kiến thức tháng 5 năm 2026 |
| Production traffic nhạy cảm chi phí | Opus 5 | Nửa giá, có Batch, caching và effort routing |
| Tác vụ suy luận rủi ro cao, số lượng thấp | Fable 5 | Vẫn được định vị là model mạnh nhất phát hành rộng rãi |
| Phiên tự chủ dài, lỗi giữa chừng tốn kém | Fable 5 | Thinking luôn bật, ít cấu hình gây lỗi hơn |
| Đã ổn định trên Fable 5, traffic thấp | Fable 5 | Migration cost có thể lớn hơn khoản tiết kiệm |
| Khai thác an ninh mạng hoặc nghiên cứu sinh học tự chủ | Không model nào | Cả hai đều kém Mythos 5 trong các lĩnh vực này |
Tóm lại:
Opus 5 thắng về kinh tế thông lượng; Fable 5 thắng về rủi ro đuôi.
Chạy so sánh trên workload của riêng bạn
Đừng chỉ so sánh benchmark công khai. Hãy xây một eval nhỏ từ prompt, tài liệu, tool call và tiêu chí chấm điểm đang phản ánh production của bạn.
Cả hai model dùng cùng Messages API endpoint. Bắt đầu với Opus 5:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"output_config": {"effort": "high"},
"messages": [
{
"role": "user",
"content": "Refactor this handler and explain the tradeoffs."
}
]
}'
Sau đó chỉ thay model ID:
{
"model": "claude-fable-5"
}
Checklist so sánh thực tế
Thiết lập hai environment trong Apidog và thực hiện các bước sau:
- Lưu API key trong environment variable, không đưa key vào request body.
- Tạo biến
model_idcho từng environment:claude-opus-5claude-fable-5
- Dùng cùng request, cùng prompt, cùng
max_tokensvà cùng tool definitions. - Chạy test case trên cả hai environment.
- Ghi nhận các trường
usagetrong response:- Input tokens
- Output tokens
- Cache read tokens
- Cache creation hoặc refresh tokens
- So sánh chất lượng đầu ra bằng rubric cụ thể thay vì đánh giá cảm tính.
- Nếu dùng agent, kiểm tra raw SSE events và tool-call payload:
- Model có gọi tool đúng không?
- Tool call có bị in ra dưới dạng text không?
- Agent có bị lặp, bỏ bước hoặc kết thúc quá sớm không?
- Với Opus 5, lặp lại test ở
low,medium,highvàxhigh.
Bước cuối thường là bước tạo ra quyết định tiết kiệm thực sự: có thể Opus 5 ở medium hoặc high đã đạt chất lượng tương đương Fable 5 cho workload của bạn.
Bạn có thể tải Apidog để quản lý environment và chạy request so sánh. Xem thêm hướng dẫn API Claude Opus 5 và trang giá chính thức của Anthropic.
Giới hạn cần nói rõ
Không model nào trong so sánh này là đỉnh cao tuyệt đối trong danh mục Anthropic.
- Fable 5 vẫn là model mạnh nhất được phát hành rộng rãi theo định vị của Anthropic.
- Opus 5 chưa thay thế danh hiệu đó.
- Anthropic tuyên bố Opus 5 vẫn kém Mythos 5 về:
- Khai thác an ninh mạng
- Nghiên cứu sinh học tự chủ
Mythos 5 là phiên bản không bộ phân loại được phát hành cùng Fable 5 trong chương trình giới hạn, không phải lựa chọn sẵn có cho đa số nhóm.
Xem so sánh Fable 5 và Mythos 5 để biết điều kiện tiếp cận.
Mô tả chính xác về Opus 5 là:
Năng lực cấp tiên phong với nửa giá của model tiên phong, nhưng vẫn có một model được đặt tên là mạnh hơn trong một số giới hạn cụ thể.
Câu hỏi thường gặp
Claude Opus 5 có tốt hơn Fable 5 không?
Theo benchmark do Anthropic công bố, Opus 5 vượt Fable 5 trên OSWorld 2.0 và gần bằng hiệu suất đỉnh Fable 5 trên CursorBench 3.2 với chi phí thấp hơn. Tuy nhiên, các số liệu này chưa được tái tạo độc lập tính đến ngày 25 tháng 7 năm 2026. Anthropic vẫn định vị Fable 5 là model mạnh nhất được phát hành rộng rãi.
Opus 5 rẻ hơn Fable 5 bao nhiêu?
Chính xác một nửa ở cả input lẫn output:
- Opus 5: 5 USD / 25 USD cho mỗi triệu token input/output.
- Fable 5: 10 USD / 50 USD cho mỗi triệu token input/output.
Batch API của Opus 5 có giá 2,50 USD / 12,50 USD, phù hợp cho workload không cần phản hồi ngay.
Model nào có giới hạn kiến thức mới hơn?
Opus 5. Giới hạn kiến thức của Opus 5 là tháng 5 năm 2026; Fable 5 là tháng 1 năm 2026.
Có nên migrate từ Fable 5 sang Opus 5 không?
Hãy bắt đầu bằng volume:
- Dưới vài trăm tác vụ khó mỗi tháng: khoản tiết kiệm thường chưa đủ lớn để biện minh cho migration.
- Trên vài nghìn tác vụ mỗi tháng: khoản tiết kiệm có thể đáng kể, nhưng chỉ nên migrate sau khi eval suite xác nhận chất lượng vẫn đạt yêu cầu.
Model ID của mỗi loại là gì?
- Opus 5:
claude-opus-5 - Fable 5:
claude-fable-5
Trên Amazon Bedrock, Opus 5 là anthropic.claude-opus-5.
Opus 5 có tính năng nào Fable 5 không có?
Opus 5 cung cấp:
-
output_config.effortvới các mức effort được hiệu chỉnh lại. - Hỗ trợ system message giữa cuộc trò chuyện.
- Chế độ nhanh ở mức giá 10 USD / 50 USD.
- Prompt caching cho prompt ngắn từ 512 token.
Theo chiều ngược lại, Priority Tier không được hỗ trợ trên Opus 5, trong khi Opus 4.8 vẫn có.
Câu trả lời ngắn gọn
Với đa số nhóm, Opus 5 là lựa chọn mặc định vì lợi ích chính nằm ở quy mô: nửa chi phí trên hàng nghìn tác vụ mỗi tháng trở thành một khoản ngân sách đáng kể.
Chọn Opus 5 khi bạn cần:
- Agent coding hoặc automation ở volume lớn.
- Computer use và browser automation.
- Kiến thức mới hơn.
- Kiểm soát chi phí bằng Batch, caching và effort routing.
Giữ Fable 5 khi:
- Tác vụ ở sát giới hạn năng lực.
- Một lần chạy lỗi có chi phí cao hơn phần chênh lệch API.
- Workflow hiện tại đã ổn định và volume chưa đủ lớn để bù migration cost.
Cuối cùng, benchmark của nhà cung cấp chỉ là điểm khởi đầu. Quyết định đúng phải đến từ eval suite, dữ liệu usage và tiêu chí chất lượng của chính bạn.

Top comments (0)