yêu cầu. Bài viết này áp dụng đúng quy tắc đó: phân tích nơi Fable 5.1 vượt trội, nơi tối ưu lời nhắc có thể thu hẹp khoảng cách và khi chi phí đọc bộ nhớ đệm khiến Fable 5.1 có thể rẻ hơn.
Các nguồn tham khảo gồm bài đăng ra mắt của Anthropic, trang mô hình Fable 5.1 và trang giá. Để xem tổng quan, hãy đọc thêm Claude Fable 5.1 là gì và Claude Opus 5 là gì.
So sánh đối chiếu
| Thuộc tính | Claude Fable 5.1 | Claude Opus 5 |
|---|---|---|
| ID mô hình | claude-fable-5-1 |
claude-opus-5 |
| Ra mắt | 1 tháng 9 năm 2026 | 24 tháng 7 năm 2026 |
| Định vị | Công việc tác tử yêu cầu suy luận phức tạp và tầm nhìn dài hạn | Mã hóa tác tử phức tạp và công việc cấp doanh nghiệp; được khuyến nghị làm mặc định |
| Đầu vào / đầu ra | $10 / $50 | $5 / $25 |
| Đọc bộ nhớ đệm | $0.25 | $0.50 |
| Ghi bộ nhớ đệm (5 phút / 1 giờ) | $12.50 / $20 | $6.25 / $10 |
| Xử lý theo lô | $5 / $25 | $2.50 / $12.50 |
| Chế độ nhanh | Không | Có ($10 / $50) |
| Cấp độ ưu tiên | Không | Không |
| Ngữ cảnh / đầu ra tối đa | 1 triệu / 128 nghìn | 1 triệu / 128 nghìn (300 nghìn khi xử lý theo lô với bản beta) |
| Giới hạn kiến thức | Tháng 6 năm 2026 | Tháng 5 năm 2026 |
| Độ trễ tương đối | Chậm hơn | Trung bình |
| Tư duy | Luôn bật; disabled trả về lỗi 400 |
Bật mặc định; cho phép disabled ở mức high hoặc thấp hơn |
Buộc tool_choice |
Lỗi 400 | Chấp nhận |
| Bộ phân loại an toàn |
cyber, bio, frontier_llm, reasoning_extraction, general_harms
|
Chỉ cyber
|
| Không lưu giữ dữ liệu | Không khả dụng trừ khi được ủy quyền | Khả dụng |
| Nỗ lực theo từng tin nhắn (beta) | Có | Có |
| Kiểm tra chỉnh sửa lịch sử | Có | Không |
Các điểm chuẩn nói gì?
Tất cả số liệu dưới đây do Anthropic cung cấp và tự chạy; hiện chưa có tái hiện độc lập.
| Điểm chuẩn | Fable 5.1 | Opus 5 | Khoảng cách |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 29.0% | +23.6 |
| AutomationBench | 31.4% | 26.9% | +4.5 |
| Humanity’s Last Exam (không công cụ) | 60.9% | 56.6% | +4.3 |
| Terminal-Bench 4.0 | 55.8% | 52.3% | +3.5 |
| CursorBench 3.2.0 | 73.4% | 70.0% | +3.4 |
| OSWorld 2.0 (một phần) | 77.9% | 75.4% | +2.5 |
| OSWorld 2.0 (nghiêm ngặt) | 41.7% | 39.6% | +2.1 |
| Humanity’s Last Exam (có công cụ) | 65.0% | 63.6% | +1.4 |
| GDPval-AA v2 | 1853 | 1824 | +29 Elo |
Có thể đọc bảng theo hai hướng:
- Trên Terminal-Bench-Science, Fable 5.1 gần như gấp đôi Opus 5. Đây là điểm chuẩn nghiên cứu dài hạn, nặng về công cụ, trong đó mô hình thực hiện thí nghiệm bằng terminal trong thời gian dài.
- Ở các điểm chuẩn còn lại, khoảng cách chỉ từ 1 đến 5 điểm. Khoảng cách 4.5 điểm trên AutomationBench đáng kể; nhưng 1.4 điểm trên Humanity’s Last Exam có công cụ hoặc 29 Elo trên GDPval có thể bị ảnh hưởng nhiều hơn bởi lời nhắc và mức độ nỗ lực.
Opus 5 ra mắt vào tháng 7 với 52.3% trên Terminal-Bench 4.0, cao hơn Fable 5 với 42.0%. Fable 5.1 đã giành lại vị trí dẫn đầu ở mức 55.8%, nhưng khoảng cách hiện chỉ là 3.5 điểm, không phải 13.8 điểm. Lợi thế của dòng Fable trong mã hóa tác tử là có thật nhưng hẹp hơn so với tháng 6. Xem thêm So sánh Opus 5 vs Fable 5.
Chi phí không đơn giản chỉ gấp đôi
Khi đầu vào và đầu ra không được lưu vào bộ nhớ đệm, Fable 5.1 có giá chính xác gấp đôi Opus 5. Tuy nhiên, chi phí đọc bộ nhớ đệm lại thấp hơn một nửa: $0.25 trên Fable 5.1 so với $0.50 trên Opus 5. Vì vậy, hệ số chi phí thực tế phụ thuộc vào lượng prefix được lưu vào bộ nhớ đệm.
Ví dụ: tác tử nặng về prefix
Giả sử một lượt chạy có:
- 150.000 token được lưu vào bộ nhớ đệm
- 1.000 token đầu vào không được lưu vào bộ nhớ đệm
- 800 token đầu ra
Opus 5:
5(0.001) + 0.5(0.15) + 25(0.0008)
= $0.005 + $0.075 + $0.02
= $0.10
Fable 5.1:
10(0.001) + 0.25(0.15) + 50(0.0008)
= $0.01 + $0.0375 + $0.04
= $0.0875
Trong lượt này, Fable 5.1 rẻ hơn.
Ví dụ: đánh giá mã nặng về đầu vào mới
Với 30.000 token đầu vào không được lưu vào bộ nhớ đệm và 4.000 token đầu ra:
Opus 5: $0.15 + $0.10 = $0.25
Fable 5.1: $0.30 + $0.20 = $0.50
Chi phí của Fable 5.1 chính xác gấp đôi.
Điểm giao nhau
Chi phí mỗi lượt của Fable 5.1 thấp hơn Opus 5 khi:
- số token đầu vào được lưu vào bộ nhớ đệm lớn hơn khoảng 20 lần tổng số token đầu vào không được lưu vào bộ nhớ đệm; và
- lớn hơn khoảng 5 lần số token đầu ra.
Điều kiện này thường gặp trong các vòng lặp tác tử nặng về prefix, nhưng gần như không xảy ra với tác vụ nặng về đầu ra. Chi phí ghi bộ nhớ đệm của Fable 5.1 cũng gấp đôi, nên các phiên thường xuyên đặt lại bộ nhớ đệm sẽ mất lợi thế.
Xem bảng phân tích giá Fable 5.1 và bảng phân tích giá Opus 5 để biết đầy đủ các trường hợp.
Khi Opus 5 là lựa chọn rõ ràng
Tác vụ không cần tư duy
Opus 5 chấp nhận:
{"type": "disabled"}
ở mức độ nỗ lực high hoặc thấp hơn. Fable 5.1 không hỗ trợ tắt tư duy. Với phân loại, trích xuất và trả lời ngắn, Opus 5 khi tắt tư duy hoặc ở mức low vừa rẻ hơn vừa nhanh hơn.
Chế độ nhanh
Opus 5 có chế độ nhanh dùng cho nghiên cứu, với tốc độ đầu ra lên đến 2,5 lần và mức giá $10 / $50. Fable 5.1 không có tính năng tương đương. Nếu thời gian phản hồi quan trọng hơn vài điểm benchmark, đây có thể là yếu tố quyết định.
Độ trễ
Anthropic xếp độ trễ của Fable 5.1 là “chậm hơn”, còn Opus 5 là “trung bình”. Một lượt Fable 5.1 ở mức nỗ lực cao trên tác vụ khó có thể kéo dài nhiều phút.
Không lưu giữ dữ liệu
Opus 5 hỗ trợ ZDR (Zero Data Retention). Fable 5.1 là mô hình được quy định và trả về lỗi 400, trừ khi Anthropic cấp quyền ZDR rõ ràng.
Ít từ chối hơn
Opus 5 chỉ chạy bộ phân loại an ninh mạng. Fable 5.1 chạy toàn bộ bộ phân loại Fable:
- An ninh mạng
- Sinh học
- Phát triển LLM tiên tiến
- Trích xuất suy luận
- Các mối nguy hại chung
Một tác vụ khoa học đời sống hoặc machine learning lành tính có thể không bị Opus 5 chặn nhưng lại bị Fable 5.1 từ chối. Trong trường hợp đó, Opus 5 là mục tiêu dự phòng phù hợp.
Buộc sử dụng công cụ
Opus 5 chấp nhận tool_choice: any và tool. Fable 5.1 trả về lỗi 400. Nếu tích hợp đang phụ thuộc vào các cuộc gọi công cụ bắt buộc, Opus 5 tránh được việc phải viết lại.
Chỉnh sửa lịch sử
Opus 5 không gặp vấn đề khi các lượt trước đó bị chỉnh sửa. Fable 5.1 vô hiệu hóa các khối tư duy sau đó khi lịch sử bị thay đổi. Vì vậy, mọi framework kiểm thử nén phía máy khách hoặc chèn lại lời nhắc theo từng lượt cần được kiểm tra trước khi chuyển sang Fable 5.1.
Khi Fable 5.1 vượt trội
Nghiên cứu dài hạn và tác tử terminal
Khoảng cách 52.6% so với 29.0% trên Terminal-Bench-Science là lớn nhất trong các benchmark của Anthropic. Nếu tác tử phải chạy thí nghiệm, nghiên cứu web nhiều bước hoặc hoạt động trong nhiều giờ, đây là nhóm tác vụ Fable 5.1 được thiết kế để xử lý.
Tự động hóa quy trình kinh doanh
Fable 5.1 đạt 31.4% so với 26.9% của Opus 5 trên AutomationBench, một điểm chuẩn mô phỏng tác vụ đầu cuối trên các ứng dụng kinh doanh.
Tác tử nặng về prefix được lưu vào bộ nhớ đệm
Chi phí đọc bộ nhớ đệm $0.25 có thể khiến Fable 5.1 rẻ hơn mỗi lượt trong các vòng lặp mà phần prefix chiếm ưu thế.
Giới hạn kiến thức mới hơn
Fable 5.1 có giới hạn kiến thức tháng 6 năm 2026, mới hơn một tháng so với Opus 5. Đây là phiên bản Claude mới nhất tại thời điểm bài viết.
Thị giác trên tài liệu dày đặc
Anthropic cho biết Fable 5.1 cải thiện khả năng đọc biểu đồ, hồ sơ và bảng lồng trong PDF, đặc biệt khi kết hợp công cụ cắt và phóng to. Opus 5 chưa được so sánh trên benchmark thị giác công khai, nên hãy xem đây là tuyên bố cần tự kiểm chứng.
Khi Opus 5 ở mức xhigh thất bại
Đây là quy tắc lựa chọn của Anthropic và là điểm bắt đầu hợp lý: nếu tác vụ thất bại trong đánh giá của bạn trên Opus 5 ở mức xhigh, hãy thử Fable 5.1 ở mức high trước khi thay đổi chiến lược khác.
Mức độ nỗ lực thay đổi kết quả so sánh
Cả hai mô hình đều có năm cấp độ nỗ lực. Anthropic mô tả Fable 5.1 ở mức low là thường cạnh tranh với Claude Opus và Claude Sonnet về chi phí mỗi tác vụ, đồng thời đạt điểm cao hơn.
Vì vậy, so sánh thực tế không nhất thiết là Opus 5 high với Fable 5.1 high. Với công việc thường ngày, hãy thử Opus 5 ở high và Fable 5.1 ở low hoặc medium. Số token đầu ra thấp hơn có thể bù đắp cho mức giá mỗi token cao gấp đôi.
Ở chiều ngược lại, lợi ích của Fable 5.1 so với Fable 5 lớn nhất ở xhigh và max. Điều đó có nghĩa là giới hạn khả năng của Opus 5 thường chỉ lộ rõ ở các cấp độ nỗ lực tốn nhiều thời gian nhất. Hãy chạy đánh giá riêng trên nhiều cấp độ trước khi kết luận từ bảng benchmark ra mắt.
Xem thêm hướng dẫn về tham số nỗ lực của Opus 5.
Khung quyết định đề xuất
-
Bắt đầu với Opus 5 ở mức
high. Đây là khuyến nghị mặc định của Anthropic; giá bằng một nửa, có ít bộ phân loại hơn và hỗ trợ ZDR. -
Nâng Opus 5 lên
xhighcho các tác vụ thất bại. Cách này thường rẻ hơn chuyển mô hình ngay lập tức. -
Chuyển từng tác vụ vẫn thất bại sang Fable 5.1 ở mức
high. Không cần chuyển toàn bộ hệ thống. - Kiểm tra hồ sơ bộ nhớ đệm của các tác vụ đã chuyển. Với vòng lặp nặng về prefix, Fable 5.1 có thể rẻ hơn mỗi lượt.
-
Kiểm tra framework kiểm thử trước khi chuyển đổi.
tool_choicebắt buộc và chỉnh sửa lịch sử không hoạt động trên Fable 5.1. Xem thêm hướng dẫn di chuyển.
Chạy so sánh trong Apidog
Tạo một collection với lời nhắc production và model dưới dạng biến môi trường. Chạy cùng một bộ kiểm thử theo thứ tự:
-
claude-opus-5ở mứchigh -
claude-opus-5ở mứcxhigh -
claude-fable-5-1ở mứchigh -
claude-fable-5-1ở mứclow
Với mỗi lần chạy:
- Lưu câu trả lời.
- Ghi lại
usage.output_tokens. - Ghi lại
usage.cache_read_input_tokens. - Tính chi phí theo tỷ lệ của từng mô hình.
- So sánh chi phí mỗi tác vụ theo model và mức độ nỗ lực.
Apidog lưu toàn bộ lần chạy trong lịch sử, giúp bạn duy trì benchmark qua các lần phát hành mô hình tiếp theo. Tải Apidog để bắt đầu.
Câu hỏi thường gặp
Claude Fable 5.1 có tốt hơn Opus 5 không?
Trên mọi benchmark Anthropic đã công bố, có. Khoảng cách dao động từ 1.4 đến 23.6 điểm. Khoảng cách lớn nhất nằm ở Terminal-Bench-Science; hầu hết các benchmark còn lại có khoảng cách dưới 5 điểm. Đây là kết quả do nhà cung cấp tự chạy.
Fable 5.1 có đáng giá gấp đôi Opus 5 không?
Với nghiên cứu dài hạn, tác tử terminal, tự động hóa kinh doanh và vòng lặp nặng về prefix, thường là có. Chi phí đọc bộ nhớ đệm thấp hơn thậm chí có thể khiến Fable 5.1 rẻ hơn mỗi lượt. Với tác vụ nặng về đầu ra, nhạy cảm với độ trễ hoặc thiên về phân loại, thường là không.
Quy tắc của Anthropic là chỉ nâng cấp khi Opus 5 ở mức độ nỗ lực cao hơn vẫn thất bại trong đánh giá của bạn.
Mô hình nào nhanh hơn?
Opus 5. Anthropic xếp Opus 5 ở mức độ trễ “trung bình”, so với “chậm hơn” của Fable 5.1. Opus 5 cũng có chế độ nhanh với tốc độ đầu ra lên đến 2,5 lần; Fable 5.1 không có.
Opus 5 có các bộ phân loại an toàn giống Fable 5.1 không?
Không. Opus 5 chỉ chạy bộ phân loại an ninh mạng. Fable 5.1 bổ sung các bộ phân loại sinh học, LLM tiên tiến, trích xuất suy luận và mối nguy hại chung. Khi Fable 5.1 từ chối, Opus 5 là một trong các mục tiêu dự phòng được phép.
Có thể dùng Fable 5.1 với ZDR như Opus 5 không?
Không. Fable 5.1 yêu cầu lưu giữ dữ liệu 30 ngày và là một mô hình được quy định. Opus 5 có sẵn theo chính sách ZDR.
Một cuộc trò chuyện có thể chuyển đổi giữa hai mô hình không?
Có thể chuyển lên Fable 5.1: mô hình này đọc được các khối tư duy của Opus 5.
Khi chuyển xuống Opus 5, API loại bỏ các khối tư duy của Fable 5.1 trước khi Opus 5 nhìn thấy chúng và không tính phí phần đó. Opus 5 sẽ lập kế hoạch lại cho lượt tiếp theo.

Top comments (0)