DEV Community

Cover image for So sánh Claude Fable 5.1 và Opus 5: Khi nào giá gấp đôi thực sự đáng tiền?
Sebastian Petrus
Sebastian Petrus

Posted on Originally published at apidog.com

So sánh Claude Fable 5.1 và Opus 5: Khi nào giá gấp đôi thực sự đáng tiền?

yêu cầu. Bài viết này áp dụng đúng quy tắc đó: phân tích nơi Fable 5.1 vượt trội, nơi tối ưu lời nhắc có thể thu hẹp khoảng cách và khi chi phí đọc bộ nhớ đệm khiến Fable 5.1 có thể rẻ hơn.

Thử Apidog ngay hôm nay

So sánh Claude Fable 5.1 và Claude Opus 5

Các nguồn tham khảo gồm bài đăng ra mắt của Anthropic, trang mô hình Fable 5.1trang giá. Để xem tổng quan, hãy đọc thêm Claude Fable 5.1 là gìClaude Opus 5 là gì.

So sánh đối chiếu

Thuộc tính Claude Fable 5.1 Claude Opus 5
ID mô hình claude-fable-5-1 claude-opus-5
Ra mắt 1 tháng 9 năm 2026 24 tháng 7 năm 2026
Định vị Công việc tác tử yêu cầu suy luận phức tạp và tầm nhìn dài hạn Mã hóa tác tử phức tạp và công việc cấp doanh nghiệp; được khuyến nghị làm mặc định
Đầu vào / đầu ra $10 / $50 $5 / $25
Đọc bộ nhớ đệm $0.25 $0.50
Ghi bộ nhớ đệm (5 phút / 1 giờ) $12.50 / $20 $6.25 / $10
Xử lý theo lô $5 / $25 $2.50 / $12.50
Chế độ nhanh Không Có ($10 / $50)
Cấp độ ưu tiên Không Không
Ngữ cảnh / đầu ra tối đa 1 triệu / 128 nghìn 1 triệu / 128 nghìn (300 nghìn khi xử lý theo lô với bản beta)
Giới hạn kiến thức Tháng 6 năm 2026 Tháng 5 năm 2026
Độ trễ tương đối Chậm hơn Trung bình
Tư duy Luôn bật; disabled trả về lỗi 400 Bật mặc định; cho phép disabled ở mức high hoặc thấp hơn
Buộc tool_choice Lỗi 400 Chấp nhận
Bộ phân loại an toàn cyber, bio, frontier_llm, reasoning_extraction, general_harms Chỉ cyber
Không lưu giữ dữ liệu Không khả dụng trừ khi được ủy quyền Khả dụng
Nỗ lực theo từng tin nhắn (beta)
Kiểm tra chỉnh sửa lịch sử Không

Các điểm chuẩn nói gì?

Tất cả số liệu dưới đây do Anthropic cung cấp và tự chạy; hiện chưa có tái hiện độc lập.

Điểm chuẩn Fable 5.1 Opus 5 Khoảng cách
Terminal-Bench-Science 0.1 52.6% 29.0% +23.6
AutomationBench 31.4% 26.9% +4.5
Humanity’s Last Exam (không công cụ) 60.9% 56.6% +4.3
Terminal-Bench 4.0 55.8% 52.3% +3.5
CursorBench 3.2.0 73.4% 70.0% +3.4
OSWorld 2.0 (một phần) 77.9% 75.4% +2.5
OSWorld 2.0 (nghiêm ngặt) 41.7% 39.6% +2.1
Humanity’s Last Exam (có công cụ) 65.0% 63.6% +1.4
GDPval-AA v2 1853 1824 +29 Elo

Có thể đọc bảng theo hai hướng:

  • Trên Terminal-Bench-Science, Fable 5.1 gần như gấp đôi Opus 5. Đây là điểm chuẩn nghiên cứu dài hạn, nặng về công cụ, trong đó mô hình thực hiện thí nghiệm bằng terminal trong thời gian dài.
  • Ở các điểm chuẩn còn lại, khoảng cách chỉ từ 1 đến 5 điểm. Khoảng cách 4.5 điểm trên AutomationBench đáng kể; nhưng 1.4 điểm trên Humanity’s Last Exam có công cụ hoặc 29 Elo trên GDPval có thể bị ảnh hưởng nhiều hơn bởi lời nhắc và mức độ nỗ lực.

Opus 5 ra mắt vào tháng 7 với 52.3% trên Terminal-Bench 4.0, cao hơn Fable 5 với 42.0%. Fable 5.1 đã giành lại vị trí dẫn đầu ở mức 55.8%, nhưng khoảng cách hiện chỉ là 3.5 điểm, không phải 13.8 điểm. Lợi thế của dòng Fable trong mã hóa tác tử là có thật nhưng hẹp hơn so với tháng 6. Xem thêm So sánh Opus 5 vs Fable 5.

Chi phí không đơn giản chỉ gấp đôi

Khi đầu vào và đầu ra không được lưu vào bộ nhớ đệm, Fable 5.1 có giá chính xác gấp đôi Opus 5. Tuy nhiên, chi phí đọc bộ nhớ đệm lại thấp hơn một nửa: $0.25 trên Fable 5.1 so với $0.50 trên Opus 5. Vì vậy, hệ số chi phí thực tế phụ thuộc vào lượng prefix được lưu vào bộ nhớ đệm.

Ví dụ: tác tử nặng về prefix

Giả sử một lượt chạy có:

  • 150.000 token được lưu vào bộ nhớ đệm
  • 1.000 token đầu vào không được lưu vào bộ nhớ đệm
  • 800 token đầu ra
Opus 5:
5(0.001) + 0.5(0.15) + 25(0.0008)
= $0.005 + $0.075 + $0.02
= $0.10

Fable 5.1:
10(0.001) + 0.25(0.15) + 50(0.0008)
= $0.01 + $0.0375 + $0.04
= $0.0875
Enter fullscreen mode Exit fullscreen mode

Trong lượt này, Fable 5.1 rẻ hơn.

Ví dụ: đánh giá mã nặng về đầu vào mới

Với 30.000 token đầu vào không được lưu vào bộ nhớ đệm và 4.000 token đầu ra:

Opus 5:    $0.15 + $0.10 = $0.25
Fable 5.1: $0.30 + $0.20 = $0.50
Enter fullscreen mode Exit fullscreen mode

Chi phí của Fable 5.1 chính xác gấp đôi.

Điểm giao nhau

Chi phí mỗi lượt của Fable 5.1 thấp hơn Opus 5 khi:

  • số token đầu vào được lưu vào bộ nhớ đệm lớn hơn khoảng 20 lần tổng số token đầu vào không được lưu vào bộ nhớ đệm; và
  • lớn hơn khoảng 5 lần số token đầu ra.

Điều kiện này thường gặp trong các vòng lặp tác tử nặng về prefix, nhưng gần như không xảy ra với tác vụ nặng về đầu ra. Chi phí ghi bộ nhớ đệm của Fable 5.1 cũng gấp đôi, nên các phiên thường xuyên đặt lại bộ nhớ đệm sẽ mất lợi thế.

Xem bảng phân tích giá Fable 5.1bảng phân tích giá Opus 5 để biết đầy đủ các trường hợp.

Khi Opus 5 là lựa chọn rõ ràng

Tác vụ không cần tư duy

Opus 5 chấp nhận:

{"type": "disabled"}
Enter fullscreen mode Exit fullscreen mode

ở mức độ nỗ lực high hoặc thấp hơn. Fable 5.1 không hỗ trợ tắt tư duy. Với phân loại, trích xuất và trả lời ngắn, Opus 5 khi tắt tư duy hoặc ở mức low vừa rẻ hơn vừa nhanh hơn.

Chế độ nhanh

Opus 5 có chế độ nhanh dùng cho nghiên cứu, với tốc độ đầu ra lên đến 2,5 lần và mức giá $10 / $50. Fable 5.1 không có tính năng tương đương. Nếu thời gian phản hồi quan trọng hơn vài điểm benchmark, đây có thể là yếu tố quyết định.

Độ trễ

Anthropic xếp độ trễ của Fable 5.1 là “chậm hơn”, còn Opus 5 là “trung bình”. Một lượt Fable 5.1 ở mức nỗ lực cao trên tác vụ khó có thể kéo dài nhiều phút.

Không lưu giữ dữ liệu

Opus 5 hỗ trợ ZDR (Zero Data Retention). Fable 5.1 là mô hình được quy định và trả về lỗi 400, trừ khi Anthropic cấp quyền ZDR rõ ràng.

Ít từ chối hơn

Opus 5 chỉ chạy bộ phân loại an ninh mạng. Fable 5.1 chạy toàn bộ bộ phân loại Fable:

  • An ninh mạng
  • Sinh học
  • Phát triển LLM tiên tiến
  • Trích xuất suy luận
  • Các mối nguy hại chung

Một tác vụ khoa học đời sống hoặc machine learning lành tính có thể không bị Opus 5 chặn nhưng lại bị Fable 5.1 từ chối. Trong trường hợp đó, Opus 5 là mục tiêu dự phòng phù hợp.

Buộc sử dụng công cụ

Opus 5 chấp nhận tool_choice: anytool. Fable 5.1 trả về lỗi 400. Nếu tích hợp đang phụ thuộc vào các cuộc gọi công cụ bắt buộc, Opus 5 tránh được việc phải viết lại.

Chỉnh sửa lịch sử

Opus 5 không gặp vấn đề khi các lượt trước đó bị chỉnh sửa. Fable 5.1 vô hiệu hóa các khối tư duy sau đó khi lịch sử bị thay đổi. Vì vậy, mọi framework kiểm thử nén phía máy khách hoặc chèn lại lời nhắc theo từng lượt cần được kiểm tra trước khi chuyển sang Fable 5.1.

Khi Fable 5.1 vượt trội

Nghiên cứu dài hạn và tác tử terminal

Khoảng cách 52.6% so với 29.0% trên Terminal-Bench-Science là lớn nhất trong các benchmark của Anthropic. Nếu tác tử phải chạy thí nghiệm, nghiên cứu web nhiều bước hoặc hoạt động trong nhiều giờ, đây là nhóm tác vụ Fable 5.1 được thiết kế để xử lý.

Tự động hóa quy trình kinh doanh

Fable 5.1 đạt 31.4% so với 26.9% của Opus 5 trên AutomationBench, một điểm chuẩn mô phỏng tác vụ đầu cuối trên các ứng dụng kinh doanh.

Tác tử nặng về prefix được lưu vào bộ nhớ đệm

Chi phí đọc bộ nhớ đệm $0.25 có thể khiến Fable 5.1 rẻ hơn mỗi lượt trong các vòng lặp mà phần prefix chiếm ưu thế.

Giới hạn kiến thức mới hơn

Fable 5.1 có giới hạn kiến thức tháng 6 năm 2026, mới hơn một tháng so với Opus 5. Đây là phiên bản Claude mới nhất tại thời điểm bài viết.

Thị giác trên tài liệu dày đặc

Anthropic cho biết Fable 5.1 cải thiện khả năng đọc biểu đồ, hồ sơ và bảng lồng trong PDF, đặc biệt khi kết hợp công cụ cắt và phóng to. Opus 5 chưa được so sánh trên benchmark thị giác công khai, nên hãy xem đây là tuyên bố cần tự kiểm chứng.

Khi Opus 5 ở mức xhigh thất bại

Đây là quy tắc lựa chọn của Anthropic và là điểm bắt đầu hợp lý: nếu tác vụ thất bại trong đánh giá của bạn trên Opus 5 ở mức xhigh, hãy thử Fable 5.1 ở mức high trước khi thay đổi chiến lược khác.

Mức độ nỗ lực thay đổi kết quả so sánh

Cả hai mô hình đều có năm cấp độ nỗ lực. Anthropic mô tả Fable 5.1 ở mức low là thường cạnh tranh với Claude Opus và Claude Sonnet về chi phí mỗi tác vụ, đồng thời đạt điểm cao hơn.

Vì vậy, so sánh thực tế không nhất thiết là Opus 5 high với Fable 5.1 high. Với công việc thường ngày, hãy thử Opus 5 ở high và Fable 5.1 ở low hoặc medium. Số token đầu ra thấp hơn có thể bù đắp cho mức giá mỗi token cao gấp đôi.

Ở chiều ngược lại, lợi ích của Fable 5.1 so với Fable 5 lớn nhất ở xhighmax. Điều đó có nghĩa là giới hạn khả năng của Opus 5 thường chỉ lộ rõ ở các cấp độ nỗ lực tốn nhiều thời gian nhất. Hãy chạy đánh giá riêng trên nhiều cấp độ trước khi kết luận từ bảng benchmark ra mắt.

Xem thêm hướng dẫn về tham số nỗ lực của Opus 5.

Khung quyết định đề xuất

  1. Bắt đầu với Opus 5 ở mức high. Đây là khuyến nghị mặc định của Anthropic; giá bằng một nửa, có ít bộ phân loại hơn và hỗ trợ ZDR.
  2. Nâng Opus 5 lên xhigh cho các tác vụ thất bại. Cách này thường rẻ hơn chuyển mô hình ngay lập tức.
  3. Chuyển từng tác vụ vẫn thất bại sang Fable 5.1 ở mức high. Không cần chuyển toàn bộ hệ thống.
  4. Kiểm tra hồ sơ bộ nhớ đệm của các tác vụ đã chuyển. Với vòng lặp nặng về prefix, Fable 5.1 có thể rẻ hơn mỗi lượt.
  5. Kiểm tra framework kiểm thử trước khi chuyển đổi. tool_choice bắt buộc và chỉnh sửa lịch sử không hoạt động trên Fable 5.1. Xem thêm hướng dẫn di chuyển.

Chạy so sánh trong Apidog

Tạo một collection với lời nhắc production và model dưới dạng biến môi trường. Chạy cùng một bộ kiểm thử theo thứ tự:

  1. claude-opus-5 ở mức high
  2. claude-opus-5 ở mức xhigh
  3. claude-fable-5-1 ở mức high
  4. claude-fable-5-1 ở mức low

Với mỗi lần chạy:

  • Lưu câu trả lời.
  • Ghi lại usage.output_tokens.
  • Ghi lại usage.cache_read_input_tokens.
  • Tính chi phí theo tỷ lệ của từng mô hình.
  • So sánh chi phí mỗi tác vụ theo model và mức độ nỗ lực.

Apidog lưu toàn bộ lần chạy trong lịch sử, giúp bạn duy trì benchmark qua các lần phát hành mô hình tiếp theo. Tải Apidog để bắt đầu.

Câu hỏi thường gặp

Claude Fable 5.1 có tốt hơn Opus 5 không?

Trên mọi benchmark Anthropic đã công bố, có. Khoảng cách dao động từ 1.4 đến 23.6 điểm. Khoảng cách lớn nhất nằm ở Terminal-Bench-Science; hầu hết các benchmark còn lại có khoảng cách dưới 5 điểm. Đây là kết quả do nhà cung cấp tự chạy.

Fable 5.1 có đáng giá gấp đôi Opus 5 không?

Với nghiên cứu dài hạn, tác tử terminal, tự động hóa kinh doanh và vòng lặp nặng về prefix, thường là có. Chi phí đọc bộ nhớ đệm thấp hơn thậm chí có thể khiến Fable 5.1 rẻ hơn mỗi lượt. Với tác vụ nặng về đầu ra, nhạy cảm với độ trễ hoặc thiên về phân loại, thường là không.

Quy tắc của Anthropic là chỉ nâng cấp khi Opus 5 ở mức độ nỗ lực cao hơn vẫn thất bại trong đánh giá của bạn.

Mô hình nào nhanh hơn?

Opus 5. Anthropic xếp Opus 5 ở mức độ trễ “trung bình”, so với “chậm hơn” của Fable 5.1. Opus 5 cũng có chế độ nhanh với tốc độ đầu ra lên đến 2,5 lần; Fable 5.1 không có.

Opus 5 có các bộ phân loại an toàn giống Fable 5.1 không?

Không. Opus 5 chỉ chạy bộ phân loại an ninh mạng. Fable 5.1 bổ sung các bộ phân loại sinh học, LLM tiên tiến, trích xuất suy luận và mối nguy hại chung. Khi Fable 5.1 từ chối, Opus 5 là một trong các mục tiêu dự phòng được phép.

Có thể dùng Fable 5.1 với ZDR như Opus 5 không?

Không. Fable 5.1 yêu cầu lưu giữ dữ liệu 30 ngày và là một mô hình được quy định. Opus 5 có sẵn theo chính sách ZDR.

Một cuộc trò chuyện có thể chuyển đổi giữa hai mô hình không?

Có thể chuyển lên Fable 5.1: mô hình này đọc được các khối tư duy của Opus 5.

Khi chuyển xuống Opus 5, API loại bỏ các khối tư duy của Fable 5.1 trước khi Opus 5 nhìn thấy chúng và không tính phí phần đó. Opus 5 sẽ lập kế hoạch lại cho lượt tiếp theo.

Top comments (0)