DEV Community

Cover image for Claude Fable 5.1 là gì? Cấu hình, Hiệu năng, Giá bán và Có gì mới
Sebastian Petrus
Sebastian Petrus

Posted on Originally published at apidog.com

Claude Fable 5.1 là gì? Cấu hình, Hiệu năng, Giá bán và Có gì mới

Claude Fable 5.1 là mô hình cấp Fable mới nhất của Anthropic, phát hành ngày 1 tháng 9 năm 2026 cùng mô hình sinh đôi có kiểm soát truy cập Claude Mythos 5.1. Mô hình này thay thế Claude Fable 5 với cùng mức giá 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra, nhưng giá đọc bộ nhớ đệm lời nh khuyên bắt đầu với Opus 5 và chỉ chuyển sang Fable 5.1 khi Opus 5 ở mức nỗ lực cao hơn chưa đáp ứng được yêu cầu. Xem thêm bài đăng ra mắttrang mô hình Fable 5.1.

Dùng thử Apidog hôm nay

Hướng dẫn này tập trung vào thông số kỹ thuật, chi phí bộ nhớ đệm, điểm chuẩn, các thay đổi có thể làm hỏng mã Fable 5, tính năng API mới, quyền truy cập và giới hạn thực tế. Mọi yêu cầu đều là HTTP thuần túy với JSON, nên bạn có thể xây dựng và kiểm thử trong Apidog trước khi tích hợp vào ứng dụng. Tham khảo thêm hướng dẫn API, cách tính chi phíhướng dẫn di chuyển.

Claude Fable 5.1 trong nháy mắt

Thông số Giá trị
ID mô hình API claude-fable-5-1 — không có hậu tố ngày
Phát hành 1 tháng 9 năm 2026
Cam kết ngừng hoạt động Không sớm hơn ngày 1 tháng 9 năm 2027
Cửa sổ ngữ cảnh 1.000.000 token, mặc định và tối đa; định giá tiêu chuẩn trên toàn bộ cửa sổ
Đầu ra tối đa 128.000 token trên Messages API
Giá cơ bản 10 USD/triệu token đầu vào; 50 USD/triệu token đầu ra
Đọc bộ nhớ đệm 0,25 USD/triệu token — bằng 0,025 lần giá đầu vào cơ bản
API hàng loạt 5 USD đầu vào; 25 USD đầu ra trên mỗi triệu token
Ngưỡng kiến thức Tháng 6 năm 2026
Suy nghĩ Thích ứng, luôn bật; không thể tắt
Mức độ nỗ lực low, medium, high, xhigh, max; mặc định là high
Độ trễ Chậm hơn Opus 5 và Sonnet 5
Priority Tier Không được hỗ trợ; Fable 5 vẫn hỗ trợ
Lưu giữ dữ liệu Yêu cầu lưu giữ 30 ngày; không có lưu giữ bằng không trừ khi Anthropic cho phép rõ ràng
Khả dụng Claude API, Amazon Bedrock, Claude Platform trên AWS, Google Cloud, Microsoft Foundry, Claude.ai và Claude Code 2.1.250+

Ba điểm cần kiểm tra trước khi tích hợp:

  • Ngưỡng kiến thức tháng 6 năm 2026 mới hơn Opus 5, vốn dừng ở tháng 5 năm 2026, và Sonnet 5, vốn dừng ở tháng 1 năm 2026.
  • Fable 5.1 không hỗ trợ Priority Tier.
  • Một tổ chức không bật chính sách lưu giữ 30 ngày có thể nhận 400 invalid_request_error. Hãy kiểm tra cài đặt lưu giữ trước khi gỡ lỗi payload.

Fable 5.1 khác gì so với Fable 5?

Fable 5.1 kế nhiệm Fable 5 trong cùng cấp độ, giữ nguyên giá trên mỗi token và sử dụng cùng trình mã hóa được giới thiệu với Opus 4.7 — tạo ra khoảng 30% token trên mỗi văn bản nhiều hơn các mô hình trước 4.7.

Anthropic mô tả Fable 5.1 và Mythos 5.1 là “cùng một mô hình nhưng với các cấp độ bảo vệ khác nhau”:

  • Fable 5.1: khả dụng rộng rãi.
  • Mythos 5.1: chỉ dành cho khách hàng được phê duyệt trong Project Glasswing, Chương trình Xác minh An ninh mạng và Chương trình Xác minh Khoa học Đời sống. Đây cũng là mô hình cung cấp sức mạnh cho Claude Security.

Xem so sánh Mythos 5.1 với Fable 5.1.

Bối cảnh phát hành cũng đáng chú ý: Fable 5 bị tạm ngừng vào tháng 6 năm 2026 theo các biện pháp kiểm soát xuất khẩu của Hoa Kỳ và quay trở lại ngày 1 tháng 7 với bộ phân loại an toàn được huấn luyện lại. Fable 5.1 giữ kiến trúc bộ phân loại và các danh mục từ chối tương tự, nhưng Anthropic cho biết chúng ít can thiệp hơn đáng kể đối với công việc lành tính. Xem thêm lịch sử tạm ngừng của Fable 5.

Theo tài liệu Anthropic, hãy bắt đầu với Opus 5 cho hầu hết tác vụ. Chọn Fable 5.1 khi cần suy luận phức tạp, tác nhân hoạt động dài hạn hoặc khi đánh giá Opus 5 ở mức nỗ lực cao hơn vẫn chưa đạt yêu cầu. So sánh Fable 5.1 với Opus 5 giúp chọn mô hình theo từng loại công việc.

Giá đọc bộ nhớ đệm giảm mạnh

Giá đầu vào và đầu ra không đổi. Thay đổi lớn nằm ở hệ số đọc bộ nhớ đệm:

  • Các mô hình Claude khác: đọc bộ nhớ đệm bằng 0,1 lần giá đầu vào.
  • Fable 5.1 và Mythos 5.1: đọc bộ nhớ đệm bằng 0,025 lần giá đầu vào, tương đương 0,25 USD/triệu token.
Mô hình Đầu vào cơ bản Đọc bộ nhớ đệm Đầu ra
Claude Fable 5.1 10 USD 0,25 USD 50 USD
Claude Fable 5 10 USD 1,00 USD 50 USD
Claude Opus 5 5 USD 0,50 USD 25 USD
Claude Sonnet 5 2 USD 0,20 USD 10 USD

So sánh giá Claude Fable 5.1

Hai hệ quả thực tế:

  1. Một lượt đọc bộ nhớ đệm Fable 5.1 rẻ hơn Opus 5, dù giá đầu vào cơ bản của Fable 5.1 cao gấp đôi.
  2. Các tác nhân dài hạn đọc lại tiền tố đã lưu ở mỗi lượt có thể giảm đáng kể chi phí. Anthropic ước tính giảm 25% cho tác vụ thông thường và lên đến khoảng 45% cho tác vụ có tính tác nhân cao.

Đây là ước tính dựa trên cách phối hợp dịch vụ của Anthropic. Hãy dùng bảng tính chi phí với tỷ lệ cache hit thực tế của bạn.

Chi phí ghi bộ nhớ đệm — 12,50 USD và 20 USD trên mỗi triệu token — cùng mức tối thiểu 512 token không thay đổi. Một cache miss hiện đắt gấp 40 lần cache hit, vì vậy cần thiết kế prefix ổn định và kiểm thử tỷ lệ cache hit cẩn thận hơn khi di chuyển từ Fable 5.

Điểm chuẩn: cần đọc với thái độ thận trọng

Tất cả số liệu dưới đây do Anthropic thực hiện và chưa có bản sao độc lập.

Điểm chuẩn Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 52,6% 24,7% 29,0% 22,4%
Terminal-Bench 4.0 55,8% 42,0% 52,3% 37,3%
GDPval-AA v2 — công việc tri thức 1853 1723 1824 1711
OSWorld 2.0 — tín dụng một phần 77,9% 72,9% 75,4% Không báo cáo
OSWorld 2.0 — nghiêm ngặt 41,7% 36,1% 39,6% Không báo cáo
Kỳ thi cuối cùng của nhân loại — không công cụ 60,9% 57,8% 56,6% Không báo cáo
Kỳ thi cuối cùng của nhân loại — có công cụ 65,0% 63,8% 63,6% Không báo cáo
AutomationBench 31,4% 17,1% 26,9% 19,6%
CursorBench 3.2.0 73,4% 70,5% 70,0% 67,2%

Anthropic cũng báo cáo Mythos 5.1 đạt 60,9% trên Terminal-Bench 4.0, cao hơn Fable 5.1 năm điểm. Đây là dấu hiệu rõ nhất cho thấy các biện pháp bảo vệ có thể làm giảm một số khả năng mã hóa tác nhân.

Terminal-Bench-Science tăng hơn gấp đôi so với Fable 5, nhưng CursorBench chỉ cao hơn Opus 5 3,4 điểm — một lợi thế thực nhưng khiêm tốn đối với mô hình có giá trên mỗi token gấp đôi. Xem bảng phân tích điểm chuẩn.

Kết quả điểm chuẩn Claude Fable 5.1

Ba thay đổi có thể làm hỏng mã Fable 5

Việc di chuyển nhìn chung là “drop-in”, nhưng ba thay đổi sau có thể trả về lỗi mà Fable 5 không trả về.

1. tool_choice bắt buộc trả về lỗi 400

Hai dạng sau không còn được hỗ trợ:

{"type": "any"}
Enter fullscreen mode Exit fullscreen mode
{"type": "tool", "name": "..."}
Enter fullscreen mode Exit fullscreen mode

API trả về thông báo:

tool_choice: type "tool" and "any" are not supported for this model
Enter fullscreen mode Exit fullscreen mode

Cách thay thế:

  • Dùng tool_choice: {"type": "auto"}.
  • Hướng dẫn mô hình gọi đúng công cụ trong prompt.
  • Đặt strict: true trên công cụ nếu cần đối số đúng schema.
  • Dùng structured outputs nếu mục tiêu duy nhất là lấy JSON hợp lệ.

2. Mô hình cũ không đọc được thinking block của Fable 5.1

Fable 5.1 có thể đọc thinking block từ Opus 5, Fable 5 và các mô hình cũ hơn. Chiều ngược lại không được hỗ trợ.

Nếu router, cơ chế retry hoặc fallback chuyển một hội thoại Fable 5.1 sang Opus 5, API sẽ loại bỏ các block này mà không tính phí; mô hình đích sẽ lập kế hoạch lại.

3. Chỉnh sửa lịch sử làm mất hiệu lực thinking block

Thinking block chỉ hợp lệ với chính xác:

  • system prompt,
  • mảng công cụ,
  • lịch sử hội thoại đứng trước block đó.

Thay đổi bất kỳ phần nào có thể khiến yêu cầu tiếp theo thất bại với lỗi 400 rằng block “được liên kết với một cuộc hội thoại khác”. Việc kiểm tra này áp dụng cho các tài khoản tạo vào hoặc sau ngày 31 tháng 8 năm 2026 và được Anthropic mô tả là biện pháp chống chắt lọc.

Nếu ứng dụng tự xây dựng messages, hãy ưu tiên các mẫu chỉ thêm vào thay vì chỉnh sửa lịch sử. Hướng dẫn preserved thinking giải thích cách giữ lại thinking block và cache.

Các hành vi khác không đổi:

  • Thinking không thể tắt.
  • Prefill trả về lỗi 400.
  • temperature không mặc định trả về lỗi 400.
  • thinking.display mặc định là "omitted".

Xem đầy đủ các ví dụ trước và sau trong hướng dẫn di chuyển từ Fable 5 và Opus 5tài liệu “Có gì mới”.

Năm tính năng bổ sung

  1. Nỗ lực trên mỗi tin nhắn — beta

    Một system message không có nội dung với output_config: {"effort": "low"} thay đổi mức nỗ lực từ lượt người dùng tiếp theo mà không làm mất hiệu lực cache. Cần header mid-conversation-output-config-2026-07-01.

  2. System message có phạm vi lượt — beta

    Đặt clear_at: "next_user_message" để system message chỉ có hiệu lực trong một lượt rồi tự ẩn. Cần header mid-conversation-system-clear-at-2026-08-21.

  3. Cập nhật tiến độ giữa các lần gọi công cụ — beta

    thinking.display: "updates" trả về ghi chú giữa các lần gọi công cụ, trong khi suy luận chi tiết vẫn được ẩn. Cần header thinking-display-updates-2026-08-18.

  4. Giá đọc cache thấp hơn

    Fable 5.1 và Mythos 5.1 đọc cache ở mức 0,025 lần giá đầu vào.

  5. Nguồn gốc nội dung

    Văn bản có watermark thống kê của Anthropic trên mọi nền tảng. Phương tiện từ sandbox thực thi mã được hỗ trợ chứng chỉ C2PA thông qua Files API. Xem giải thích về watermark.

Fable 5.1 hoạt động khác biệt như thế nào?

Bạn có thể nhận thấy một số thay đổi mà không cần sửa mã:

  • Một lệnh gọi công cụ cho mỗi lượt trong các vòng lặp tác nhân dài, thay vì xử lý hàng loạt nhiều lệnh gọi như Fable 5.
  • Ít tin nhắn tiến độ hơn giữa các lần gọi công cụ.
  • Nhiều câu trả lời từ bộ nhớ hơn khi dùng mức nỗ lực low.
  • Văn xuôi dày đặc hơn và ít định dạng trò chuyện hơn.
  • Trích dẫn trong phần tóm tắt không phải lúc nào cũng được đánh dấu.
  • Mô hình có xu hướng viết lại toàn bộ tệp thay vì chỉnh sửa từng phần.

Hãy bắt đầu với effort: "high" rồi chạy lại bộ đánh giá. Anthropic cho biết mức medium gần tương đương Fable 5 nhưng có chi phí thấp hơn. Tham khảo hướng dẫn nhắc lệnh chính thứchướng dẫn prompting trên Apidog.

Giới hạn an toàn

Fable 5.1 vẫn chạy các bộ phân loại an toàn. Yêu cầu bị từ chối trả về HTTP 200 với:

{
  "stop_reason": "refusal",
  "stop_details": {
    "category": "cyber"
  }
}
Enter fullscreen mode Exit fullscreen mode

Các danh mục có thể gồm:

  • cyber
  • bio
  • frontier_llm
  • reasoning_extraction
  • general_harms

Anthropic báo cáo:

  • Bộ phân loại sinh học can thiệp ít hơn 85% đối với câu hỏi lành tính so với Fable 5 khi ra mắt.
  • Biện pháp bảo vệ an ninh mạng can thiệp ít hơn khoảng 60% trên mỗi phiên Claude Code.
  • Fable 5.1 có thể xác định lỗ hổng trong mã bạn sở hữu, nhưng không phát triển khai thác. Khả năng này thuộc về Mythos 5.1.

Trong mã ứng dụng, hãy kiểm tra stop_reason trước khi đọc content. Có thể cấu hình fallback sang Opus 4.8 hoặc Opus 5 bằng fallbacks: "default" và header server-side-fallback-2026-07-01. Từ chối xảy ra trước khi có đầu ra sẽ không bị tính phí. Xem hướng dẫn xử lý từ chối.

Lưu ý rằng mô hình fallback không đọc được thinking block của Fable 5.1. Mythos 5.1 cũng vượt trội hơn Fable 5.1 ở những bài kiểm tra được công bố cho cả hai, còn bộ phân loại của Fable 5.1 rộng hơn bộ chỉ dành cho an ninh mạng của Opus 5.

Nền tảng hỗ trợ

Fable 5.1 khả dụng trên:

  • Claude API: claude-fable-5-1
  • Amazon Bedrock: anthropic.claude-fable-5-1
  • Claude Platform trên AWS, Google Cloud và Microsoft Foundry: claude-fable-5-1
  • Claude.ai: Pro, Max, Team và Enterprise; không có trên Free
  • Claude Code: phiên bản 2.1.250 trở lên

Cấu hình trên các nền tảng đám mây tương tự Fable 5; xem hướng dẫn khả dụng trên đám mây. Trong Claude.ai, gói Max bao gồm các mô hình Fable trong phạm vi tối đa 50% giới hạn hàng tuần; gói Pro sử dụng tín dụng. Xem thêm hướng dẫn Claude Codecác cách sử dụng miễn phí hoặc tiết kiệm nhất.

Kiểm thử Fable 5.1 bằng Apidog

Trong Apidog, tạo một yêu cầu POST tới https://api.anthropic.com/v1/messages với các header:

x-[REDACTED CREDENTIAL]
anthropic-version: 2023-06-01
Enter fullscreen mode Exit fullscreen mode

Body:

{
  "model": "claude-fable-5-1",
  "max_tokens": 16000,
  "output_config": {"effort": "high"},
  "messages": [
    {"role": "user", "content": "Review this pagination handler and list the edge cases it misses."}
  ]
}
Enter fullscreen mode Exit fullscreen mode

Không cần trường thinking. Hãy cấp đủ max_tokens vì giới hạn này bao gồm cả suy nghĩ và phản hồi.

Khi kiểm thử, hãy xác nhận:

  1. stop_reason trước khi đọc content.
  2. Thinking block trống hoặc bị lược bỏ theo cấu hình.
  3. usage.cache_read_input_tokens trong lần gửi thứ hai.
  4. Tỷ lệ cache hit và chi phí đọc cache thực tế.
  5. Hành vi fallback khi yêu cầu bị từ chối.

Bạn có thể tải Apidog để lưu request này thành một test case có thể chạy lại.

Ai nên dùng Claude Fable 5.1?

Nên dùng Fable 5.1 khi:

  • Tác nhân chạy hàng giờ và thường xuyên đọc lại prefix đã lưu.
  • Bạn đang sử dụng Fable 5 và muốn giữ nguyên mức giá nhưng giảm chi phí cache.
  • Opus 5 ở mức xhigh vẫn chưa đạt yêu cầu.
  • Ứng dụng cần kiến thức đến tháng 6 năm 2026.

Nên giữ Opus 5 hoặc Sonnet 5 khi:

  • Priority Tier là yêu cầu bắt buộc.
  • Tổ chức không cho phép lưu giữ dữ liệu 30 ngày.
  • Hệ thống thường xuyên chỉnh sửa lịch sử hội thoại.
  • Khối lượng công việc rẻ, lớn và Opus 5 hoặc Sonnet 5 đã đủ. Xem thêm so sánh Fable 5.1 với Fable 5tổng quan Sonnet 5.

Câu hỏi thường gặp

ID mô hình của Claude Fable 5.1 là gì?

Chuỗi chính xác là claude-fable-5-1. Trên Amazon Bedrock, dùng anthropic.claude-fable-5-1.

Claude Fable 5.1 có giá bao nhiêu?

Giá là 10 USD/triệu token đầu vào và 50 USD/triệu token đầu ra, giống Fable 5. Đọc cache là 0,25 USD/triệu token, giảm từ 1 USD. API hàng loạt có giá 5 USD đầu vào và 25 USD đầu ra. Không có chế độ nhanh hoặc Priority Tier.

Claude Fable 5.1 có tốt hơn Fable 5 không?

Theo mọi điểm chuẩn Anthropic công bố, có. Mức tăng lớn nhất nằm ở Terminal-Bench-Science — 52,6% so với 24,7% — và AutomationBench — 31,4% so với 17,1%. Đây là kết quả do nhà cung cấp tự thực hiện, chưa có bản sao độc lập.

Điều gì bị hỏng khi chuyển từ Fable 5?

tool_choice dạng bắt buộc trả về lỗi 400; các mô hình cũ hơn không thể đọc thinking block của Fable 5.1; và chỉnh sửa lượt trước đó làm mất hiệu lực thinking block trên các tài khoản tạo vào hoặc sau ngày 31 tháng 8 năm 2026.

Fable 5.1 còn từ chối yêu cầu an ninh mạng không?

Có, trong một số trường hợp. Anthropic báo cáo số lần can thiệp an ninh mạng giảm khoảng 60% trên mỗi phiên Claude Code và cho phép tìm kiếm lỗ hổng trong mã. Phát triển khai thác vẫn bị từ chối.

Có thể dùng Claude Fable 5.1 miễn phí không?

Không có trên gói Free. Gói Pro dùng tín dụng, còn gói Max bao gồm mô hình trong phạm vi tối đa 50% giới hạn hàng tuần. API không có tầng miễn phí ngoài tín dụng khi đăng ký.

Liên kết tham khảo

Top comments (0)