Anthropic đã ra mắt Claude Fable 5 vào ngày 9 tháng 6 năm 2026, và nó đi kèm với mức giá buộc người dùng phải đưa ra một quyết định thực sự: câu hỏi Claude Fable 5 so với Opus 4.8, về cơ bản, là một câu hỏi về tiền bạc. Fable 5 có chi phí mỗi token chính xác gấp đôi so với Opus 4.8. Chi phí đầu vào là 10 USD cho mỗi triệu token so với 5 USD của Opus 4.8, và chi phí đầu ra là 50 USD cho mỗi triệu token so với 25 USD. Vì vậy, trước khi bạn đọc bất kỳ tuyên bố về hiệu suất nào, bài toán đã được định sẵn: cùng một nhà cung cấp, cùng một API Messages, và một mức phí cao gấp 2 lần cho mô hình mới hơn. Phần thú vị là tìm ra khi nào mức phí cao đó xứng đáng, và khi nào bạn đang đốt tiền. Nếu bạn muốn có thông tin đầy đủ về mô hình cũ trước, hướng dẫn về Claude Opus 4.8 của chúng tôi sẽ giải thích nó là gì và vị trí của nó trong dòng sản phẩm.
TL;DR
Claude Fable 5 và Opus 4.8 thuộc cùng một dòng sản phẩm. Fable 5 có chi phí mỗi token chính xác gấp 2 lần Opus 4.8 (10 USD/50 USD so với 5 USD/25 USD). Đối với hầu hết các tác vụ trò chuyện, tạo mã và truy xuất thông tin, Opus 4.8 là lựa chọn thông minh hơn. Hãy sử dụng Fable 5 khi bạn cần các tác vụ tự chủ với tầm nhìn rất dài, duy trì tính mạch lạc qua hàng triệu token. Nếu không, hãy tiết kiệm tiền.

Claude Fable 5 so với Opus 4.8 trong nháy mắt
Đây là bảng so sánh để bạn có thể thấy sự đánh đổi tại một chỗ.
| Khía cạnh | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|
| ID mô hình API | claude-fable-5 |
claude-opus-4-8 |
| Giá đầu vào (mỗi 1 triệu token) | 10,00 USD | 5,00 USD |
| Giá đầu ra (mỗi 1 triệu token) | 50,00 USD | 25,00 USD |
| Chi phí tương đối | Gấp 2 lần Opus 4.8 | Mức cơ sở |
| Ngữ cảnh | Hoạt động trên hàng triệu token; không có số lượng cố định được công bố | Cửa sổ ngữ cảnh 1 triệu token |
| Tư duy và nỗ lực | Tư duy thích ứng | Tư duy thích ứng + nỗ lực (thấp/trung bình/cao/rất cao/tối đa) |
| Định vị | Một mô hình lớp Mythos được làm an toàn để sử dụng chung; mô hình mạnh nhất Anthropic đã cung cấp rộng rãi | Có khả năng cao; là mô hình mạnh nhất của Anthropic được cung cấp rộng rãi trước Fable 5 |
| Tốt nhất cho | Công việc tự chủ với tầm nhìn rất dài, di chuyển quy mô lớn, các tác nhân hoạt động nhiều giờ | Hầu hết các tác vụ trò chuyện, tạo mã, RAG và tương tác |
Lưu ý về ngữ cảnh: Anthropic chưa công bố chính xác số lượng cửa sổ ngữ cảnh cho Fable 5. Công ty mô tả nó là khả năng duy trì sự tập trung qua hàng triệu token, vì vậy hãy coi hành vi ngữ cảnh dài của nó là một điểm mạnh định tính hơn là một thông số kỹ thuật cố định. Ngược lại, Opus 4.8 có cửa sổ 1 triệu token được ghi lại. Nếu quyết định của bạn phụ thuộc vào một con số ngữ cảnh chính xác, Opus 4.8 là lựa chọn có một con số mà bạn có thể trích dẫn trong tài liệu thiết kế; tài liệu tổng quan mô hình của Anthropic liệt kê các thông số kỹ thuật đã công bố cho dòng sản phẩm. Để có phần giới thiệu bằng ngôn ngữ đơn giản về mô hình mới, phần giải thích của chúng tôi về Claude Fable 5 bao gồm những điều cơ bản, và phân tích chi phí của Opus 4.8 của chúng tôi đi sâu hơn về mặt chi phí.
Giá: Fable 5 có chi phí chính xác gấp đôi
Đây là sự thật rõ ràng nhất trong toàn bộ so sánh này, vì vậy hãy bắt đầu từ đây.
Fable 5 tính phí 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra. Opus 4.8 tính phí 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra. Tỷ lệ đầu vào gấp hai lần, tỷ lệ đầu ra gấp hai lần. Không có dấu hoa thị, không có chiết khấu theo cấp bậc làm thay đổi tỷ lệ, và không có phụ phí ngữ cảnh dài làm nghiêng nó. Fable 5 đắt gấp 2 lần Opus 4.8 trên mọi phương diện. Bạn có thể xác nhận các mức phí hiện tại trên trang giá của Anthropic.
Tính trên 1.000 token, chi phí sẽ là:
- Fable 5: 0,010 USD đầu vào, 0,050 USD đầu ra
- Opus 4.8: 0,005 USD đầu vào, 0,025 USD đầu ra
Những con số đó trông rất nhỏ khi đứng riêng lẻ, và đó chính xác là cách mà ngân sách vượt tầm kiểm soát của các đội nhóm. Tỷ lệ mới là điều quan trọng một khi khối lượng công việc tăng lên.
Hãy lấy một ví dụ thực tế hàng tháng. Giả sử một tính năng sản xuất xử lý 200 triệu token đầu vào và tạo ra 40 triệu token đầu ra trong một tháng. Với Opus 4.8, chi phí là 200 x 5 USD + 40 x 25 USD, tức là 1.000 USD + 1.000 USD = 2.000 USD. Với Fable 5, cùng một khối lượng công việc đó là 200 x 10 USD + 40 x 50 USD, tức là 2.000 USD + 2.000 USD = 4.000 USD. Cùng số token, cùng công việc, 2.000 USD so với 4.000 USD. Mức phí cao cấp tăng tuyến tính theo mức sử dụng, vì vậy một khối lượng công việc chạy cả ngày, mỗi ngày, sẽ tăng gấp đôi chi phí mô hình ngay khi bạn thay đổi chuỗi mô hình.
Cách đặt vấn đề đó rất quan trọng bởi vì quyết định nâng cấp không phải là "Fable 5 có tốt hơn không." Nó gần như luôn tốt hơn. Quyết định là "Fable 5 có đủ tốt hơn để biện minh cho việc tăng gấp đôi khoản mục cụ thể này không." Đối với một công cụ nội bộ có khối lượng thấp, 2.000 USD thêm mỗi tháng có thể là không đáng kể. Đối với một điểm cuối hướng tới khách hàng có khối lượng cao, đó có thể là sự khác biệt giữa biên lợi nhuận lành mạnh và biên lợi nhuận âm. Hãy định giá khối lượng công việc, không phải mô hình. Nếu bạn muốn phân tích chi phí sâu hơn về tùy chọn rẻ hơn, hãy xem phân tích giá Opus 4.8 của chúng tôi; đối với bảng giá cụ thể của mô hình mới, hướng dẫn giá Claude Fable 5 của chúng tôi có đầy đủ chi tiết.
Khả năng: Nơi Fable 5 vượt trội
Fable 5 không phải là một phiên bản đổi tên tiếp thị của Opus 4.8. Nó thực sự là một mô hình có khả năng cao hơn, và khoảng cách đó thể hiện rõ nhất trong các tác vụ dài, tự chủ.
Trong thông báo về Claude Fable 5, Anthropic mô tả Fable 5 là một mô hình thuộc lớp Mythos được làm an toàn để sử dụng chung, là mô hình có khả năng cao nhất mà công ty đã cung cấp rộng rãi. Nó được xây dựng cho các tác vụ tự chủ với tầm nhìn rất dài và duy trì sự tập trung qua hàng triệu token. Cụm từ cuối cùng đó chính là toàn bộ điểm nhấn. Rất nhiều mô hình có thể viết một hàm tốt hoặc trả lời một câu hỏi. Ít mô hình hơn nhiều có thể chạy hàng giờ, duy trì một kế hoạch mạch lạc trên một lượng ngữ cảnh khổng lồ, và vẫn đưa ra những quyết định tốt ở cuối.
Minh chứng rõ ràng nhất là kết quả của Stripe. Fable 5 đã thực hiện di chuyển 50 triệu dòng mã Ruby cho Stripe chỉ trong một ngày, một công việc mà đội ngũ ước tính sẽ mất hai tháng hoặc hơn. Đó không phải là một sự trừu tượng hóa theo tiêu chuẩn. Đó là một sự di chuyển thực tế của một cơ sở mã thực tế ở quy mô mà nút thắt cổ chai là sự mạch lạc bền vững, không phải chất lượng thô trên mỗi token. Một mô hình bị lạc đề hoặc mất dấu vết sau vài trăm nghìn token không thể thực hiện công việc đó ở bất kỳ giá nào. Đây chính là khối lượng công việc mà Fable 5 được xây dựng cho.
Bộ nhớ khuếch đại khoảng cách. Trong một thử nghiệm Slay the Spire, việc cung cấp bộ nhớ tệp liên tục cho Fable 5 đã tạo ra sự cải thiện gấp 3 lần so với Opus 4.8. Bài học này khái quát rất tốt ngoài một trò chơi thẻ bài: khi một tác vụ trải dài qua nhiều bước và mô hình có thể ghi chú cho chính nó và đọc lại chúng, Fable 5 tổng hợp bộ nhớ đó thành kết quả tốt hơn đáng kể trong các lần chạy dài. Nếu tác nhân của bạn duy trì một bảng nháp, một tệp kế hoạch hoặc một kho lưu trữ bộ nhớ có cấu trúc trong suốt một phiên dài, đó chính xác là thiết lập mà sức mạnh tầm nhìn dài của Fable 5 chuyển thành những chiến thắng có thể đo lường được.
Trên các tiêu chuẩn, Fable 5 đã đạt được các vị trí dẫn đầu ở gần như tất cả các tiêu chuẩn. Nó đứng đầu FrontierCode và FrontierBench từ Cognition, CursorBench, và Hebbia’s Finance Benchmark, cùng nhiều tiêu chuẩn khác. Anthropic chưa công bố điểm số công khai cho các tiêu chuẩn này, vì vậy hãy coi các vị trí này là định hướng hơn là những con số để trích dẫn. Mô hình này nhất quán: Fable 5 dẫn đầu trong các đánh giá về lập trình, tác nhân và tài chính. Điểm mấu chốt không phải là sự khác biệt trên bảng xếp hạng; mà là mô hình này nằm ở hoặc gần đầu các loại tác vụ khó khăn, nhiều bước, tương ứng với công việc thực tế đắt đỏ.
Một điều nữa đáng biết để so sánh công bằng: Fable 5 được trang bị các biện pháp bảo vệ để định tuyến một số truy vấn nhạy cảm nhất định, an ninh mạng, sinh học và hóa học, cũng như các yêu cầu chắt lọc mô hình, tới Opus 4.8 thay vì trả lời trực tiếp. Anthropic cho biết điều này xảy ra dưới 5% các phiên, vì vậy nó hiếm khi ảnh hưởng đến việc sử dụng bình thường, nhưng đây là một sự khác biệt về hành vi thực sự. Đối với hầu hết các khối lượng công việc, bạn sẽ không bao giờ thấy điều đó. Để so sánh trực tiếp với các nhà cung cấp khác, bài so sánh Opus 4.8 với GPT-5.5 và Gemini 3.5 của chúng tôi và bài so sánh Fable 5 với GPT-5.5 và Gemini 3.5 tương ứng đặt mỗi mô hình vào một phạm vi rộng hơn.
Khi nào Opus 4.8 là lựa chọn thông minh hơn
Đây là phần mà các thông báo ra mắt thường bỏ qua: đối với một phần lớn các công việc sản xuất, Opus 4.8 là lựa chọn kinh tế tốt hơn, và nó không hề thua kém.
Opus 4.8 là mô hình có khả năng nhất của Anthropic được cung cấp rộng rãi trước khi Fable 5 ra mắt. Nó không trở nên tệ hơn vào ngày Fable 5 được phát hành. Nó vẫn là một mô hình mạnh mẽ, thuộc hàng tiên phong với cửa sổ ngữ cảnh 1 triệu token được ghi nhận, tư duy thích ứng và đầy đủ các cấp độ nỗ lực từ thấp đến tối đa. Đối với hầu hết các giao diện trò chuyện, hầu hết việc tạo mã và hầu hết việc tạo ra kết quả được tăng cường bằng truy xuất (RAG), Opus 4.8 tạo ra kết quả xuất sắc với chi phí mỗi token chỉ bằng một nửa. Nếu tác vụ phù hợp thoải mái trong một triệu token và được giải quyết trong một lượt hoặc một vòng lặp ngắn, bạn rất có thể đang trả gấp đôi cho khả năng mà bạn sẽ không sử dụng khi chọn Fable 5.
Ba hình thức công việc sau đây thiên về Opus 4.8:
- Trò chuyện tương tác và trợ lý, nơi mỗi lượt ngắn gọn, độ trễ quan trọng và mô hình hiếm khi cần duy trì một kế hoạch nhiều giờ.
- Tạo và xem xét mã ở cấp độ hàm, tệp hoặc yêu cầu kéo (pull-request), nơi ngữ cảnh được giới hạn và tác vụ hoàn thành nhanh chóng.
- RAG và hỏi đáp tài liệu, nơi bạn đưa ngữ cảnh liên quan vào cửa sổ 1 triệu token và đặt một câu hỏi tập trung. Cửa sổ là tài sản ở đây, và Opus 4.8 có một cửa sổ được ghi lại.
Ngoài ra còn có một lập luận thuyết phục một cách âm thầm ẩn trong chính thiết kế của Fable 5. Khi Fable 5 gặp một trong các danh mục bảo vệ của mình, nó sẽ định tuyến truy vấn đến Opus 4.8. Mô hình mới hơn thực sự quay trở lại mô hình cũ hơn cho các trường hợp nhạy cảm. Đó là một tín hiệu mạnh mẽ rằng Opus 4.8 được tin cậy, có khả năng và đủ tốt để thay thế cho mô hình flagship trong lưu lượng truy cập thực tế. Nếu nó là mạng lưới an toàn dưới mô hình đắt nhất mà Anthropic bán, thì nó quá đủ cho phần lớn các yêu cầu hàng ngày của bạn.
Mặc định ưu tiên chi phí, thì rất đơn giản: bắt đầu với Opus 4.8, đo lường, và chỉ nâng cấp những khối lượng công việc cụ thể chứng tỏ chúng cần khả năng tự chủ với tầm nhìn dài. Nếu ngay cả Opus 4.8 cũng vượt quá nhu cầu của một khối lượng công việc, Claude Sonnet 4.6 nằm dưới nó với chi phí 3 USD đầu vào và 15 USD đầu ra, và xử lý các tác vụ đơn giản, khối lượng lớn với một phần nhỏ chi phí. Để biết chi tiết thiết lập về các cấp độ Claude rẻ hơn, hướng dẫn API Opus 4.8 của chúng tôi sẽ hướng dẫn các cuộc gọi.
Khung quyết định: Bạn nên chọn cái nào?
Bỏ qua cảm tính và định tuyến theo khối lượng công việc. Các quy tắc này bao gồm hầu hết các trường hợp thực tế.
- Các tác vụ ngắn, một lần (trò chuyện, phân loại, trích xuất, một đoạn mã nhanh): Sử dụng Opus 4.8. Mức phí gấp đôi không mang lại lợi ích gì ở đây vì tác vụ không bao giờ tận dụng lợi thế tầm nhìn dài của Fable 5.
- Tạo và xem xét mã có giới hạn (một hàm, một tệp, một PR): Sử dụng Opus 4.8. Kết quả mạnh mẽ, chi phí bằng một nửa, và ngữ cảnh phù hợp.
- RAG, hỏi đáp tài liệu và phân tích trong cửa sổ 1 triệu token: Sử dụng Opus 4.8. Cửa sổ một triệu token được ghi nhận là tính năng bạn đang trả tiền, và Opus 4.8 có nó.
- Các tác nhân tự chủ hoạt động nhiều giờ và phải duy trì tính mạch lạc trong suốt quá trình hoạt động rất dài: Sử dụng Fable 5. Đây là khối lượng công việc mà nó được xây dựng cho, và khoảng cách về tính mạch lạc biện minh cho mức giá.
- Di chuyển và tái cấu trúc lớn bao gồm một cơ sở mã khổng lồ trong một lần: Sử dụng Fable 5. Việc di chuyển 50 triệu dòng mã của Stripe là một ví dụ. Ở quy mô đó, sự tập trung bền vững là nút thắt cổ chai, và Fable 5 giải quyết được nó.
- Các tác nhân chạy dài với bộ nhớ liên tục: Sử dụng Fable 5. Kết quả bộ nhớ gấp 3 lần cho thấy lợi ích kép trong các phiên dài là có thật.
- Chi phí là ràng buộc cứng: Sử dụng Opus 4.8, hoặc chuyển sang Sonnet 4.6 cho các tác vụ đơn giản, khối lượng lớn. Dành Fable 5 cho một vài công việc thực sự cần đến nó.
Quy tắc chung: mặc định là Opus 4.8, sau đó chỉ nâng cấp từng khối lượng công việc cụ thể lên Fable 5 khi chúng chứng minh được nhu cầu về khả năng tự chủ tầm nhìn dài. Tăng gấp đôi chi phí trên toàn bộ hệ thống chỉ vì một công việc được hưởng lợi là cách phổ biến nhất mà các nhóm chi tiêu quá mức cho một mô hình flagship.
Chuyển đổi giữa chúng trong mã
Tin tốt cho bất kỳ ai đang cân nhắc quyết định này: việc chuyển đổi là rất dễ dàng. Cả hai mô hình đều hoạt động phía sau cùng một API Messages. Không có việc di chuyển SDK, không có luồng xác thực mới, không có cấu trúc yêu cầu bị thay đổi. Bạn chỉ cần thay đổi chuỗi ID mô hình và không có gì khác. `claude-fable-5` cho mô hình mới, `claude-opus-4-8` cho mô hình rẻ hơn.
import anthropic
client = anthropic.Anthropic()
# Mặc định, cấp bậc tiên phong, giá rẻ hơn
response = client.messages.create(
model="claude-opus-4-8", # đổi sang "claude-fable-5" cho mô hình flagship
max_tokens=16000,
thinking={"type": "adaptive"},
messages=[{"role": "user", "content": "Summarize this design doc and list open questions."}],
)
for block in response.content:
if block.type == "text":
print(block.text)
Vì sự khác biệt duy nhất là chuỗi mô hình, bạn có thể định tuyến theo từng yêu cầu. Gửi lưu lượng truy cập hàng ngày đến claude-opus-4-8, và chuyển chuỗi sang claude-fable-5 cho một số công việc cần khả năng tự chủ tầm nhìn dài, tất cả từ cùng một client và cùng một đường dẫn mã. Điều đó giúp chiến lược "mặc định rẻ, nâng cấp theo yêu cầu" dễ dàng thực hiện: một giá trị cấu hình duy nhất hoặc một điều kiện một dòng quyết định mô hình nào xử lý một yêu cầu nhất định. Để biết toàn bộ bề mặt yêu cầu trên mô hình cũ, hãy xem hướng dẫn API Opus 4.8 của chúng tôi; hướng dẫn API Fable 5 tương ứng bao gồm mô hình mới.
Tự mình so sánh chúng với Apidog
Các bảng giá và tuyên bố về hiệu suất chỉ giúp bạn được một phần. Cách trung thực để giải quyết câu hỏi Claude Fable 5 vs Opus 4.8 cho khối lượng công việc của bạn là gửi cùng một lời nhắc đến cả hai ID mô hình và xem kết quả trả về. Đó là một công việc mà Apidog xử lý một cách gọn gàng.
Thiết lập một yêu cầu tới Anthropic Messages API, sau đó sao chép nó và chỉ thay đổi trường mô hình, `claude-fable-5` trong một yêu cầu, `claude-opus-4-8` trong yêu cầu còn lại. Gửi cả hai với một lời nhắc thực sự giống với lưu lượng truy cập sản xuất của bạn, chứ không phải một câu hỏi nhỏ. Sau đó so sánh hai phản hồi song song: câu trả lời nào chính xác hơn, câu trả lời nào đầy đủ hơn, và liệu khoảng cách về chất lượng có đủ lớn để quan trọng đối với trường hợp sử dụng của bạn hay không.
Apidog cũng hiển thị các con số thúc đẩy quyết định chi phí. Bạn có thể theo dõi độ trễ trên mỗi cuộc gọi và đọc mức sử dụng token trực tiếp từ mỗi phản hồi, bao gồm số lượng đầu vào và đầu ra xác định số tiền bạn thực sự phải trả. Đặt mức sử dụng từ cả hai mô hình bên cạnh sự khác biệt về chất lượng, và mức phí gấp đôi không còn là trừu tượng nữa. Bạn có thể thấy, đối với lời nhắc thực tế của mình, liệu đầu ra của Fable 5 có đáng giá thêm token và đô la hay liệu Opus 4.8 đã hoàn thành công việc rồi. Lưu hai yêu cầu đó dưới dạng một bộ sưu tập nhỏ và bạn sẽ có một công cụ kiểm tra A/B có thể lặp lại mà bạn có thể chạy lại bất cứ khi nào lời nhắc của bạn thay đổi hoặc một mô hình mới ra mắt. Nếu bạn muốn thử, hãy Tải xuống Apidog và xây dựng hai yêu cầu trong vài phút. Đó là một con đường nhanh hơn để có được câu trả lời tự tin hơn là đọc thêm một bảng thông số kỹ thuật, và Apidog giữ toàn bộ so sánh ở một nơi.

