Phân tích chuyên sâu Claude Fable 5.1: năng lực, giá và so sánh với Fable 5
Phân tích dựa trên nguồn chính về Claude Fable 5.1, gồm giá các tuyến Modelflare, khác biệt với Fable 5, migration API, giới hạn và cách chọn tuyến.
Claude Fable 5.1 là mô hình frontier dành cho suy luận khó và các tác vụ agent kéo dài. Modelflare hiện cung cấp đúng model ID claude-fable-5-1 qua ba tuyến giá công khai. Điều cần quyết định không phải là Fable 5.1 có “tốt nhất” một cách trừu tượng hay không, mà là tuyến và mức effort nào giúp hoàn thành toàn bộ tác vụ với chi phí và rủi ro phù hợp.
Tóm tắt: Chọn Fable 5.1 cho coding ở quy mô cả repository, nghiên cứu nhiều bước, phân tích nhiều tài liệu và agent phải chạy hàng giờ. Với câu hỏi thường ngày hoặc yêu cầu độ trễ thấp, Fable 5 hay mô hình nhẹ hơn có thể đủ. Giá dưới đây là giá người dùng Modelflare được kiểm tra ngày 2/9/2026; trang giá trực tiếp là nguồn chính thức.
Bài viết tách biệt sự kiện do Anthropic ghi nhận, catalog trực tiếp của Modelflare, benchmark do nhà cung cấp công bố và phần phân tích. Điểm benchmark hay một dòng model đã cấu hình không bảo đảm mọi prompt, tool hoặc giao thức hoạt động giống nhau.
Câu trả lời chính
Fable 5.1 là bản nâng cấp nhỏ về tên nhưng là một bước tiến đáng kể trong workflow. Nó giữ context 1M token, output tối đa 128K và adaptive thinking luôn bật như Fable 5, đồng thời cải thiện coding dài hạn, nghiên cứu nhiều bước, tài liệu, bảng tính, slide, vision và computer use. Anthropic cũng giảm giá đọc cache trên API.
Ba tuyến của Modelflare làm rõ lựa chọn giữa chi phí và tính liên tục:
- claude-premium: ưu tiên ổn định.
- claude-award: ưu tiên giá cho tác vụ có thể retry an toàn.
- claude-stable: lựa chọn hằng ngày cho developer cá nhân và production.
Đây không phải là nâng cấp không cần thay đổi cho mọi Messages client tùy biến. Forced tool use bị từ chối, thinking block của Fable 5.1 gắn chặt hơn với lịch sử hội thoại, và trong vòng lặp dài model có thể phát ra ít tool call song song hơn Fable 5. Hãy kiểm thử migration ở cấp giao thức trước khi đổi agent dài hạn.
Thông số chính và giá hiện tại
Thông tin model lấy từ tổng quan Fable 5.1 của Anthropic và tài liệu cập nhật. Các trường Modelflare được đối chiếu với phản hồi trực tiếp của /api/pricing ngày 2/9/2026.
| Thuộc tính | Fable 5.1 |
|---|---|
| Model ID | claude-fable-5-1 |
| Cửa sổ context | 1M tokens |
| Output tối đa | 128K tokens |
| Thinking | Adaptive, luôn bật |
| Effort mặc định | high |
| Độ trễ tương đối | Chậm hơn |
| Mốc kiến thức | Tháng 6/2026 |
| Input/output API chính thức | $10 / $50 mỗi 1M token |
| Cache read chính thức | $0.25 mỗi 1M token |
Giá các tuyến Modelflare
Đây là giá dành cho người dùng Modelflare, không phải giá niêm yết trực tiếp của Anthropic. Đơn vị USD trên 1M token; input và output tính riêng.
| Tuyến | Hệ số | Input | Output | Định vị |
|---|---|---|---|---|
| claude-premium | 0.5x | $5.00 | $25.00 | Ưu tiên ổn định và tỷ lệ request thành công |
| claude-award | 0.25x | $2.50 | $12.50 | Chi phí thấp nhất; development và test có thể retry |
| claude-stable | 0.315x | $3.15 | $15.75 | Development hằng ngày và production |
Dòng model trực tiếp báo ratio cache read 0.025. Với cache và các chiều sử dụng khác, hãy đối chiếu trang giá cùng bản ghi usage đã hoàn tất. Không dùng riêng bảng này để dự báo nếu chưa kiểm tra tuyến và chế độ tính phí hiện tại. Dòng model trực tiếp báo ratio cache read 0.025. Với cache và các chiều sử dụng khác, hãy đối chiếu trang giá cùng bản ghi usage đã hoàn tất. Không dùng riêng bảng này để dự báo nếu chưa kiểm tra tuyến và chế độ tính phí hiện tại.
So sánh Fable 5.1 và Fable 5
Anthropic xem Fable 5.1 là phiên bản kế nhiệm Fable 5, không phải một họ model khác. Khác biệt thực tế tập trung ở tác vụ dài và chi phí đọc lại prefix prompt ổn định.
| Khía cạnh | Fable 5.1 | Fable 5 | Ý nghĩa cho developer |
|---|---|---|---|
| Context và output | 1M / 128K | 1M / 128K | Không cần migration dung lượng |
| Adaptive thinking | Luôn bật | Luôn bật | Giữ block và điều chỉnh effort |
| Giá input/output | $10 / $50 mỗi 1M | $10 / $50 mỗi 1M | Giá cơ bản không đổi |
| Cache read | $0.25 / 1M chính thức | $1 / 1M chính thức | Vòng lặp agent dài đọc prefix rẻ hơn |
| Coding | Mạnh hơn ở multi-file, refactor, debug, kiểm tra | Mạnh ở coding dài | Chạy lại đánh giá repository |
| Nghiên cứu và artifact | Tốt hơn cho nghiên cứu, tài liệu, bảng, slide | Mạnh nhưng kém ổn định hơn ở chuỗi dài | Yêu cầu nguồn và checkpoint |
| Tool và lịch sử | Từ chối forced use, binding thinking chặt hơn | Ít ràng buộc hơn | Cập nhật Messages client tùy biến |
| Đa ngôn ngữ | Tương đương Fable 5 | Mốc so sánh | Không giả định lợi thế ngôn ngữ mới |
Đây không chỉ là “thông minh hơn với cùng hóa đơn”. Khi cache read chiếm phần lớn, tác vụ dài có thể rẻ hơn; model chậm hơn hoặc thêm lượt tool vẫn có thể tăng chi phí thời gian. Hãy đo toàn bộ tác vụ, retry và thời gian review của con người.
Phân tích năng lực
Coding dài hạn
Khác biệt rõ nhất khi thay đổi trải rộng qua file, service, test và tài liệu. Anthropic mô tả phiên tự chủ nhiều ngày, code review, tối ưu hiệu năng, triển khai đúng thiết kế và kiểm tra kết quả bằng vision. Giá trị chính là sửa nguyên nhân gốc: model có xu hướng truy tìm lỗi phía sau test thất bại hoặc crash hiếm thay vì chỉ vá triệu chứng.
Điều đó không khiến chạy code không giám sát trở nên an toàn tự động. Hãy giới hạn workspace, điểm phê duyệt, ngân sách test và rollback; yêu cầu danh sách file và kiểm tra đã thay đổi, lưu diff cùng kết quả ngoài transcript.
Nghiên cứu và công việc tri thức
Model có thể đưa câu hỏi qua tìm kiếm, thu thập bằng chứng, phân tích và artifact cuối. Phù hợp với memo, spreadsheet có công thức, dàn ý slide và các kiểm tra tài chính hoặc vận hành phụ thuộc vào phát hiện ban đầu.
Rủi ro chính là bằng chứng bị thay đổi. Ở effort thấp, model có thể tìm kiếm ít hơn và dựa vào bộ nhớ nhiều hơn. Yêu cầu liên kết, ngày tháng và phần nêu bằng chứng nào sẽ làm thay đổi kết luận. Ví dụ của nhà cung cấp và trích dẫn khách hàng là bằng chứng định tính, không phải benchmark độc lập.
Vision và computer use
Fable 5.1 đọc được biểu đồ dày, bảng trong PDF, bố cục tài liệu và có thể so sánh UI tạo ra với mục tiêu ban đầu. Điều này hữu ích cho review thiết kế, báo cáo tài chính, sơ đồ kiến trúc và workflow trình duyệt.
Vision không bảo đảm hiểu đúng từng pixel. Cắt riêng vùng quan trọng, giữ nguyên byte file giữa các lượt và kiểm tra chữ nhỏ cùng tọa độ độc lập. Computer use phải nằm sau quyền ứng dụng và một điểm dừng do con người kiểm soát.
Đầu ra đa ngôn ngữ
Anthropic báo cáo hiệu năng đa ngôn ngữ tương đương Fable 5. Các trang bài viết và giá của Modelflare đã bản địa hóa, nhưng chất lượng vẫn phụ thuộc ngôn ngữ prompt, nguồn, thuật ngữ và ràng buộc đầu ra. Cố định tên, đơn vị, identifier code và thuật ngữ pháp lý trong glossary, rồi đánh giá từng ngôn ngữ bằng cùng một bộ tác vụ.
Cách đọc benchmark
Bảng dưới đây tái hiện so sánh công khai của Anthropic. Đây là số liệu do nhà cung cấp báo cáo với safeguard production bật, không phải cam kết của Modelflare.
| Benchmark | Fable 5.1 | Fable 5 | Diễn giải |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | Mức tăng công bố lớn ở tác vụ khoa học agent |
| Terminal-Bench 4.0 | 55.8% | 42.0% | Kết quả terminal coding công bố cao hơn |
| GDPval-AA v2 | 1853 | 1723 | Điểm công việc tri thức cao hơn |
| OSWorld 2.0, partial | 77.9% | 72.9% | Computer use tăng, bị ảnh hưởng bởi safeguard |
| OSWorld 2.0, strict | 41.7% | 36.1% | Điểm tuyệt đối thấp hơn, cùng hướng |
| Humanity's Last Exam, không tool | 60.9% | 57.8% | Cải thiện suy luận vừa phải |
| Humanity's Last Exam, có tool | 65.0% | 63.8% | Tool có ích nhưng không luôn thắng |
| AutomationBench | 31.4% | 17.1% | Kết quả workflow kinh doanh công bố mạnh hơn |
| CursorBench 3.2.0 | 73.4% | 70.5% | Kết quả coding agent cao hơn |
Anthropic lưu ý can thiệp an toàn có thể làm giảm điểm. Harness, effort, quyền tool, timeout và chính sách retry đều thay đổi kết quả. So sánh nội bộ công bằng phải chạy lại cùng tác vụ an toàn, báo cáo chi phí mỗi tác vụ thành công, độ trễ, retry và phần sửa của con người.
API và lưu ý migration
Catalog trực tiếp của Modelflare đánh dấu claude-fable-5-1 cho các bề mặt tương thích Anthropic và OpenAI. Có endpoint không có nghĩa là parity tính năng: hãy kiểm tra event streaming, schema tool, structured output và input vision.
export MODELFLARE_API_KEY='YOUR_MODELFLARE_API_KEY'
curl -sS https://modelflare.dev/v1/messages \
-H "x-api-key: ${MODELFLARE_API_KEY}" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-fable-5-1",
"max_tokens": 512,
"messages": [{"role": "user", "content": "Liệt kê ba rủi ro trong kế hoạch migration này."}]
}'
Khi chuyển Messages client tùy biến từ Fable 5:
- bỏ tool_choice có giá trị any hoặc tool, dùng chọn tool tự động với schema nghiêm ngặt;
- coi lịch sử là append-only khi giữ thinking block;
- không dựng lại system prompt hoặc danh sách tool giữa các lượt nếu không dùng cơ chế tương ứng;
- đo cache và độ trễ trước khi bật beta effort theo từng message;
- dự kiến tool call song song biến thiên hơn và cập nhật tiến độ ít hơn;
- coi stop_reason: "refusal" là phản hồi HTTP thành công và áp dụng fallback có giới hạn.
Chuỗi suy nghĩ thô không được trả về. Nếu giao diện cần tiến độ, hãy yêu cầu cập nhật dành cho người dùng và tách chúng khỏi suy luận ẩn.
Chọn tuyến Modelflare
Chọn tuyến theo chi phí của một lần thất bại, không theo bảng xếp hạng chung. Với 100K token input và 10K token output, không tính cache, retry hay phí khác:
| Tuyến | Phép tính | Chi phí tác vụ gần đúng |
|---|---|---|
| claude-premium | 0.1 × $5 + 0.01 × $25 | $0.75 |
| claude-award | 0.1 × $2.50 + 0.01 × $12.50 | $0.375 |
| claude-stable | 0.1 × $3.15 + 0.01 × $15.75 | $0.4725 |
Chọn claude-premium khi thất bại đắt hoặc cần tính liên tục. Chọn claude-award cho development, khám phá theo lô và tác vụ có thể retry an toàn. Chọn claude-stable làm mặc định cân bằng cho developer cá nhân, dự án dài và production. Kiểm tra lại trang giá trước khi tăng lưu lượng.
An toàn, giới hạn và dữ liệu
Fable 5.1 có classifier an toàn cho an ninh mạng và sinh học. Một số yêu cầu có thể bị từ chối hoặc chuyển sang fallback kém năng lực hơn; từ chối có thể trả HTTP 200 với stop_reason: "refusal". Tách từ chối khỏi lỗi truyền tải trong retry và billing.
Anthropic phân loại Fable 5.1 là Covered Model. Nếu không có thỏa thuận doanh nghiệp được phê duyệt, thời gian lưu mặc định là 30 ngày. Không gửi secret hay dữ liệu chịu quản lý chỉ vì context lớn. Dùng tool quyền tối thiểu, log đã che, giới hạn thời gian và bản ghi usage có thể audit.
Model chậm hơn các lựa chọn Claude nhẹ, còn 1M token chỉ là trần chứ không bảo đảm truy xuất đồng đều. Tokenizer mới có thể tạo nhiều hơn khoảng 30% token cho cùng văn bản so với model cũ. Lập ngân sách từ bản ghi usage.
Câu hỏi thường gặp
Fable 5.1 có luôn tốt hơn Fable 5 không? Không. Nó mạnh hơn ở tác vụ dài, nhưng Fable 5 có thể nhanh hơn hoặc đủ cho việc thường ngày. Hãy đánh giá toàn bộ tác vụ.
Tuyến Modelflare nào rẻ nhất? claude-award với hệ số 0.25x, dành cho workload chấp nhận retry hoặc biến động khả dụng.
Nên dùng tuyến nào cho production? Bắt đầu với claude-stable; chọn claude-premium khi tính liên tục và tỷ lệ thành công quan trọng hơn giá.
Có thể dùng nguyên loop tool của Fable 5 không? Không nên mặc định như vậy. Forced tool bị từ chối, binding thinking chặt hơn và gọi song song có thể khác. Hãy chạy test nhiều lượt thật.
Một phản hồi văn bản thành công có chứng minh vision hoặc tool hoạt động không? Không. Kiểm tra từng modality và giao thức, gồm streaming, từ chối, hủy và input lỗi.
Nguồn và lịch sử cập nhật
- Anthropic: Introducing Claude Fable 5.1 and Claude Mythos 5.1
- Claude Fable 5.1 model overview
- What's new in Claude Fable 5.1
- Migrating to Claude Fable 5.1
- Giá trực tiếp Modelflare
- Hướng dẫn routing ổn định của Modelflare
- Hướng dẫn theo dõi chi phí token
Lịch sử cập nhật: 2/9/2026 — bản nháp đầu tiên; khả dụng model, hệ số tuyến và giá input/output của Modelflare đã được kiểm tra trên catalog trực tiếp. Thông số và benchmark của Anthropic được kiểm tra từ các nguồn chính được liên kết. Không khẳng định đã tái lập benchmark độc lập.