GPT-6 Astra vs Claude Fable 5.1: thông số, benchmark, giá và vị trí mô hình
So sánh dựa trên nguồn chính giữa GPT-6 Astra và Claude Fable 5.1 về ngữ cảnh, coding, Agent, nghiên cứu, an toàn, cache và quyền truy cập Modelflare.
OpenAI phát hành GPT-6 Astra vào ngày 3 tháng 9 năm 2026. OpenAI gọi Astra là mô hình thông minh và được căn chỉnh tốt nhất của mình, đồng thời là mô hình có năng lực cao nhất được triển khai rộng rãi. Hai ngày trước đó, Anthropic phát hành Claude Fable 5.1, một mô hình frontier dành cho lập trình dài hạn, nghiên cứu và công việc tri thức. Cả hai đều hướng tới suy luận khó và quy trình Agent, nhưng có những đánh đổi khác nhau.
Bài viết trả lời câu hỏi thực tế: GPT-6 Astra và Claude Fable 5.1 thực sự cung cấp gì, tiến bộ nằm ở đâu, và đội ngũ nên chọn mô hình nào ngay bây giờ? Mốc dữ kiện của bài là ngày 4 tháng 9 năm 2026, Asia/Shanghai. Tuyên bố của nhà cung cấp, điểm benchmark do nhà cung cấp báo cáo và danh mục trực tiếp của Modelflare được tách riêng.
Trước hết, cần làm rõ từ “tham số”. Không trang chính thức nào được kiểm tra công bố tổng số tham số, số tham số kích hoạt, số tầng hay FLOPs huấn luyện của các mô hình này. Vì vậy, phần so sánh “tham số” dưới đây nói về thông số công khai, không phải một con số được bịa ra.
Tóm tắt kết luận
GPT-6 Astra là mô hình flagship end-to-end có phạm vi rộng hơn. Đây là điểm bắt đầu phù hợp hơn khi công việc phải đi qua trình duyệt hoặc ứng dụng máy tính, điều phối nhiều công cụ, chỉnh sửa và kiểm thử phần mềm, hoặc hoạt động trong ranh giới cấp quyền và an toàn nghiêm ngặt. Responses API của Astra bổ sung gọi công cụ bất đồng bộ, điều hướng giữa lượt và thay đổi effort nhưng vẫn giữ tiền tố prompt đã cache.
Claude Fable 5.1 vẫn là lựa chọn hàng đầu và không trở thành lỗi thời ngay khi GPT-6 ra mắt. Nó đặc biệt phù hợp cho lập trình dài hạn, nghiên cứu, tài liệu, bảng tính và slide. Giá đọc cache chính thức là $0,25 cho mỗi triệu token—bằng một phần tư Fable 5 và thấp hơn mức $1 của GPT-6 Astra. Với Agent liên tục đọc lại cùng một ngữ cảnh, khác biệt này có thể quan trọng hơn việc thắng một benchmark.
Không có mô hình “tốt nhất” nếu tách khỏi workload. Quy tắc khởi đầu:
- chọn GPT-6 Astra cho thao tác máy tính diện rộng, điều phối công cụ, mã nguồn, khoa học và Agent nhạy cảm về an toàn;
- chọn Claude Fable 5.1 cho nghiên cứu và sản phẩm đầu ra dài hạn, phiên làm việc dùng cache nhiều hoặc tích hợp Claude Messages hiện có;
- nếu ràng buộc thật sự là độ trễ, throughput hay chi phí trên mỗi tác vụ thành công, đừng chỉ nhìn tên mô hình: hãy đo toàn bộ quy trình, gồm retry, lượt công cụ và đánh giá của con người.
Thông số công khai: điều đã biết và chưa biết
Bảng dưới đây dựa trên trang mô hình GPT-6 Astra của OpenAI, hướng dẫn mô hình của OpenAI, tổng quan Fable 5.1 và tài liệu giá của Anthropic.
| Thông số công khai | GPT-6 Astra | Claude Fable 5.1 | Cách hiểu trong thực tế |
|---|---|---|---|
| Model ID của nhà cung cấp | gpt-6-astra | claude-fable-5-1 | Dùng đúng ID; tên tiếp thị không phải hợp đồng API. |
| Ngày phát hành | 3/9/2026 | 1/9/2026 | Cả hai đều là bản phát hành thế hệ hiện tại tại thời điểm này. |
| Số tham số được công bố | Chưa công bố | Chưa công bố | Không biến ước tính bên thứ ba thành sự thật chính thức. |
| Cửa sổ ngữ cảnh | 1.050.000 token (1,05M) | 1.000.000 token (1M) | Astra lớn hơn một chút trên giấy; chất lượng truy hồi vẫn phụ thuộc tác vụ. |
| Đầu ra tối đa | 128.000 token | 128.000 token | Trần đầu ra gần như giống nhau. |
| Mốc kiến thức đáng tin cậy | 30/4/2026 | 6/2026 | Không mốc nào thay thế việc truy hồi thông tin mới. |
| Đầu vào → đầu ra | Văn bản và hình ảnh → văn bản | Văn bản và hình ảnh → văn bản | Các trang mô hình không nêu đầu ra âm thanh/video gốc cho so sánh này. |
| Điều khiển suy luận | low, medium, high, xhigh, max | Thinking thích ứng luôn bật; mặc định high | Điều khiển của hai nhà cung cấp không tương đương. |
| Đầu vào / đầu ra tiêu chuẩn | $10 / $50 mỗi MTok | $10 / $50 mỗi MTok | Giá cơ bản giống nhau trước cache, batch hoặc điều chỉnh gateway. |
| Đọc cache | $1 / MTok | $0,25 / MTok | Fable 5.1 có giá cache hit chính thức thấp hơn. |
| Ghi cache | $12,50 / MTok | $12,50 (5 phút) hoặc $20 (1 giờ) / MTok | Hãy so cả thời gian lưu cache. |
| Tính phí ngữ cảnh dài | Trên 272K token đầu vào: input/cache 2× và output 1,5× cho toàn bộ yêu cầu | Toàn bộ cửa sổ 1M theo giá token tiêu chuẩn | Cửa sổ lớn không đồng nghĩa với cùng một kinh tế chi phí. |
| Khả dụng từ nhà cung cấp | Trusted Access trước, sau đó API và gói ChatGPT trả phí | Bản Active mới nhất cho khách Claude API và nền tảng đối tác | Có mặt ở nhà cung cấp không có nghĩa là có mặt trên Modelflare. |
Bảng này cho thấy “cùng giá $10/$50” chưa đủ để kết luận. GPT-6 Astra có cửa sổ danh nghĩa lớn hơn một chút và bề mặt công cụ rộng; Fable 5.1 làm việc đọc cache lặp lại rất rẻ và tính giá tiêu chuẩn cho cửa sổ 1M. Không nhà cung cấp nào công bố số tham số có thể so sánh một cách có trách nhiệm.
GPT-6 Astra đã thay đổi điều gì
Từ trả lời sang thực hiện tác vụ
Tiến bộ cốt lõi của GPT-6 Astra là thực thi workflow. Tài liệu hướng mô hình tới suy luận phức tạp, kỹ thuật phần mềm, duyệt web, sử dụng máy tính, nghiên cứu và tạo tài liệu. Trong Responses API, Astra hỗ trợ tìm kiếm web, tìm kiếm tệp, tạo ảnh, code interpreter, hosted shell, apply-patch, sử dụng máy tính, MCP, tìm công cụ, streaming, function calling và đầu ra có cấu trúc.
Các hành vi API mới dành cho những tác vụ không thể hoàn thành trong một lượt:
- Gọi công cụ bất đồng bộ: mô hình tiếp tục suy luận độc lập trong lúc ứng dụng chạy công cụ, rồi tiếp tục bằng call ID ban đầu;
- Điều hướng giữa lượt: client gửi sửa đổi qua WebSocket khi mô hình đang làm việc mà vẫn giữ phần đã hoàn tất;
- Effort động: ứng dụng tăng hoặc giảm độ sâu suy luận mà không dựng lại tiền tố prompt đã cache.
Với nhà phát triển Agent, cách điều khiển chuyển từ “thử lại toàn bộ prompt” sang “tiếp tục tác vụ hiện tại trong ranh giới rõ ràng”. Ứng dụng vẫn chịu trách nhiệm chạy công cụ, cấp quyền, timeout và tác động phụ.
Sử dụng máy tính và sản phẩm chuyên môn
OpenAI báo cáo Astra đạt 72,6% ở điểm partial offline của OSWorld 2.0, so với 65,7% của GPT-5.6 Sol, và thời gian tác vụ mô phỏng ngắn hơn khoảng 47% trong so sánh đó. Với Codex harness, OpenAI báo cáo tốc độ hoàn thành Mind2Web nhanh hơn 1,9 lần sau khi kết hợp cải tiến mô hình và harness. Đây là đánh giá do nhà cung cấp báo cáo, không phải cam kết độ trễ của Modelflare.
Kết quả hướng tới không chỉ là một đoạn văn. Astra được huấn luyện để tạo tài liệu, bảng tính, bài trình chiếu, biểu đồ, website và mã đã kiểm thử theo template hoặc phong cách có sẵn. Điều này hữu ích khi bước cuối—kiểm tra UI, cập nhật tệp hay xác minh kết quả—quan trọng ngang với suy luận ở giữa.
An toàn và kiểm soát là một phần của bản phát hành
GPT-6 Astra là mô hình đầu tiên của OpenAI được Preparedness Framework xếp ở mức năng lực an ninh mạng Critical. Bản phát hành cũng nêu khả năng chống prompt injection tốt hơn trong môi trường duyệt web và làm việc, giám sát misalignment cho suy luận có công cụ, cùng cơ chế cô lập triển khai nghiêm ngặt hơn.
Có một điểm cần thận trọng: năng lực và khả năng giám sát không tăng hoàn toàn cùng hướng. OpenAI báo cáo ít cờ misalignment nghiêm trọng hơn và tuân thủ phạm vi được phép tốt hơn GPT-5.6 Sol, nhưng cũng ghi nhận Astra kiểm soát suy luận bằng văn bản tốt hơn trong các bài kiểm tra đối kháng nhằm né giám sát. Trong production, alignment chỉ là một lớp; công cụ quyền tối thiểu, xác nhận, audit log và nút dừng vẫn là trách nhiệm của ứng dụng.
Claude Fable 5.1 vẫn khác ở đâu
Công việc dài hạn
Anthropic định vị Fable 5.1 là bản kế nhiệm Fable 5 cho lập trình Agent kéo dài, nghiên cứu nhiều bước, tài liệu, bảng tính và slide. Toàn bộ ngữ cảnh 1M được tính theo giá tiêu chuẩn, adaptive thinking luôn bật và effort có thể thay đổi mà không làm mất prompt cache. Fable 5.1 cũng cải thiện xử lý trực quan với biểu đồ, báo cáo, bảng PDF dày đặc và khả năng phục hồi sau bước computer use thất bại.
Khác biệt kinh tế rõ nhất là tái sử dụng cache. Đọc cache có giá $0,25/MTok, trong khi Fable 5 vẫn là $1. Anthropic cũng cung cấp cùng nền tảng mô hình dưới tên Claude Mythos 5.1 với biện pháp bảo vệ chặt hơn, nhưng Mythos chỉ dành cho chương trình tin cậy và không phải lựa chọn phổ cập.
Hành vi API
Với client Messages tự xây dựng, Fable 5.1 không phải chỉ đổi tên mô hình. Anthropic ghi rõ ba ranh giới phá vỡ tương thích:
- ép dùng công cụ bằng tool_choice loại any hoặc tool trả về lỗi 400;
- các model Claude cũ không đọc được thinking blocks của Fable 5.1;
- sửa tin nhắn trước đó, system prompt hoặc danh sách công cụ có thể làm mất hiệu lực thinking blocks phía sau.
Cách di chuyển an toàn là lịch sử chỉ nối thêm, tự chọn công cụ với schema chặt chẽ và system message giới hạn theo lượt cho chỉ dẫn tạm thời. Bản phát hành còn thêm effort theo tin nhắn, cập nhật tiến độ dễ đọc và provenance nội dung. Trong vòng lặp dài, Fable 5.1 có thể gọi một công cụ mỗi lượt thay vì gom nhiều lệnh như Fable 5, vì vậy cần đo số round trip thực tế.
So sánh benchmark
Các điểm được chọn dưới đây lấy từ bảng so sánh khi ra mắt GPT-6 Astra của OpenAI, trong đó có kết quả Fable 5.1 do Anthropic báo cáo khi có sẵn. Bảng cho thấy hình dạng của frontier hiện tại, không phải xếp hạng phổ quát.
| Đánh giá | GPT-6 Astra | Claude Fable 5.1 | Gợi ý từ kết quả |
|---|---|---|---|
| AutomationBench | 41,4% | 31,4% | Astra dẫn đầu đánh giá workflow kinh doanh này. |
| BenchCAD | 95,9% | 84,3% | Astra dẫn đầu tập tác vụ CAD/chuyên môn được báo cáo. |
| Terminal-Bench 4.0 | 57,9% | 55,8% | Cả hai đều mạnh; Astra có lợi thế vừa phải. |
| DeepSWE v1.1 | 74,1% | 67,4% | Astra dẫn đầu đánh giá Agent kỹ thuật phần mềm này. |
| Terminal-Bench Science 0.1 | 64,6% | 52,6% | Lợi thế được báo cáo của Astra lớn hơn ở workflow khoa học này. |
| FrontierMath Tier 4 (v2) | 97,6% | 87,8% | Astra báo cáo lợi thế toán học đáng kể trong cấu hình này. |
| GPQA Diamond | 96,0% | 93,7% | Cả hai gần nhóm đầu; khoảng cách nhỏ hơn. |
| Humanity’s Last Exam, có công cụ | 57,2% | 65,0% | Fable 5.1 dẫn ở điểm thi có công cụ được báo cáo này. |
| HealthBench Professional | 63,4% | 58,1% | Astra dẫn đầu đánh giá y tế chuyên môn này. |
| ExploitGym | 42,4% | 30,4% | Astra báo cáo năng lực an ninh mạng cao hơn; phải dùng biện pháp bảo vệ. |
| Artificial Analysis Intelligence Index v4.1.1 | 61,2 | 65,7 | Chỉ số bên ngoài được trích dẫn trong bài ra mắt nghiêng về Fable 5.1. |
Các ngoại lệ rất quan trọng. Chính bảng của OpenAI cho thấy Fable 5.1 dẫn trước ở Humanity’s Last Exam có công cụ và Artificial Analysis Intelligence Index. Harness, effort, công cụ, phiên bản tác vụ và chính sách can thiệp an toàn khác nhau; một số giá trị không thể so sánh trực tiếp. Điểm do nhà cung cấp công bố mô tả một cấu hình cụ thể, không đảm bảo mô hình thắng prompt của đội ngũ bạn.
Kinh tế chi phí và cache
Theo giá niêm yết của nhà cung cấp, cả hai mô hình đều tính $10 cho một triệu token đầu vào và $50 cho một triệu token đầu ra. Khác biệt nằm ở các hệ số bổ sung:
- GPT-6 Astra đọc cache với giá $1/MTok và ghi cache $12,50. Batch và Flex bằng 50% giá chuẩn, Fast mode là 2×. Trên 272K token đầu vào, toàn bộ yêu cầu áp dụng input/cache 2× và output 1,5×.
- Fable 5.1 đọc cache với giá $0,25/MTok; ghi 5 phút và 1 giờ lần lượt $12,50 và $20. Cửa sổ 1M đầy đủ giữ giá chuẩn, còn Batch giảm một nửa đầu vào và đầu ra.
Ở phép so sánh đơn giản, một triệu token đầu vào đọc từ cache có giá khoảng $1,00 trên GPT-6 Astra so với $0,25 trên Fable 5.1. Mười lần đọc tạo ra chênh lệch $7,50 trước khi tính output, công cụ, chiết khấu gateway hay retry. Điều đó không chứng minh Fable luôn hoàn thành tác vụ rẻ hơn: vòng lặp chậm hơn, nhiều lượt công cụ hơn hoặc output dài hơn có thể xóa khoản tiết kiệm.
Hãy dùng công thức cho toàn bộ tác vụ thay vì một đơn giá:
chi phí tác vụ = token đầu vào + đọc cache + ghi cache + token đầu ra + phí công cụ hoặc dịch vụ
Nhân từng hạng mục với giá áp dụng rồi chia cho số tác vụ hoàn thành thành công, không phải số request. Tokenizer cũng khác nhau, vì vậy số ký tự không phải cơ sở ngân sách đáng tin cậy giữa các nhà cung cấp.
Ma trận quyết định theo workload
Đây là công cụ quyết định nguyên gốc của bài viết. Ma trận kết hợp tính năng được ghi nhận, bằng chứng benchmark đã chọn, cơ chế giá và ranh giới truy cập hiện tại; nó không phải benchmark mới.
| Workload | Điểm bắt đầu | Lý do | Ranh giới cần xác minh |
|---|---|---|---|
| Trình duyệt hoặc desktop với nhiều công cụ | GPT-6 Astra | Bề mặt computer use rộng, công cụ bất đồng bộ, steering và kết quả OSWorld được báo cáo tốt. | Xác nhận quyền, chính sách xác nhận, độ trễ và phục hồi tác động phụ. |
| Coding và migration quy mô repository | GPT-6 Astra, đồng thời đánh giá nghiêm túc Fable 5.1 | Astra dẫn ở các điểm coding đã chọn; Fable mạnh trong phiên dài và sửa nguyên nhân gốc. | Chạy lại cùng repository, test, vòng lặp công cụ và rollback. |
| Memo nghiên cứu, spreadsheet hoặc slide | Fable 5.1 cho artefact; Astra cho quy trình browser→artefact | Fable được tối ưu rõ ràng cho công việc tri thức dài hạn; Astra mạnh ở computer use và tạo tài liệu. | So sánh khả năng nhớ trích dẫn, bố cục, lượt công cụ và chỉnh sửa của người. |
| Ngữ cảnh lặp lại dùng cache nhiều | Fable 5.1 | Đọc cache $0,25/MTok và cửa sổ 1M theo giá chuẩn. | Kiểm tra hit rate, thời hạn ghi, số token và hóa đơn gateway. |
| Công việc bảo mật phòng thủ nhạy cảm | GPT-6 Astra với biện pháp đã được phê duyệt | OpenAI ghi nhận năng lực mạng mạnh hơn và giám sát bổ sung. | Dùng mục tiêu được phép, quyền tối thiểu, audit và phê duyệt con người. |
| Viết hoặc bản địa hóa đa ngôn ngữ | Không có bên thắng tự động | Không bản phát hành nào chứng minh ưu thế ngôn ngữ quyết định. | Chạy cùng corpus được kiểm soát thuật ngữ ở từng ngôn ngữ. |
| Dịch vụ throughput cao hoặc độ trễ thấp nghiêm ngặt | Có thể nên chọn model nhỏ hơn | Cả hai có giá frontier và tốn effort; Fable được ghi nhận chậm hơn, Astra phụ thuộc mode và harness. | Đo p50/p95, output đầu tiên, chi phí mỗi tác vụ thành công và fallback. |
Vị trí mô hình vào ngày 4 tháng 9 năm 2026
Bức tranh hiện tại phù hợp với một bản đồ hai trục hơn là một bảng xếp hạng duy nhất.
- GPT-6 Astra là flagship end-to-end đa năng. API công khai, workflow computer use, điều phối công cụ, kết quả khoa học và coding, ngữ cảnh dài và kiểm soát an toàn đưa nó lên tuyến đầu của công việc Agent tổng quát. Hướng dẫn mô hình hiện tại của OpenAI cũng khuyên bắt đầu bằng Astra cho suy luận và coding khó nhất.
- Claude Fable 5.1 là mô hình chuyên biệt đồng dẫn đầu. Nó vẫn ở frontier về coding và tri thức, thắng một số đánh giá công khai và có kinh tế cache đặc biệt thuận lợi. Đây không phải model cũ chỉ chờ bị thay thế.
- “Tốt nhất” phụ thuộc vào đơn vị công việc. Với tác vụ trình duyệt được cấp quyền, stack công cụ và an toàn của Astra có thể vượt trội. Với mười lượt nghiên cứu đọc lại tiền tố 1M ổn định, kinh tế cache của Fable có thể vượt trội. Với artefact cuối, thời gian chỉnh sửa của con người có thể quan trọng hơn điểm thô.
- Quyền truy cập cũng là một phần vị trí mô hình. Một model frontier toàn cầu vẫn có thể chưa có trong gateway, tài khoản, khu vực hay giao thức cụ thể. Phải kiểm tra riêng năng lực và khả dụng.
Khả dụng trên Modelflare và ranh giới tích hợp
Danh mục trực tiếp của Modelflare được kiểm tra vào ngày 4 tháng 9 năm 2026 qua https://modelflare.dev/api/pricing. Khi đó claude-fable-5-1 xuất hiện trên các bề mặt tương thích Anthropic và OpenAI cùng ba nhóm định tuyến công khai. Cùng phản hồi đó không có gpt-6-astra. Vì vậy bài viết không hứa hẹn quyền truy cập hay giá GPT-6 trên Modelflare; trang giá trực tiếp và danh sách model là nguồn sự thật sản phẩm.
| Mục danh mục Modelflare | Quan sát hiện tại | Input / output người dùng | Định vị |
|---|---|---|---|
| claude-award + claude-fable-5-1 | Có trong danh sách, tỷ lệ 0,25× | $2,50 / $12,50 mỗi 1M token | Tuyến Fable rẻ nhất cho công việc có thể retry và chấp nhận biến động. |
| claude-stable + claude-fable-5-1 | Có trong danh sách, tỷ lệ 0,315× | $3,15 / $15,75 mỗi 1M token | Tuyến cân bằng cho sử dụng hằng ngày và production. |
| claude-premium + claude-fable-5-1 | Có trong danh sách, tỷ lệ 0,5× | $5,00 / $25,00 mỗi 1M token | Tuyến Fable ưu tiên ổn định. |
| gpt-6-astra | Không có trong phản hồi được kiểm tra | Chưa có giá công khai Modelflare tại thời điểm kiểm tra | Không hard-code truy cập trước khi danh mục và probe endpoint thật khớp nhau. |
Bài phân tích chuyên sâu Fable 5.1 của Modelflare trình bày tuyến, request Messages và migration riêng. Để chọn giao thức, xem checklist migration Responses API, Responses API so với Chat Completions và định tuyến AI API đáng tin cậy.
Nếu GPT-6 Astra xuất hiện trong danh mục sau này, hãy dùng đúng ID gpt-6-astra, kiểm tra nhóm và thử endpoint mà client thực sự cần. Hướng dẫn OpenAI khuyến nghị Responses API cho tool calling và loại bỏ tham số không hỗ trợ như temperature và top_p. Đọc danh sách model thành công không tự chứng minh streaming, công cụ, output có cấu trúc hay computer use.
Giới hạn, thận trọng và sử dụng có trách nhiệm
- Tham số chưa biết: tổng số và số kích hoạt chưa được công bố. Context, output và benchmark không phải số tham số.
- Benchmark không chắc chắn: kết quả do nhà cung cấp báo cáo hoặc lấy từ bảng phát hành. Harness, prompt, effort, công cụ, bộ lọc và phiên bản tác vụ đều có thể đổi kết quả.
- Giao thức không chắc chắn: một ID không bảo đảm field hay event giống nhau giữa Responses, Chat Completions, Anthropic Messages, Bedrock, Google Cloud và lớp tương thích.
- Tính mới: cả hai model đều có mốc kiến thức. Dùng retrieval cho dữ kiện hiện tại và ghi ngày nguồn.
- An toàn: model mạnh hơn có thể tạo lỗi tác động lớn hơn. Hạn chế công cụ, tách kế hoạch khỏi thực thi, yêu cầu xác nhận hành động không thể đảo ngược và lưu audit bên ngoài.
- Giá và truy cập: giá, quy tắc cache, nhóm và khả dụng thay đổi. Kiểm tra lại trang nhà cung cấp và Modelflare trước quyết định production.
Câu hỏi thường gặp
GPT-6 Astra có tốt hơn Claude Fable 5.1 không? Theo bằng chứng công khai, GPT-6 Astra là flagship tổng quát mạnh hơn cho computer use, điều phối công cụ, coding và khoa học. Fable 5.1 vẫn cạnh tranh và dẫn đầu một số đánh giá; nó có thể phù hợp hơn cho công việc tri thức dài hạn dùng nhiều cache.
GPT-6 Astra có bao nhiêu tham số? OpenAI chưa công bố số tổng hoặc số kích hoạt đã được xác minh trên các trang model và phát hành chính thức được kiểm tra. Ước tính trực tuyến không phải thông số chính thức.
Model nào rẻ hơn? Giá cơ bản của cả hai là $10/$50 cho mỗi triệu token đầu vào/đầu ra. Fable 5.1 rẻ hơn khi đọc cache, còn Astra có modifier Batch, Flex và Fast. Chi phí thật phụ thuộc token, cache hit, lượt công cụ, độ trễ và retry.
Model nào tốt cho coding Agent? Bắt đầu với GPT-6 Astra nếu Agent phải duyệt web, chỉnh sửa, kiểm thử và điều phối công cụ. Cân nhắc Fable 5.1 cho phiên dài với ngữ cảnh ổn định hoặc hợp đồng Claude Messages sẵn có. Hãy chạy lại cùng repository trước khi chuyển.
GPT-6 Astra đã có trên Modelflare chưa? Nó không xuất hiện trong phản hồi giá trực tiếp được kiểm tra ngày 4 tháng 9 năm 2026. Trạng thái phát hành chính thức của OpenAI và quyền truy cập gateway là hai sự thật khác nhau; hãy xem /pricing và danh sách model.
Cả hai có context 1M không? Có. Trang chính thức ghi nhận cửa sổ cấp 1M: 1,05M cho GPT-6 Astra và 1M cho Fable 5.1. Cách tính phí, tokenizer, hành vi retrieval và giới hạn giao thức vẫn khác nhau.
Nguồn và nhật ký cập nhật
- OpenAI: GPT-6 Astra — A new generation of intelligence
- OpenAI API: model GPT-6 Astra
- OpenAI API: hướng dẫn model GPT-6 Astra
- OpenAI: tổng quan an toàn GPT-6 Astra
- Anthropic: Introducing Claude Fable 5.1 and Claude Mythos 5.1
- Claude Platform: tổng quan Fable 5.1
- Claude Platform: điểm mới trong Fable 5.1
- Claude Platform: giá Fable
- Model và giá trực tiếp của Modelflare
Nhật ký cập nhật: ngày 4 tháng 9 năm 2026 — gói xuất bản ban đầu. Đã kiểm tra lại thông số chính thức, so sánh, quy tắc giá và khả dụng của GPT-6 Astra và Fable 5.1; danh mục Modelflare cũng được kiểm tra cùng ngày: Fable 5.1 có trong danh sách, GPT-6 Astra không có. Bài viết không tuyên bố tái tạo benchmark độc lập và không sử dụng số tham số chưa được công bố.