Giao một việc dài hơi cho AI rồi đi làm việc khác là mong muốn chung của người làm code, nhưng hai hãng dẫn đầu chọn hai phương án khác nhau. Claude Fable 5.1 của Anthropic ra mắt ngày 01/09/2026, làm việc qua Claude Code trong cửa sổ dòng lệnh. Hai ngày sau, OpenAI công bố GPT-6 Astra với năng lực computer use, tức tự quan sát màn hình, nhấp chuột và gõ phím thay bạn. Cùng giá API, cùng nhắm vào lập trình, nhưng cách vận hành, độ an toàn và cấu hình laptop để dùng mượt lại chênh lệch rõ. Bài viết chỉ so sánh trực tiếp khi cả hai hãng công bố số trên cùng thước đo.
Claude Fable 5.1 và GPT-6 Astra khác nhau ở cách làm việc
Anthropic định vị Claude Fable 5.1 là mô hình cấp Mythos, dùng chung lõi với phiên bản Mythos 5.1 nhưng kèm lớp bảo vệ, và xếp trên Opus 5 trong dải sản phẩm. Điểm mấu chốt với người viết mã là mô hình này khả dụng ngay trong Claude Code, công cụ agent chạy trong terminal: đọc kho mã, chạy thử, sửa lỗi rồi kiểm tra lại, tất cả bằng văn bản. Bạn thấy từng lệnh nó định chạy và có quyền từ chối trước khi lệnh thực thi.

GPT-6 Astra được OpenAI mô tả là “mô hình thông minh và được căn chỉnh tốt nhất thế giới”, một tuyên bố của hãng, chưa có bên thứ ba xác nhận. Trục chính của Astra là computer use: mô hình quan sát ảnh chụp màn hình, di chuyển con trỏ, điền biểu mẫu và điều khiển phần mềm đồ họa như một người ngồi trước laptop. Astra khả dụng trong ChatGPT gói Plus, Pro, Business, Enterprise, qua API, Azure và AWS Bedrock. Với doanh nghiệp, tính năng này mặc định tắt lúc ra mắt.
Hai nguyên lý vận hành dẫn tới hai kiểu công việc phù hợp. Terminal-agent hợp với công việc diễn đạt được bằng lệnh và tệp: tái cấu trúc mã, viết test, xử lý dữ liệu, tự động hóa quy trình build. Computer use hợp với công việc bị khóa trong giao diện đồ họa: phần mềm kế toán không có API, cổng web nội bộ, ứng dụng desktop cũ. Nếu phần lớn công việc của bạn nằm trong terminal, hãy ưu tiên khác biệt về mô hình hơn khác biệt về giao diện.
Điểm coding của Claude Fable 5.1 so với GPT-6 Astra
Hai hãng công bố hai bộ bài kiểm chuẩn gần như không trùng nhau, nên phần lớn số liệu chỉ có thể trình bày song song. Chỉ hai bài có số chính chủ từ cả hai phía, đáp ứng điều kiện so sánh trực tiếp: Terminal-Bench 4.0 đo lập trình agent trong terminal và Terminal-Bench-Science 0.1 đo nghiên cứu khoa học tự động. Cả Anthropic lẫn OpenAI đều ghi GPT-5.6 Sol ở mức 37,3% trên Terminal-Bench 4.0, một dấu hiệu xác nhận hai phòng thí nghiệm dùng cùng thang đo.
| Bài kiểm chuẩn | Claude Fable 5.1 (Anthropic công bố) | GPT-6 Astra (OpenAI công bố) | Cùng thước đo |
|---|---|---|---|
| Terminal-Bench 4.0 | 55,8% | 57,9% | Có |
| Terminal-Bench-Science 0.1 | 52,6% | 64,6% | Có, sai số 3,5-4,5 điểm |
| OSWorld 2.0 | 77,9% (bộ tác vụ 8/2026) | 72,6% (offline) | Không |
| DeepSWE v1.1 | Không công bố | 74,1% | Không |
| FrontierCode 1.1 Extended | Không công bố | 64,5% | Không |
| CursorBench 3.2.0 | 73,4% | Không công bố | Không |
Trên Terminal-Bench 4.0, Astra nhỉnh hơn 2,1 điểm, một chênh lệch nhỏ khi Anthropic ghi rõ Fable 5.1 được đo với lớp bảo vệ bật. Ở Terminal-Bench-Science, chênh lệch 12 điểm nghiêng về Astra là rõ hơn, dù Anthropic nêu sai số chuẩn tới 4,5 điểm cho mỗi mô hình. Với OSWorld 2.0, Anthropic dùng bộ tác vụ phát hành tháng 8/2026, chấm 0 điểm ở những tác vụ mà lớp bảo vệ can thiệp, và nói thẳng con số này không so ngang được với kết quả trước đó, nên 77,9% và 72,6% không phải là một cuộc đua.
Mức tăng từ 42,0% của Fable 5 lên 55,8% ở bản 5.1 là điểm Anthropic nhấn mạnh trong thông báo ra mắt Claude Fable 5.1 và Mythos 5.1. Với người làm việc trong Claude Code, ý nghĩa nằm ở hiệu năng trên tác vụ dài: mô hình ít lạc hướng hơn trong chuỗi đọc mã, chạy thử, sửa lỗi. Còn ưu thế coding của Astra thể hiện qua DeepSWE v1.1 đạt 74,1% và FrontierCode 1.1 Extended đạt 64,5%, hai bài mà Anthropic không công bố số tương ứng.
Claude Code tại terminal và computer use trên màn hình laptop
Claude Code cài qua npm hoặc bộ cài riêng, hỗ trợ Terminal của macOS, Windows và Linux, và đọc trực tiếp thư mục dự án bạn đang mở. Một phiên điển hình: bạn mô tả yêu cầu, mô hình lập kế hoạch, sửa nhiều tệp, tự chạy test rồi báo cáo. Vì mọi thao tác là lệnh, bạn xem lại được lịch sử, đưa vào git và tái lập trên máy khác. Gói Claude Pro trở lên đã bao gồm công cụ này với hạn mức theo phiên, chủ đề mà Hưng Phát đã phân tích trong bài Kinh nghiệm dùng Claude Pro: Sử dụng sao cho không phí hạn mức.
GPT-6 Astra thao tác theo cách một người thao tác máy: chụp màn hình, suy luận, nhấp chuột, gõ phím, lặp lại. Ưu thế là không cần API hay dòng lệnh, mô hình vào được mọi phần mềm có giao diện. Nhược điểm là tốc độ phụ thuộc vào vòng lặp quan sát và hành động. OpenAI cho biết Astra rút ngắn 47% thời gian mỗi tác vụ OSWorld so với GPT-5.6 Sol, nhưng đây vẫn là quy trình từng bước trên màn hình, và laptop phải duy trì nguyên trạng thái trong suốt phiên.

Với lập trình viên, Astra còn hiện diện trong Codex, môi trường kỹ nghệ phần mềm của OpenAI, nên bạn không bắt buộc dùng computer use cho việc viết mã. Ngược lại, Anthropic cũng nêu Claude Fable 5.1 có thể vận hành trình duyệt trong các tác vụ agent, dù không công bố số đo riêng cho phần này. Ranh giới giữa hai bên vì thế là trọng tâm chứ không phải độc quyền: một bên đặt terminal làm mặc định, bên kia đặt màn hình làm mặc định.
Về ngữ cảnh làm việc, Claude Fable 5.1 duy trì cửa sổ 1 triệu token theo tài liệu docs.claude.com, đủ nạp một kho mã cỡ vừa cùng tài liệu kèm theo. OpenAI không nêu cửa sổ ngữ cảnh của Astra trên trang giới thiệu, nên bài không đưa con số ước đoán. Với dự án lớn, giới hạn thực chất thường không phải cửa sổ ngữ cảnh mà là chi phí nạp lại ngữ cảnh ở mỗi lượt, phần sẽ bàn ngay dưới.
Chi phí API và gói thuê bao khi dùng lâu dài
Giá niêm yết API của hai mô hình trùng nhau: 10 USD mỗi triệu token đầu vào, 50 USD mỗi triệu token đầu ra. Chênh lệch nằm ở phần đọc bộ nhớ đệm, thứ quyết định chi phí thực của phiên agent dài vì ngữ cảnh được nạp lại liên tục. Anthropic hạ giá đọc cache xuống 0,25 USD mỗi triệu token, bằng 2,5% giá đầu vào, và ước tính khối lượng công việc agent rẻ hơn tới 45% so với Fable 5. OpenAI công bố Fast mode nhanh gấp đôi với giá gấp đôi, không nêu giá cache trên trang ra mắt.
| Hạng mục | Claude Fable 5.1 | GPT-6 Astra |
|---|---|---|
| Token đầu vào (API) | 10 USD/triệu | 10 USD/triệu |
| Token đầu ra (API) | 50 USD/triệu | 50 USD/triệu |
| Đọc cache | 0,25 USD/triệu | Không công bố |
| Batch API | 5 USD vào, 25 USD ra | Không nêu trên trang ra mắt |
| Chế độ nhanh | Không có | Fast mode, giá gấp đôi |
| Gói thuê bao | Pro, Max, Team, Enterprise | Plus, Pro, Business, Enterprise |
| Nguồn | anthropic.com, docs.claude.com | openai.com |
Với cá nhân, gói thuê bao thường là phương án kinh tế hơn API. Claude Fable 5.1 mở cho Pro, Max, Team và Enterprise, dùng chung hạn mức với Claude Code. Astra mở cho Plus, Pro, Business và Enterprise, kèm bản Astra Pro cho các gói cao. Cả hai hãng không công bố hạn mức theo số lượt ngay trên trang giới thiệu, nên bạn cần thử trong một tuần làm việc thật để biết gói nào đủ.
Có một chi tiết riêng với thị trường Việt Nam: giá API tính bằng USD và trừ qua thẻ quốc tế, còn gói thuê bao có thể thanh toán qua kho ứng dụng. Với đội nhóm chạy agent suốt ngày, đọc cache rẻ là ưu thế thật của Anthropic. Với cá nhân dùng vài giờ mỗi ngày, chênh lệch chi phí giữa hai bên gần như bằng không, và yếu tố quyết định quay về cách làm việc bạn thấy tiện hơn.
Rủi ro bảo mật khi trao quyền cho agent tự thao tác
Cả hai công cụ đều đòi quyền hành động thay bạn, và đây là chỗ cần thận trọng nhất. Claude Code mặc định hỏi trước mỗi lệnh ghi tệp hay chạy shell; bạn có thể cấp quyền theo từng loại thao tác hoặc theo thư mục. Rủi ro điển hình là lệnh xóa nhầm, đẩy nhầm nhánh git, hoặc mô hình đọc tệp cấu hình chứa khóa API rồi đưa vào ngữ cảnh. Cách phòng đơn giản là ưu tiên làm việc trong nhánh riêng và không để tệp .env trong thư mục được cấp quyền.
Computer use của GPT-6 Astra mở rộng bề mặt tấn công sang toàn bộ màn hình, nơi chứa nhiều dữ liệu nhạy cảm. Một trang web hay email chứa chỉ dẫn ẩn có thể đánh lừa agent thực hiện thao tác ngoài ý muốn, hình thức được gọi là prompt injection. OpenAI cho biết Astra được giám sát bằng Codex Auto-review và theo dõi chuỗi hành động; khi hệ thống an toàn can thiệp, tác vụ trong ChatGPT hoặc Codex sẽ tạm dừng để bạn xem lại, còn trong API tác vụ dừng hẳn.

OpenAI cũng công bố kết quả kiểm thử nội bộ tại trang giới thiệu GPT-6 Astra: GPT-5.6 Sol khi không có lớp bảo vệ đã vượt quá mục tiêu được cấp phép trong 48% trường hợp, còn Astra là 0%. Đây là số do chính hãng đo trên bộ thử của hãng. Phía Anthropic, Claude Fable 5.1 kèm bộ phân loại an toàn kích hoạt mặc định cho mảng an ninh mạng và sinh học, giảm khoảng 60% số lần lớp bảo vệ an ninh mạng can thiệp mỗi phiên Claude Code so với Fable 5, và từ chối các yêu cầu tấn công tinh vi.
Nguyên tắc chung khi dùng agent trên laptop cá nhân: tạo tài khoản hệ điều hành riêng cho agent, không lưu mật khẩu trong trình duyệt mà agent điều khiển, và luôn xác minh trước khi cho phép thao tác thanh toán hay gửi dữ liệu ra ngoài. Terminal-agent dễ kiểm soát hơn vì mọi thứ là văn bản; computer use tiện hơn nhưng khó biết mô hình đã nhìn thấy gì trên màn hình.
Ai nên chọn Claude Fable 5.1 và laptop nào chạy mượt
Nếu công việc của bạn là viết mã, bảo trì hệ thống, xử lý dữ liệu bằng script, Claude Fable 5.1 trong Claude Code là phương án tự nhiên: mọi thao tác nằm trong git, chi phí cache thấp, và mô hình được Anthropic thiết kế cho phiên làm việc nhiều giờ. Nếu việc của bạn bị khóa trong phần mềm đồ họa không có API, hoặc bạn đã dùng ChatGPT hằng ngày, Astra với computer use giải quyết đúng chỗ nghẽn đó.

Về cấu hình, cả hai mô hình chạy trên máy chủ và laptop chỉ là thiết bị truy cập, nhưng phiên agent lại mở rất nhiều thứ cùng lúc: terminal, trình soạn thảo, trình duyệt với hàng chục thẻ, đôi khi thêm Docker. RAM 32 GB là ngưỡng Hưng Phát khuyến nghị để không tràn bộ nhớ khi Astra chụp màn hình liên tục hoặc Claude Code chạy test song song. Vì sao RAM lớn quan trọng hơn GPU với kiểu công việc này đã được phân tích trong bài Chọn laptop khoa học dữ liệu: Ưu tiên RAM lớn, CPU đa nhân hay giới hạn VRAM cho CUDA?.
Hai điểm nữa nên ưu tiên: cổng Thunderbolt 4 để nối màn hình ngoài cùng ổ cứng tốc độ cao qua một dây, và màn hình 16:10 độ phân giải cao để theo dõi agent làm việc mà không phải cuộn liên tục. Trong kho Hưng Phát tính đến 07/09/2026, Lenovo ThinkPad X1 Carbon Gen 13 (2025) bản Core Ultra 7 258V, 32 GB RAM, màn hình WUXGA cảm ứng, tầm 40 triệu, và Dell 14 Premium DA14250 (2025) với Core Ultra 7 255H, 32 GB RAM, màn hình 3.2K OLED cảm ứng, tầm 39 triệu, đều đáp ứng đủ ba tiêu chí trên.
Câu hỏi thường gặp về Claude Fable 5.1 và GPT-6 Astra
Claude Fable 5.1 và GPT-6 Astra có so sánh trực tiếp được không?
Chỉ trên Terminal-Bench 4.0 (55,8% so với 57,9%) và Terminal-Bench-Science 0.1 (52,6% so với 64,6%), vì đây là hai bài cả Anthropic lẫn OpenAI đều công bố số. Các bài còn lại như OSWorld 2.0, DeepSWE hay CursorBench chỉ có số một phía hoặc chạy bộ tác vụ khác nhau.
Dùng Claude Code có phải trả thêm tiền ngoài gói Claude Pro?
Không. Công cụ này dùng chung hạn mức của gói Pro, Max, Team hoặc Enterprise. Chỉ khi gọi qua API bạn mới trả 10 USD đầu vào và 50 USD đầu ra cho mỗi triệu token, cộng 0,25 USD cho mỗi triệu token đọc cache.
Computer use của GPT-6 Astra có mở sẵn cho tài khoản doanh nghiệp?
Không. Theo OpenAI, quản trị viên Enterprise phải tự bật Astra cho không gian làm việc vì tính năng mặc định tắt lúc ra mắt. Tài khoản Plus và Pro cá nhân được mở dần theo từng đợt.
Laptop 16 GB RAM có chạy được hai công cụ này không?
Được, vì mô hình xử lý trên máy chủ. Nhưng khi mở cùng lúc terminal, trình soạn thảo, trình duyệt nhiều thẻ và Docker, 32 GB giúp duy trì phiên agent dài không bị chậm do tràn bộ nhớ.
