Ra mắt đầu tháng 9/2026, GPT-6 Astra cho thấy OpenAI không còn chỉ chạy đua về khả năng trả lời hay viết code. Trọng tâm mới là AI có thể tự thao tác máy tính, dùng công cụ và hoàn thành một quy trình công việc từ đầu đến cuối.

Ngày 3/9/2026, OpenAI chính thức giới thiệu GPT-6 Astra, model mới tập trung mạnh vào coding, research, computer use và các tác vụ nhiều bước. Nếu các thế hệ GPT trước thường được đánh giá bằng khả năng trả lời câu hỏi hay sinh code, Astra cho thấy một hướng phát triển khác rõ ràng hơn: AI Agent có thể trực tiếp làm việc thay vì chỉ hướng dẫn người dùng.
Đây cũng là điểm khiến Astra trở thành đối thủ đáng chú ý của Claude Fable 5.1, model mới của Anthropic vốn rất mạnh về coding, knowledge work và các tác vụ kéo dài.
Khác biệt lớn nhất của Astra không nằm ở một benchmark reasoning đơn lẻ, mà ở khả năng kết hợp nhiều công cụ trong cùng một workflow.
Astra được thiết kế để có thể làm việc với trình duyệt, terminal, tài liệu, spreadsheet và các phần mềm khác. Thay vì người dùng hỏi AI rồi tự thực hiện từng bước, mục tiêu là giao cho AI một nhiệm vụ và để agent tự xử lý phần lớn quy trình.
Ví dụ, một developer có thể yêu cầu:
Điểm quan trọng ở đây không phải AI viết được một đoạn code đẹp đến đâu, mà là nó có thể tự đi hết bao nhiêu bước trước khi cần con người can thiệp.
Theo số liệu OpenAI công bố, GPT-6 Astra đạt 41,4% trên AutomationBench, trong khi Claude Fable 5.1 đạt 31,4%. Đây là benchmark tập trung vào các workflow công việc thực tế, và khoảng cách này cho thấy Astra đang có lợi thế đáng kể ở mảng agentic workflow.
Nếu chỉ nhìn vào coding, cuộc đua vẫn cân bằng hơn nhiều.
Claude Fable 5.1 tiếp tục là một model rất mạnh cho các task như phân tích codebase lớn, debug, root-cause analysis và long-running coding. Anthropic công bố Fable 5.1 đạt 55,8% trên Terminal-Bench 4.0 và 73,4% trên CursorBench 3.2.
Trong khi đó, OpenAI định vị Astra mạnh ở software engineering, đặc biệt khi coding được kết hợp với terminal, browser và các công cụ khác.
Điều này tạo ra một khác biệt khá thú vị.
Claude có xu hướng nổi bật khi cần phân tích sâu và giữ mạch suy luận trong một task dài. Astra lại đặc biệt đáng chú ý khi task yêu cầu AI vừa suy luận vừa trực tiếp thao tác nhiều công cụ để hoàn thành công việc.
Với developer, đây có thể quan trọng hơn việc so sánh một vài điểm benchmark.
Một model có thể viết code tốt hơn 5% nhưng phải hỏi lại người dùng liên tục chưa chắc hiệu quả bằng một agent có thể tự build, test, đọc log và sửa lỗi trong nhiều vòng liên tiếp.
GPT-6 Astra không thắng ở mọi mặt.
Ngay trong số liệu do OpenAI công bố, Claude Fable 5.1 đạt 65,7 trên Artificial Analysis Intelligence Index, cao hơn Astra ở mức 61,2.
Anthropic cũng đang tập trung mạnh vào scientific research, knowledge work và các tác vụ kéo dài nhiều giờ. Fable 5.1 được thiết kế để duy trì trạng thái công việc lâu hơn, tự kiểm tra kết quả và xử lý những vấn đề phức tạp mà không dễ mất mạch.
Vì vậy, kết luận rằng GPT-6 Astra đã “đánh bại Claude” sẽ là quá sớm.
Thực tế hợp lý hơn là hai hãng đang nhấn mạnh hai thế mạnh hơi khác nhau:
Cuộc đua AI trước đây thường xoay quanh những câu hỏi như:
“Model nào thông minh hơn?”
“Model nào viết code tốt hơn?”
“Model nào có context lớn hơn?”
Nhưng với Astra, tiêu chí đánh giá có thể đang thay đổi.
Câu hỏi thực tế hơn sẽ là:
Model nào có thể tự hoàn thành nhiều công việc hơn với ít sự can thiệp của con người hơn?
Đây là thay đổi rất lớn.
Trong môi trường doanh nghiệp, chi phí của AI không chỉ là giá token. Chi phí còn bao gồm thời gian con người phải kiểm tra, sửa prompt, chạy lại, giải thích context và xử lý khi agent đi sai hướng.
Nếu một model đắt hơn một chút nhưng có thể hoàn thành task sau một lần giao việc, nó hoàn toàn có thể rẻ hơn một model cần năm hoặc mười vòng trao đổi.
Hiện tại chưa có một model thắng tuyệt đối.
Nếu công việc chủ yếu là phân tích tài liệu, reasoning dài, research hoặc cần một coding partner giữ context tốt trong thời gian dài, Claude Fable 5.1 vẫn là lựa chọn rất mạnh.
Nếu công việc cần kết hợp code, terminal, browser và các ứng dụng khác để thực hiện một workflow hoàn chỉnh, GPT-6 Astra đang là model đặc biệt đáng chú ý.
Với developer hoặc các team đang xây AI Agent, Astra có thể hấp dẫn hơn chính vì khả năng biến reasoning thành hành động.
GPT-6 Astra không chỉ là một bản nâng cấp về “độ thông minh” của GPT.
Điểm đáng chú ý nhất là OpenAI đang đẩy mạnh quá trình chuyển từ chatbot sang AI Agent có khả năng trực tiếp thực hiện công việc.
Claude vẫn là đối thủ cực mạnh và thậm chí dẫn trước Astra ở một số benchmark. Nhưng Astra cho thấy cuộc đua AI đang bước sang một giai đoạn khác: model tốt nhất có thể sẽ không phải model trả lời hay nhất, mà là model hoàn thành công việc thực tế tốt nhất.
Trong vài năm tới, đây có lẽ sẽ là câu hỏi quan trọng hơn nhiều so với việc GPT hay Claude có thêm bao nhiêu điểm benchmark.
Bình luận
Chưa có bình luận nào. Hãy là người đầu tiên!
Bạn cần đăng nhập để bình luận.