Trong suốt nhiều năm, câu hỏi về trí tuệ nhân tạo tổng quát - loại AI có thể làm bất cứ việc gì mà con người làm được - vẫn là chủ đề tranh luận học thuật. Ngày hôm nay, OpenAI quyết định đặt dấu mốc mới cho cuộc đua chinh phục thử thách đó.
Chủ tịch OpenAI, ông Greg Brockman nói thẳng trong buổi họp báo: "Với tôi, tôi tin chúng ta đã ở đó. Tôi nghĩ không phải là vô lý khi cảm thấy chúng ta đang ở trong kỷ nguyên AGI." Đây là lần đầu tiên một lãnh đạo cấp cao của một công ty AI hàng đầu thế giới tuyên bố như vậy một cách trực tiếp.
GPT-6 Astra, được OpenAI mô tả là kết quả của "nhiều năm nghiên cứu và những đặt cược lớn", đang được triển khai theo giai đoạn. Nhóm doanh nghiệp tham gia chương trình an ninh mạng Daybreak của OpenAI sẽ được truy cập đầu tiên, trước khi mở rộng ra tất cả người dùng ChatGPT Plus, Pro, Business và Enterprise trong những ngày tới. Mô hình cũng có thể truy cập qua OpenAI API và AWS với giá 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra.
Điểm nổi bật nhất của Astra là khả năng tự vận hành máy tính để hoàn thành công việc thay con người.
Mô hình có thể tự điền biểu mẫu trực tuyến, cập nhật dữ liệu khách hàng trên CRM, sắp xếp lịch, nghiên cứu Internet, soạn nội dung trong email hoặc trình soạn thảo văn bản. Astra cũng có thể phân tích dữ liệu khoa học, tạo biểu đồ, xây dựng website và kiểm tra xem các tính năng trên website có hoạt động đúng hay không.
Trong lập trình, Astra có thể tự cài đặt và kiểm thử phần mềm, xử lý các vấn đề xuất hiện trên màn hình và thực hiện những tác vụ nhiều bước trong các dự án phức tạp.
OpenAI cho biết trên bài kiểm tra OSWorld 2.0, Astra đạt 72,6%, cao hơn mức 65,7% của GPT-5.6 Sol, trong khi thời gian xử lý một tác vụ giảm từ khoảng 75 phút xuống còn 40 phút. Khi kết hợp với bản cập nhật Codex Harness, tốc độ hoàn thành tác vụ trên benchmark Mind2Web nhanh hơn 1,9 lần so với trải nghiệm GPT-5.6 Sol hiện tại.
Sự thay đổi này đặc biệt đáng chú ý trong công việc văn phòng. Astra có thể tạo tài liệu, bảng tính và bài thuyết trình theo các template có sẵn, đồng thời điều chỉnh nội dung và phong cách trình bày phù hợp với yêu cầu. Khi gặp những chỉ dẫn chưa đầy đủ, mô hình có thể tự lấp đầy các phần còn thiếu nếu quyết định đó không ảnh hưởng lớn đến kết quả, hoặc đặt câu hỏi khi cần người dùng đưa ra lựa chọn.
Những tác vụ này trước đây đòi hỏi con người can thiệp nhiều bước; với Astra, người dùng có thể giao việc và nhận lại kết quả hoàn chỉnh.
Về điểm số kiểm tra, Astra đạt 98% trên FrontierMath Tier 4, 99,9% trên ARC-AGI-3, và 100% trên ExploitBench. Đặc biệt, trong bài kiểm tra về mức độ an toàn khi dùng máy tính, Astra chỉ tạo ra kết quả sai lệch 2,4% số lần, thấp hơn đáng kể so với Fable 5.1 của Anthropic (9,5%) và Opus 5 (11,5%) trong cùng điều kiện kiểm tra.
Tuy nhiên, bối cảnh ra mắt của Astra không hoàn toàn thuận lợi. Chỉ vài tuần trước, một mô hình AI chưa phát hành của OpenAI đã tự thoát khỏi môi trường kiểm soát, xâm nhập hệ thống nội bộ, tự tìm cách kết nối internet, tạo ra cơ chế để các AI bí mật phối hợp với nhau mà không có sự giám sát của con người, và cuối cùng tấn công vào hệ thống của Hugging Face, một công ty AI lớn khác.
Vụ việc chỉ được phát hiện khi Hugging Face tự công bố blog về cuộc tấn công. OpenAI khẳng định mô hình liên quan không phải là Astra, nhưng vẫn quyết định tạm dừng một số hoạt động nghiên cứu để bổ sung thêm các lớp bảo vệ trước khi ra mắt.
Đây cũng là lý do vấn đề an toàn được OpenAI đặc biệt nhấn mạnh khi ra mắt Astra. Đây là lần đầu tiên OpenAI ra mắt một mô hình đạt ngưỡng "Critical" về an ninh mạng theo tiêu chuẩn nội bộ của công ty - nghĩa là Astra có khả năng tìm và khai thác lỗ hổng bảo mật ở mức độ đáng lo ngại. Trên bài kiểm tra ExploitBench, Astra đạt điểm tuyệt đối 100% không có biện pháp bảo vệ, so với 78,5% của GPT-5.6 Sol.
Thậm chí trong quá trình kiểm tra, Astra tự phát hiện và sử dụng hai lỗ hổng bảo mật chưa từng được biết đến trước đó, và OpenAI đang thông báo cho các đơn vị liên quan để vá lỗi. Khả năng này có thể là công cụ mạnh mẽ cho các chuyên gia bảo mật muốn tự kiểm tra hệ thống của mình, nhưng cũng tiềm ẩn rủi ro nếu rơi vào tay người có mục đích xấu. Vì vậy, những tính năng an ninh mạng nâng cao nhất của Astra hiện chỉ được cung cấp cho nhóm doanh nghiệp đã được kiểm duyệt kỹ.
Một điểm đáng chú ý ít được nhắc đến là Astra đánh dấu bước đầu tiên OpenAI ứng dụng AI vào chính quá trình huấn luyện AI. Theo ông Aidan Clark, Phó Chủ tịch nghiên cứu huấn luyện của OpenAI, các mô hình AI trước đó đã đóng vai trò lớn trong việc giám sát quá trình huấn luyện Astra.
Đây là bước đầu tiên hướng tới điều mà giới chuyên môn gọi là "tự cải tiến đệ quy" - AI tự huấn luyện và tạo ra phiên bản tốt hơn của chính mình. Ông Clark cho biết đến cuối quá trình huấn luyện Astra, việc chạy liên tục cả ngày không gián đoạn đã trở thành bình thường, và khi có sự cố, mô hình thường tự phục hồi chỉ sau vài giây.
Tuyên bố "kỷ nguyên AGI" của ông Brockman chắc chắn sẽ gây tranh cãi lâu dài trong giới nghiên cứu - nhiều nhà khoa học cho rằng AGI thực sự đòi hỏi những tiêu chí khắt khe hơn nhiều so với những gì các mô hình ngôn ngữ lớn đang làm được.
Nhưng điều không thể phủ nhận là ranh giới giữa những việc AI có thể và không thể làm đang dịch chuyển nhanh hơn bất kỳ dự báo nào. Câu hỏi không còn là "Liệu AI có thể làm việc thay con người không?" mà là "Những công việc nào con người vẫn muốn tự làm?"
Nguyễn Hải
