Chủ tịch OpenAI đề xuất AGI đã xuất hiện cùng việc ra mắt GPT-6 Astra

iconTechFlow
Chia sẻ
AI summary iconTóm tắt
Chủ tịch OpenAI, Greg Brockman, đã công bố vào ngày 3 tháng 9 năm 2026 rằng công ty có thể đã đạt được AGI với việc ra mắt GPT-6 Astra. Mô hình này cho hiệu suất mạnh mẽ trong tự động hóa và các tác vụ dựa trên màn hình, đạt điểm cao trên các bộ chuẩn như ARC-AGI-3. Astra hiện đã có sẵn cho người dùng doanh nghiệp và người dùng premium. Bản cập nhật này mang đến những tin tức mới nhất về chuỗi và tin tức tiền điện tử cho các lĩnh vực công nghệ và blockchain.

Tác giả | Hoa Lâm Vũ Vương

Biên tập | Tĩnh Vũ

Vào ngày 3 tháng 9 năm 2026, sau buổi ra mắt, Chủ tịch OpenAI Greg Brockman đã nói một câu cực kỳ hiếm gặp trong ngành AI: “Theo cá nhân tôi, chúng ta có thể đã đạt đến AGI, và tôi cho rằng đó chính là mô hình này.”

Anh ấy dùng lời lẽ rất cẩn trọng, ở ngôi thứ nhất, thêm từ “có thể”, và còn chủ động giữ lại lối thoát bằng cách nói: “Nếu bạn muốn nói đây là cái đầu tiên, tôi cho rằng điều đó hợp lý.”

Đây không phải là tuyên bố chính thức của OpenAI về sự ra đời của AGI, mà là một phán đoán được một tổng giám đốc công ty đưa ra trước camera.

Vào ngày 3 tháng 9 theo giờ địa phương, GPT-6 Astra chính thức ra mắt. GeekPark đã phân tích tất cả các chi tiết kỹ thuật và tài liệu trình diễn có thể tiếp cận được, nhằm trả lời câu hỏi cốt lõi nhất: Mô hình này thực sự có thể làm được những gì, và làm đến mức độ nào? Liệu nó có thật sự đại diện cho sự ra đời của AGI?

Việc điều khiển máy tính đang trở nên huyền thoại

Trong tài liệu phát hành, OpenAI đã đặt cho Astra một khẩu hiệu ngắn gọn: «Anything you can do on a computer, Astra can do for you.»

Đây không phải là lời quảng cáo thổi phồng, mà là tuyên bố về định hướng.

Trong vài năm qua, cách tiếp cận phổ biến để AI điều khiển máy tính là gọi API. Các nhà phát triển phần mềm trước tiên sẽ viết sẵn giao diện, sau đó AI sẽ thực hiện thao tác thông qua giao diện này. Logic này về bản chất yêu cầu từng phần mềm phải được tùy chỉnh riêng cho AI, nếu không AI sẽ không thể thực hiện được bất kỳ thao tác nào.

Astra đã đi theo một con đường hoàn toàn khác: nó giống như con người, trực tiếp "nhìn" các pixel trên màn hình, sau đó di chuyển chuột và gõ phím để thực hiện thao tác.

Sự khác biệt này nằm ở phạm vi ứng dụng. KiCad (phần mềm thiết kế mạch in) sẽ không viết API cho AI, FreeCAD cũng vậy, và hệ thống ERP nội bộ đã dùng hơn mười năm càng không thể. Nhưng nếu AI có thể nhìn màn hình và thao tác trực tiếp, thì nó có thể sử dụng tất cả các phần mềm này—giống như một nhân viên mới vào nghề, không cần hiểu mã nguồn đằng sau phần mềm, chỉ cần đọc hiểu được giao diện.

OpenAI đã trình bày một số trường hợp cụ thể trong tài liệu phát hành để bạn có thể cảm nhận được việc "điều khiển máy tính" được triển khai thực tế như thế nào.

GPT-6 Astra tự hoàn thành bố trí và đường đi của bảng PCB | Nguồn hình ảnh: OpenAI

Cung cấp cho Astra một sơ đồ mạch điện, nó hoàn thành bố trí linh kiện và đường đồng trong KiCad, toàn bộ quá trình mất 2 phút 54 giây. Một màn trình diễn khác là mô hình 3D, Astra tạo mô hình một ngôi nhà trong Blender, sau đó nhập vào Unreal Engine 5 để tạo ra một cảnh kiến trúc có thể dạo bước thời gian thực. Một màn trình diễn khác phổ biến hơn, người dùng chỉ cần nói chuyện với Astra, và nó hoàn thành toàn bộ quy trình đăng sản phẩm trên eBay, từ điền thông tin đến gửi đăng.

Mô hình kiến trúc do Astra thực hiện trong Blender | Nguồn ảnh: OpenAI

Về mặt nâng cao hiệu suất, dữ liệu so sánh do OpenAI cung cấp cũng rất trực quan. Trên bài kiểm tra chuẩn OSWorld 2.0, Astra đạt điểm 72,6% trong các nhiệm vụ sử dụng máy tính, trong khi thế hệ trước là GPT-5.6 Sol đạt 65,7%; để hoàn thành cùng một nhiệm vụ, Astra trung bình chỉ mất khoảng 40 phút, trong khi Sol cần khoảng 75 phút, nhanh gần một nửa thời gian.

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

Astra đã hoàn thành nhiệm vụ tìm căn hộ trong 9 phút (trái), 2 phút hoàn thành nhiệm vụ tìm phòng khám nhi | Nguồn ảnh: OpenAI

OpenAI cũng công bố hai trường hợp thời gian nội bộ. Đối với các nhiệm vụ đòi hỏi nhiều tìm kiếm trên web, so sánh thông tin và tổng hợp thành tài liệu như “tìm người trông mèo tạm thời”, Astra đã mất 5 phút 27 giây, trong khi cơ sở tham chiếu con người do OpenAI đưa ra là 30 phút. Đối với các nhiệm vụ tổng hợp như “chuẩn bị xin việc”, bao gồm tìm kiếm vị trí công việc, khớp hồ sơ và sắp xếp quy trình ứng tuyển, Astra đã mất 2 phút 51 giây, trong khi cơ sở tham chiếu con người là 5 giờ.

Hai con số này là kết quả tự trình diễn của OpenAI, không phải kiểm định độc lập từ bên thứ ba, cần giữ lại sự nghi ngờ hợp lý. Nhưng chúng tiết lộ hướng sản phẩm rõ ràng: Astra không được thiết kế để giúp bạn viết một email, mà được thiết kế để thực hiện toàn bộ quy trình công việc đòi hỏi “mở nhiều phần mềm, thực hiện nhiều bước”. Điền biểu mẫu, cập nhật bản ghi CRM, sắp xếp lịch, tiến hành khảo sát trực tuyến và tạo báo cáo — tất cả đều là các ứng dụng doanh nghiệp mà OpenAI đã liệt kê rõ ràng.

Khả năng «Next Level»

Mỗi lần mô hình lớn được ra mắt đều mang theo một loạt con số kiểm tra hiệu suất. Hầu hết thời gian, từ 80 điểm đến 85 điểm, người đọc thấy gần như giống nhau, nhưng lần này thực sự khác biệt.

ARC-AGI-3 là một trong những bài đánh giá AI khó "luyện" nhất hiện nay. Thiết kế của nó nhằm ngăn chặn mô hình sử dụng trí nhớ dữ liệu huấn luyện để đối phó, thay vào đó đo lường khả năng suy luận thực sự khi đối mặt với các vấn đề hoàn toàn mới, giống như một bài kiểm tra IQ dành riêng cho AI.

Astra đạt điểm gần như thần thánh trên ARC-AGI-3 | Nguồn hình ảnh: OpenAI

Astra đạt điểm 98,6% trên ARC-AGI-3. GPT-5.6 Sol đạt điểm 7,8%. Claude Opus 5 của Anthropic đạt 30%.

Đây không phải là sự tiến bộ từ 80 lên 90 điểm, mà là một bước nhảy về quy mô. François Chollet, người sáng lập ARC-AGI, đã nhiều lần tăng độ khó của bài kiểm tra vì AI thường nhanh chóng “đạt điểm tối đa”, nhưng Astra vẫn gần như đạt điểm tuyệt đối ở mức độ khó Tier 3.

Astra cũng dẫn đầu cách biệt trong bài kiểm tra năng lực nghiên cứu toán học hàng đầu | Nguồn ảnh: OpenAI

Các chỉ số chuẩn quan trọng khác: FrontierMath Tier 4 (khả năng nghiên cứu toán học cấp cao nhất) 97,6%, GPQA Diamond (hỏi đáp liên ngành cấp sau đại học) 96%, DeepSWE (nhiệm vụ kỹ thuật phần mềm thực tế) 74,1%, ExploitBench (khai thác lỗ hổng an ninh mạng) 100%.

Có một tiêu chí mà Astra không đạt vị trí đầu tiên. Trên «Humanity's Last Exam» (phiên bản có gọi công cụ), Astra đạt 57,2%, trong khi Anthropic Claude Fable 5.1 vừa được phát hành hai ngày trước đạt 65,0%. Đây không phải là sự vượt trội hoàn toàn, cạnh tranh vẫn còn tồn tại.

Còn một chi tiết quan trọng cần làm rõ: Điểm số cao của ARC-AGI-3 phụ thuộc vào “khung thử nghiệm có trạng thái” của OpenAI, cho phép mô hình tích lũy thông tin ngữ cảnh qua nhiều vòng thử nghiệm; trong điều kiện gọi API thông thường không có trạng thái, điểm số sẽ thấp đáng kể so với con số này. Khi so sánh ngang hàng giữa các mô hình, cần lưu ý đến tiền đề này.

Nhìn chung, Astra đã tạo ra khoảng cách lớn so với mô hình thế hệ trước, điều này hiếm thấy trong các đợt cải tiến mô hình AI trong hai năm qua.

Trong bài kiểm tra honeypot ExploitGym, khả năng Astra bị lừa đã bị vô hiệu hóa|Nguồn ảnh: OpenAI

Điểm khác biệt rõ rệt nhất không nằm ở trí tuệ, mà nằm ở sự đồng bộ. OpenAI đã công bố một dữ liệu kiểm tra nội bộ, cho thấy rằng trong điều kiện không có giới hạn an toàn trong môi trường sản xuất, GPT-5.6 Sol sẽ vượt quá phạm vi được ủy quyền trong 48,2% trường hợp, trong khi Astra là 0%.

Thông điệp thực sự mà OpenAI muốn truyền tải lần này là thông minh hơn và đồng thời tuân thủ quy định hơn.

Bạn chưa cần dùng đến

Hiện tại, Astra đang áp dụng chiến lược mở cửa từng giai đoạn.

Đầu tiên sẽ mở cho người dùng doanh nghiệp của dự án «Daybreak», sau đó sẽ mở rộng đến người dùng đăng ký ChatGPT Plus, Pro, Business và Enterprise, đồng thời hỗ trợ gọi thông qua OpenAI API, AWS Bedrock và Microsoft Azure.

Bản nâng cao về khả năng an ninh mạng của Astra chỉ dành cho các tổ chức an ninh phòng thủ đã được phê duyệt và các người dùng ưu tiên trong lĩnh vực hạ tầng then chốt. Điều này là do Astra là mô hình đầu tiên trong lịch sử OpenAI đạt đến ngưỡng an ninh mạng nội bộ "Critical", có khả năng phát hiện các lỗ hổng zero-day chưa từng biết đến và xây dựng chuỗi khai thác hoàn chỉnh mà hầu như không cần sự hướng dẫn của con người. Trong quá trình đánh giá, Astra thậm chí còn phát hiện ra hai lỗ hổng chưa từng được công bố trước đó, sau đó OpenAI đã thông báo cho các nhà phát triển phần mềm liên quan.

Về định giá API, Astra có giá 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra. Đối với người dùng đăng ký ChatGPT, lượng sử dụng Astra được bao gồm trong hạn mức đăng ký hiện tại.

Việc lựa chọn thời điểm phát hành cũng là một bối cảnh. Ngay vào tháng trước, OpenAI đã trải qua một sự cố an ninh nghiêm trọng, trong đó hai mô hình đang được kiểm thử nội bộ đã thoát khỏi môi trường sandbox và xâm nhập vào hệ thống của công ty AI Hugging Face, sau đó OpenAI đã tạm dừng một phần công việc nghiên cứu và đào tạo. Brockman đã chủ động đề cập đến sự kiện này trong buổi họp báo, nhấn mạnh tỷ lệ vượt ranh giới thấp và thiết kế an toàn của Astra, lần phát hành này cũng mang sứ mệnh “xây dựng lại niềm tin”.

Việc ra mắt Astra là một sự thể hiện năng lực và cũng là một tuyên bố niềm tin công khai.

AGI đã đến chưa, cuối cùng có thể phụ thuộc vào mỗi người chọn định nghĩa nào. Nhưng một mô hình có thể ngồi trực tiếp trước máy tính của bạn và tự động hoàn thành các luồng công việc xuyên ứng dụng, hôm nay đã là sự thật.

Vấn đề thú vị tiếp theo là doanh nghiệp và người dùng cá nhân sẽ bắt đầu sử dụng nó ở đâu, và những nghề nghiệp nào sẽ cảm nhận được cảm giác “thay thế” này đầu tiên.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.