OpenAI ra mắt GPT-6 Astra, mở rộng cho người dùng Pro, Enterprise và Business Premium, API đồng thời ra mắt.Tác giả bài viết, nguồn: NewZeYuan
GPT-6 Astra đã chính thức mở toàn bộ!
Vừa mới đây, OpenAI chính thức thông báo rằng tất cả người dùng Pro, Enterprise và Business Premium đã có thể sử dụng trực tiếp GPT-6 Astra trong ChatGPT Work và Codex, API đồng thời được triển khai.

Tuy nhiên, người dùng Plus và người dùng Business thông thường vẫn phải chờ thêm vài ngày.
Ngày 3 tháng 9, OpenAI thông báo triển khai Astra theo từng giai đoạn. Hai ngày sau, hôm nay, tất cả người dùng cao cấp trả phí đã được mở hoàn toàn.
Hãy xóa lời nhắc trước đã
Với một bản phát hành lớn như vậy, lời khuyên đầu tiên mà kỹ sư OpenAI Victor Nunez đưa ra cho mọi người lại là xóa câu lệnh của bạn.
Anh ấy nói: Nhân lúc Astra bắt đầu ra mắt, hãy quay lại dọn dẹp file AGENTS.md và Skills của bạn, đồng thời suy nghĩ lại cách sử dụng cấp độ suy luận.

AGENTS.md là bản hướng dẫn dành cho AI: bạn là ai, nên làm gì và không nên làm gì. Skills là hướng dẫn cách thực hiện công việc: khi gặp tình huống này, hãy làm theo quy trình này.
Trong những năm qua, các nhà phát triển đối phó với mô hình bằng cách đơn giản và thô bạo: liên tục thêm nội dung vào tài liệu hướng dẫn. Nếu nó không hiểu, hãy giải thích thêm một bước. Nếu nó thường xuyên mắc lỗi, hãy thêm một ràng buộc mới. Nếu nó vẫn sai, hãy bổ sung thêm một ví dụ.
Giống như dán giấy ghi chú lên bàn của một nhân viên mới hay quên. Lâu dần, cả cái bàn đều đầy giấy ghi chú.
Nhưng sau khi Astra đến, những mảnh giấy ghi chú trên bàn trở thành gánh nặng.
OpenAI đã viết trong hướng dẫn mô hình của Astra: Astra trở nên nhạy cảm hơn với các lệnh trong skill và AGENTS.md.
Những quy tắc cũ từng chỉ là hình thức, giờ đây sẽ được nó thực thi từng điều một. Một quy tắc mơ hồ sẽ khiến nó dừng lại để xác nhận nhiều lần; hai quy tắc mâu thuẫn với nhau sẽ trực tiếp khiến nó bối rối.
Hãy lấy một ví dụ. Trước đây, bạn đã viết câu “Tất cả phương án phải được phê duyệt”, mô hình cũ nhìn thấy cũng như không thấy, vẫn tiếp tục làm.
Astra sẽ không. Nó thực sự sẽ dừng lại và hỏi bạn: “Vui lòng cho biết方案 này cần ai phê duyệt?” rồi… chờ.
Vì vậy, hướng dẫn đã sử dụng bốn chữ "khuyến nghị mạnh mẽ" để các mô hình kiểm toán của nhà phát triển có thể đọc từng tệp skill.
Không chỉ vậy, Astra còn hỏi nhiều câu hỏi hơn thế hệ trước.
Bạn bảo nó làm việc, nó làm đến giữa chừng thì dừng lại: “Ở đây có hai cách làm, bạn muốn chọn cách nào?” Giúp tôi đi, tự bạn chọn một cách rồi làm tiếp đi được không? Viết mã cũng vậy, chưa động tay đã chạy hết một vòng kiểm thử, thay đổi màu nút cũng phải viết unit test trước.
Tất cả những điều này đều phải điều chỉnh thông qua prompt. Và hướng điều chỉnh chủ yếu là thu về.
Điều đáng ngạc nhiên hơn là hướng dẫn còn đính kèm một đoạn lời nhắc sẵn, yêu cầu Astra không sử dụng các cụm từ thông dụng như “delve” hay “đáng chú ý là”, thậm chí cả cấu trúc câu “phủ định rồi đảo ngược” (ví dụ: “Đây không phải về X, mà là về Y”) cũng bị cấm rõ ràng.
Người viết những câu nói sáo rỗng này là mô hình, và người dạy bạn cách phòng tránh những câu nói sáo rỗng ấy cũng là nhà sản xuất mô hình. Có một sự trung thực kiểu: “Chính tôi đào hố, và chính tôi dạy bạn cách lấp nó.”
Nói đến đây, có thể có người hỏi: Điều này liên quan gì đến tôi?
Quá quan trọng.
Logic của Astra đã thay đổi, nghĩa là cách bạn tương tác với AI cũng nên thay đổi.
Trước đây, khi bạn trò chuyện với ChatGPT và thấy câu trả lời của nó không tốt, phản xạ tự nhiên là thêm giới hạn, thêm yêu cầu. Một điều chưa đủ thì thêm hai, hai điều chưa đủ thì thêm năm.
Đây chính là tư duy cộng—càng mô hình ngu ngốc, bạn càng phải viết ra nhiều quy tắc hơn.
Bây giờ Astra nói với bạn: Đừng viết nhiều vậy.
Nó đã có thể suy ra ý định của bạn từ ngữ cảnh, chủ động hỏi bạn khi lệnh có sự mơ hồ, và có thể ghi nhớ mục tiêu toàn cục trong các nhiệm vụ nhiều bước.
Những lời nhắc kiểu vá víu bạn viết ra không những thừa thãi mà còn có thể khiến nó đi sai hướng.
Vì vậy, từ được nhấn mạnh lặp đi lặp lại trong hướng dẫn di chuyển chính thức của OpenAI là: kiểm toán. Kiểm toán tất cả các lệnh bạn gửi cho nó, xóa bỏ những lệnh đã lỗi thời, thừa thãi và mâu thuẫn.
Càng mô hình mạnh, bạn càng nên viết ít quy tắc hơn.
This principle applies equally to developers and regular users.
Mạnh đến mức nào
Đã nói nhiều về «phép trừ», vậy Astra đã «thêm» được bao nhiêu khả năng?
Các nhà phát triển có quyền truy cập sớm đã nộp bài答卷.
Nhà phát triển Matt Shumer đã xây dựng một Manhattan trong Unreal Engine, từng con phố một, trong vòng một tuần.
Anh ấy đã phát minh ra một cách chơi gọi là "vòng lặp quản lý": một Astra đóng vai quản lý, chia toàn bộ nhiệm vụ thành danh sách và các giai đoạn; sau đó mở một Astra khác làm người thực hiện.
Quản lý chỉ giao một nhiệm vụ một lúc, hoàn thành xong mới giao nhiệm vụ tiếp theo, tuyệt đối không tiết lộ trước. Về phía đội ngũ thực hiện, thời điểm cao điểm nhất có tới 96 tác nhân thông minh cùng hoạt động, đẩy công việc tiến lên như một dây chuyền sản xuất.
Shumer cũng phát hiện ra một chi tiết cách diễn đạt rất thú vị: khi yêu cầu mô hình thực hiện từng giai đoạn một cách “cực tốt”, nó sẽ kiên trì tiến bước; nhưng ngay khi thay thành “hoàn hảo”, nó lập tức chìm sâu vào những chi tiết nhỏ nhặt và không thể thoát ra. Sự khác biệt chỉ trong một từ đã quyết định liệu dự án có được thúc đẩy hay bị đình trệ.
Nhà phát triển Anshu thốt lên: Astra thực sự là vị thần máy AGI siêu cấp trong lĩnh vực trò chơi 3D.
Astra chỉ mất 45 phút để tạo ra một thế giới trò chơi mở với chất lượng hình ảnh tuyệt vời.
Nhà miễn dịch học Derya Unutmaz chỉ nhập một câu: “Hãy tạo một video giảng dạy về tế bào T trong 5 phút.”
Astra tự viết bình luận, dùng Remotion để tạo hoạt hình, dùng Imagegen để tạo hình ảnh, và còn chủ động đề xuất dùng HeyGen để thêm lời dẫn, hoàn thành một video trong một lần thực hiện.
Sau khi xem xong, nhà khoa học đã nghiên cứu tế bào T trong 35 năm nói: “Tôi chắc chắn không thể giảng hay như vậy.” Hiện anh ấy đang lên kế hoạch thực hiện một loạt bài giảng về miễn dịch học và đăng lên trang web.
Tom Krcha đã đưa cho Astra một bản vẽ cũ của một chuyến tàu hơi nước.
Sau vài phút, Blender tạo ra 3.295 đối tượng có thể chỉnh sửa, mỗi bộ phận đều có thể tháo rời và chỉnh sửa riêng lẻ.
Bài tweet này đã có hơn 750.000 lượt xem.
Anh ấy lại thử một chiếc tàu Commodore Vanderbilt ít phổ biến hơn, phần đầu locomotive cần được sửa thủ công, nhưng điểm xuất phát đã cao đến mức đáng kinh ngạc.
Con số mà OpenAI tự công bố cũng đủ mạnh mẽ.
Trên OSWorld 2.0 (làm cho mô hình thao tác như con người trên màn hình máy tính), Astra đạt 72,6%, trong khi thế hệ trước GPT-5.6 Sol đạt 65,7%; thời gian thực hiện mỗi nhiệm vụ giảm từ 75 phút xuống còn 40 phút—độ chính xác tăng lên, tốc độ nhanh gần gấp đôi.
Tất nhiên, Astra cũng không vượt trội hoàn toàn. Trên chỉ số trí tuệ tổng hợp độc lập của Artificial Analysis, Astra đạt 61,2 điểm, trong khi Claude Fable 5.1 mà Anthropic vừa phát hành tuần này đạt 65,7 điểm.
Trận này giữa hai hùng chủ vẫn chưa phân được thắng bại.
Thời kỳ phép trừ
Trong vài năm qua, câu chuyện về phát triển AI là phép cộng.
Mô hình không đủ thông minh, nên dùng quy tắc để bù đắp, quy tắc càng bù đắp càng dày.
Bây giờ, điểm yếu đã được khắc phục. Chính quy tắc đã trở thành nguồn lỗi mới.
OpenAI đã lặng lẽ thay đổi hướng đi của kỹ thuật AI bằng một hướng dẫn mô hình: trước đây là dạy nó từng bước thực hiện, giờ đây là gỡ bỏ từng lớp quy tắc cũ cản trở, tạo không gian cho nó.
Mối quan hệ giữa con người và mô hình cũng đã thay đổi.
Trước đây là dạy nó. Giờ đây là—đừng cản nó.
