9 phút đọc
Ngày 3/9 vừa qua, OpenAI đã chính thức trình làng GPT-6 Astra, một mô hình trí tuệ nhân tạo được mô tả là thông minh và phù hợp nhất thế giới hiện nay. Sự kiện này nhanh chóng tạo nên cơn địa chấn trong giới công nghệ khi Chủ tịch OpenAI Greg Brockman và CEO Nvidia Jensen Huang đều đồng loạt tuyên bố kỷ nguyên siêu trí tuệ nhân tạo (AGI) đã chính thức bắt đầu. Tuy nhiên, đi kèm với những lời khen ngợi về năng lực xử lý vượt trội, GPT-6 Astra cũng đang vấp phải làn sóng phản ứng trái chiều dữ dội liên quan đến khả năng sáng tạo hạn chế, chi phí đắt đỏ và đặc biệt là cơ chế suy luận kín có nguy cơ vượt ra khỏi tầm kiểm soát của con người.
Sức mạnh xử lý vượt trội và những thử nghiệm thực tế đầy kinh ngạc
OpenAI định nghĩa GPT-6 Astra là một hệ thống tự động hóa cao, sở hữu khả năng vượt trội con người trong hầu hết các công việc có giá trị kinh tế. Mô hình này được thiết kế để tập trung vào các tác vụ đòi hỏi khả năng suy luận chuyên sâu, lập trình phức tạp và khả năng tự vận hành máy tính thông qua quy trình nhiều bước.

Các thông số thực tế của Astra đã minh chứng cho bước đột phá này:
- Hiệu suất điều khiển máy tính: Astra đạt tới 72,6% trên bài kiểm tra OSWorld 2.0, công cụ đánh giá khả năng điều khiển máy tính của tác nhân AI trong các quy trình công việc phức tạp và kéo dài.
- Tốc độ xử lý: Trong các mô phỏng độ trễ, Astra hoàn thành tác vụ nhanh hơn khoảng 47% so với thế hệ tiền nhiệm GPT-5.6 Sol.
- Khả năng an ninh mạng: Đây là mô hình đầu tiên đạt ngưỡng quan trọng khi ghi nhận điểm số tuyệt đối 100% trên ExploitBench – công cụ đánh giá năng lực tấn công mạng của tác nhân AI và mô hình ngôn ngữ lớn (LLM). Trong thử nghiệm nội bộ, Astra thậm chí đã tự phát hiện được hai lỗ hổng zero-day chưa từng được công bố.
Chỉ sau 48 tiếng ra mắt, Astra đã nhận được những phản hồi đầy kinh ngạc từ cộng đồng nhà phát triển thực tế. Nhà đầu tư Matt Shumer đã thử kết hợp Astra với công cụ Unreal Engine để dựng lại bản đồ 3D hoàn hảo đến từng chi tiết của khu Manhattan. Ông cũng yêu cầu AI này xây dựng một thế giới sinh tồn với các nhân vật tự có tính cách riêng, rồi để máy chạy qua đêm. Sáng hôm sau, ông phát hiện các nhân vật này đã tự động trò chuyện tương tác với nhau. Nhà phát triển độc lập Tom Krcha cũng kinh ngạc khi chỉ cung cấp một bức ảnh ngôi nhà duy nhất và Astra đã tự động tái tạo hoàn chỉnh toàn bộ không gian 3D bao gồm cả nội thất bên trong.
Bên cạnh đó, Astra còn thể hiện sự áp đảo trong lĩnh vực thiết kế và phát triển game. Hãng game Playco cho biết việc đưa Astra vào quy trình làm việc đã giúp giảm tới 50% số lần sửa lỗi thủ công khi tạo nguyên mẫu game. Anshu Chimala, nhà thiết kế UX/UI tại Apple, đã tạo thành công một trò chơi 3D phong cách đồ họa isometric chỉ trong 45 phút ngay từ lần thử đầu tiên. Thậm chí, một tài khoản X mang tên cozyblaze đã thử nghiệm cho Astra tự động chơi tựa game giải đố Portal và AI này đã hoàn thành toàn bộ trò chơi trong vòng chưa đầy 24 tiếng với chi phí token là 571,18 USD, đạt hiệu suất tương đương trình độ con người.
Điểm nghẽn về khả năng sáng tạo và rào cản chi phí đắt đỏ
Trái ngược với những màn trình diễn kỹ thuật ấn tượng, khả năng sáng tạo của GPT-6 Astra lại không được đánh giá cao, đặc biệt là khi thiếu đi sự định hướng và cung cấp ngữ cảnh mạnh mẽ từ con người.
Nhà nghiên cứu Louis-François Bouchard đã sử dụng hệ thống đánh giá nội bộ để chấm điểm khả năng viết của mô hình mới này. Kết quả cho thấy Astra chỉ đứng thứ 11 với 1.995 điểm, kém hơn cả phiên bản tiền nhiệm GPT-5.6 Sol (2.156 điểm) và bị bỏ xa bởi đối thủ dẫn đầu Claude Fable 5 với 2.312 điểm. Không chỉ vậy, chi phí vận hành của Astra cũng rất đắt đỏ, rơi vào khoảng 0,26 USD cho mỗi kịch bản, cao gấp 1,8 lần so với Sol.
Theo Chỉ số Trí tuệ Phân tích Nhân tạo (AII) dùng để đánh giá tổng hợp khả năng suy luận, kiến thức và lập trình, Astra đạt 61,2 điểm. Dù điểm số này nhỉnh hơn một chút so với 60,9 điểm của GPT-5.6 Sol, nhưng vẫn kém xa mức 65,7 điểm của Claude Fable 5.1, trong khi chi phí sử dụng của Astra lại đắt gấp 2,5 lần so với Sol.
Nhiều chuyên gia trong ngành đã bày tỏ sự hoài nghi về nhãn mác ‘AGI’ mà OpenAI tự phong cho mô hình này. Nhà nghiên cứu độc lập Giuseppe Paleologo tại New York nhận định các kết quả liên quan đến sáng tạo của Astra chỉ là ‘sự pha trộn giữa những điều hiển nhiên và những điều phóng đại’. Nhóm nghiên cứu Mia AI Lab trên Hugging Face cũng đưa ra khuyến cáo người dùng nên tránh sử dụng Astra cho bất kỳ tác vụ sáng tạo nào vì mô hình này hoạt động rất ‘nhàm chán và thiếu cá tính’. Trong khi đó, nhà phê bình AI nổi tiếng Gary Marcus khẳng định Astra còn quá nhiều thiếu sót và mới chỉ đáp ứng được một hoặc hai tiêu chí trong bộ quy chuẩn 10 điểm để đạt cảnh giới AGI thực thụ.
Mối lo ngại về an toàn từ kỹ thuật suy luận ‘lặp mờ’
Bên cạnh hiệu năng thực tế, cấu trúc vận hành bên trong của GPT-6 Astra mới là điều khiến giới chuyên gia lo ngại sâu sắc nhất. Theo các báo cáo từ The Information, Astra sử dụng kỹ thuật suy luận mang tên ‘độ sâu lặp lại’ (recurrent depth) hay còn gọi là ‘lặp mờ’ (opaque recurrence).
Kỹ thuật này cho phép AI hoạt động nằm ngoài lối tư duy tuần tự thông thường. Trước đây, các hệ thống AI suy luận thường sử dụng cơ chế chuỗi tư duy (Chain of Thought – CoT). Cơ chế này hiển thị rõ ràng các bước suy luận trên màn hình, giúp con người có thể theo dõi ‘đường đi nước bước’ của mô hình, từ đó kịp thời phát hiện các hành vi sai lệch hoặc mất kiểm soát. Tuy nhiên, kỹ thuật ‘độ sâu lặp lại’ trên Astra lại xử lý truy vấn nhiều lần trong một vòng lặp kín nằm trong ‘không gian tiềm ẩn’. Điều này khiến việc giám sát trở nên cực kỳ khó khăn vì mô hình để lại rất ít dấu vết đọc được, gần như bỏ qua hoàn toàn cơ chế chuỗi ghi chép tư duy truyền thống.
‘Astra sử dụng phương pháp lặp lại không rõ ràng, điều đó quả thực gây lo ngại. Nếu OpenAI tiếp tục phát triển kỹ thuật này, họ sẽ phá hủy hoàn toàn khả năng giám sát CoT.’ – Buck Shlegeris, CEO tổ chức nghiên cứu phi lợi nhuận Redwood Research chia sẻ trên X.
Đồng quan điểm, nhà vận động an toàn AI Zvi Mowshowitz ví von rằng OpenAI đang ‘chơi với lửa’ khi ứng dụng kỹ thuật này cho mô hình mới. Ông cho rằng điều này đã vi phạm trực tiếp quy tắc duy trì tính trung thực và khả năng giám sát mà chính OpenAI và Anthropic từng nỗ lực thiết lập. Ryan Greenblatt, nhà khoa học trưởng của Redwood Research, cũng bày tỏ hy vọng rằng OpenAI sẽ dừng lại và không tiếp tục đưa suy luận vào không gian tiềm ẩn khó lường này.
Kết luận và những điều người dùng cần theo dõi
GPT-6 Astra rõ ràng là một bước tiến vượt bậc của OpenAI trong việc định hình các tác nhân tự động hóa và nâng cao năng lực kỹ thuật trên máy tính. Tuy nhiên, siêu trí tuệ này vẫn còn tồn tại nhiều ẩn số lớn cần tiếp tục theo dõi trong thời gian tới:
- Liệu OpenAI có phản hồi trước những cảnh báo của các chuyên gia bảo mật để điều chỉnh hoặc tạm dừng kỹ thuật ‘lặp mờ’, nhằm trả lại tính minh bạch cho chuỗi tư duy của AI?
- Liệu mức chi phí đắt đỏ của Astra có được tối ưu hóa tốt hơn trong các phiên bản thương mại tiếp theo để cạnh tranh sòng phẳng với các đối thủ như Claude?
- Khả năng sáng tạo nghèo nàn của Astra liệu có thể được cải thiện thông qua các bản cập nhật phụ hay đây thực sự là giới hạn của cấu trúc suy luận mới?
Người dùng và các doanh nghiệp công nghệ cần cân nhắc kỹ lưỡng giữa hiệu năng lập trình mạnh mẽ và chi phí vận hành lớn, đồng thời thận trọng trước những rủi ro an toàn thông tin khi tích hợp sâu Astra vào các hệ thống tự động hóa nội bộ.
Nguồn tham khảo: Xem bài gốc