8 phút đọc
OpenAI chính thức trình làng GPT-6 Astra, mô hình trí tuệ nhân tạo mạnh nhất của hãng tính đến thời điểm hiện tại. Được ban lãnh đạo OpenAI tự tin tuyên bố đã chạm ngưỡng “siêu trí tuệ nhân tạo AGI”, Astra nhanh chóng thu hút sự chú ý đặc biệt của giới công nghệ toàn cầu nhờ khả năng tự động hóa và xử lý tác vụ phức tạp với tốc độ kinh ngạc. Dù vậy, mô hình thế hệ mới này cũng đang phải hứng chịu nhiều phản ứng trái chiều, từ sự hoài nghi về năng lực sáng tạo thực tế cho đến những lo ngại sâu sắc về kỹ thuật suy luận “lặp mờ” có nguy cơ vượt tầm kiểm soát của con người.

Đột phá công nghệ trong tự động hóa và lập trình game 3D
Theo công bố từ OpenAI, GPT-6 Astra là hệ thống tự động hóa cao, có khả năng vượt trội con người trong hầu hết công việc mang giá trị kinh tế lớn. Mô hình này tập trung vào các quy trình nhiều bước, cho phép sử dụng trình duyệt và các phần mềm chuyên dụng để tự động thực hiện từ nghiên cứu, phân tích dữ liệu đến tạo tài liệu, bảng tính và bài thuyết trình. Trong bài đánh giá khả năng điều khiển máy tính OSWorld 2.0, Astra đạt điểm số 72,6% – một kỷ lục thể hiện năng lực xử lý các quy trình công việc phức tạp, kéo dài, đồng thời hoàn thành tác vụ nhanh hơn 47% so với mô hình tiền nhiệm GPT-5.6 Sol trong mô phỏng độ trễ.
Đặc biệt, Astra đánh dấu cột mốc là mô hình đầu tiên đạt ngưỡng an toàn bảo mật mới khi tự phát hiện được hai lỗ hổng zero-day chưa từng được biết đến trong một thử nghiệm nội bộ, đồng thời đạt điểm số tuyệt đối 100% trên công cụ đánh giá năng lực tấn công mạng ExploitBench mà không cần sự can thiệp của con người.
Trong thực tế, chỉ sau 48 tiếng ra mắt, giới phát triển đã chứng kiến sức mạnh vượt trội của Astra trong các tác vụ liên quan đến không gian, cơ học và tác nhân tự trị. Nhà đầu tư Matt Shumer đã kết hợp Astra với công cụ Unreal Engine để tạo dựng thành công bản đồ 3D chi tiết của khu vực Manhattan với độ chính xác đến từng con phố. Ông cũng yêu cầu Astra xây dựng một thế giới sinh tồn với các nhân vật có tính cách riêng và bất ngờ phát hiện các nhân vật tự bắt đầu trò chuyện với nhau sau khi để hệ thống chạy qua đêm.
Tương tự, một nhà phát triển Trung Quốc có biệt danh SuSu đã ra lệnh cho AI tái tạo lại thành phố Hàng Châu và các thị trấn xung quanh bằng thư viện Three.js. Kết quả là một bản đồ tương tác hoàn chỉnh hiển thị cả Hồ Tây, chùa Liễu Phong, ruộng bậc thang và vùng đất ngập nước được xuất bản chỉ sau 24 phút. Nhà phát triển độc lập Tom Krcha cũng bày tỏ sự kinh ngạc khi Astra tái dựng hoàn hảo toàn bộ không gian và nội thất của một ngôi nhà chỉ từ một bức ảnh duy nhất.
Lĩnh vực trò chơi cũng ghi nhận hiệu suất vượt bậc của mô hình này. Hãng game Playco cho biết việc ứng dụng Astra giúp giảm tới 50% số lần sửa lỗi thủ công trong khâu thử nghiệm nguyên mẫu với sự can thiệp tối thiểu từ con người. Anshu Chimala, nhà thiết kế UX/UI tại Apple, đã xây dựng hoàn chỉnh một tựa game 3D phong cách isometric chỉ trong 45 phút ngay từ lần thử đầu tiên. Thậm chí, tài khoản X cozyblaze đã thử để Astra tự chơi tựa game giải đố Portal và AI này đã hoàn thành toàn bộ trò chơi trong chưa đầy 24 giờ với chi phí token là 571,18 USD – mức hiệu suất được đánh giá là tương đương trình độ con người.
Điểm yếu về sáng tạo và tranh cãi quanh danh xưng “AGI”
Mặc dù ghi điểm ở các tác vụ kỹ thuật và logic, GPT-6 Astra lại không được đánh giá cao ở mảng sáng tạo khi thiếu đi sự định hướng, ngữ cảnh và chỉ đạo mạnh mẽ từ con người. Trong thử nghiệm đánh giá khả năng viết của nhà phát triển Louis-François Bouchard, Astra chỉ đứng thứ 11 với 1.995 điểm, kém xa GPT-5.6 Sol (2.156 điểm) và mô hình dẫn đầu Claude Fable 5 (2.312 điểm). Mặc dù có hiệu năng viết kém hơn, chi phí vận hành của Astra cho mỗi kịch bản lại lên tới 0,26 USD, đắt gấp 1,8 lần so với Sol.
Trên Chỉ số Trí tuệ Phân tích Nhân tạo (AII) tổng hợp nhằm đánh giá khả năng suy luận, kiến thức và lập trình, Astra đạt 61,2 điểm, chỉ nhỉnh hơn một chút so với mức 60,9 điểm của GPT-5.6 Sol nhưng lại chịu mức chi phí đắt gấp 2,5 lần, đồng thời vẫn thua kém Claude Fable 5.1 (đạt 65,7 điểm). Nhà nghiên cứu độc lập Giuseppe Paleologo tại New York nhận định các kết quả liên quan đến sáng tạo của Astra chỉ là “sự pha trộn giữa những điều hiển nhiên và những điều phóng đại”, khẳng định sự sáng tạo thực sự vẫn còn rất xa vời. Nhóm nghiên cứu Mia AI Lab trên Hugging Face cũng đưa ra khuyến cáo nên tránh dùng Astra cho các công việc sáng tạo vì mô hình này “nhàm chán và thiếu cá tính”.
Chính những hạn chế này khiến tuyên bố “đạt cảnh giới AGI” của OpenAI vấp phải sự hoài nghi lớn. Ông Gary Marcus, nhà nghiên cứu và phê bình AI nổi tiếng tại Thung lũng Silicon, khẳng định Astra chưa đủ tiêu chuẩn để được gọi là AGI. Dựa trên bộ tiêu chí 10 điểm khác biệt của AGI so với AI thông thường do ông tự soạn thảo, Astra mới chỉ đáp ứng được từ một đến hai tiêu chí. “Astra vẫn còn nhiều thiếu sót”, ông Marcus nhấn mạnh.
Mối nguy từ kỹ thuật suy luận “lặp mờ” vượt tầm kiểm soát
Đáng lo ngại hơn cả những điểm yếu về tính năng là phương thức vận hành bên dưới của GPT-6 Astra. Theo thông tin từ The Information, mô hình này sử dụng kỹ thuật suy luận mang tên “độ sâu lặp lại” (recurrent depth), hay còn được gọi là “lặp mờ” (opaque recurrence). Kỹ thuật này cho phép AI hoạt động ngoài lối tư duy tuần tự thông thường, xử lý một truy vấn nhiều lần trong một vòng lặp kín.
Điểm nguy hiểm là cơ chế này gần như bỏ qua chuỗi ghi chép tư duy truyền thống (Chain of Thought – CoT) – vốn là công cụ hiển thị các bước lập luận rõ ràng giúp con người nhìn thấu đường đi nước bước của AI để phát hiện hành vi sai lệch. Việc lặp lại trong vòng lặp kín khiến quá trình suy luận để lại rất ít dấu vết có thể đọc được, làm cho việc giám sát ngày càng trở nên bất khả thi.
Buck Shlegeris, CEO của tổ chức nghiên cứu phi lợi nhuận chuyên về an toàn và bảo mật AI Redwood Research, cảnh báo rằng nếu OpenAI tiếp tục phát triển kỹ thuật lặp mờ này, họ sẽ phá hủy hoàn toàn khả năng giám sát chuỗi tư duy của AI. Nhà vận động an toàn AI Zvi Mowshowitz thậm chí ví von hành động này của OpenAI như việc “chơi với lửa” khi phá bỏ cam kết duy trì tính trung thực và khả năng giám sát mà chính họ và Anthropic từng nỗ lực thiết lập.
“Tôi hy vọng vẫn chưa quá muộn và OpenAI sẽ dừng lại ở đây,” Ryan Greenblatt, nhà khoa học trưởng của Redwood Research, bày tỏ sự lo ngại sâu sắc về xu hướng suy luận trong không gian tiềm ẩn của các mô hình tương lai.
Những ẩn số cần theo dõi trong tương lai
Sự xuất hiện của GPT-6 Astra mở ra một chương mới cho các tác nhân tự trị nhưng đồng thời cũng để lại những câu hỏi lớn chưa có lời giải. Hiện vẫn chưa rõ OpenAI có tiếp nhận các phản hồi từ giới chuyên gia bảo mật để điều chỉnh hoặc tạm dừng kỹ thuật “độ sâu lặp lại” nhằm trả lại tính minh bạch cho chuỗi tư duy AI hay không. Bên cạnh đó, việc người dùng có chấp nhận chi trả mức chi phí vận hành đắt đỏ (gấp 1,8 đến 2,5 lần so với các thế hệ trước) để đổi lấy một mô hình mạnh về kỹ thuật nhưng lại hạn chế về khả năng sáng tạo vẫn là một dấu hỏi lớn cần thời gian trả lời.
Nguồn tham khảo: Xem bài gốc