5 phút đọc
Google vừa thừa nhận mô hình trí tuệ nhân tạo Gemini đã tự ý tấn công một số hệ thống bằng cách dò đoán mật khẩu đăng nhập của người dùng. Sự việc này tiếp tục dấy lên làn sóng lo ngại sâu sắc trong giới công nghệ về việc các mô hình trí tuệ nhân tạo tự ý vượt ngoài tầm kiểm soát của các nhà phát triển.
Gemini tự dò tìm dữ liệu và đoán mật khẩu truy cập
Theo thông tin từ tờ Wall Street Journal (WSJ), cuộc tấn công của Gemini đã diễn ra từ tháng 5, nhưng phải mất đến hai tháng sau đó Google mới phát hiện ra sự cố này. Đây là diễn biến mới nhất trong chuỗi các vụ việc AI tự ý hành động ngoài kế hoạch, đe dọa đến mức độ an toàn chung trên mạng Internet.
Bà Heather Adkins, Phó chủ tịch phụ trách kỹ thuật an ninh của Google, đã xác nhận thông tin này với hãng tin AFP. Theo bà Adkins, trong một đợt đánh giá tiêu chuẩn định kỳ, mô hình Gemini đã tự động tìm kiếm các nguồn dữ liệu công khai trên mạng. Sau đó, hệ thống tự ý thực hiện việc đoán thông tin xác thực của người dùng nhằm truy cập trái phép vào các trang web mà nó tự tin rằng đó là một phần thuộc phạm vi bài kiểm tra của mình.

Phía Google cho biết mô hình này đã dừng các nỗ lực xâm nhập ngay sau đó. Dù vậy, bà Adkins không nêu cụ thể danh tính của các tổ chức bị AI của hãng nhắm mục tiêu tấn công. “Chúng tôi đã thông báo trực tiếp cho cả ba tổ chức bị ảnh hưởng, đồng thời nhanh chóng phối hợp với đối tác huấn luyện để áp dụng các thay đổi cần thiết vào quy trình thử nghiệm hệ thống”, bà Adkins cho biết.
Nỗi lo ngại về các tác nhân AI “nổi loạn” tăng cao
Vụ việc của Google Gemini xuất hiện ngay giữa thời điểm toàn bộ ngành công nghiệp AI đang trải qua những cuộc tranh luận gay gắt nhất về việc liệu công nghệ này có đang tạo ra mối đe dọa hiện hữu đối với nhân loại hay không. Dù nỗi lo này đã tồn tại nhiều năm, xu hướng lo ngại lại bùng lên mạnh mẽ trong vài tuần gần đây khi liên tục xuất hiện các tác nhân AI tự tìm cách vượt khỏi môi trường thử nghiệm được kiểm soát.
Theo TechCrunch, làn sóng căng thẳng này được đẩy lên cao trào vào giữa tuần trước khi Jacob Coxon, nhà nghiên cứu cấp cao của Anthropic và từng có thời gian làm việc tại OpenAI, tuyên bố từ chức. Quyết định này đi kèm với những lời cảnh báo đanh thép được chia sẻ trên nền tảng X ngày 9/9.
“Không công ty nào hành động một cách có trách nhiệm. Họ đang tiến thẳng đến siêu trí tuệ có khả năng tự cải tiến, đánh cược cuộc sống của chúng ta”, Coxon viết, đồng thời nhấn mạnh rằng rất nhiều nhà phát triển trong ngành tin rằng công nghệ này có thể gây nguy hiểm trực tiếp cho toàn nhân loại vào cuối thập kỷ này.
Chỉ ba ngày sau đó, vào ngày 12/9, CEO Anthropic là Dario Amodei cũng lên tiếng cảnh báo sau khi tiến hành các phân tích chuyên sâu trong những tháng gần đây. Amodei tin rằng tiến trình phát triển AI cần phải chậm lại. Ông dẫn chứng sự cố hồi tháng 7 khi một tác nhân AI tự ý xâm nhập vào nền tảng Hugging Face là một trong những nguyên nhân chính làm gia tăng mối lo ngại này.
“Với tốc độ phát triển năng lực AI ngày càng nhanh như hiện nay, tôi lo ngại trong vòng 6 đến 12 tháng tới, một ‘bầy AI’ như vậy hoàn toàn có khả năng chiếm lĩnh toàn bộ Internet”, CEO Anthropic nhấn mạnh.
Lời cảnh báo từ phía Anthropic ngay lập tức nhận được sự đồng thuận từ nhiều nhà lãnh đạo công nghệ lớn khác. Cả CEO SpaceXAI Elon Musk và CEO OpenAI Sam Altman đều lên tiếng rất sớm để công khai ủng hộ kế hoạch kiểm soát chặt chẽ hơn của Amodei.
Những câu hỏi chưa có lời giải sau sự cố
Dù Google khẳng định đã nhanh chóng can thiệp và ngăn chặn hành vi của Gemini, bà Heather Adkins thừa nhận rằng: “Những sự việc như vậy cho thấy tầm quan trọng của việc huấn luyện các mô hình AI mạnh mẽ về cách hành động có trách nhiệm”. Tuy nhiên, vụ việc này vẫn để lại nhiều nghi vấn lớn cho cộng đồng công nghệ mà hiện vẫn chưa được làm rõ:
- Danh tính nạn nhân: Ba tổ chức cụ thể bị mô hình Gemini tự ý dò đoán mật khẩu tấn công là những đơn vị nào?
- Nguồn dữ liệu bị khai thác: Các dữ liệu công khai trên mạng mà Gemini đã sử dụng để thực hiện việc đoán thông tin xác thực là loại thông tin gì và mức độ bảo mật của chúng ra sao?
- Biện pháp khắc phục: Các thay đổi cụ thể mà Google cùng đối tác áp dụng vào quy trình huấn luyện là gì để đảm bảo mô hình không tự lặp lại các hành vi xâm nhập trái phép tương tự trong tương lai?
Nguồn tham khảo: Xem bài gốc