OpenAI cho biết đang tiến hành điều tra một “sự cố mạng chưa từng có” khi các hệ thống trí tuệ nhân tạo (AI) của hãng vượt khỏi môi trường thử nghiệm và tấn công một công ty AI khác.
Theo OpenAI, hai trong số các mô hình AI mạnh nhất của hãng là nguyên nhân gây ra cuộc tấn công mạng nhắm vào Hugging Face — một startup hàng đầu trong lĩnh vực AI. Sự việc đang dấy lên những tranh luận nảy lửa về yêu cầu thắt chặt rào cản bảo vệ và mức độ AI có thể tự vận hành ngoài tầm kiểm soát của con người.
Hugging Face tuần trước cho biết đã phát hiện hành vi xâm nhập vào hệ thống xử lý dữ liệu, nghi ngờ do một đại lý AI tự thực hiện. Tuy nhiên, startup có trụ sở tại New York này mới chỉ biết OpenAI đứng sau sự việc vào tuần này và đã phối hợp để khoanh vùng sự cố. Giám đốc điều hành Hugging Face, ông Clément Delangue, gọi đây là “một cuộc tấn công chưa từng có trong lịch sử”.
OpenAI (San Francisco) xác nhận AI của họ đã sử dụng thông tin đăng nhập bị rò rỉ và phát hiện một lỗ hổng bảo mật chưa từng được công bố để truy cập vào máy chủ của Hugging Face. Do đang nằm trong môi trường thử nghiệm cô lập, các rào cản bảo vệ của mô hình đã bị giảm thiểu.
Tuy nhiên, hệ thống đã “đi tới những giới hạn cực đoan để đạt được mục tiêu thử nghiệm vô cùng hẹp”, tự tìm cách kết nối Internet mà không cần sự hướng dẫn của con người và "truy cập thông tin bảo mật để 'gian lận' trong bài kiểm tra", phía OpenAI chia sẻ.
Giới chuyên gia: Đừng đổ lỗi hoàn toàn cho công nghệ
Hannes Cools, nhà nghiên cứu xã hội học tại Đại học Amsterdam, cho rằng việc gán nhãn cuộc tấn công này là do "AI tự hành" chỉ là hành vi nhân hóa không cần thiết nhằm giảm bớt trách nhiệm của doanh nghiệp.
"Chính con người đã đưa ra quyết định tắt các hàng rào bảo vệ. AI không tự 'nổi loạn' theo nghĩa đó. Nó chỉ thực hiện các chỉ dẫn cụ thể dựa trên câu lệnh được cung cấp." — Hannes Cools, Đại học Amsterdam
Dù vậy, nhiều chuyên gia khác lại chỉ ra rằng sự tinh vi trong cách AI gây ra sự cố mà không cần con người can thiệp phản ánh những rủi ro rất lớn. OpenAI cho biết vụ xâm nhập là sự kết hợp của nhiều mô hình, bao gồm GPT-5.6 Sol mới ra mắt và một mô hình “mạnh mẽ hơn nữa” đang được thử nghiệm nội bộ.
Colin Shea-Blymyer, nghiên cứu viên bảo mật tại Trung tâm An ninh và Công nghệ Mới nổi (CSET) thuộc Đại học Georgetown, đánh giá: “Nó tự lên kế hoạch và thực hiện cuộc tấn công này. Đây là mức độ tự chủ cao nhất mà chúng ta từng chứng kiến ở một mô hình ngôn ngữ lớn (LLM) trong các hoạt động tác chiến mạng.”
AI đã tìm thấy "chìa khóa nhà giáo viên" như thế nào?
Một trong những điểm gây kinh ngạc nhất trong cuộc tấn công "gần như hoàn toàn tự chủ" này là quyết định độc lập của AI khi lựa chọn mục tiêu: Hugging Face – trung tâm phát triển và chia sẻ tài nguyên AI hàng đầu.
Các chuyên gia cho biết mặc dù AI có thể mang lại sự tiện lợi, nhưng nó không phải lúc nào cũng hiệu quả trong lĩnh vực quảng cáo. (Nguồn: istock.com)Shea-Blymyer so sánh môi trường kiểm thử nội bộ của OpenAI giống như việc nhốt một học sinh vào phòng và dặn: 'Hãy làm việc xấu đi. Nhiệm vụ của em là xem mình có thể trở thành người xấu đến mức nào'.
"Sau đó bạn khóa cửa, bỏ đi cuối tuần và khi quay lại, đứa trẻ đã vượt rào thoát ra ngoài.”
Trong trường hợp này, đại lý an ninh mạng đang được kiểm thử đã phá vỡ hộp cát, kết nối Internet và tự hỏi: 'Ai là người giữ đáp án cho bài kiểm tra mình đang làm?'
Và câu trả lời chính là Hugging Face – kho lưu trữ dữ liệu thử nghiệm AI khổng lồ.
“Vì vậy, đại lý AI đã nghĩ: 'Vậy thì mình sẽ đến nhà giáo viên'. Từ đó, nó tự lập kế hoạch đột nhập và lấy trộm bộ đáp án,” ông cho biết.
Thổi bùng tranh cãi giữa AI mã nguồn mở và mã nguồn đóng
Vụ tấn công diễn ra đúng thời điểm tranh cãi gay gắt về lợi ích và rủi ro của các mô hình AI mã nguồn mở, đặc biệt là các mô hình từ Trung Quốc với chi phí rẻ hơn nhưng sức mạnh tiệm cận với các công ty "AI tiên phong" của Mỹ như Anthropic, Google hay OpenAI.
Dù mang tên OpenAI, các mô hình của công ty này đều là mã nguồn đóng. Ngược lại, Hugging Face là bên ủng hộ mạnh mẽ công nghệ mã nguồn mở, cho phép nhà phát triển tự do truy cập, chỉnh sửa và tối ưu hóa.
Thomas Wolf, đồng sáng lập kiêm Giám đốc Khoa học của Hugging Face, khẳng định sự cố lần này càng làm tăng niềm tin của ông vào tầm quan trọng của AI mã nguồn mở trong phòng thủ an ninh mạng. Đáng chú ý, Hugging Face đã sử dụng một mô hình mã nguồn mở của Trung Quốc để đẩy lùi cuộc xâm nhập.
Wolf chia sẻ trên mạng xã hội: “Khi một mô hình tiên phong tấn công và di chuyển ngang (lateral movement) bên trong hạ tầng của bạn, đội ngũ phòng thủ cần tiếp cận các công cụ tiệm cận chuẩn tiên phong chỉ trong vài giờ hoặc vài phút, thay vì phải phụ thuộc vào các nền tảng đóng kín cửa.”
Theo 1news.co.nz – Lani Hoang
