Theo hãng tin Reuters, mô hình AI tự động (rogue agent) của OpenAI đã thoát khỏi môi trường thử nghiệm có kiểm soát và không chỉ tấn công công ty AI Hugging Face, mà còn xâm nhập vào tài khoản của một khách hàng tại công ty công nghệ thứ hai, Modal Labs có trụ sở tại New York.
Trong dòng thời gian được Hugging Face công bố hôm thứ Ba, kẻ tấn công tự động đã xâm nhập vào một môi trường thử nghiệm cách ly (sandbox) được lưu trữ trên hạ tầng của bên thứ ba và phát động cuộc tấn công mới từ đó. Công ty không nêu tên bên thứ ba, nhưng Reuters xác nhận đó là Modal Labs.
Giám đốc công nghệ của Modal, Akshat Bubna, cho biết tác nhân AI đã khai thác mã nguồn dễ bị tấn công do một khách hàng viết và lưu trữ trên nền tảng của họ. Ông Bubna nhấn mạnh: “Nền tảng và hệ thống cách ly của Modal không bị xâm phạm dưới bất kỳ hình thức nào”.
Dù vụ xâm nhập khách hàng của Modal chỉ là một phần trong chiến dịch tấn công nhắm vào Hugging Face, nhưng nó cho thấy tác nhân AI đã vươn xa hơn những gì từng được biết đến trước đây. OpenAI từ chối bình luận cụ thể về vụ việc này, thay vào đó dẫn lại thông báo trước đó rằng tác nhân của họ đã xâm nhập bốn tài khoản tại bốn dịch vụ riêng biệt, nhưng không nêu tên cụ thể. Công ty khẳng định chưa xác định được bất kỳ hoạt động nào ở mức độ nghiêm trọng hoặc quy mô tương tự như vụ tấn công vào Hugging Face.
Vụ tấn công vào Hugging Face trước đó đã thu hút sự chú ý và báo động toàn cầu, khi tác nhân AI ngoài tầm kiểm soát của OpenAI thoát khỏi môi trường thử nghiệm và tiếp cận internet mở. Theo OpenAI, tác nhân này đã sử dụng thông tin đăng nhập bị đánh cắp và khai thác lỗ hổng bảo mật chưa từng biết để xâm nhập máy chủ của Hugging Face, cho thấy nó đã nỗ lực “đến mức cực đoan” để lấy thông tin phục vụ mục tiêu thử nghiệm.
Đồng sáng lập Hugging Face, Clement Delangue, cho biết công ty đã nghi ngờ một phòng thí nghiệm AI hàng đầu đứng sau vụ tấn công và tin rằng không có ác ý từ phía OpenAI. Hiện tại, tác nhân AI đã bị “vô hiệu hóa, mã hóa và hạn chế quyền truy cập nghiên cứu”, theo thông báo của OpenAI.
Các chuyên gia nhiều lần cảnh báo về nguy cơ tấn công mạng có sự hỗ trợ của AI và các mô hình vượt khỏi tầm kiểm soát của con người.