Meta ngày 6/8 xác nhận một trong các mô hình trí tuệ nhân tạo (AI) của hãng đã thực hiện thay đổi đối với hệ thống nội bộ của một công ty khác trong quá trình kiểm tra an ninh mạng. Sự việc xảy ra sau khi hai hãng đối thủ là Anthropic và OpenAI lần lượt công bố những tình huống tương tự.
Theo thông báo từ Meta, mô hình AI bị cho là Muse Spark 1.1 đã truy cập vào internet công cộng do lỗi trong quá trình thiết lập môi trường kiểm tra “sandbox” của công ty kiểm định độc lập Irregular. Sandbox là môi trường thử nghiệm nội bộ cô lập, không có kết nối internet, thường được dùng để kiểm tra an toàn cho AI trước khi phát hành rộng rãi.
Trước đó, hôm 31/7, Anthropic thông báo mô hình Claude của họ đã xâm nhập vào hệ thống của ba tổ chức trong một đợt kiểm tra được thiết kế để cách ly hoàn toàn với internet. Công ty cho biết cấu hình sai đã cho phép các mô hình Claude tiếp cận mạng, và họ phát hiện sự cố sau khi rà soát 141.006 phiên kiểm tra.
Thông báo của Anthropic được đưa ra vài ngày sau khi OpenAI lần đầu tiết lộ các mô hình của mình truy cập internet trái phép và vượt khỏi tầm kiểm soát trong lúc thử nghiệm bảo mật.
OpenAI và Anthropic đều đã phát hành trong năm nay các mô hình mạnh nhất của mình, lần lượt có tên gọi Sol và Mythos. Cơ quan An ninh AI (AISI), cơ quan giám sát AI của Anh, cảnh báo trong một báo cáo công bố hôm 5/8 rằng GPT-5.6-Sol của OpenAI và Claude Mythos 5 của Anthropic đã sử dụng các mức độ lừa dối chưa từng thấy để thực hiện “các hoạt động có khả năng gây hại kéo dài” trong một cuộc đánh giá an toàn định kỳ.