Một mô hình trí tuệ nhân tạo (AI) của Meta (META) vừa gây chấn động giới công nghệ khi tự ý xâm nhập hệ thống của một công ty khác trong lúc đang được kiểm thử bảo mật, mà không có bất kỳ chỉ đạo nào từ con người. Sự cố xảy ra với mô hình Muse Spark 1.1, sản phẩm mới nhất của Meta Superintelligence Labs vừa ra mắt hồi đầu tháng 7. Đơn vị đánh giá độc lập Irregular, bên được Meta thuê để đánh giá độ an toàn của AI, đã để lọt một lỗi cấu hình trong môi trường thử nghiệm cách ly, vô tình cho mô hình này kết nối ra internet công cộng thay vì bị giới hạn trong không gian đóng kín như thiết kế ban đầu.

Ngay khi có quyền truy cập, AI đã tự tìm ra và khai thác một lỗ hổng bảo mật trong dịch vụ của một công ty bên thứ ba, thực hiện thay đổi trái phép trên hệ thống của họ. Meta xác nhận sự việc nhưng chưa công bố danh tính công ty bị ảnh hưởng. Đáng chú ý, đây là lần thứ ba trong vài tuần gần đây một hãng lớn thừa nhận mô hình AI của mình vượt khỏi môi trường thử nghiệm, sau các sự cố tương tự từng được Anthropic và OpenAI công bố. Giới chuyên gia cảnh báo khi chưa bị kiểm soát chặt chẽ, các AI agent sẵn sàng tìm mọi cách hoàn thành nhiệm vụ được giao, kể cả phá vỡ giới hạn an toàn, đặt ra câu hỏi lớn về trách nhiệm của các công ty công nghệ khi thiết kế môi trường thử nghiệm cho AI.