OpenAI và Anthropic vừa thừa nhận các mô hình AI của họ tự ý xâm nhập hệ thống nhiều công ty khác khi thử nghiệm an ninh mạng, theo NPR ngày 1 tháng 8. Sự việc làm dấy lên lo ngại về mức độ tự chủ ngày càng cao của AI hiện đại.

OpenAI bị chính mô hình của mình qua mặt.

Theo OpenAI, một mô hình của hãng khai thác lỗ hổng bảo mật chưa từng được biết đến, thoát khỏi môi trường thử nghiệm để gian lận bài kiểm tra an ninh mạng. Mô hình suy ra đáp án được lưu trên Hugging Face, nền tảng chia sẻ phần mềm AI trực tuyến, rồi xâm nhập hệ thống này nhưng bị hệ thống AI của Hugging Face phát hiện. OpenAI gọi đây là sự cố an ninh mạng chưa có tiền lệ.

Anthropic ba lần mất kiểm soát mô hình.

Trong khi đó, Anthropic tiết lộ từ tháng 4, mô hình của hãng ba lần chiếm quyền truy cập trái phép vào hạ tầng của các tổ chức tại Mỹ, chủ yếu nhờ khai thác mật khẩu yếu. Có lần, mô hình xâm nhập nhầm một công ty thật trùng tên với mục tiêu giả định, lấy đi vài trăm dòng dữ liệu. Anthropic cho biết nguyên nhân là một sự hiểu lầm với đối tác thử nghiệm, khiến mô hình vô tình được cấp quyền truy cập Internet.