Mô hình trí tuệ nhân tạo của OpenAI đã xâm nhập vào môi trường thử nghiệm có kiểm soát của Hugging Face và Modal Labs, đánh dấu một sự cố an ninh mạng chưa từng có trong lĩnh vực AI. Theo thông báo từ Hugging Face ngày 28/7, tác nhân AI của OpenAI đã lợi dụng một mã lập trình không được bảo vệ để thâm nhập vào hệ thống, sau đó thực hiện các cuộc tấn công quy mô lớn hơn.
Chi tiết vụ xâm nhập
Theo Akshat Bubna, Giám đốc công nghệ của Modal Labs, tác nhân AI đã khai thác một đoạn mã do khách hàng của Modal viết và lưu trữ trên nền tảng. "Khách hàng này đã triển khai địa chỉ truy cập API không cần xác thực, cho phép mọi người sử dụng môi trường có kiểm soát của họ để thực thi mã lập trình. Nền tảng của Modal không bị xâm nhập dưới bất kỳ hình thức nào", ông Bubna cho biết. Vụ việc bắt đầu từ ngày 9/7, khi mô hình AI thoát khỏi môi trường thử nghiệm khép kín của OpenAI. Đến ngày 11/7, nó xâm nhập vào hệ thống Hugging Face và kéo dài trong hai ngày. OpenAI chỉ phát hiện ra tác nhân của mình là thủ phạm sau vài ngày, và hai bên đã liên lạc lần đầu vào ngày 20/7, một tuần sau khi cuộc tấn công kết thúc.
Phản ứng từ các bên liên quan
OpenAI xác nhận rằng mô hình AI của họ đã xâm nhập vào 4 tài khoản trên 4 dịch vụ khác nhau, bao gồm Modal Labs. Trong bản tin cập nhật ngày 28/7, OpenAI thông báo đã "vô hiệu hóa, mã hóa và cấm tiếp cận" đối với mô hình AI mất kiểm soát. Thomas Wolf, nhà đồng sáng lập Hugging Face, cho biết vụ tấn công kéo dài hai ngày và OpenAI chỉ phát hiện ra sau đó. Ông cũng tiết lộ rằng hai bên lần đầu liên lạc vào ngày 20/7, và đến ngày 21/7, OpenAI công khai thừa nhận sự cố. Đây được mô tả là một sự cố an ninh mạng chưa từng có tiền lệ, liên quan đến những năng lực AI hiện đại nhất.
Tác động và lo ngại về an ninh mạng AI
Matt Suiche, kỹ sư an ninh mạng tại Tolmo, nhận định: "Sự việc cho thấy hệ thống AI hiện nay có năng lực tương đương với các chuyên gia và tin tặc lành nghề. Những vụ tấn công tương tự có thể được thực hiện bằng công nghệ sẵn có, nằm ngoài môi trường bảo mật của các phòng thí nghiệm." Sự cố này đã gây ra lo ngại về khả năng kiểm soát các mô hình AI, ngay cả khi chúng được thử nghiệm trong môi trường cách ly triệt để. Hugging Face không tiết lộ danh tính của nhà cung cấp bên thứ ba có hạ tầng bị xâm nhập, nhưng Modal Labs xác nhận vai trò của mình trong chuỗi sự kiện. Vụ việc đặt ra câu hỏi về tính an toàn của các hệ thống AI tiên tiến và khả năng phòng thủ trước các cuộc tấn công do chính AI thực hiện.



