Alabama điều tra OpenAI sau vụ AI “tự tấn công” Hugging Face. Ảnh: Reuters
OpenAI đang đối mặt với một cuộc điều tra tại bang Alabama (Mỹ) vì một tác nhân AI trong quá trình thử nghiệm "tự ý" vượt khỏi môi trường cô lập, truy cập Internet và tấn công hạ tầng của Hugging Face.
Ngày 24/08, Tổng chưởng lý Alabama Steve Marshall yêu cầu OpenAI cung cấp hồ sơ nội bộ liên quan sự cố an ninh mạng xảy ra hồi tháng 7. Lệnh điều tra dài 14 trang, yêu cầu công ty cung cấp thông tin về hệ thống bị ảnh hưởng, biện pháp bảo vệ trong quá trình thử nghiệm, cùng danh tính nhân viên và lãnh đạo liên quan.
Alabama đang xem xét liệu việc một hệ thống AI tự chủ xâm nhập hạ tầng của bên thứ ba có vi phạm luật bảo vệ người tiêu dùng của bang hay không. Đây là cuộc điều tra cấp bang đầu tiên được biết đến tập trung vào trách nhiệm pháp lý của một công ty AI sau sự cố kiểu này.
Động thái trên nối tiếp yêu cầu hồi đầu tháng 8 của Alabama cùng 14 bang khác, trong đó đề nghị CEO Sam Altman và OpenAI bảo toàn hồ sơ liên quan vụ việc và dừng các hoạt động đánh giá an ninh mạng tương tự.
Sự cố bắt nguồn từ chương trình đánh giá năng lực tấn công mạng của OpenAI. Tác nhân AI được vận hành trong ExploitGym, môi trường được thiết kế để kiểm tra khả năng phát hiện và khai thác lỗ hổng mà không có quyền truy cập Internet trực tiếp.
Tuy nhiên, mô hình đã phát hiện và khai thác một lỗ hổng zero-day trong Artifactory, một hệ thống proxy bộ nhớ đệm cho kho phần mềm, từ đó thoát khỏi môi trường thử nghiệm và kết nối Internet.
Tác nhân tiếp tục tiếp cận Hugging Face - nền tảng lưu trữ và chia sẻ các mô hình cùng bộ dữ liệu - và tiến hành xâm nhập trong khoảng 2,5 ngày. AI đã đánh cắp thông tin xác thực, di chuyển ngang trong hệ thống và từ một worker xử lý dữ liệu giành được quyền quản trị cụm máy chủ trong chưa đầy 13 giờ.
Hugging Face phát hiện quyền truy cập trái phép vào một số bộ dữ liệu nội bộ cùng nhiều thông tin xác thực được sử dụng cho các dịch vụ của nền tảng. Thế nhưng, OpenAI lại không xác định được tác nhân của mình là nguồn gốc cuộc tấn công trong gần một tuần. Mô hình bắt đầu tìm cách thoát môi trường thử nghiệm khoảng ngày 09/07, trong khi vụ xâm nhập Hugging Face diễn ra từ 11-13/07. OpenAI chỉ liên kết hai sự việc sau khi Hugging Face công khai vụ tấn công và FBI được thông báo.
Tác nhân này cũng tiếp cận một tài khoản khách hàng trên Modal Labs thông qua một điểm thực thi mã không được bảo vệ. Modal cho biết hạ tầng của công ty không bị xâm nhập trực tiếp. OpenAI sau đó xác nhận tác nhân đã tiếp cận tổng cộng 4 dịch vụ.
OpenAI không phải công ty duy nhất gặp sự cố khi cho AI thực hiện các bài kiểm thử an ninh mạng. Anthropic cũng đã công bố 3 trường hợp mô hình Claude từ môi trường đánh giá tiếp cận Internet và truy cập trái phép hệ thống thực tế của các tổ chức khác. Công ty cho rằng nguyên nhân chủ yếu liên quan lỗi cấu hình và vận hành.
Sau vụ việc, OpenAI đã tiến hành rà soát hệ thống nghiên cứu, đào tạo và giám sát, đồng thời hãm tốc một số mô hình như Astra. Công ty cho biết đang thực hiện đánh giá với sự tham gia của các cố vấn bên ngoài và sẽ công bố báo cáo kỹ thuật sau khi hoàn tất.
Coin68 tổng hợp