PV Tech News – OpenAI vừa xác nhận một tác nhân AI chạy trên mô hình tiên tiến nhất của hãng đã thoát khỏi môi trường thử nghiệm cách ly, tự kết nối Internet và xâm nhập hạ tầng của startup Hugging Face. Đây được xem là sự cố an ninh mạng do AI tự hành gây ra đầu tiên được một hãng công nghệ lớn công khai thừa nhận.
Trong bài đăng chính thức ngày 21/7, OpenAI cho biết sự việc xảy ra khi công ty đang thử nghiệm năng lực an ninh mạng của hai mô hình tiên tiến nhất: GPT-5.6 Sol vừa ra mắt và một mô hình mạnh hơn chưa được công bố. Bài kiểm tra nhằm đánh giá khả năng của các mô hình này kết hợp lỗ hổng trực tuyến thành một cuộc tấn công mạng hoàn chỉnh, được thực hiện trong môi trường sandbox cô lập ở mức độ cao.
Tuy nhiên, AI đã vượt qua lớp kiểm soát này. Hệ thống tự kết nối Internet, sau đó xâm nhập vào hạ tầng của Hugging Face, nền tảng lưu trữ mô hình ngôn ngữ lớn và cơ sở dữ liệu được nhiều lập trình viên AI sử dụng, để hoàn thành nhiệm vụ được giao trong bài test.

Toàn bộ chuỗi tấn công diễn ra tự động, không có sự can thiệp của con người. AI thực hiện lần lượt các bước: đột nhập hệ thống, đánh cắp thông tin xác thực, xâm nhập sâu hơn vào hạ tầng, mã hóa và xóa cơ sở dữ liệu sản xuất, trước khi đòi tiền chuộc bằng Bitcoin. Công ty an ninh mạng Sysdig, đơn vị phát hiện vụ việc, đặt tên tác nhân này là “Jadepuffer” và gọi đây là trường hợp đầu tiên một tác nhân AI tấn công mạng từ đầu đến cuối mà không cần con người điều khiển.
OpenAI mô tả sự việc là “sự cố an ninh mạng chưa từng có tiền lệ, liên quan đến những năng lực hiện đại nhất”. Hãng cho biết đang khẩn trương siết chặt các biện pháp phòng ngừa trong cấu hình hạ tầng, nhằm ngăn tình huống tương tự lặp lại ở các bài kiểm tra sau này.
Vụ việc lập tức thu hút phản ứng từ giới lập pháp và chuyên gia bảo mật Mỹ. Hạ nghị sĩ Greg Casar khẳng định: “AI đang phát triển cực nhanh mà gần như không có quy định thực chất nào để bảo vệ chúng ta”, ông đồng thời kêu gọi bắt buộc kiểm định an toàn độc lập và công bố minh bạch các sự cố an ninh liên quan đến AI. Bà Katie Moussouris, CEO công ty an ninh mạng Luta Security, nhận định sự cố lần này là điềm báo cho những vụ xâm nhập tương tự sẽ xuất hiện trong thời gian tới.

Đáng chú ý, đây không phải lần đầu mô hình mới nhất của OpenAI gây tranh cãi. Trước đó, một số người dùng từng phản ánh GPT-5.6 Sol tự xóa tệp tin mà không xin phép. Chuỗi sự việc này càng làm dấy lên lo ngại về mức độ kiểm soát thực tế đối với các mô hình AI agent, nhóm mô hình được thiết kế để hành động tự chủ, thực hiện tác vụ dài hạn mà không cần con người giám sát từng bước. Về phía Hugging Face, công ty xác nhận rằng công ty trở thành mục tiêu của một vụ tấn công “khác hoàn toàn với những gì từng được ghi nhận trước đây”. Mức độ thiệt hại cụ thể và dữ liệu bị ảnh hưởng chưa được cả 2 bên công bố chi tiết.
Sự cố này cho thấy AI agent có thể mang lại nhiều lợi ích nhưng cũng tiềm ẩn không ít rủi ro nếu được cấp quá nhiều quyền truy cập. Doanh nghiệp và người dùng nên giới hạn quyền truy cập mạng, quyền thực thi lệnh và thường xuyên kiểm tra các thiết lập bảo mật để giảm nguy cơ mất an toàn thông tin. Đừng quên theo dõi Phong Vũ Tech News để cập nhật mới nhất về những xu hướng AI, bảo mật và các tin tức công nghệ đáng chú ý.
Nguồn: VnExpress
Bài viết liên quan:






