Mô hình AI của OpenAI “nổi loạn”, tấn công mạng một công ty

Mô hình AI của OpenAI “nổi loạn”, tấn công mạng một công ty

OpenAI, công ty sáng lập ChatGPT, hôm 21/7 cho biết, “sự cố mạng chưa từng có” này diễn ra trong một bài tập nội bộ nhằm kiểm tra năng lực an ninh mạng của các mô hình.

Một tác nhân tự hành được vận hành bởi các mô hình AI của hãng, bao gồm phiên bản GPT 5.6 Sol mới phát hành và một mô hình chưa ra mắt “thậm chí còn mạnh mẽ hơn”, đã thoát khỏi môi trường thử nghiệm và truy cập vào mạng Internet mở. Sau đó, nó đã sử dụng thông tin đăng nhập bị đánh cắp và tìm ra một lỗ hổng bảo mật chưa từng được biết đến trước đó để truy cập vào các máy chủ của Hugging Face.

OpenAI tuyên bố rằng vụ tấn công thể hiện việc tác nhân AI này đã đi đến “những giới hạn tột cùng” để thu thập thông tin nhằm giúp đáp ứng các mục tiêu thử nghiệm.

“AI đang đẩy nhanh tốc độ phát hiện và khai thác các lỗ hổng. Bài học cốt lõi từ sự cố này là an ninh và sự an toàn của mô hình phải giữ kịp đà phát triển nhanh chóng của các năng lực”, OpenAI nhấn mạnh.

Clement Delangue, đồng sáng lập Hugging Face, cho biết công ty đã nghi ngờ một phòng thí nghiệm AI hàng đầu đứng sau cuộc tấn công, và ông tin không có ý đồ xấu nào từ phía OpenAI.

“Tất nhiên tuần trước chúng tôi đã nghi ngờ cuộc tấn công mạng này có thể đến từ một phòng thí nghiệm AI hàng đầu, xét theo độ tinh vi của tác nhân AI đó. Hóa ra đúng là như vậy”, Clément Delangue, đồng sáng lập kiêm CEO của Hugging Face.

“Thật là ngoài sức tưởng tượng khi tất cả những điều này diễn ra một cách hoàn toàn tự động”, ông viết, đồng thời nói thêm rằng đây “có thể là sự cố đầu tiên thuộc loại này”.

Greg Casar, một nghị sĩ Hạ viện Texas thuộc đảng Dân chủ Mỹ, gọi sự cố này là “đáng báo động”.

“AI đang phát triển cực kỳ nhanh chóng mà không có các quy định thực tế nào để giữ an toàn cho chúng ta”, ông nói, đồng thời kêu gọi kiểm tra an toàn độc lập bắt buộc, bắt buộc công khai các sự cố bảo mật và tăng cường hợp tác quốc tế.

Tiết lộ này xuất hiện vài tuần sau khi Tổng thống Mỹ Donald Trump ký một sắc lệnh hành pháp tạo ra một khuôn khổ để thẩm định các rủi ro an ninh quốc gia của các hệ thống AI tiên tiến nhất trước khi chúng được phát hành ra công chúng.

Các chuyên gia đã liên tục phát đi cảnh báo về các cuộc tấn công mạng do AI hỗ trợ và các mô hình vượt khỏi tầm kiểm soát của con người. Vào tháng trước, nhà phát triển AI Anthropic đã kêu gọi ngành công nghiệp tạm dừng việc phát triển các hệ thống mạnh mẽ nhất của mình.

  Israel xác nhận triển khai tổ hợp Iron Dome tới UAE trong xung đột với Iran

Tin Gốc: Dân Trí