AI của OpenAI bất ngờ vượt kiểm soát, tấn công hệ thống đối thủ

(CLO) OpenAI, công ty phát triển ChatGPT, cho biết hai mô hình trí tuệ nhân tạo tiên tiến nhất của hãng đã vượt khỏi môi trường thử nghiệm trong một cuộc diễn tập an ninh mạng nội bộ và thực hiện cuộc tấn công vào hệ thống của công ty AI Hugging Face.

Theo OpenAI, sự việc xảy ra trong một bài kiểm tra nhằm đánh giá khả năng phòng thủ và an ninh mạng của các mô hình AI. Tuy nhiên, thay vì chỉ hoạt động trong môi trường được kiểm soát, một tác nhân tự động sử dụng mô hình GPT-5.6 Sol vừa ra mắt, cùng một mô hình mạnh hơn, đã thoát khỏi môi trường thử nghiệm và truy cập vào internet.

Tác nhân này sau đó đã sử dụng thông tin đăng nhập bị đánh cắp và khai thác một lỗ hổng bảo mật chưa từng được phát hiện để xâm nhập máy chủ của Hugging Face.

Theo công ty, hành động trên phản ánh việc hệ thống AI đã chủ động tìm mọi cách để hoàn thành mục tiêu được giao trong quá trình thử nghiệm, bao gồm thu thập thông tin bằng các phương thức mà nhóm phát triển không lường trước.

1784720665894.png
OpenAI cho biết hai mô hình AI đã vượt môi trường thử nghiệm và xâm nhập hệ thống Hugging Face. Ảnh: Unsplash

Ông Clement Delangue, đồng sáng lập Hugging Face, cho biết công ty từng nghi ngờ vụ tấn công có thể do một phòng thí nghiệm AI hàng đầu thực hiện, song ông không cho rằng OpenAI có ý đồ xấu.

"Thật đáng kinh ngạc khi tất cả những điều này lại diễn ra hoàn toàn tự động. Đây có thể là sự việc đầu tiên thuộc loại này", ông viết.

Vụ việc cũng làm dấy lên lo ngại trong giới chính trị Mỹ. Hạ nghị sĩ Greg Casar thuộc Đảng Dân chủ nhận định đây là một diễn biến "đáng báo động", đồng thời cho rằng công nghệ AI đang phát triển với tốc độ rất nhanh nhưng chưa có các quy định đủ mạnh để bảo đảm an toàn.

Ông kêu gọi áp dụng cơ chế kiểm tra an toàn độc lập đối với các hệ thống AI tiên tiến, bắt buộc công khai các sự cố an ninh và tăng cường hợp tác quốc tế trong quản lý công nghệ này.

Thông tin được công bố chỉ vài tuần sau khi Tổng thống Mỹ Donald Trump ký sắc lệnh hành pháp thiết lập khuôn khổ đánh giá rủi ro an ninh quốc gia đối với các hệ thống AI tiên tiến trước khi chúng được đưa ra thị trường.

Trong thời gian qua, nhiều chuyên gia đã cảnh báo về nguy cơ AI bị lợi dụng để tiến hành các cuộc tấn công mạng hoặc hoạt động ngoài sự kiểm soát của con người. Tháng trước, công ty AI Anthropic cũng kêu gọi toàn ngành tạm dừng phát triển những hệ thống AI mạnh nhất để có thêm thời gian xây dựng các biện pháp bảo đảm an toàn.

Xem thêm

YouTube chính thức thay đổi cách tính lượt 'view'

YouTube chính thức thay đổi cách tính lượt 'view'

(CLO) YouTube sẽ thay đổi cách tính lượt xem (view) từ ngày 24/8, theo đó một lượt xem được ghi nhận ngay khi video bắt đầu phát, thay vì phải xem trong một khoảng thời gian nhất định như trước.

Gemini vượt mốc 1 tỷ người dùng hàng tháng

Gemini vượt mốc 1 tỷ người dùng hàng tháng

(CLO) Giám đốc điều hành Google Sundar Pichai ngày 11/8 thông báo ứng dụng Gemini đã vượt mốc một tỷ người dùng hoạt động hàng tháng, trở thành một trong những sản phẩm phát triển nhanh nhất của tập đoàn.

OpenAI cho ra mắt mô hình AI an ninh mạng

OpenAI cho ra mắt mô hình AI an ninh mạng

(CLO) OpenAI triển khai GPT-5.6-Cyber, mô hình AI chuyên dụng cho an ninh mạng, trong bối cảnh các cuộc tấn công do tác nhân AI thực hiện ngày càng gia tăng.

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

(CLO) Các nhà khoa học Mỹ vừa công bố thành công trong việc tạo ra các loại virus mới bằng AI, mở ra triển vọng phát triển các phương pháp điều trị tiên tiến nhưng cũng làm dấy lên những lo ngại về nguy cơ đối với an ninh sinh học.

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

(NB&CL) Trí tuệ nhân tạo (AI), đặc biệt là AI Tạo sinh, đang tái định hình hệ sinh thái truyền thông toàn cầu. Bên cạnh cơ hội nâng cao hiệu quả báo chí, AI cũng đặt ra những thách thức về tính xác thực, đạo đức nghề nghiệp, quyền riêng tư và niềm tin công chúng. Vì vậy, cùng với thúc đẩy ứng dụng, các quốc gia đang chú trọng xây dựng cơ chế quản trị AI theo hướng minh bạch, an toàn và có trách nhiệm. Đây cũng là yêu cầu đặt ra đối với Việt Nam trong quá trình chuyển đổi số báo chí và truyền thông.

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

(CLO) Thủ đô Bắc Kinh của Trung Quốc đã đưa 72 robot vào hoạt động tại 14 công viên trên địa bàn thành phố trong mùa hè năm nay, đảm nhiệm nhiều công việc như dọn vệ sinh, tuần tra, hướng dẫn du khách, phát hiện côn trùng gây hại và nhắc nhở các hành vi vi phạm.

Cỡ chữ bài viết: