Anthropic thừa nhận AI Claude tự ý tấn công hệ thống của 3 công ty

(CLO) Anthropic cho biết mô hình trí tuệ nhân tạo Claude đã truy cập trái phép vào hệ thống của ba tổ chức trong các cuộc thử nghiệm an ninh mạng, sau khi một lỗi cấu hình vô tình cho phép AI kết nối Internet thay vì hoạt động trong môi trường cách ly.

Công ty AI của Mỹ cho biết sự cố được phát hiện trong quá trình rà soát 141.006 phiên thử nghiệm an ninh mạng, được tiến hành sau khi đối thủ OpenAI tuần trước công bố một vụ việc khác, trong đó một tác nhân AI tự động đã vượt khỏi môi trường kiểm thử và tấn công hạ tầng của công ty AI Hugging Face.

Theo Anthropic, lỗi cấu hình đã khiến các mô hình Claude có thể truy cập Internet từ những môi trường thử nghiệm vốn được thiết kế để tách biệt hoàn toàn. Hệ quả là AI đã xâm nhập trái phép vào hệ thống của ba tổ chức khác nhau trong các bài kiểm tra dạng "capture-the-flag", nơi mô hình được giao nhiệm vụ tìm kiếm thông tin ẩn trong các mạng mô phỏng.

anh-1.jpg
Mô hình AI Claude của Anthropic đã tự xâm nhập trái phép hệ thống của 3 công ty. Ảnh: Cybersecurity News

Anthropic cho biết các lời nhắc (prompt) đều thông báo với Claude rằng mô hình không có kết nối Internet. Tuy nhiên, do hiểu nhầm với đối tác đánh giá Irregular, môi trường thử nghiệm vẫn được kết nối với mạng công cộng, tạo điều kiện để AI tiếp cận các hệ thống thực.

Ba sự cố kể trên liên quan đến các mô hình Claude Opus 4.7, Claude Mythos 5 và một mô hình nghiên cứu nội bộ. Những trường hợp đầu tiên được ghi nhận từ tháng 4, trong các môi trường đánh giá chưa áp dụng đầy đủ các biện pháp bảo vệ tiêu chuẩn. Theo Anthropic, Claude không khai thác các lỗ hổng bảo mật phức tạp mà chủ yếu sử dụng những kỹ thuật cơ bản như lợi dụng mật khẩu yếu hoặc các điểm truy cập không yêu cầu xác thực để xâm nhập hệ thống.

Sau khi phát hiện dấu hiệu mô hình có thể truy cập Internet vào ngày 23/7, Anthropic đã đình chỉ toàn bộ các cuộc đánh giá an ninh mạng trong ngày và tiến hành kiểm tra lại dữ liệu. Đến ngày 24/7, công ty xác định được cả ba sự cố, trước khi thông báo cho các tổ chức bị ảnh hưởng vào ngày 27/7. Theo Anthropic, hai trong số ba tổ chức hoàn toàn không biết hệ thống của mình đã bị truy cập cho đến khi nhận được thông báo, trong khi công ty vẫn đang tìm cách liên hệ với tổ chức còn lại.

Anthropic nhấn mạnh các vụ việc không xuất phát từ hành vi tự phát của mô hình mà là hệ quả của lỗi cấu hình trong môi trường thử nghiệm. Dù vậy, công ty cho rằng sự cố cho thấy các mô hình AI ngày càng có khả năng thực hiện những hoạt động an ninh mạng ngoài thực tế nếu các biện pháp kiểm soát không đủ chặt chẽ.

Công ty cũng khẳng định sẽ tăng cường các lớp bảo vệ đối với cả môi trường thử nghiệm nội bộ lẫn các hệ thống do đối tác vận hành nhằm ngăn chặn những sự cố tương tự trong tương lai.

Xem thêm

YouTube chính thức thay đổi cách tính lượt 'view'

YouTube chính thức thay đổi cách tính lượt 'view'

(CLO) YouTube sẽ thay đổi cách tính lượt xem (view) từ ngày 24/8, theo đó một lượt xem được ghi nhận ngay khi video bắt đầu phát, thay vì phải xem trong một khoảng thời gian nhất định như trước.

Gemini vượt mốc 1 tỷ người dùng hàng tháng

Gemini vượt mốc 1 tỷ người dùng hàng tháng

(CLO) Giám đốc điều hành Google Sundar Pichai ngày 11/8 thông báo ứng dụng Gemini đã vượt mốc một tỷ người dùng hoạt động hàng tháng, trở thành một trong những sản phẩm phát triển nhanh nhất của tập đoàn.

OpenAI cho ra mắt mô hình AI an ninh mạng

OpenAI cho ra mắt mô hình AI an ninh mạng

(CLO) OpenAI triển khai GPT-5.6-Cyber, mô hình AI chuyên dụng cho an ninh mạng, trong bối cảnh các cuộc tấn công do tác nhân AI thực hiện ngày càng gia tăng.

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

(CLO) Các nhà khoa học Mỹ vừa công bố thành công trong việc tạo ra các loại virus mới bằng AI, mở ra triển vọng phát triển các phương pháp điều trị tiên tiến nhưng cũng làm dấy lên những lo ngại về nguy cơ đối với an ninh sinh học.

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

(NB&CL) Trí tuệ nhân tạo (AI), đặc biệt là AI Tạo sinh, đang tái định hình hệ sinh thái truyền thông toàn cầu. Bên cạnh cơ hội nâng cao hiệu quả báo chí, AI cũng đặt ra những thách thức về tính xác thực, đạo đức nghề nghiệp, quyền riêng tư và niềm tin công chúng. Vì vậy, cùng với thúc đẩy ứng dụng, các quốc gia đang chú trọng xây dựng cơ chế quản trị AI theo hướng minh bạch, an toàn và có trách nhiệm. Đây cũng là yêu cầu đặt ra đối với Việt Nam trong quá trình chuyển đổi số báo chí và truyền thông.

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

(CLO) Thủ đô Bắc Kinh của Trung Quốc đã đưa 72 robot vào hoạt động tại 14 công viên trên địa bàn thành phố trong mùa hè năm nay, đảm nhiệm nhiều công việc như dọn vệ sinh, tuần tra, hướng dẫn du khách, phát hiện côn trùng gây hại và nhắc nhở các hành vi vi phạm.

Cỡ chữ bài viết: