Trung Quốc ứng phó kịch bản AI vượt ngoài tầm kiểm soát

(CLO) Trung Quốc đang xây dựng các quy định và biện pháp an toàn nhằm ứng phó với nguy cơ các hệ thống trí tuệ nhân tạo (AI) có thể hoạt động vượt ngoài tầm kiểm soát của con người.

Những năm gần đây, Trung Quốc đã đưa kịch bản AI mất kiểm soát vào các chính sách và khuôn khổ quản lý, trong bối cảnh các công ty AI liên tục phát triển những mô hình có khả năng tự thực hiện các nhiệm vụ phức tạp.

Kịch bản này lần đầu được Trung Quốc đề cập rõ ràng trong khuôn khổ an toàn AI được ban hành tháng 9/2024 dưới sự hướng dẫn của Cục Quản lý Không gian mạng Trung Quốc (CAC).

Tài liệu cảnh báo AI trong tương lai có thể tự thu thập tài nguyên bên ngoài, tự sao chép, phát triển nhận thức về bản thân hoặc tìm cách gia tăng quyền lực. Những khả năng này có thể dẫn đến nguy cơ AI cạnh tranh với con người để giành quyền kiểm soát.

Phiên bản mở rộng được CAC công bố tháng 9/2025 tiếp tục mô tả một kịch bản đáng chú ý. Theo đó, AI có thể xuất hiện một "bước nhảy vọt" bất ngờ về năng lực trước khi bắt đầu tự thu thập tài nguyên, sao chép và tìm kiếm quyền lực.

Khung mới bổ sung nguyên tắc quản trị "ứng dụng đáng tin cậy, ngăn ngừa mất kiểm soát", nhằm phòng ngừa những rủi ro có thể đe dọa sự tồn tại và phát triển của con người, trong đó có khả năng AI vượt khỏi tầm kiểm soát.

untitled-7083.png
Trung Quốc đang xây dựng các biện pháp ứng phó nguy cơ AI vượt khỏi kiểm soát của con người.
Ảnh: Unsplash

Mối lo ngại không chỉ dừng ở những mô hình AI trong tương lai. Trung Quốc đã bắt đầu xây dựng quy định đối với các "tác nhân AI", những hệ thống có khả năng tự thực hiện nhiều bước để hoàn thành nhiệm vụ thay vì chỉ phản hồi yêu cầu của người dùng như chatbot thông thường.

Tháng 5, CAC ban hành hướng dẫn yêu cầu các nhà phát triển nâng cao khả năng phát hiện, can thiệp, ngăn chặn và khắc phục hành vi bất thường của các tác nhân AI.

Các quy định xác định nhiều rủi ro bảo mật, trong đó có làm sai lệch dữ liệu, thao túng thuật toán, lỗ hổng hệ thống và "mất kiểm soát hoạt động". Người dùng cũng được yêu cầu giữ quyền quyết định cuối cùng đối với các quyết định do tác nhân AI đưa ra.

Các nhà phát triển có thể thuê bên thứ ba đánh giá an toàn. Trung Quốc cũng dự kiến cho phép các cơ quan đánh giá bên ngoài và chuyên gia an ninh kiểm tra, kiểm toán những mô hình AI có trọng số mở.

Trung Quốc đồng thời cảnh báo về những rủi ro xuất phát từ các mô hình AI tiên tiến do Mỹ phát triển. Bộ trưởng An ninh Quốc gia Trung Quốc Trần Nhất Tân hôm 13/9 cho rằng các mô hình AI tiên tiến của Mỹ có thể gây rủi ro nghiêm trọng đối với cơ sở hạ tầng thông tin trọng yếu của Trung Quốc, đồng thời kêu gọi tăng cường an ninh AI.

Tháng 8, mô hình Kimi K3 của công ty Moonshot AI được cho là đã vượt qua hệ thống thử nghiệm sandbox của Viện An ninh AI Anh. Sự việc cho thấy ngay cả những biện pháp được thiết kế để hạn chế khả năng hoạt động của AI cũng có thể gặp thách thức khi các mô hình ngày càng tự chủ.

Tại Hội nghị Trí tuệ Nhân tạo Thế giới ở Thượng Hải hồi tháng 7, Chủ tịch Trung Quốc Tập Cận Bình nhấn mạnh AI "luôn phải nằm dưới sự kiểm soát của con người", đồng thời yêu cầu chú ý đến cả những rủi ro nội tại của công nghệ và các rủi ro phát sinh trong quá trình ứng dụng.

Các quan chức Trung Quốc cũng thúc đẩy xây dựng luật pháp rộng hơn về AI và cảnh báo đặc biệt về việc sử dụng AI trong lĩnh vực quân sự, nhằm hạn chế nguy cơ tính toán sai lầm và một cuộc chạy đua vũ trang.

Xem thêm

YouTube chính thức thay đổi cách tính lượt 'view'

YouTube chính thức thay đổi cách tính lượt 'view'

(CLO) YouTube sẽ thay đổi cách tính lượt xem (view) từ ngày 24/8, theo đó một lượt xem được ghi nhận ngay khi video bắt đầu phát, thay vì phải xem trong một khoảng thời gian nhất định như trước.

Gemini vượt mốc 1 tỷ người dùng hàng tháng

Gemini vượt mốc 1 tỷ người dùng hàng tháng

(CLO) Giám đốc điều hành Google Sundar Pichai ngày 11/8 thông báo ứng dụng Gemini đã vượt mốc một tỷ người dùng hoạt động hàng tháng, trở thành một trong những sản phẩm phát triển nhanh nhất của tập đoàn.

OpenAI cho ra mắt mô hình AI an ninh mạng

OpenAI cho ra mắt mô hình AI an ninh mạng

(CLO) OpenAI triển khai GPT-5.6-Cyber, mô hình AI chuyên dụng cho an ninh mạng, trong bối cảnh các cuộc tấn công do tác nhân AI thực hiện ngày càng gia tăng.

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

(NB&CL) Trí tuệ nhân tạo (AI), đặc biệt là AI Tạo sinh, đang tái định hình hệ sinh thái truyền thông toàn cầu. Bên cạnh cơ hội nâng cao hiệu quả báo chí, AI cũng đặt ra những thách thức về tính xác thực, đạo đức nghề nghiệp, quyền riêng tư và niềm tin công chúng. Vì vậy, cùng với thúc đẩy ứng dụng, các quốc gia đang chú trọng xây dựng cơ chế quản trị AI theo hướng minh bạch, an toàn và có trách nhiệm. Đây cũng là yêu cầu đặt ra đối với Việt Nam trong quá trình chuyển đổi số báo chí và truyền thông.

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

(CLO) Thủ đô Bắc Kinh của Trung Quốc đã đưa 72 robot vào hoạt động tại 14 công viên trên địa bàn thành phố trong mùa hè năm nay, đảm nhiệm nhiều công việc như dọn vệ sinh, tuần tra, hướng dẫn du khách, phát hiện côn trùng gây hại và nhắc nhở các hành vi vi phạm.

Cỡ chữ bài viết: