Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

(CLO) Các nhà nghiên cứu thuộc Đại học Cảnh sát Điều tra Hình sự Trung Quốc đã phát triển một hệ thống trí tuệ nhân tạo (AI) có khả năng thu thập và phân tích nội dung trên dark web bằng tiếng Trung, nhằm hỗ trợ phát hiện các hoạt động phạm pháp trên không gian mạng.

Dark web (web tối) là phần ẩn của internet, chỉ có thể truy cập bằng các công cụ đặc biệt. Nhờ cơ chế mã hóa và ẩn danh, đây thường là nơi diễn ra các hoạt động như mua bán dữ liệu cá nhân, thông tin tài chính, dịch vụ phạm pháp và nhiều loại nội dung bất hợp pháp khác.

Theo nghiên cứu công bố hồi tháng 5 trên Tạp chí Hệ thống Máy tính Trung Quốc, hầu hết các công trình trước đây chỉ tập trung phân tích nội dung trên dark web bằng tiếng Anh, trong khi dữ liệu tiếng Trung gần như chưa được nghiên cứu.

Để tiếp cận các diễn đàn trên dark web, nhóm nghiên cứu đã xây dựng một hệ thống có thể tự đăng nhập, vượt qua các bước xác thực và thu thập dữ liệu mà không bị các website phát hiện.

Nhờ đó, họ thu thập được hơn 10.000 bài đăng và dữ liệu từ 8 diễn đàn, trang web tiếng Trung trên dark web. Sau khi thu thập, AI chuyển toàn bộ nội dung, kể cả hình ảnh như ảnh thẻ ngân hàng hay giấy tờ, thành văn bản để phân tích.

web-toi.jpg
Trung Quốc phát triển AI tự động phát hiện nội dung phạm pháp trên dark web. Ảnh: Unsplash

Nhóm nghiên cứu ban đầu gắn nhãn thủ công cho khoảng 1.800 mẫu dữ liệu để "dạy" AI nhận biết các loại nội dung.

Sau nhiều vòng huấn luyện, hệ thống đã phân loại hơn 12.000 bài đăng thành nhiều nhóm, như mua bán thông tin tài chính, mua bán dữ liệu định danh cá nhân, rao bán dịch vụ bất hợp pháp, nội dung khiêu dâm, nội dung cực đoan hoặc bạo lực.

Ngoài việc xác định loại nội dung, AI còn chấm điểm mức độ rủi ro của từng bài đăng. Các bài viết chỉ chứa từ ngữ nhạy cảm nhưng chưa vi phạm pháp luật được xếp ở mức rủi ro thấp. Trong khi đó, những nội dung liên quan đến đánh cắp danh tính, cung cấp công cụ phạm tội hoặc liên quan đến trẻ vị thành niên sẽ được chấm điểm cao hơn.

Nhóm nghiên cứu cho biết hệ thống đã được kiểm thử trên một bộ dữ liệu độc lập và cho kết quả phân loại có độ chính xác cao.

Theo các tác giả nghiên cứu, AI có thể giúp giảm đáng kể khối lượng công việc của con người trong việc rà soát nội dung trên dark web, đồng thời tạo nền tảng cho các nghiên cứu và công cụ phân tích chuyên sâu hơn trong tương lai.

Xem thêm

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

(CLO) Ngày 10/7, Apple đã đệ đơn kiện OpenAI cùng một số cựu nhân viên lên Tòa án Quận Bắc California (Mỹ), cáo buộc công ty này tiến hành một chiến dịch có hệ thống nhằm chiếm đoạt bí mật thương mại về phần cứng để phục vụ tham vọng phát triển thiết bị tiêu dùng.

OpenAI chính thức phát hành mô hình GPT-5.6 mới

OpenAI chính thức phát hành mô hình GPT-5.6 mới

(CLO) Ngày 9/7, OpenAI chính thức phát hành dòng mô hình GPT-5.6 gồm ba phiên bản Sol, Terra và Luna. Đây là lần đầu tiên công ty từ bỏ cách đặt tên bằng số để chuyển sang các tên gọi mới nhằm giúp người dùng dễ phân biệt cấp độ hiệu năng và chi phí giữa các mô hình.

Hàn Quốc bắt đầu áp dụng luật chống tin giả mới

Hàn Quốc bắt đầu áp dụng luật chống tin giả mới

(CLO) Từ ngày 7/7, Hàn Quốc bắt đầu thi hành luật chống thông tin giả, tin sai lệch mới, cho phép áp dụng các mức bồi thường và xử phạt nặng đối với các tổ chức truyền thông, người có ảnh hưởng trên mạng xã hội và các nền tảng trực tuyến nếu phát tán thông tin sai sự thật.

Liên hợp quốc cảnh báo AI phát triển vượt tốc độ xây dựng quy định

Liên hợp quốc cảnh báo AI phát triển vượt tốc độ xây dựng quy định

(CLO) Tổng thư ký Liên hợp quốc Antonio Guterres ngày 6/7 cảnh báo trí tuệ nhân tạo (AI) đang phát triển với tốc độ vượt quá khả năng theo kịp của con người, đồng thời kêu gọi xây dựng các quy tắc quản trị thống nhất trên toàn cầu nhằm giảm thiểu những rủi ro tiềm ẩn, đặc biệt đối với trẻ em.

Cỡ chữ bài viết: