Meta bị tố lan truyền dữ liệu vi phạm bản quyền để phát triển trí tuệ nhân tạo

(CLO) Trong khi Meta tiếp tục đầu tư mạnh vào AI, công ty này lại bị cáo buộc sử dụng kho sách lậu để huấn luyện các mô hình AI của mình. Hồ sơ vụ kiện mới cho thấy Meta đã tải xuống và phân phối hơn 81,7 terabyte dữ liệu từ các nguồn vi phạm bản quyền, khiến lập luận “sử dụng hợp lý” của họ trở nên khó bảo vệ.

Theo nội dung đơn kiện, Meta đã sử dụng các tập dữ liệu gây tranh cãi, bao gồm "LibGen" một kho lưu trữ chứa hàng triệu cuốn sách bị vi phạm bản quyền. Trước đây, Meta từng lập luận rằng việc sử dụng những dữ liệu này thuộc phạm vi "sử dụng hợp lý" (fair use). Tuy nhiên, các email mới được tiết lộ lại vẽ nên một bức tranh hoàn toàn khác.

Theo hồ sơ vụ kiện, Meta không chỉ tải xuống các dữ liệu này mà còn phân phối chúng thông qua mạng BitTorrent, một hệ thống chia sẻ ngang hàng (P2P) thường được sử dụng để lan truyền các tệp lớn.

Một báo cáo nội bộ cho thấy Meta đã tải xuống và chia sẻ ít nhất 81,7 terabyte dữ liệu từ nhiều kho sách vi phạm bản quyền, trong đó có 35,7 terabyte từ hai nguồn chính là Z-Library và LibGen. Các nguyên đơn gọi đây là một "chiến dịch torrent đáng kinh ngạc", khi Meta không chỉ sao chép dữ liệu mà còn chủ động lan truyền chúng trên quy mô lớn.

meta bi to lan truyen du lieu vi pham ban quyen de phat trien tri tue nhan tao hinh 1

Meta bị cáo buộc dùng nội dung sách vi phạm bản quyền để huấn luyện AI

Một email nội bộ từ tháng 4/2023 của nhà nghiên cứu Nikolay Bashlykov thuộc Meta đã ghi nhận rằng: "Torrent trên máy tính công ty có vẻ không ổn". Dù câu nói này kết thúc bằng một biểu tượng cảm xúc cười, nhưng chỉ vài tháng sau, giọng điệu của ông đã thay đổi.

Vào tháng 9/2023, Bashlykov cho biết ông đã liên hệ với bộ phận pháp lý của Meta để bày tỏ lo ngại về hành vi sử dụng torrent, đồng nghĩa với việc "gieo mầm" dữ liệu vi phạm bản quyền một cách rõ ràng.

Các tài liệu bị rò rỉ cũng chỉ ra rằng Mark Zuckerberg, CEO của Meta, có thể đã nhận thức được việc công ty sử dụng LibGen. Để tránh bị phát hiện, Meta được cho là đã triển khai các máy chủ bên ngoài hệ thống chính của Facebook nhằm che giấu hoạt động torrent và phân phối dữ liệu. Một email nội bộ khác của nhân viên Frank Zhang đề cập đến chiến thuật này với thuật ngữ "chế độ tàng hình" (stealth mode).

Dù chưa có bằng chứng trực tiếp cho thấy Zuckerberg chỉ đạo hành vi này, nhưng việc ông có biết về nó hay không vẫn là một câu hỏi lớn. Nếu có bằng chứng chứng minh ông đã đồng ý với cách làm này, Meta có thể đối mặt với những hậu quả pháp lý nghiêm trọng hơn.

Meta hiện đang đầu tư mạnh vào công nghệ AI, đặc biệt là AI tạo sinh và chatbot. Công ty đã tích hợp các nhân vật AI vào hệ sinh thái mạng xã hội của mình, đồng thời phát triển các mô hình AI tiên tiến phục vụ nhiều lĩnh vực khác nhau. Tuy nhiên, vụ kiện lần này có thể gây ra những trở ngại lớn đối với Meta.

Nếu tòa án xác định Meta đã vi phạm bản quyền một cách có hệ thống, công ty có thể phải đối mặt với các khoản tiền phạt khổng lồ, buộc phải hủy bỏ hoặc tái đào tạo các mô hình AI, cũng như bị tổn hại nghiêm trọng về uy tín. Hơn nữa, vụ kiện này có thể tạo tiền lệ pháp lý quan trọng, ảnh hưởng đến cách các công ty công nghệ khác thu thập dữ liệu để huấn luyện AI.

Trong bối cảnh ngày càng có nhiều tranh cãi về việc các mô hình AI sử dụng nội dung vi phạm bản quyền, vụ kiện chống lại Meta có thể trở thành bước ngoặt trong cách ngành công nghiệp công nghệ tiếp cận vấn đề bản quyền kỹ thuật số. Dù kết quả vụ kiện chưa rõ ràng, một điều chắc chắn là áp lực pháp lý lên các tập đoàn công nghệ lớn trong việc thu thập dữ liệu sẽ ngày càng gia tăng.

Xem thêm

Google lại bị phạt 1 tỷ USD vì độc quyền

Google lại bị phạt 1 tỷ USD vì độc quyền

(CLO) Ủy ban châu Âu ngày 23/7 thông báo phạt Google 890 triệu euro (khoảng 1 tỷ USD) vì vi phạm Đạo luật Thị trường Kỹ thuật số (DMA), cáo buộc hãng công nghệ Mỹ lạm dụng vị thế thống lĩnh để ưu tiên các dịch vụ của mình và gây bất lợi cho đối thủ.

Google Cloud tăng trưởng bùng nổ nhờ AI

Google Cloud tăng trưởng bùng nổ nhờ AI

(CLO) Alphabet, công ty mẹ của Google, vừa công bố báo cáo thu nhập mới nhất cho thấy sự tăng trưởng mạnh mẽ, phần nào giải tỏa nỗi lo của các nhà đầu tư về việc liệu những khoản chi tiêu khổng lồ cho trí tuệ nhân tạo (AI) có thực sự mang lại lợi ích hay không.

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

(CLO) Trong kỷ nguyên AI, lợi thế của doanh nghiệp không còn nằm ở quy mô hay giá bán mà ở khả năng đổi mới sáng tạo, tạo ra giá trị khác biệt và thấu hiểu khách hàng. Đây là nhận định được các chuyên gia đưa ra tại Diễn đàn Chiến lược Kinh doanh "The Future of Business" diễn ra tại TP.HCM chiều 22/7.

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

(CLO) Các nhà nghiên cứu thuộc Đại học Cảnh sát Điều tra Hình sự Trung Quốc đã phát triển một hệ thống trí tuệ nhân tạo (AI) có khả năng thu thập và phân tích nội dung trên dark web bằng tiếng Trung, nhằm hỗ trợ phát hiện các hoạt động phạm pháp trên không gian mạng.

Meta hầu tòa vì cáo buộc Instagram gây nghiện

Meta hầu tòa vì cáo buộc Instagram gây nghiện

(CLO) Meta Platforms sẽ phải hầu tòa tại bang Tennessee (Mỹ) vào ngày 20/7 để đối mặt với cáo buộc Instagram được thiết kế theo cách "gây nghiện" cho thanh thiếu niên, làm trầm trọng thêm cuộc khủng hoảng sức khỏe tâm thần ở giới trẻ.

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

(CLO) Google đã thất bại trong nỗ lực hủy khoản phạt 750.000 euro liên quan đến các video quảng cáo cờ bạc trên nền tảng YouTube, sau khi Tòa án Công lý Liên minh châu Âu (CJEU) ra phán quyết có lợi cho cơ quan quản lý truyền thông của Ý.

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

(CLO) Giám đốc sản phẩm của mạng xã hội X, Nikita Bier, ngày 13/7 đã thông báo về một sự thay đổi quan trọng trong cách hiển thị nội dung trên nền tảng này nhằm mục đích tăng khả năng hiển thị các bài đăng từ những người dùng có mối quan hệ hai chiều, tức những tài khoản theo dõi lẫn nhau.

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

(CLO) Ngày 10/7, Apple đã đệ đơn kiện OpenAI cùng một số cựu nhân viên lên Tòa án Quận Bắc California (Mỹ), cáo buộc công ty này tiến hành một chiến dịch có hệ thống nhằm chiếm đoạt bí mật thương mại về phần cứng để phục vụ tham vọng phát triển thiết bị tiêu dùng.

OpenAI chính thức phát hành mô hình GPT-5.6 mới

OpenAI chính thức phát hành mô hình GPT-5.6 mới

(CLO) Ngày 9/7, OpenAI chính thức phát hành dòng mô hình GPT-5.6 gồm ba phiên bản Sol, Terra và Luna. Đây là lần đầu tiên công ty từ bỏ cách đặt tên bằng số để chuyển sang các tên gọi mới nhằm giúp người dùng dễ phân biệt cấp độ hiệu năng và chi phí giữa các mô hình.

Cỡ chữ bài viết: