Bạn hiểu AI đến mức nào? Dưới đây là 7 thuật ngữ cần biết

(CLO) Bạn có thể đã nghe nói về học máy (machine learning) và thuật toán (algorithms). Nhưng bạn có biết các thuật ngữ như "red teaming" và "watermarking" là gì không?

Việc trí tuệ nhân tạo (AI) phát triển nhanh chóng làm dấy lên lo ngại rằng nó đang phát triển nhanh hơn mức con người có thể hiểu được về tác động của nó.

ban hieu ai den muc nao duoi day la 7 thuat ngu can biet hinh 1

Ảnh: ST

Bài liên quan

Các hãng thông tấn hàng đầu thế giới ký thư ngỏ kiểm soát AI trong báo chí

Các hãng tin đàm phán về việc sử dụng nội dung của các công ty AI

Google và Universal Music đàm phán về deepfake AI

Meta giải tán nhóm khoa học để chuyển hướng sang AI kiếm tiền

Việc sử dụng AI tổng quát đã tăng lên đáng kể sau khi các công cụ như ChatGPT xuất hiện. Mặc dù những công cụ này mang lại nhiều lợi ích nhưng chúng cũng có thể bị lạm dụng theo những cách có hại.

Để quản lý rủi ro này, Mỹ và nhiều quốc gia khác đã bảo đảm các thỏa thuận từ 7 công ty, bao gồm Amazon, Anthropic, Google, Inflection, Meta, Microsoft và OpenAI, để cam kết thực hành việc phát triển công nghệ AI một cách an toàn.

Thông báo của Nhà Trắng đi kèm với thuật ngữ riêng có thể không quen thuộc với người bình thường, với các từ như “red teaming” và “watermarking”. Dưới đây là 7 thuật ngữ đáng quan tâm liên quan tới AI.

Học máy (Machine learning)

Nhánh AI này nhằm mục đích huấn luyện máy móc thực hiện một nhiệm vụ cụ thể một cách chính xác bằng cách xác định các mẫu. Sau đó, máy có thể đưa ra dự đoán dựa trên dữ liệu đó.

Học sâu (Deep learning)

Các tác vụ AI sáng tạo thường dựa vào học sâu, một phương pháp liên quan đến việc huấn luyện máy tính sử dụng mạng thần kinh, một bộ thuật toán được thiết kế để bắt chước các tế bào thần kinh trong não người, nhằm tạo ra các liên kết phức tạp giữa các mẫu để tạo văn bản, hình ảnh hoặc nội dung khác.

Vì các mô hình học sâu có nhiều lớp tế bào thần kinh nên chúng có thể học các mẫu phức tạp hơn so với học máy truyền thống.

Mô hình ngôn ngữ lớn (Large language model)

Một mô hình ngôn ngữ lớn, hay LLM, đã được đào tạo dựa trên lượng dữ liệu khổng lồ và nhằm mục đích mô hình hóa ngôn ngữ hoặc dự đoán từ tiếp theo trong một chuỗi. Các mô hình ngôn ngữ lớn, như ChatGPT và Google Bard, có thể được sử dụng cho các tác vụ bao gồm tóm tắt, dịch thuật và trò chuyện.

Thuật toán (Algorithm)

Một tập hợp các hướng dẫn hoặc quy tắc cho phép máy móc đưa ra dự đoán, giải quyết vấn đề hoặc hoàn thành nhiệm vụ. Các thuật toán có thể cung cấp các đề xuất mua sắm và trợ giúp phát hiện gian lận cũng như các chức năng trò chuyện dịch vụ khách hàng.

Định kiến (Bias)

Vì AI được đào tạo bằng các tập dữ liệu lớn nên AI có thể kết hợp thông tin có hại trong dữ liệu, chẳng hạn như các ngôn từ kích động thù địch. Phân biệt chủng tộc và phân biệt giới tính cũng có thể xuất hiện trong các bộ dữ liệu được sử dụng để đào tạo AI, dẫn đến nội dung sai lệch.

Các công ty AI đã đồng ý nghiên cứu sâu hơn về cách tránh sự thiên vị và phân biệt đối xử có hại trong các hệ thống AI.

Red teaming

Một trong những cam kết mà các công ty đã đảm bảo với Nhà Trắng là thực hiện "red teaming" bên trong và bên ngoài các mô hình và hệ thống AI.

"Red team" (tạm dịch là "quân đỏ") liên quan đến việc thử nghiệm một mô hình để phát hiện ra những tác hại tiềm ẩn. Thuật ngữ này xuất phát từ một thông lệ quân sự, khi một đội sẽ mô phỏng hoạt động của kẻ tấn công để đưa ra các chiến lược.

Phương pháp này được sử dụng rộng rãi để kiểm tra các lỗ hổng bảo mật trong các hệ thống như nền tảng điện toán đám mây của các công ty như Microsoft và Google.

Watermarking

Watermark là một cách để biết liệu âm thanh hoặc hình ảnh đó có phải do AI tạo ra hay không. Những dữ kiện được đối chiếu để xác minh có thể bao gồm thông tin về người đã tạo ra, cũng như cách thức và thời điểm được tạo hoặc chỉnh sửa.

Ví dụ, Microsoft đã cam kết đánh dấu vào các hình ảnh do các công cụ AI của mình tạo ra. Các công ty cũng cam kết với Nhà Trắng sẽ đánh dấu "watermark" (tạm dịch là "dấu mờ") vào hình hoặc ghi lại xuất xứ... nhằm xác định đó là ảnh do AI tạo ra.

Các dấu mờ cũng thường được sử dụng để theo dõi các vi phạm sở hữu trí tuệ. Các dấu mờ cho hình ảnh do AI tạo có thể hiển thị dưới dạng nhiễu không thể nhận thấy, chẳng hạn như thay đổi một chút ở mỗi pixel thứ bảy.

Tuy nhiên, việc tạo dấu mờ chìm cho văn bản do AI tạo có thể phức tạp hơn và có thể liên quan đến việc điều chỉnh mẫu từ, để nó có thể được xác định là nội dung do AI tạo ra.

Hoàng Tôn (theo Poynter)

Xem thêm

Google lại bị phạt 1 tỷ USD vì độc quyền

Google lại bị phạt 1 tỷ USD vì độc quyền

(CLO) Ủy ban châu Âu ngày 23/7 thông báo phạt Google 890 triệu euro (khoảng 1 tỷ USD) vì vi phạm Đạo luật Thị trường Kỹ thuật số (DMA), cáo buộc hãng công nghệ Mỹ lạm dụng vị thế thống lĩnh để ưu tiên các dịch vụ của mình và gây bất lợi cho đối thủ.

Google Cloud tăng trưởng bùng nổ nhờ AI

Google Cloud tăng trưởng bùng nổ nhờ AI

(CLO) Alphabet, công ty mẹ của Google, vừa công bố báo cáo thu nhập mới nhất cho thấy sự tăng trưởng mạnh mẽ, phần nào giải tỏa nỗi lo của các nhà đầu tư về việc liệu những khoản chi tiêu khổng lồ cho trí tuệ nhân tạo (AI) có thực sự mang lại lợi ích hay không.

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

(CLO) Trong kỷ nguyên AI, lợi thế của doanh nghiệp không còn nằm ở quy mô hay giá bán mà ở khả năng đổi mới sáng tạo, tạo ra giá trị khác biệt và thấu hiểu khách hàng. Đây là nhận định được các chuyên gia đưa ra tại Diễn đàn Chiến lược Kinh doanh "The Future of Business" diễn ra tại TP.HCM chiều 22/7.

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

(CLO) Các nhà nghiên cứu thuộc Đại học Cảnh sát Điều tra Hình sự Trung Quốc đã phát triển một hệ thống trí tuệ nhân tạo (AI) có khả năng thu thập và phân tích nội dung trên dark web bằng tiếng Trung, nhằm hỗ trợ phát hiện các hoạt động phạm pháp trên không gian mạng.

Meta hầu tòa vì cáo buộc Instagram gây nghiện

Meta hầu tòa vì cáo buộc Instagram gây nghiện

(CLO) Meta Platforms sẽ phải hầu tòa tại bang Tennessee (Mỹ) vào ngày 20/7 để đối mặt với cáo buộc Instagram được thiết kế theo cách "gây nghiện" cho thanh thiếu niên, làm trầm trọng thêm cuộc khủng hoảng sức khỏe tâm thần ở giới trẻ.

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

(CLO) Google đã thất bại trong nỗ lực hủy khoản phạt 750.000 euro liên quan đến các video quảng cáo cờ bạc trên nền tảng YouTube, sau khi Tòa án Công lý Liên minh châu Âu (CJEU) ra phán quyết có lợi cho cơ quan quản lý truyền thông của Ý.

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

(CLO) Giám đốc sản phẩm của mạng xã hội X, Nikita Bier, ngày 13/7 đã thông báo về một sự thay đổi quan trọng trong cách hiển thị nội dung trên nền tảng này nhằm mục đích tăng khả năng hiển thị các bài đăng từ những người dùng có mối quan hệ hai chiều, tức những tài khoản theo dõi lẫn nhau.

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

(CLO) Ngày 10/7, Apple đã đệ đơn kiện OpenAI cùng một số cựu nhân viên lên Tòa án Quận Bắc California (Mỹ), cáo buộc công ty này tiến hành một chiến dịch có hệ thống nhằm chiếm đoạt bí mật thương mại về phần cứng để phục vụ tham vọng phát triển thiết bị tiêu dùng.

OpenAI chính thức phát hành mô hình GPT-5.6 mới

OpenAI chính thức phát hành mô hình GPT-5.6 mới

(CLO) Ngày 9/7, OpenAI chính thức phát hành dòng mô hình GPT-5.6 gồm ba phiên bản Sol, Terra và Luna. Đây là lần đầu tiên công ty từ bỏ cách đặt tên bằng số để chuyển sang các tên gọi mới nhằm giúp người dùng dễ phân biệt cấp độ hiệu năng và chi phí giữa các mô hình.

Cỡ chữ bài viết: