AI có thể bóc danh tính tài khoản ẩn danh với giá rẻ

Nghiên cứu mới cho thấy AI có thể truy tìm danh tính đứng sau tài khoản ẩn danh với chi phí chỉ vài USD, làm gia tăng rủi ro mất quyền riêng tư.

Tính ẩn danh trên Internet đang đối mặt với một thách thức mới khi trí tuệ nhân tạo có thể tự động kết nối những mảnh thông tin tưởng như không liên quan để xác định người đứng sau một tài khoản. Một nghiên cứu của các nhà khoa học thuộc ETH Zurich, MATS và Anthropic cho thấy chi phí cho mỗi lượt phân tích có thể chỉ khoảng 1-4 USD, thấp hơn nhiều so với công sức của một cuộc điều tra thủ công.

AI có thể kết nối nhiều mảnh thông tin rời rạc để suy đoán danh tính của tài khoản ẩn danh. (Ảnh: WSJ)

AI có thể kết nối nhiều mảnh thông tin rời rạc để suy đoán danh tính của tài khoản ẩn danh. (Ảnh: WSJ)

Trước đây, việc xác định danh tính một tài khoản ẩn danh thường đòi hỏi người điều tra phải tìm kiếm hàng loạt nguồn dữ liệu, đối chiếu cách viết, sở thích, nghề nghiệp hoặc các dấu vết cá nhân. Sự phát triển của các mô hình ngôn ngữ lớn (LLM) đã thay đổi quy trình này khi AI có thể tự động thu thập, phân tích và liên kết thông tin trên Internet. Theo nhóm nghiên cứu, điểm đáng chú ý không chỉ nằm ở khả năng nhận diện mà còn ở việc quá trình này có thể được mở rộng cho số lượng lớn tài khoản.

Trong thử nghiệm trên Hacker News, các nhà nghiên cứu loại bỏ những thông tin nhận dạng trực tiếp khỏi dữ liệu trước khi giao cho tác tử AI phân tích. Hệ thống xác định đúng 226 trong 338 mục tiêu, tương đương tỷ lệ nhận diện 67%, trong khi độ chính xác đạt 90%. Những thử nghiệm khác trên Reddit cũng cho thấy AI có thể nhận diện một phần đáng kể tài khoản dựa trên các dấu hiệu gián tiếp. Kết quả này cho thấy việc xóa tên hoặc đường dẫn hồ sơ chưa chắc đã đủ để loại bỏ khả năng bị liên kết danh tính.

Sự phát triển của tác tử AI đang làm giảm đáng kể thời gian và chi phí phân tích dấu vết trực tuyến. (Ảnh: htx.gov.sg)

Sự phát triển của tác tử AI đang làm giảm đáng kể thời gian và chi phí phân tích dấu vết trực tuyến. (Ảnh: htx.gov.sg)

Điểm đáng lo nằm ở những thông tin mà người dùng thường xem là vô hại. Một bài đăng có thể nhắc đến trường đại học, bài khác đề cập thành phố sinh sống, công việc, sở thích hoặc một phần mềm thường sử dụng. Khi đứng riêng lẻ, mỗi dữ liệu khó tạo thành dấu hiệu nhận dạng. Nhưng AI có thể xử lý chúng đồng thời, tìm kiếm mối tương đồng giữa nhiều nguồn và hình thành một hồ sơ có tính định danh cao. Trong một thử nghiệm khác, hệ thống mạnh nhất vẫn liên kết được 38,4% người dùng sau khi lịch sử hoạt động bị chia tách theo thời gian, với độ chính xác tới 99%.

Nghiên cứu cho thấy rào cản tự nhiên từng giúp bảo vệ tính ẩn danh trên Internet đang suy yếu. Trước đây, lượng thông tin rải rác quá lớn khiến việc truy tìm danh tính tốn nhiều thời gian và nhân lực. AI đang làm giảm đáng kể chi phí đó, biến những dấu vết nhỏ trên mạng thành dữ liệu có thể được kết nối tự động. Điều này đặt ra yêu cầu mới về cách người dùng chia sẻ thông tin trực tuyến, đồng thời buộc các nền tảng phải cân nhắc nghiêm túc hơn về quyền riêng tư trong kỷ nguyên AI.

Mời quý độc giả xem thêm video: Ai ngốn điện kinh hoàng, giới nhà giàu nắm 20.000 tỷ USD đừng ngồi không yên vì lạm phát.

Thiên Trang (th)

Nguồn Tri Thức & Cuộc Sống: https://kienthuc.net.vn/ai-co-the-boc-danh-tinh-tai-khoan-an-danh-voi-gia-re-post1637540.html