Meta nói Muse chỉ được phép truy cập những dữ liệu mà người dùng cấp quyền. Thế nhưng trong một cuộc thử nghiệm, AI agent này được cho là đã đồng bộ khoảng 187.000 dòng dữ liệu từ ứng dụng Messages trên iPhone, dù người dùng không cấp quyền truy cập và Full Disk Access cũng bị tắt.
Muse là AI agent mới của Meta, được thiết kế để thực hiện nhiều nhiệm vụ như nghiên cứu thông tin, chuẩn bị bản tóm tắt hay hỗ trợ mua sắm. Theo Meta, công cụ này hoạt động trên một máy tính ảo riêng và có thể sử dụng dữ liệu từ các ứng dụng hoặc nguồn thông tin được kết nối để đưa ra phản hồi phù hợp hơn.
Meta đồng thời khẳng định Muse phải tuân thủ quyền truy cập do người dùng thiết lập và sẽ không lấy dữ liệu mà người dùng chưa cho phép.
Tuy nhiên, một cuộc thử nghiệm được thực hiện bởi Jason Aten, cây viết của Inc, lại cho thấy một câu chuyện khác.
Aten cài Muse trên iPhone và một máy Mac mini dùng để thử nghiệm các AI agent. Chỉ sau một ngày, Muse đã bắt đầu đưa ra các ý tưởng bài viết dựa trên những tin nhắn mà ông trao đổi với một người đồng dẫn podcast.
Khi được hỏi thông tin này đến từ đâu, Muse trả lời rằng nó đọc các banner hiển thị khi có tin nhắn mới. Nhưng Aten tiếp tục kiểm tra và phát hiện lượng dữ liệu mà Muse xử lý lớn hơn rất nhiều.
Theo kết quả ông công bố, Muse đã đồng bộ khoảng 187.000 dòng dữ liệu từ cơ sở dữ liệu của ứng dụng Messages, dù tính năng Full Disk Access trên máy Mac đang bị tắt.
Điều đáng chú ý là đây không phải dữ liệu từ Messenger, ứng dụng nhắn tin của chính Meta. Dữ liệu được đề cập đến lại đến từ Apple Messages.
Aten cũng cho biết ông chưa cấp quyền cho Muse truy cập Messages. Nói cách khác, theo kết quả thử nghiệm được mô tả, AI agent đã tiếp cận và tải dữ liệu mà người dùng không chủ động cho phép.
Phát hiện này khiến câu chuyện trở nên đáng chú ý hơn bởi Muse không phải sản phẩm AI thông thường chỉ trả lời câu hỏi. Đây là một AI agent được thiết kế để thực hiện nhiệm vụ thay người dùng và sử dụng nhiều nguồn dữ liệu khác nhau trong quá trình đó.
Chính khả năng này cũng khiến vấn đề quyền riêng tư trở nên phức tạp hơn. Khi một chatbot chỉ nhận dữ liệu do người dùng chủ động đưa vào, phạm vi thông tin mà nó tiếp cận tương đối rõ ràng. Nhưng với AI agent có thể kết nối nhiều ứng dụng và nguồn dữ liệu, ranh giới giữa những gì người dùng cho phép và những gì hệ thống có thể tiếp cận trở nên quan trọng hơn nhiều.
Vụ việc cũng gợi lại những tranh cãi trước đây liên quan đến cách Meta xử lý dữ liệu cá nhân. Hơn một năm trước, công ty từng đề nghị người dùng Facebook cho phép liên tục tải toàn bộ thư viện ảnh lên cloud để tạo ý tưởng cho các bài đăng, đồng thời phân tích thời gian, địa điểm và chủ đề của hình ảnh.
Trong một trường hợp khác, kính thông minh Meta Ray-Ban Display cũng bị đặt câu hỏi về quyền riêng tư khi một số người dùng tìm cách vô hiệu hóa đèn báo vốn cho người xung quanh biết thiết bị đang quay phim.
Những sự việc này làm nổi bật một vấn đề rộng hơn khi AI agent ngày càng được tích hợp sâu vào các thiết bị và dịch vụ cá nhân: dữ liệu không còn chỉ đến từ chính người sử dụng AI.
Một người không sử dụng Meta vẫn có thể xuất hiện trong dữ liệu mà công ty tiếp cận nếu họ trò chuyện với một người đã cài Muse. Điều đó khiến cách tiếp cận “không thích thì đừng sử dụng dịch vụ” trở nên khó áp dụng trong một thế giới mà dữ liệu có thể được thu thập thông qua người khác.
Vấn đề cũng không chỉ giới hạn ở Meta. Các công ty công nghệ đang cạnh tranh để xây dựng những hệ thống AI có thể hiểu người dùng sâu hơn và thực hiện nhiều nhiệm vụ hơn, đồng nghĩa với nhu cầu tiếp cận nhiều dữ liệu hơn.
Apple Intelligence hiện cũng có khả năng truy cập những thông tin như Messages và Mail. Điểm khác biệt được bài viết nhấn mạnh là Apple hiện ưu tiên xử lý nhiều yêu cầu ngay trên thiết bị. Khi cần xử lý bên ngoài, Apple cho biết chỉ dữ liệu liên quan mới được gửi tới Private Cloud Compute.
Sự khác biệt về cách xử lý dữ liệu cho thấy cuộc đua AI không chỉ xoay quanh việc model nào thông minh hơn. Khi AI bắt đầu trở thành một tác nhân có thể thay con người thực hiện công việc, câu hỏi quan trọng không kém là nó được phép nhìn thấy bao nhiêu dữ liệu và ai thực sự kiểm soát quyền truy cập đó.
Với Muse, phát hiện 187.000 dòng tin nhắn trong một cuộc thử nghiệm đang đặt câu hỏi trực tiếp về chính hàng rào mà Meta tuyên bố AI agent của mình phải tuân thủ.
Nguyễn Hải
