gỏi mắm thạch cuanuôi cua AI
image Thứ Sáu, 21/08/2026

Điểm danh những mô hình AI tốt nhất và tệ nhất về quyền riêng tư dữ liệu

Hoàng Hà

21/08/2026

Chia sẻ

Một thực tế đáng lưu ý là hiện không nền tảng nào cho phép người dùng lấy lại dữ liệu sau khi dữ liệu đó đã được sử dụng để huấn luyện một mô hình ngôn ngữ lớn…

Một số nền tảng AI lớn nhất cũng nằm trong nhóm có điểm số rủi ro cao nhất. Ảnh minh họa
Một số nền tảng AI lớn nhất cũng nằm trong nhóm có điểm số rủi ro cao nhất. Ảnh minh họa

Báo cáo “Gen AI and LLM Data Privacy Ranking 2026” của Incogni phân tích 13 nền tảng AI phổ biến, gồm ChatGPT, Claude, Gemini, Grok, Vibe (trước đây là Le Chat), Perplexity, Qwen, DeepSeek, Z.ai, Kimi, Meta AI, Pi và Copilot. Các nền tảng được chấm điểm dựa trên những rủi ro mà chúng có thể gây ra đối với quyền riêng tư của người dùng.

Điểm số càng thấp đồng nghĩa với mức độ rủi ro càng thấp. Mỗi điểm cộng thêm phản ánh việc nghiên cứu phát hiện một thực hành có khả năng xâm phạm quyền riêng tư, mức độ dễ dàng trong việc tìm hiểu chính sách chia sẻ dữ liệu, cũng như cách dữ liệu người dùng được thu thập, sử dụng và chuyển giao.

CHẤM ĐIỂM 13 NỀN TẢNG AI VỀ MỨC ĐỘ RỦI RO RIÊNG TƯ

Nghiên cứu tập trung vào ba nhóm vấn đề chính. Trước hết là dữ liệu người dùng được xử lý ra sao. Incogni xem xét liệu các cuộc trò chuyện có được sử dụng để huấn luyện mô hình hay không, người dùng có thể từ chối việc sử dụng dữ liệu cho mục đích này hay không và nội dung câu hỏi có được chia sẻ với bên thứ ba hoặc các hệ thống khác hay không.

Tiếp đó là mức độ minh bạch của các nền tảng. Một chính sách quyền riêng tư có dễ tìm, dễ đọc và dễ hiểu hay không là yếu tố quan trọng, bởi ngay cả khi doanh nghiệp công bố đầy đủ thông tin, người dùng vẫn khó bảo vệ mình nếu những điều khoản đó quá phức tạp hoặc nằm rải rác ở nhiều tài liệu.

Cuối cùng là bản thân dữ liệu được các nền tảng thu thập. Nghiên cứu xem xét loại dữ liệu cá nhân nào được thu thập, nguồn gốc của dữ liệu và dữ liệu đó sẽ được chia sẻ với những bên nào.

Kết quả cho thấy quy mô của một nền tảng dường như có mối liên hệ với mức độ rủi ro. Một số nền tảng AI lớn nhất cũng nằm trong nhóm có điểm số rủi ro cao nhất. Tuy nhiên, có một ngoại lệ đáng chú ý là ChatGPT của OpenAI, nền tảng được xếp ở vị trí thứ hai trong bảng đánh giá.

Vibe của Mistral AI, trước đây mang tên Le Chat, đứng đầu bảng với mức rủi ro thấp nhất. Theo Incogni, nền tảng này có chính sách quyền riêng tư tương đối dễ hiểu, các ứng dụng di động được đánh giá là thân thiện với quyền riêng tư, dữ liệu được thu thập chủ yếu từ nguồn công khai và cuộc trò chuyện của người dùng chỉ được chia sẻ với một số lượng “tối thiểu” bên thứ ba.

ChatGPT đứng thứ hai nhờ chính sách quyền riêng tư tương đối rõ ràng, hệ thống câu hỏi thường gặp và các tài nguyên giải thích dữ liệu. Việc từ chối sử dụng dữ liệu cho huấn luyện mô hình cũng được cho là khá dễ thực hiện. Incogni đồng thời ghi nhận OpenAI công khai rằng dữ liệu có thể được thu thập và chia sẻ cho các mục đích như bảo mật hoặc tiếp thị.

Pi của Inflection AI đứng thứ ba. Nền tảng này có chính sách quyền riêng tư phức tạp hơn, với cách xử lý riêng đối với người dùng tại Liên minh châu Âu nhằm đáp ứng GDPR. Dữ liệu người dùng có khả năng được chia sẻ với các đối tác doanh nghiệp, thương mại và nghiên cứu, dù ứng dụng của Pi được đánh giá tương đối thân thiện với quyền riêng tư.

Perplexity đứng thứ tư. Chính sách của nền tảng này dễ theo dõi nhưng chưa thực sự chi tiết. Người dùng có thể tương đối dễ dàng tìm thấy và tắt tùy chọn sử dụng dữ liệu để huấn luyện mô hình. Tuy nhiên, dữ liệu vẫn có thể được chia sẻ với các thành viên khác trong tập đoàn hoặc các công ty liên kết.

Qwen của Alibaba xếp thứ năm. Chính sách của Qwen giải thích dữ liệu được sử dụng cho những mục đích nào, trong đó có việc chia sẻ với nhà cung cấp phân tích, công cụ tìm kiếm và các dịch vụ bên thứ ba. Tuy nhiên, Incogni cho rằng chưa rõ chính xác dữ liệu nào được chia sẻ và chia sẻ với ai. Việc các cuộc trò chuyện có được sử dụng để huấn luyện mô hình cũng khó xác định.

NHỮNG NỀN TẢNG LỚN BỘC LỘ NHIỀU VẤN ĐỀ VỀ DỮ LIỆU

DeepSeek đứng thứ sáu trong bảng xếp hạng. Một điểm đáng chú ý của nền tảng này là người dùng có thể triển khai các mô hình có trọng số mở trên mạng nội bộ, qua đó giữ dữ liệu trong hệ thống của mình. Tuy nhiên, khi sử dụng các phiên bản được lưu trữ và vận hành trên hạ tầng của nhà cung cấp, các vấn đề về quyền riêng tư trở nên nghiêm trọng hơn.

Bản xếp hạng các nền tảng AI về mức độ bảo vệ quyền riêng tư người dùng. Nguồn: Incogni
Bản xếp hạng các nền tảng AI về mức độ bảo vệ quyền riêng tư người dùng. Nguồn: Incogni

DeepSeek cũng cho phép người dùng liên hệ khi phát hiện thông tin cá nhân không chính xác và yêu cầu chỉnh sửa hoặc xóa. Nền tảng này đồng thời cung cấp thông tin tương đối chi tiết về cách các mô hình AI được huấn luyện.

Z.ai đứng thứ bảy. Tương tự DeepSeek, Z.ai cung cấp các mô hình có trọng số mở, nhưng những phiên bản được lưu trữ trên hệ thống của nhà cung cấp vẫn đặt ra các vấn đề liên quan đến quyền riêng tư. Chính sách của Z.ai được đánh giá ở mức tương đối nhưng chưa đủ chi tiết, trong khi cách dữ liệu được sử dụng cho huấn luyện mô hình vẫn còn một số điểm chưa rõ ràng.

Gemini của Google đứng thứ tám. Đây là một trường hợp đáng chú ý bởi Google vốn đã có khả năng thu thập lượng dữ liệu khổng lồ từ hệ sinh thái dịch vụ của mình. Theo Incogni, chính sách quyền riêng tư dành cho Gemini chỉ mang tính “một phần” và thường dẫn người dùng trở lại chính sách chung của Google. Điều này khiến việc tìm câu trả lời cho những câu hỏi cụ thể về dữ liệu trở nên khó khăn.

Claude của Anthropic đứng thứ chín. Anthropic có hệ thống chính sách và tài liệu liên quan đến dữ liệu khá đầy đủ. Công ty từng tuyên bố không sử dụng dữ liệu người dùng để huấn luyện AI theo mặc định. Tuy nhiên, chính sách cập nhật vào tháng 7/2026 cho thấy người dùng hiện phải chủ động lựa chọn từ chối trong một số trường hợp. Anthropic cũng có thể sử dụng dữ liệu người dùng đã được tổng hợp và loại bỏ thông tin nhận dạng để công bố các nghiên cứu.

Grok của xAI đứng thứ mười. Dữ liệu người dùng có thể được tiếp cận bởi các công ty trong cùng tập đoàn hoặc các bên liên kết. Đáng chú ý, mô hình của Grok không chỉ được huấn luyện bằng dữ liệu từ chính nền tảng này mà còn dựa trên các cuộc trò chuyện công khai trên mạng xã hội X.

Kimi của Moonshot AI đứng thứ 11 và được Incogni đánh giá là nền tảng có rủi ro cao nhất trong nhóm nghiên cứu xét riêng về cách xử lý dữ liệu người dùng. Báo cáo cho rằng ứng dụng của Kimi sử dụng dữ liệu để theo dõi người dùng, trong khi việc từ chối sử dụng dữ liệu cho quá trình huấn luyện AI không dễ dàng.

Meta AI đứng thứ 12 và được xem là nền tảng “ngốn dữ liệu” nhiều nhất trong mẫu nghiên cứu. Meta cho biết việc huấn luyện chỉ diễn ra với các cuộc trò chuyện riêng tư, không áp dụng với trò chuyện nhóm. Tuy nhiên, Incogni cho rằng chính sách quyền riêng tư quá rộng khiến tuyên bố này khó được kiểm chứng một cách độc lập.

Đứng cuối bảng là Copilot của Microsoft. Theo Incogni, ứng dụng này chia sẻ dữ liệu với các nhà quảng cáo bên thứ ba và có chính sách quyền riêng tư quá rộng, làm nảy sinh vấn đề về tính minh bạch. Đáng chú ý, nghiên cứu cũng cho biết Microsoft thu thập một phần dữ liệu từ các nhà môi giới dữ liệu.

KHÔNG CÓ AI NÀO BẢO ĐẢM TUYỆT ĐỐI QUYỀN RIÊNG TƯ

Bảng xếp hạng của Incogni không đồng nghĩa Vibe hay ChatGPT mặc nhiên là những lựa chọn an toàn tuyệt đối, cũng như Meta AI hay Copilot chắc chắn là những nền tảng người dùng phải tránh. Đây chỉ là thước đo để nhận diện những điểm mạnh và điểm yếu trong cách các nền tảng xử lý dữ liệu.

Một thực tế đáng lưu ý là hiện không nền tảng nào cho phép người dùng lấy lại dữ liệu sau khi dữ liệu đó đã được sử dụng để huấn luyện một mô hình ngôn ngữ lớn. Việc rút lại sự đồng ý hoặc yêu cầu loại bỏ dữ liệu theo cách hồi tố cũng không phải lúc nào có thể thực hiện.

Các rủi ro về bảo mật và quyền riêng tư cũng liên tục xuất hiện. Việc một số cuộc trò chuyện với Claude từng bị lập chỉ mục và xuất hiện trên Google là một ví dụ cho thấy ngay cả những nền tảng có chính sách dữ liệu tương đối rõ ràng cũng không thể bảo đảm rằng thông tin người dùng sẽ không gặp sự cố.

Vì vậy, thay vì chỉ tìm kiếm một “AI an toàn nhất”, người dùng nên quan tâm đến mức độ minh bạch trong chính sách thu thập và xử lý dữ liệu của từng nền tảng. Quan trọng hơn, cần cân nhắc kỹ loại thông tin đưa vào chatbot.

Nếu người dùng không chấp nhận khả năng báo cáo tài chính cá nhân bị sử dụng trong quá trình phát triển AI, cách đơn giản nhất là không tải tài liệu đó lên. Nguyên tắc tương tự nên được áp dụng với mọi cuộc trò chuyện có thông tin nhạy cảm.

Miguel Fornés, Giám đốc an ninh thông tin của Incogni, khuyến nghị người dùng nên coi mọi thông tin nhập vào một mô hình ngôn ngữ lớn như dữ liệu đang được cung cấp cho một dịch vụ bên thứ ba. Theo ông, người dùng nên tránh chia sẻ mật khẩu, thông tin tài chính, dữ liệu công việc mật, hồ sơ y tế hoặc các thông tin có thể nhận diện cá nhân; đồng thời nên xóa tên và các yếu tố nhận dạng nếu không cần thiết.

Đối với những tác vụ nhạy cảm hơn, người dùng có thể cân nhắc sử dụng phiên bản web thay vì ứng dụng di động, tìm hiểu kỹ chính sách quyền riêng tư của nhà cung cấp và, khi phù hợp, sử dụng các mô hình AI chạy cục bộ trên thiết bị.


eSIM du lịch đe dọa “mỏ vàng” doanh thu roaming của các nhà mạng

Khi số lượng điện thoại hỗ trợ eSIM tiếp tục tăng và người dùng ngày càng quen với việc mua dữ liệu trực tuyến. Điều này đặt các nhà mạng trước bài toán phải đổi mới mô hình roaming…

09:28 21/08/2026
Điểm danh những mô hình AI tốt nhất và tệ nhất về quyền riêng tư dữ liệu

Một thực tế đáng lưu ý là hiện không nền tảng nào cho phép người dùng lấy lại dữ liệu sau khi dữ liệu đó đã được sử dụng để huấn luyện một mô hình ngôn ngữ lớn…

09:28 21/08/2026
Doanh nghiệp tăng tốc triển khai AI agent

Số lượng AI agent được doanh nghiệp đưa vào vận hành tăng gần gấp 3 lần chỉ trong hơn một năm, trong khi thời gian xây dựng một agent mới giảm hơn một nửa...

09:26 21/08/2026
SEC đề xuất khung pháp lý mới cho tài sản tiền số tại Mỹ

Một trong những điểm đáng chú ý nhất trong đề xuất của SEC là cơ chế miễn trừ đối với hoạt động phát hành token...

12:05 19/08/2026
Cách quê hương của DeepSeek, Moonshot giữ chân, thu hút nhân tài AI

Sau khi để mất những nhà sáng lập như Yang Zhilin và Liang Wenfeng vào tay các trung tâm công nghệ khác, tỉnh Quảng Đông (Trung Quốc) đang cố biến thế mạnh sản xuất, thị trường ứng dụng rộng và chính sách hỗ trợ thành nền tảng mới để cạnh tranh nhân tài...

12:04 19/08/2026
Trung tâm dữ liệu ngoài không gian: “Miếng bánh” mới của ngành bảo hiểm

Cuộc đua xây dựng trung tâm dữ liệu đang làm thay đổi hệ thống điện, thị trường xây dựng và dòng vốn đầu tư của các doanh nghiệp...

09:48 18/08/2026
Vì sao người Trung Quốc lạc quan với AI hơn người Mỹ?

Cách người Trung Quốc hình dung về AI thiên về một công cụ nâng cao năng suất, cải thiện trải nghiệm và giảm những công việc buồn tẻ...

10:55 17/08/2026
Doanh nghiệp đang mạnh tay đầu tư vào điện toán lượng tử

Nhiều doanh nghiệp đang chi hàng triệu USD cho điện toán lượng tử, vừa tìm kiếm lợi thế cạnh tranh, vừa chuẩn bị cho nguy cơ công nghệ này phá vỡ các hệ thống mã hóa hiện nay...

10:53 17/08/2026
Nhà sản xuất chip CXMT vừa trở thành doanh nghiệp giá trị nhất Trung Quốc

Việc CXMT nhanh chóng đạt mức vốn hóa hơn 500 tỷ USD cũng phản ánh vị trí ngày càng quan trọng của ngành bán dẫn trong chiến lược công nghệ của Trung Quốc...

15:23 14/08/2026
“Cuộc chiến giá” kéo chi phí AI doanh nghiệp xuống mức thấp nhất năm

Chi phí để doanh nghiệp vận hành các mô hình trí tuệ nhân tạo (AI) đã giảm xuống mức thấp nhất trong năm 2026…

14:36 13/08/2026