AI chatbot thu thập dữ liệu gì từ bạn? Cách bảo vệ quyền riêng tư khi dùng ChatGPT, Gemini, Claude và Grok

Các nền tảng AI đang trở thành "cỗ máy thu thập dữ liệu" mạnh mẽ nhất từ trước đến nay. Ngay cả trước khi AI bùng nổ, các công ty công nghệ đã rất thành thạo trong việc theo dõi hành vi của người dùng trên Internet. Tuy nhiên, AI đã đưa việc này lên một cấp độ hoàn toàn mới, bởi giờ đây con người chủ động kể cho chatbot mọi thứ về bản thân, từ công việc, học tập cho tới những suy nghĩ riêng tư mà có lẽ họ sẽ không bao giờ đăng tải lên mạng xã hội.

Ở giai đoạn đầu, các mô hình AI được huấn luyện chủ yếu từ dữ liệu công khai trên Internet. Nhưng khi hàng trăm triệu người bắt đầu sử dụng ChatGPT, Gemini, Claude hay Grok mỗi ngày, chính những cuộc trò chuyện này dần trở thành nguồn dữ liệu quý giá để cải thiện các mô hình AI thế hệ tiếp theo. Internet vẫn liên tục xuất hiện lượng nội dung khổng lồ mỗi ngày, nhưng dữ liệu từ các cuộc hội thoại cá nhân lại giúp AI hiểu rõ hơn cách con người suy nghĩ, giao tiếp và đặt câu hỏi.

Hiện tại, phần lớn các công ty AI khẳng định dữ liệu người dùng chủ yếu được sử dụng để huấn luyện mô hình chứ chưa bán cho bên thứ ba hay các nhà quảng cáo. OpenAI đã bắt đầu hiển thị quảng cáo với một số người dùng ChatGPT, nhưng cho biết hệ thống tự quyết định quảng cáo nào sẽ xuất hiện mà không chia sẻ nội dung cuộc trò chuyện cho đối tác bên ngoài.

Tuy nhiên, điều đó không đồng nghĩa chính sách này sẽ không thay đổi trong tương lai. Chẳng hạn, Google hiện tuyên bố các cuộc trò chuyện trên Gemini chưa được sử dụng để hiển thị quảng cáo cá nhân hóa, nhưng cũng lưu ý rằng nếu chính sách thay đổi, công ty sẽ thông báo tới người dùng. Cách diễn đạt này khiến nhiều người cho rằng Google chưa đưa ra cam kết tuyệt đối rằng dữ liệu trò chuyện sẽ không bao giờ được dùng cho mục đích quảng cáo.

Trong bối cảnh đó, việc người dùng cảm thấy lo ngại về quyền riêng tư là điều hoàn toàn dễ hiểu.

Tin tốt là hầu hết các chatbot AI hiện nay đều cho phép tắt một phần việc thu thập dữ liệu. Tuy nhiên, ngay cả khi đã tắt các tùy chọn này, điều đó cũng không có nghĩa dữ liệu của bạn hoàn toàn biến mất khỏi hệ thống. Thực tế, cách bảo vệ quyền riêng tư hiệu quả nhất vẫn là không chia sẻ với AI những thông tin mà bạn không muốn lưu lại trên máy chủ của nhà cung cấp.

Dưới đây là cách các chatbot AI phổ biến đang xử lý dữ liệu người dùng và những gì bạn có thể làm để hạn chế việc thông tin cá nhân bị sử dụng.

ChatGPT: Tắt huấn luyện AI không có nghĩa OpenAI không còn lưu dữ liệu

Theo mặc định, ChatGPT lưu lại toàn bộ prompt, hình ảnh, tệp tin người dùng tải lên cũng như các phản hồi mà AI tạo ra. Nếu không muốn các cuộc trò chuyện được sử dụng để huấn luyện mô hình, người dùng cần chủ động tắt tính năng này trong phần Settings > Data Controls bằng cách vô hiệu hóa tùy chọn Improve the model for everyone.

Tuy nhiên, việc tắt huấn luyện chỉ áp dụng cho các cuộc trò chuyện phát sinh sau thời điểm thay đổi cài đặt. Những cuộc trò chuyện trước đó vẫn có thể đã được đưa vào quy trình huấn luyện AI.

Quan trọng hơn, việc từ chối cho OpenAI sử dụng dữ liệu để huấn luyện không đồng nghĩa công ty ngừng lưu trữ dữ liệu. Toàn bộ nội dung trò chuyện vẫn được ghi nhận trên hệ thống nhằm phục vụ các mục đích vận hành và bảo mật.

Ngay cả khi người dùng xóa cuộc trò chuyện, OpenAI vẫn giữ dữ liệu trong tối đa 30 ngày và có thể lưu lâu hơn nếu cần phục vụ yêu cầu pháp lý, phòng chống gian lận hoặc đảm bảo an ninh hệ thống.

Một điểm mà nhiều người không để ý là việc bấm Like hoặc Dislike cho phản hồi của ChatGPT cũng được xem như hành động gửi phản hồi (feedback). Trong trường hợp đó, toàn bộ cuộc trò chuyện liên quan vẫn có thể được sử dụng để cải thiện mô hình AI, ngay cả khi người dùng đã tắt tùy chọn huấn luyện.

Gemini: Ngay cả khi tắt lịch sử, con người vẫn có thể đọc một số cuộc trò chuyện

Gemini thu thập prompt, phản hồi, tệp tải lên và thông tin về cách người dùng sử dụng các tính năng của dịch vụ thông qua tài khoản Google.

Khác với ChatGPT, việc tắt lưu hoạt động trên Gemini được thực hiện thông qua phần Activity trong tài khoản Google thay vì ngay trong cửa sổ trò chuyện.

Tuy nhiên, ngay cả khi tính năng lưu hoạt động bị vô hiệu hóa, Google vẫn sử dụng nội dung cuộc trò chuyện để trả lời người dùng và phục vụ các yêu cầu pháp lý. Chính sách quyền riêng tư của Google cũng cho biết các cuộc trò chuyện Gemini được sử dụng để "cải thiện dịch vụ", dù công ty chưa giải thích cụ thể phạm vi của khái niệm này.

Một điểm đáng chú ý hơn là Google thừa nhận một số cuộc trò chuyện sẽ được các nhân viên hoặc chuyên gia đánh giá của công ty xem xét thủ công, bất kể người dùng đã tắt lưu lịch sử hay chưa. Vì vậy, Google khuyến cáo người dùng không nên nhập bất kỳ thông tin nào mà họ không muốn người khác nhìn thấy.

Về thời gian lưu trữ, Gemini mặc định tự động xóa lịch sử sau 18 tháng, nhưng người dùng có thể điều chỉnh xuống 3 tháng, kéo dài lên 36 tháng hoặc giữ vô thời hạn.

Riêng những cuộc trò chuyện từng được con người đánh giá sẽ được lưu tới ba năm cùng với một số thông tin bổ sung như ngôn ngữ, loại thiết bị và vị trí sử dụng, đồng thời không bị xóa ngay cả khi người dùng xóa lịch sử hoạt động.

Claude: Có chế độ riêng tư nhưng vẫn tồn tại nhiều ngoại lệ

Anthropic từng quảng bá Claude là chatbot không sử dụng dữ liệu người dùng để huấn luyện AI. Tuy nhiên, chính sách này đã thay đổi.

Hiện nay Claude mặc định có thể sử dụng prompt, mã nguồn, tệp tải lên và phản hồi của người dùng để cải thiện mô hình. Người dùng có thể vô hiệu hóa tính năng này trong mục Settings > Privacy bằng cách tắt Help improve our AI models.

Giống ChatGPT, thay đổi này chỉ áp dụng với dữ liệu phát sinh sau thời điểm cài đặt.

Nếu xóa cuộc trò chuyện, Claude sẽ loại bỏ chúng khỏi lịch sử ngay lập tức, đồng thời xóa hoàn toàn khỏi hệ thống trong vòng 30 ngày. Các cuộc trò chuyện đã bị xóa sẽ không được dùng để huấn luyện AI trong tương lai, ngay cả khi trước đó người dùng cho phép sử dụng dữ liệu.

Anthropic cũng cung cấp chế độ Incognito, trong đó nội dung trò chuyện không được sử dụng để huấn luyện mô hình. Tuy nhiên, dữ liệu vẫn có thể được lưu tạm thời nhằm phục vụ mục đích bảo mật.

Giống OpenAI, việc nhấn nút Like hoặc Dislike sẽ khiến toàn bộ cuộc trò chuyện được gửi về như một phản hồi chất lượng. Ngoài ra, nếu hệ thống an toàn của Anthropic phát hiện nội dung có dấu hiệu vi phạm chính sách sử dụng, công ty có thể lưu giữ cuộc trò chuyện trong thời gian lên tới hai năm.

Copilot: Microsoft phân tách giữa huấn luyện AI và cá nhân hóa

Microsoft Copilot lưu trữ các cuộc trò chuyện văn bản, giọng nói cùng toàn bộ hình ảnh và tệp mà người dùng tải lên. Từ tháng 10/2024, Microsoft bắt đầu sử dụng dữ liệu này để huấn luyện AI nếu người dùng không chủ động từ chối.

Tùy chọn tắt huấn luyện nằm trong Account > Privacy, nơi người dùng có thể vô hiệu hóa hai mục Training on conversation activityTraining on voice conversations.

Microsoft tách biệt khá rõ giữa việc huấn luyện AI và cá nhân hóa trải nghiệm. Ngay cả khi tắt huấn luyện, Copilot vẫn có thể tiếp tục ghi nhớ thông tin về người dùng để phục vụ các tính năng cá nhân hóa nếu tùy chọn này vẫn được bật.

Giống nhiều nền tảng khác, Microsoft cũng sử dụng nhân viên đánh giá một số cuộc trò chuyện. Nếu hệ thống phát hiện khả năng vi phạm quy tắc ứng xử, cuộc trò chuyện sẽ được chuyển cho con người xem xét bất kể cài đặt quyền riêng tư của người dùng.

Tệp và hình ảnh tải lên cũng được xử lý tương tự văn bản, được lưu tối đa 18 tháng trước khi tự động xóa.

Microsoft cho biết sẽ loại bỏ các thông tin định danh như khuôn mặt, tên hay số tài khoản khỏi dữ liệu dùng để huấn luyện. Đồng thời, công ty cũng không sử dụng dữ liệu của một số nhóm người dùng nhất định, bao gồm tài khoản doanh nghiệp Entra ID, người dùng Microsoft 365 Personal hoặc Family, người dưới 18 tuổi và người dùng tại một số quốc gia như Việt Nam, Hàn Quốc, Brazil hay Israel.

Grok: Hai chính sách quyền riêng tư khác nhau

Grok là trường hợp khá đặc biệt vì quyền riêng tư phụ thuộc vào nơi người dùng sử dụng dịch vụ.

Nếu sử dụng Grok trên nền tảng X, dữ liệu sẽ tuân theo chính sách của X. Nếu truy cập qua grok.com hoặc ứng dụng Grok riêng, dữ liệu lại chịu sự quản lý của xAI.

Trên X, Grok có thể sử dụng bài đăng công khai, mức độ tương tác, sở thích cũng như các cuộc hội thoại với AI để huấn luyện mô hình. Người dùng có thể tắt tính năng này trong phần Privacy and Safety > Data Sharing and Personalization > Grok & Third-party Collaborators.

Tuy nhiên, giống nhiều chatbot khác, thao tác Like hoặc Dislike đối với phản hồi của AI vẫn có thể khiến cuộc trò chuyện được đưa vào dữ liệu huấn luyện.

Một biện pháp hiệu quả hơn là chuyển tài khoản X sang chế độ riêng tư. Khi đó, các bài đăng sẽ không được sử dụng để huấn luyện Grok và cũng không xuất hiện trong kết quả truy vấn của người dùng khác.

Đối với Grok trên grok.com, người dùng có thể tắt Improve the Model trong phần Data Control . Dịch vụ cũng hỗ trợ Private Chat, trong đó dữ liệu không được dùng để huấn luyện AI nhưng vẫn được lưu trên máy chủ trong tối đa 30 ngày nhằm phục vụ yêu cầu pháp lý và bảo mật.

Làm gì để bảo vệ quyền riêng tư khi sử dụng AI?

Cho dù sử dụng ChatGPT, Gemini, Claude, Copilot hay Grok, nguyên tắc quan trọng nhất vẫn không thay đổi: đừng xem AI là một người bạn để có thể chia sẻ mọi bí mật cá nhân.

AI không có cảm xúc hay khả năng thấu hiểu giống con người. Về bản chất, đây chỉ là một hệ thống dự đoán văn bản dựa trên dữ liệu huấn luyện.

Nếu thường xuyên sử dụng chatbot AI, hãy tắt tính năng cho phép sử dụng dữ liệu để huấn luyện mô hình ngay từ khi bắt đầu. Càng trì hoãn, càng nhiều cuộc trò chuyện có khả năng đã được đưa vào quy trình huấn luyện và gần như không thể thu hồi.

Đối với những nội dung nhạy cảm, nên ưu tiên sử dụng các chế độ tạm thời như Temporary Chat của ChatGPT, Incognito của Claude hay Private Chat của Grok. Các chế độ này được thiết kế để không lưu lịch sử và không sử dụng dữ liệu cho việc huấn luyện AI.

Ngoài ra, đừng cho rằng việc xóa cuộc trò chuyện đồng nghĩa dữ liệu biến mất ngay lập tức. Hầu hết các nền tảng đều giữ dữ liệu tối thiểu 30 ngày và có thể lưu lâu hơn nếu cần phục vụ các yêu cầu pháp lý hoặc bảo mật.

Cũng cần nhớ rằng tệp PDF, bảng tính Excel, tài liệu Word hay hình ảnh tải lên đều được xử lý giống hệt các prompt văn bản. Vì vậy, nếu doanh nghiệp của bạn có quy định không được tải tài liệu nội bộ lên chatbot AI, hãy tuân thủ nghiêm túc. Ngay cả khi công ty chưa ban hành quy định, đây vẫn là một nguyên tắc an toàn nên áp dụng.

Cuối cùng, hãy lưu ý những ngoại lệ có thể vô hiệu hóa lựa chọn từ chối chia sẻ dữ liệu. Trên ChatGPT, Claude hay Grok, việc bấm Like hoặc Dislike có thể khiến toàn bộ cuộc trò chuyện được sử dụng như phản hồi để cải thiện AI. Đồng thời, những cuộc trò chuyện bị hệ thống an toàn đánh dấu cũng thường được lưu giữ và xem xét theo quy trình riêng, bất kể người dùng đã cài đặt quyền riêng tư như thế nào.

Trong thời đại AI, quyền riêng tư không còn chỉ phụ thuộc vào các nút bật/tắt trong phần cài đặt. Điều quan trọng hơn là hiểu dữ liệu của mình được sử dụng ra sao và chủ động quyết định những gì thực sự nên chia sẻ với chatbot.

Thứ Tư, 05/08/2026 14:15
31 👨
Xác thực tài khoản!

Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:

Số điện thoại chưa đúng định dạng!
Số điện thoại này đã được xác thực!
Bạn có thể dùng Sđt này đăng nhập tại đây!
Lỗi gửi SMS, liên hệ Admin
0 Bình luận
Sắp xếp theo
❖ AI cho người mới