Những thông tin quan trọng về bảo mật và quyền riêng tư dữ liệu trong ChatGPT
Mua gói Thành viên QuanTriMang Pro để trải nghiệm website không quảng cáo và sử dụng các tiện ích AI trên QuanTriMang.
ChatGPT vẫn giữ vị thế thống trị trong lĩnh vực AI nhờ việc phát hành GPT-5.3 và GPT-5.4 vào đầu năm 2026 cùng chế độ "ChatGPT agent" có khả năng tự vận hành. Tuy nhiên, khi công nghệ chuyển đổi từ dạng chatbot thụ động sang agent chủ động có thể tự duyệt web thay cho người dùng, các vấn đề về quyền riêng tư cũng trở nên nghiêm trọng hơn.
Các khảo sát của Statista từ giai đoạn đầu triển khai công nghệ cho thấy gần một nửa số người được hỏi lo ngại về việc thu thập dữ liệu cá nhân. Đến năm 2026, những lo ngại này đã chuyển từ vấn đề thu thập dữ liệu đơn thuần sang các vấn đề phức tạp hơn như lưu giữ dữ liệu theo yêu cầu pháp lý và giám sát tự động. Tài liệu này cung cấp câu trả lời chính xác và đầy đủ về cách OpenAI xử lý dữ liệu người dùng ở thời điểm hiện tại.
Mục lục bài viết
- ChatGPT có lưu trữ dữ liệu của người dùng không?
- Lĩnh vực mới về quyền riêng tư: ChatGPT agent
- OpenAI Privacy Filter: Che giấu thông tin nhạy cảm ngay trên thiết bị trước khi gửi đi
- Tại sao quyền riêng tư dữ liệu trên ChatGPT lại là vấn đề đáng lo ngại?
- Làm thế nào để tăng cường tính riêng tư khi sử dụng ChatGPT?
ChatGPT có lưu trữ dữ liệu của người dùng không?
Có, ChatGPT lưu trữ dữ liệu của bạn, nhưng các quy định đã thay đổi đáng kể trong năm 2025 và đầu năm 2026 do các vụ kiện tụng ở cấp liên bang.
1. Chính sách tiêu chuẩn
Đối với các tương tác trò chuyện thông thường, OpenAI lưu trữ các câu lệnh (prompt), lịch sử trò chuyện và thông tin tài khoản (email, địa chỉ IP, vị trí) của bạn để huấn luyện mô hình và cung cấp dịch vụ. Thông thường, nếu bạn xóa một cuộc trò chuyện, dữ liệu đó sẽ bị loại bỏ khỏi hệ thống của OpenAI trong vòng 30 ngày.
2. Tác động từ vụ kiện của The New York Times
Vụ kiện bản quyền giữa The New York Times và OpenAI đã làm thay đổi căn bản cơ chế thực thi "Quyền được xóa dữ liệu" trong suốt năm 2025 và kéo dài sang năm 2026.
Lệnh lưu giữ dữ liệu (từ tháng 5 đến tháng 9 năm 2025): Vào tháng 5 năm 2025, Thẩm phán Tòa sơ thẩm (Magistrate Judge) Ona T. Wang của Hoa Kỳ đã ra lệnh cho OpenAI phải lưu giữ vô thời hạn tất cả các nhật ký trò chuyện trên ChatGPT để phục vụ quá trình thu thập chứng cứ pháp lý. Trong giai đoạn này, ngay cả khi bạn chọn "xóa", dữ liệu của bạn vẫn được lưu trữ riêng biệt theo yêu cầu pháp lý. Các cuộc trò chuyện bắt nguồn từ Khu vực Kinh tế Châu Âu, Thụy Sĩ và Vương quốc Anh không nằm trong phạm vi của lệnh này.
Sự thay đổi vào tháng 10: Vào ngày 9 tháng 10 năm 2025, Thẩm phán Wang đã chấm dứt nghĩa vụ lưu giữ dữ liệu trên diện rộng. Nghĩa vụ lưu giữ toàn bộ dữ liệu nhật ký đầu ra của OpenAI đối với các dữ liệu phát sinh sau đó đã kết thúc vào ngày 26 tháng 9 năm 2025, cho phép công ty quay lại áp dụng chính sách xóa dữ liệu tiêu chuẩn trong vòng 30 ngày đối với dữ liệu mới.
Lệnh cung cấp dữ liệu vào tháng 1 năm 2026: Vào ngày 5 tháng 1 năm 2026, Thẩm phán Tòa án Quận (District Judge) Sidney H. Stein của Hoa Kỳ đã phê chuẩn phán quyết của thẩm phán tòa sơ thẩm, buộc OpenAI phải cung cấp 20 triệu nhật ký ChatGPT (đã được loại bỏ thông tin định danh) cho các bên nguyên đơn là những cơ quan báo chí. Điều này có nghĩa là trong khi các nhật ký mới lại được xóa theo quy trình thông thường, thì một lượng lớn những cuộc trò chuyện đã được lưu giữ trước đó sẽ thực sự bị phân tích bởi các bên thứ ba trong vụ kiện bản quyền tổng hợp này.
Rủi ro về "Dữ liệu Zombie" (Dữ liệu tồn đọng): Dữ liệu được ghi nhận trong khoảng thời gian từ tháng 4 đến tháng 9 năm 2025 vẫn được lưu giữ theo lệnh ban đầu. Ngoài ra, các tài khoản và domain bị The New York Times đánh dấu cụ thể là có liên quan đến vụ kiện vẫn tiếp tục bị lưu giữ.
Điểm mấu chốt: Mặc dù tính năng xóa dữ liệu thông thường đã được khôi phục cho đa số người dùng, các lệnh lưu trữ dữ liệu theo yêu cầu pháp lý cho thấy "Quyền được xóa" của người dùng có thể bị tòa án đình chỉ bất cứ lúc nào; đồng thời, phán quyết tháng 1 năm 2026 cũng chỉ ra rằng dữ liệu được lưu giữ có thể rơi vào tay các bên thứ ba.
Lĩnh vực mới về quyền riêng tư: ChatGPT agent
Vào tháng 8 năm 2025, OpenAI đã tích hợp sản phẩm "Operator" (vốn hoạt động độc lập trước đó) vào chế độ ChatGPT agent. Trải nghiệm hợp nhất này vẫn duy trì cơ chế bảo vệ quyền riêng tư nghiêm ngặt hơn của phiên bản tiền nhiệm. Do ChatGPT agent có khả năng thực hiện các thao tác trên môi trường web thực tế (như đặt vé máy bay hay điền biểu mẫu), hệ thống đòi hỏi phải có cơ chế giám sát chặt chẽ để ngăn chặn hành vi lạm dụng.
| Tính năng | Thời hạn lưu giữ | Những gì được ghi lại? |
|---|---|---|
| Chat tiêu chuẩn | 30 ngày (sau khi xóa) | Câu lệnh văn bản, file upload. |
| ChatGPT agent | 90 ngày (sau khi xóa) | Văn bản, ảnh chụp màn hình, lịch sử duyệt web |
Rủi ro liên quan đến ảnh chụp màn hình: Để hoạt động, ChatGPT agent liên tục chụp ảnh màn hình cửa sổ trình duyệt mà nó đang điều khiển. Nếu agent truy cập vào trang hiển thị thông tin định danh cá nhân (PII) nhạy cảm hoặc các bảng điều khiển chứa dữ liệu độc quyền, những hình ảnh này sẽ bị ghi lại. Ngay cả khi bạn xóa phiên làm việc ngay lập tức, các ảnh chụp màn hình này vẫn được lưu giữ trong 90 ngày để phục vụ công tác đánh giá an toàn.
| Cấp độ | Tính năng | Lợi ích về quyền riêng tư |
|---|---|---|
| Basic | Temporary Chat | Không có lịch sử, không được đào tạo |
| Advanced | Privacy Filter (Mới) | Che giấu thông tin định danh cá nhân (PII) tại chỗ trước khi truyền tải |
| Sovereign | AWS/Azure EKM | Các key mã hóa có thể thu hồi |
| Ultra | Zero Data Retention (ZDR) | Không có dữ liệu nào được ghi vào ổ đĩa (chỉ dùng API) |
OpenAI Privacy Filter: Che giấu thông tin nhạy cảm ngay trên thiết bị trước khi gửi đi
Vào tháng 4 năm 2026, OpenAI đã phát hành Privacy Filter (Bộ lọc Quyền riêng tư), một mô hình trọng số mở được thiết kế để phát hiện và che giấu thông tin định danh cá nhân (PII) trong văn bản trước khi dữ liệu được gửi đến dịch vụ AI trên nền tảng đám mây. Mô hình này được phát hành theo giấy phép Apache 2.0 trên Hugging Face và GitHub, cho phép các tổ chức sử dụng cho mục đích thương mại, tinh chỉnh và tích hợp vào sản phẩm riêng mà không phải trả phí bản quyền.
Về mặt kỹ thuật: Privacy Filter là mô hình có 1,5 tỷ tham số với khoảng 50 triệu tham số hoạt động (được xây dựng dựa trên kiến trúc Mixture-of-Experts thuộc dòng mô hình gpt-oss của OpenAI). Mô hình này đủ gọn nhẹ để chạy trên laptop thông thường hoặc thậm chí trực tiếp trên trình duyệt web. Thay vì tạo văn bản theo từng token như các mô hình ngôn ngữ lớn (LLM) thông thường, nó hoạt động như một bộ phân loại token hai chiều: Mô hình đọc dữ liệu đầu vào trong một lần xử lý duy nhất và gán nhãn cho mỗi token thuộc 1 trong 8 danh mục PII hoặc background.
8 danh mục mà mô hình có thể phát hiện và che giấu bao gồm:
- private_person (tên người)
- private_address (địa chỉ nhà và các địa chỉ riêng tư khác)
- private_email
- private_phone
- private_url
- private_date
- account_number (bao gồm số thẻ tín dụng, tài khoản ngân hàng và các mã định danh tương tự)
- secret (mật khẩu, API key, token bảo mật)
Ý nghĩa đối với quyền riêng tư: Các phương pháp phát hiện PII truyền thống thường dựa vào biểu thức chính quy (regex) và khớp mẫu; cách này phát hiện tốt những định dạng rõ ràng như địa chỉ email nhưng lại bỏ sót các tham chiếu theo ngữ cảnh (ví dụ: "dùng thẻ giống lần trước") hoặc các tên gọi mơ hồ. Privacy Filter sử dụng khả năng hiểu ngôn ngữ dựa trên ngữ cảnh, nhờ đó có thể phân biệt liệu "Alice" là một cá nhân thực hay một nhân vật văn học dựa vào văn bản xung quanh. Trên bộ dữ liệu chuẩn PII-Masking-300k, OpenAI ghi nhận điểm F1 đạt 96% và tăng lên 97,43% đối với phiên bản đã hiệu chỉnh của bộ dữ liệu này.
Lợi ích của việc xử lý cục bộ trước tiên: Do mô hình chạy trực tiếp trên thiết bị, văn bản gốc chứa PII không cần phải rời khỏi máy tính của người dùng để thực hiện quy trình làm sạch dữ liệu. Đối với các tổ chức xử lý dữ liệu khách hàng, hồ sơ y tế hoặc thông tin tài chính mang tính bảo mật, đây là một bước chuyển đổi quan trọng so với quy trình gửi dữ liệu thô đến dịch vụ che giấu thông tin trên đám mây.
Những hạn chế quan trọng: OpenAI nêu rõ rằng Privacy Filter là "công cụ hỗ trợ che giấu thông tin và giảm thiểu dữ liệu, chứ không phải là giải pháp ẩn danh hóa, đảm bảo tuân thủ hay cam kết an toàn tuyệt đối". Công cụ này có thể bỏ sót các định danh hiếm gặp, che giấu quá mức những đoạn văn bản ngắn và hoạt động không đồng đều giữa các ngôn ngữ. Đối với các trường hợp sử dụng đòi hỏi độ chính xác và an toàn cao như quy trình pháp lý, y tế hoặc tài chính, OpenAI khuyến nghị kết hợp công cụ này với quy trình kiểm duyệt của con người và tinh chỉnh mô hình chuyên biệt cho lĩnh vực đó. Nó nên được xem là một lớp bảo vệ trong chiến lược "quyền riêng tư ngay từ khâu thiết kế", chứ không chỉ là một bước thủ tục để đánh dấu "đã tuân thủ".
Đối với các tổ chức tại Hà Lan, đây là bước tiền xử lý hữu ích trong những quy trình mà nhân viên hoặc hệ thống chuyển văn bản phi cấu trúc (email, bản ghi chép hội thoại, phiếu yêu cầu hỗ trợ) vào ChatGPT hoặc các mô hình ngôn ngữ lớn (LLM) khác. Công cụ này không thay thế các nghĩa vụ tuân thủ AVG/GDPR của tổ chức, nhưng nó nâng cao tiêu chuẩn kỹ thuật có thể đạt được đối với việc che giấu thông tin định danh cá nhân (PII) ngay tại hệ thống nội bộ.
Tại sao quyền riêng tư dữ liệu trên ChatGPT lại là vấn đề đáng lo ngại?
Ngoài vấn đề "hộp đen" trong quá trình huấn luyện AI, quyền riêng tư còn là một lĩnh vực phức tạp và đầy rủi ro pháp lý.
GDPR và Đạo luật AI của EU
Châu Âu tiếp tục đi đầu trong công tác quản lý và ban hành quy định. Đạo luật AI của EU đã chính thức đi vào hoạt động toàn diện trong năm 2025:
- Tháng 2 năm 2025: Các quy định cấm đối với hệ thống AI gây "rủi ro không thể chấp nhận được" bắt đầu có hiệu lực.
- Tháng 8 năm 2025: Các quy định về AI đa năng (GPAI) bắt đầu được áp dụng, yêu cầu OpenAI phải duy trì tài liệu kỹ thuật chi tiết và tuân thủ luật bản quyền của EU.
Cơ quan bảo vệ dữ liệu Hà Lan (Autoriteit Persoonsgegevens - AP) vẫn duy trì sự giám sát chặt chẽ. Sau án phạt 290 triệu euro áp đặt lên Uber vào năm 2024 do chuyển dữ liệu trái phép sang Mỹ, các tổ chức tại Hà Lan cần đặc biệt lưu tâm đến nơi lưu trữ dữ liệu AI của mình. AP nhấn mạnh rằng kiến thức và kỹ năng về AI (theo Điều 4 của Đạo luật AI) hiện là nghĩa vụ bắt buộc đối với các công ty triển khai những công cụ này.
Làm thế nào để tăng cường tính riêng tư khi sử dụng ChatGPT?
1. Từ chối việc sử dụng dữ liệu để huấn luyện mô hình (đối với tài khoản cá nhân)
Nếu bạn đang sử dụng gói miễn phí (Free), Plus hoặc Pro, dữ liệu của bạn mặc định sẽ được sử dụng để huấn luyện các mô hình của OpenAI. Bạn có thể ngăn chặn điều này bằng cách:
- Vào mục Settings > Data Controls.
- Tắt tùy chọn Improve the model for everyone.
Lưu ý: Thao tác này không bỏ qua quy trình lưu trữ dữ liệu trong 30 ngày (hoặc 90 ngày đối với ChatGPT agent) nhằm mục đích giám sát hành vi lạm dụng, nhưng nó ngăn dữ liệu của bạn trở thành một phần trong cơ sở kiến thức vĩnh viễn của AI.
2. Sử dụng tính năng Temporary Chat
Đối với các tác vụ nhạy cảm mang tính chất một lần, hãy sử dụng tính năng Temporary Chat. Các cuộc trò chuyện này không được lưu vào lịch sử và không được sử dụng để huấn luyện mô hình, mặc dù quy định lưu trữ dữ liệu 30 ngày để giám sát lạm dụng vẫn được áp dụng.
3. Chuyển sang các gói dành cho doanh nghiệp
Đối với các tổ chức, lựa chọn an toàn hơn là đăng ký gói ChatGPT Enterprise hoặc Business (gói trước đây có tên là ChatGPT Team đã được đổi tên thành Business vào tháng 8 năm 2025).
- Không huấn luyện mô hình: OpenAI tuyên bố rõ ràng rằng họ không sử dụng dữ liệu doanh nghiệp để huấn luyện mô hình theo mặc định.
- Quản lý key doanh nghiệp (EKM): Được triển khai vào năm 2025, tính năng này cho phép các không gian làm việc (workspace) thuộc gói Enterprise và Edu tự quản lý key mã hóa thông qua AWS, Google Cloud hoặc Azure. Nếu bạn thu hồi key, OpenAI sẽ không thể đọc dữ liệu của bạn nữa, tạo ra một lớp bảo vệ về mặt kỹ thuật. Lưu ý rằng EKM hiện chỉ dành cho khách hàng Enterprise và Edu có đại diện tài khoản OpenAI cụ thể.
- Không lưu trữ dữ liệu (ZDR): Các khách hàng doanh nghiệp đủ điều kiện có thể sử dụng API ZDR, trong đó dữ liệu không bị ghi vào ổ đĩa hoặc nhật ký hệ thống (log), mặc dù điều này có thể hạn chế một số tính năng nâng cao.
4. Chạy Privacy Filter ngay trên thiết bị trước khi gửi văn bản đến ChatGPT
Đối với các nhà phát triển và doanh nghiệp, Privacy Filter của OpenAI có thể được tích hợp như một lớp tiền xử lý trước bất kỳ lệnh gọi API hoặc quy trình làm việc nào liên quan đến ChatGPT. Vì bộ lọc này chạy cục bộ, bạn có thể làm sạch dữ liệu nhật ký, phiếu hỗ trợ hoặc thông tin người dùng nhập vào trước khi dữ liệu được gửi đến máy chủ của OpenAI. Điều này đặc biệt hữu ích cho các tổ chức chịu sự ràng buộc của các nguyên tắc nghiêm ngặt về giảm thiểu dữ liệu theo quy định AVG/GDPR; tuy nhiên, giải pháp này nên được kết hợp với việc rà soát chính sách và sự giám sát của con người thay vì coi đó là giải pháp tuân thủ độc lập.
5. Công cụ Deep Research & các kết nối đám mây
Công cụ Deep Research có khả năng kết nối với Google Drive và Microsoft OneDrive. Mặc dù nội dung các file của bạn không được sử dụng để huấn luyện đối với các gói Enterprise, nhưng hệ thống vẫn tạo ra những nhật ký tương tác (siêu dữ liệu về những gì bạn đã truy cập và thời điểm truy cập). Hãy luôn tuân thủ nguyên tắc "Quyền hạn tối thiểu" khi cấp quyền truy cập vào bộ nhớ đám mây cho AI.
Bạn nên đọc
-
Tại sao tin tặc nhắm mục tiêu vào tài khoản ChatGPT?
-
Có nên tin tưởng thông tin tư vấn tài chính từ công cụ AI như ChatGPT và Bard?
-
5 lý do khiến các công ty cấm ChatGPT
-
5 lý do khiến ChatGPT trở thành ứng dụng phát triển nhanh nhất mọi thời đại
-
10 cheat code giúp bạn vắt kiệt ChatGPT
-
So sánh ChatGPT Business và Team: Gói nào phù hợp với bạn?
-
Cách xử lý khi ChatGPT phản hồi chậm
-
Hướng dẫn nâng cấp tài khoản ChatGPT Plus miễn phí
-
Cách tạo tài khoản ChatGPT trên điện thoại, máy tính
Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:
Hướng dẫn AI
AI Tools
Học IT
Hàm Excel