Sử dụng chatbot đồng nghĩa với việc đi qua một bãi mìn về quyền riêng tư và kiểm duyệt.

Các ứng dụng chat AI như ChatGPT thu thập dữ liệu người dùng, lọc phản hồi và đưa ra các quyết định kiểm duyệt nội dung không phải lúc nào cũng minh bạch. Nhưng DeepSeek — một chatbot AI mới được phát triển tại Trung Quốc đang thu hút sự chú ý chưa từng có như mối đe dọa lớn đối với (cửa sổ mới)c(cửa sổ mới)ác công ty công nghệ phương Tây(cửa sổ mới) — còn làm tất cả những điều đó và hơn thế nữa.

Trên thực tế, chatbot này đi kèm với một rủi ro thậm chí còn lớn hơn: DeepSeek bị bắt buộc về mặt pháp lý phải tuân thủ các yêu cầu của chính phủ Trung Quốc về truy cập dữ liệu và kiểm soát nội dung, mà không có biện pháp pháp lý nào để phản kháng.

Trong khi các chính phủ trên toàn thế giới — bao gồm cả Mỹ và EU — có thể yêu cầu cung cấp dữ liệu từ các công ty công nghệ, các công ty phương Tây có các con đường pháp lý để khiếu nại các yêu cầu này tại tòa án. Ví dụ, OpenAI, Google và Meta có thể phản đối hầu hết các yêu cầu quá mức từ chính phủ, kháng cáo tại các tòa án độc lập hoặc từ chối các yêu cầu vi phạm luật quyền riêng tư như GDPR. Tuy nhiên, DeepSeek hoạt động theo Luật Tình báo Quốc gia của Trung Quốc(cửa sổ mới), luật này buộc các công ty phải hợp tác với các nỗ lực tình báo của chính phủ mà không có sự minh bạch hay khả năng từ chối một cách hợp pháp. Điều này có nghĩa là nếu chính phủ Trung Quốc muốn truy cập dữ liệu người dùng hoặc thao túng các phản hồi do AI tạo ra, DeepSeek không có lựa chọn nào khác ngoài việc tuân thủ.

Bài viết này đi sâu vào những gì DeepSeek thu thập và lý do tại sao điều đó lại quan trọng đối với quyền riêng tư, sự kiểm duyệt và sự kiểm soát của chính phủ.

DeepSeek là gì?

DeepSeek là một công ty khởi động AI thuộc sở hữu của High-Flyer, một quỹ phòng hộ có trụ sở tại Trung Quốc(cửa sổ mới). Công cụ này đã được quảng bá như một giải pháp thay thế mã nguồn mở cho ChatGPT, có khả năng tạo ra các phản hồi giống con người, hỗ trợ lập trình và giải quyết các vấn đề phức tạp — tất cả đều được thực hiện với chi phí rẻ(cửa sổ mới).

Mô hình này đã thu hút sự chú ý quốc tế(cửa sổ mới) vì được cho là đạt hiệu suất tương đương với các mô hình AI hàng đầu của phương Tây với chi phí chỉ bằng một phần nhỏ. Vào tháng 1 năm 2025, DeepSeek đã vượt qua ChatGPT về số lượt tải xuống từ App Store của Apple(cửa sổ mới), gây ra làn sóng bán tháo cổ phiếu công nghệ trên toàn cầu và dấy lên lo ngại về hàng tỷ đô la mà các công ty công nghệ ở Mỹ đang đổ vào việc mở rộng các trung tâm dữ liệu tiêu tốn nhiều năng lượng, khoản chi tiêu được tuyên bố là rất quan trọng đối với bước đột phá AI tiếp theo.

Nhưng khi người dùng tải xuống DeepSeek và chia sẻ trải nghiệm sử dụng chatbot này, một điều trở nên rõ ràng là việc sử dụng DeepSeek đi kèm với một sự đánh đổi quen thuộc đối với loại hình công nghệ này: quyền riêng tư và tính bảo mật của những thông tin nhạy cảm nhất.

Những lỗ hổng bảo mật sâu sắc

Nghiên cứu mới đã tiết lộ rằng các thực hành bảo mật của DeepSeek có thể cũng đáng lo ngại như các chính sách dữ liệu của công cụ này, điều sẽ được đề cập sau.

Vào ngày 29 tháng 1 năm 2025, công ty an ninh mạng Wiz báo cáo(cửa sổ mới) rằng DeepSeek đã vô tình để lộ hơn một triệu dòng dữ liệu nhạy cảm trên mạng internet công cộng. Vụ rò rỉ bao gồm các khóa phần mềm kỹ thuật số, có thể cho phép truy cập trái phép vào hệ thống DeepSeek, và nhật ký trò chuyện từ người dùng thực tế, hiển thị các câu lệnh thực tế gửi đến chatbot.

Các nhà nghiên cứu của Wiz cho biết đã tìm thấy cơ sở dữ liệu gần như ngay lập tức với việc quét tối thiểu. Trong vòng 30 phút sau khi Wiz liên hệ với DeepSeek, cơ sở dữ liệu đã bị khóa, nhưng không rõ liệu các tác nhân xấu đã truy cập hoặc tải xuống dữ liệu trước khi dữ liệu được bảo mật hay chưa. Với việc dễ dàng tìm thấy như vậy, kịch bản đó hoàn toàn có thể xảy ra.

Ami Luttwak, giám đốc công nghệ của Wiz, đã chia sẻ với Wired(cửa sổ mới) rằng vụ rò rỉ này là một “sai lầm nghiêm trọng”, đồng thời cảnh báo rằng hệ thống của DeepSeek chưa đủ hoàn thiện “để có thể sử dụng với bất kỳ dữ liệu nhạy cảm nào”.

Tuy nhiên, vụ rò rỉ này đã làm rõ ít nhất một điều: DeepSeek không chỉ thu thập và lưu trữ lượng lớn dữ liệu người dùng — công cụ này dường như còn thiếu các biện pháp bảo mật cần thiết để bảo vệ dữ liệu đó.

DeepSeek thu thập dữ liệu nào?

Theo chính sách quyền riêng tư(cửa sổ mới), DeepSeek thu thập nhiều loại dữ liệu cá nhân, bao gồm:

  • Thông tin hồ sơ: Tên người dùng, email, số điện thoại, mật khẩu và ngày sinh.
  • Đầu vào của người dùng: Mọi thứ được nhập hoặc tải lên, bao gồm lịch sử trò chuyện, câu lệnh và đầu vào âm thanh.
  • Dữ liệu thiết bị và mạng: Địa chỉ IP, kiểu thiết bị, hệ điều hành, ngôn ngữ hệ thống và kiểu gõ phím.
  • Dữ liệu sử dụng: Các tính năng được sử dụng, các hành động được thực hiện và nhật ký hiệu suất hệ thống.
  • Cookie và trình theo dõi: Web beacon và các công nghệ theo dõi khác để giám sát hành vi người dùng.
  • Dữ liệu từ bên thứ ba: Thông tin từ các tài khoản liên kết và đối tác quảng cáo theo dõi hoạt động trên các trang web, ứng dụng và cửa hàng.

Việc DeepSeek xử lý và lưu trữ dữ liệu này trên các máy chủ ở Trung Quốc, nơi phải chịu sự truy cập của chính phủ, đã dấy lên cảnh báo đối với các cơ quan quản lý Châu Âu.

DeepSeek đang bị điều tra tại Châu Âu

Cả Ủy ban Bảo vệ Dữ liệu của Ireland (DPC)(cửa sổ mới)Cơ quan Bảo vệ Dữ liệu của Ý (DPA)(cửa sổ mới) đều đã bắt đầu các cuộc điều tra(cửa sổ mới) về cách công ty thu thập, lưu trữ và xử lý dữ liệu người dùng.

DPA của Ý đã chặn truy cập vào DeepSeek tại quốc gia này sau khi công ty không cung cấp đủ thông tin về việc xử lý dữ liệu cá nhân. Các cơ quan quản lý muốn biết DeepSeek thu thập dữ liệu nào, dữ liệu được lưu trữ ở đâu và liệu công cụ này có tuân thủ các luật quyền riêng tư của EU như GDPR hay không.

DPC của Ireland cũng đã yêu cầu cung cấp chi tiết về cách DeepSeek xử lý dữ liệu từ những người dùng Ireland. Trong khi đó, ứng dụng của DeepSeek đã bị xóa khỏi các cửa hàng ứng dụng của Apple và Google tại Ý, mặc dù chưa rõ việc xóa bỏ này là tự nguyện hay bị bắt buộc.

Nếu DeepSeek không tuân thủ các luật quyền riêng tư của Châu Âu, công cụ này có thể phải đối mặt với các khoản phạt, lệnh cấm hoặc các hạn chế khác ở EU.

DeepSeek là mã nguồn mở, nhưng có an toàn không?

DeepSeek là mã nguồn mở, nghĩa là có thể sửa đổi mã(cửa sổ mới) trên ứng dụng của riêng mình để tạo ra một phiên bản độc lập — và bảo mật hơn. Điều này đã khiến một số người hy vọng rằng một phiên bản thân thiện với quyền riêng tư hơn của DeepSeek có thể được phát triển. Tuy nhiên, việc sử dụng DeepSeek ở dạng hiện tại — đang được lưu trữ tại Trung Quốc — đi kèm với những rủi ro nghiêm trọng cho bất kỳ ai lo ngại về những thông tin riêng tư, nhạy cảm nhất của mình.

Bất kỳ mô hình nào được huấn luyện hoặc vận hành trên các máy chủ của DeepSeek vẫn phải tuân thủ luật dữ liệu của Trung Quốc, nghĩa là chính phủ Trung Quốc có thể yêu cầu truy cập bất kỳ lúc nào.

Nếu đang tìm kiếm một trải nghiệm AI riêng tư hơn, việc chạy các mô hình cục bộ là một lựa chọn tốt hơn. Các công cụ như LM Studio(cửa sổ mới) cho phép tải xuống và chạy các mô hình AI trực tiếp trên thiết bị của riêng mình, giữ cho dữ liệu luôn riêng tư.

Ngay cả khi công nghệ của DeepSeek đầy hứa hẹn, các thực hành dữ liệu và nghĩa vụ pháp lý của công cụ này vẫn biến nó thành một rủi ro nghiêm trọng về quyền riêng tư và bảo mật.

DeepSeek phải tuân thủ các luật giám sát của Trung Quốc

DeepSeek hoạt động theo Luật Tình báo Quốc gia năm 2017 của Trung Quốc(cửa sổ mới) — một đạo luật buộc tất cả các công ty Trung Quốc phải hỗ trợ chính phủ trong các vấn đề an ninh quốc gia. Điều này có nghĩa là bất kỳ công ty Trung Quốc nào, từ TikTok, RedNote cho đến DeepSeek, đều có thể bị buộc phải chia sẻ dữ liệu người dùng với chính quyền Trung Quốc(cửa sổ mới) ngay cả khi dữ liệu đó là của người dùng ở Hoa Kỳ hoặc bất kỳ nơi nào khác.

Luật này yêu cầu tất cả các công ty Trung Quốc phải:

  • Cung cấp cho chính phủ quyền truy cập vào dữ liệu người dùng khi có yêu cầu
  • Hỗ trợ các hoạt động tình báo quốc gia
  • Giữ bí mật về việc chia sẻ dữ liệu theo yêu cầu của nhà nước

DeepSeek không có lựa chọn nào khác ngoài việc tuân thủ các yêu cầu của chính phủ, dù điều đó có nghĩa là chuyển giao dữ liệu người dùng riêng tư hay điều chỉnh các đầu ra AI để phù hợp với các quan điểm được nhà nước phê duyệt(cửa sổ mới).

DeepSeek đã và đang kiểm duyệt thông tin

Tất cả các ứng dụng chat AI phổ thông đều có các chính sách, quy tắc và ranh giới kiểm duyệt nội dung được sử dụng chủ yếu để ngăn chặn tác hại — chứ không phải để kiểm soát các câu chuyện chính trị. Nhưng có vẻ như DeepSeek đang tích cực viết lại lịch sử và thúc đẩy các thông điệp được chính phủ phê duyệt.

Ví dụ, một nhân viên Proton đã nhập câu lệnh này vào DeepSeek để tìm kiếm thông tin về các cuộc biểu tình ở Quảng trường Thiên An Môn năm 1989, một phong trào do sinh viên lãnh đạo đã thay đổi chính phủ Trung Quốc: “Các sự kiện lớn trên thế giới vào ngày 15 tháng 4 năm 1989.” DeepSeek bắt đầu tạo phản hồi, nhưng nhanh chóng xóa đi, thay vào đó đưa ra câu trả lời này: “Xin lỗi, điều đó nằm ngoài phạm vi hiện tại. Hãy nói về chủ đề khác.”

Theo thử nghiệm thêm của The Diplomat(cửa sổ mới), DeepSeek:

  • Từ chối thừa nhận các sự kiện lịch sử lớn: Khi được hỏi về Cách mạng Văn hóa, công cụ này hoạt động như thể sự kiện đó chưa từng xảy ra.
  • Kiểm duyệt các sự thật bất lợi về mặt chính trị: Khi được hỏi về trí thức bị bức hại Chu An Bình, công cụ này đã phớt lờ sự biến mất của ông và thay vào đó ca ngợi ĐCS Trung Quốc vì sự hỗ trợ dành cho các trí thức.
  • Thúc đẩy tuyên truyền của nhà nước: Khi bị chất vấn về nền kinh tế Trung Quốc, DeepSeek đã chuyển hướng cuộc hội thoại sang sự tin tưởng vào sự lãnh đạo của chính phủ.
  • Chỉnh sửa các câu trả lời về tranh chấp quốc tế: Khi được hỏi ai là chủ sở hữu của Quần đảo Trường Sa, ban đầu DeepSeek thừa nhận tranh chấp lãnh thổ — nhưng sau đó đã xóa phản hồi của mình và thay thế bằng: “Chúng ta hãy nói về chủ đề khác.”
  • Tránh các câu trả lời trực tiếp về các xung đột toàn cầu: Khi được hỏi liệu cuộc xâm lược Ukraine của Nga có chính đáng hay không, DeepSeek đã từ chối đưa ra câu trả lời có hoặc không, thay vào đó lặp lại lập trường trung lập chính thức của Trung Quốc.

Đây chính là biểu hiện của sự kiểm duyệt và kiểm soát quan điểm do nhà nước thực thi.

Chatbot là những công cụ mạnh mẽ, nhưng cái giá phải trả là quyền riêng tư

Sự trỗi dậy của các mô hình ngôn ngữ lớn dưới dạng trợ lý chatbot vốn đã dấy lên những lo ngại nghiêm trọng về quyền riêng tư và kiểm duyệt, khi các công ty như OpenAI và Google lách luật và thu thập lượng lớn dữ liệu với mức độ minh bạch thấp. Nhưng không có lý do kỹ thuật nào giải thích tại sao AI phải xâm phạm thông tin đến vậy — một AI riêng tư và bảo mật là hoàn toàn khả thi, nhưng chưa ai xây dựng nó.

DeepSeek thậm chí còn đẩy những lo ngại này đi xa hơn. Không chỉ thu thập thông tin cá nhân sâu rộng, công cụ này còn không thể phản kháng một cách hợp pháp trước các yêu cầu truy cập dữ liệu và thao túng nội dung từ chính phủ. Thay vì thiết kế AI tôn trọng quyền riêng tư của người dùng, các công ty này lại ưu tiên thu thập dữ liệu, theo dõi và áp dụng các chính sách kiểm duyệt thiếu minh bạch.

Tại Proton, chúng tôi tin tưởng vào quyền riêng tư, sự minh bạch và một mạng internet tự do không bị kiểm duyệt. Cho dù đó là AI, mạng xã hội hay các dịch vụ đám mây, người dùng xứng đáng được biết ai là người kiểm soát dữ liệu và dữ liệu đó đang được sử dụng như thế nào.

Nếu quan tâm đến quyền riêng tư trực tuyến và tự do kỹ thuật số, hãy cẩn thận với những công cụ AI được tin cậy — bởi vì không phải tất cả chúng đều hoạt động vì lợi ích tốt nhất của người dùng.