Cuối tuần vừa qua, cộng đồng người dùng trên Reddit phát hiện một lượng lớn cuộc trò chuyện với Claude – chatbot AI của Anthropic – xuất hiện công khai trên Google. Chỉ cần nhập cụm từ tìm kiếm chuyên biệt như “site:claude.ai/share”, người dùng có thể thấy danh sách dài các đoạn hội thoại đã được chia sẻ.
Các cuộc trò chuyện bị lộ bao gồm nhiều chủ đề khác nhau: lập trình, ghi chú công việc, đánh giá sách, thậm chí cả nội dung khiêu dâm mà Claude tạo ra – điều trái với chính sách của Anthropic. Một số đoạn chat được cho là chứa thông tin nhạy cảm như tên, địa chỉ và khóa ví tiền điện tử.
Tính năng “Share” của Claude cho phép người dùng tạo liên kết riêng để gửi bản ghi cuộc trò chuyện cho người khác. Theo mặc định, mọi cuộc trò chuyện đều ở chế độ riêng tư. Chỉ khi người dùng chủ động nhấn nút chia sẻ, hệ thống mới tạo ra một địa chỉ web công khai. Tuy nhiên, các liên kết này thiếu thẻ “noindex”, khiến công cụ tìm kiếm có thể lập chỉ mục nếu chúng được đăng trên diễn đàn, mạng xã hội hoặc các trang công cộng khác.

Phát ngôn viên của Anthropic cho biết công ty trao quyền kiểm soát việc chia sẻ cho người dùng và không cung cấp danh mục trò chuyện hay sơ đồ web cho các công cụ tìm kiếm. “Khi chia sẻ một cuộc trò chuyện, người dùng đang biến nội dung đó thành công khai, và giống như những nội dung web công khai khác, chúng có thể được dịch vụ bên thứ ba lưu trữ,” đại diện công ty khẳng định với Fortune.
Sự cố nhanh chóng được khắc phục. Đến Chủ nhật, nhiều kết quả tìm kiếm đã biến mất khỏi Google. Anthropic được cho là đã bổ sung thẻ noindex và các biện pháp bảo vệ khác. Người dùng có thể kiểm tra và xóa các cuộc trò chuyện đã chia sẻ trong phần Cài đặt → Quyền riêng tư → Shared chats.
Anthropic cho biết họ từng sử dụng tệp robots.txt để hạn chế trình thu thập dữ liệu. Tuy nhiên, theo cơ chế hoạt động của Google và Bing, nếu một trang công khai được người dùng đăng lên diễn đàn, mạng xã hội hoặc các website khác, công cụ tìm kiếm vẫn có thể lập chỉ mục trang đó dù bị chặn thu thập dữ liệu.

Hệ quả là nhiều cuộc trò chuyện chứa thông tin nhạy cảm đã xuất hiện trong kết quả tìm kiếm, bao gồm sơ yếu lý lịch, hồ sơ y tế, tài liệu nội bộ doanh nghiệp, khóa API, khóa ví tiền mã hóa và các nội dung được tạo bằng Claude Artifacts.
Đây không phải lần đầu tiên hiện tượng này xảy ra. Năm 2025, Claude từng gặp sự cố tương tự. ChatGPT của OpenAI và Grok cũng từng để lộ hàng trăm nghìn đoạn chat trên Google trong quá khứ. Nguyên nhân chung là các liên kết chia sẻ công khai bị công cụ tìm kiếm thu thập khi chúng xuất hiện trên internet công cộng.
Các chuyên gia cảnh báo rằng khi người dùng ngày càng chia sẻ thông tin nhạy cảm với chatbot, rủi ro rò rỉ dữ liệu cá nhân ngày càng cao. Việc nhiều công ty AI lớn cùng mắc lỗi tương tự cho thấy ngành công nghiệp vẫn chưa giải quyết triệt để vấn đề bảo mật của tính năng chia sẻ.
Người dùng được khuyến cáo nên kiểm tra lịch sử chia sẻ, xóa các liên kết chứa thông tin nhạy cảm và tránh đưa dữ liệu cá nhân, khóa bảo mật hay tài liệu công ty vào các cuộc trò chuyện có thể được chia sẻ công khai.
