Hàng nghìn cuộc trò chuyện Claude AI bất ngờ xuất hiện trên Google Search
Theo điều tra của WIRED cùng các hãng truyền thông như Axios, Fortune và TechCrunch, hàng nghìn cuộc trò chuyện được chia sẻ công khai từ Claude AI của Anthropic đã bị Google lập chỉ mục (index). Điều này có nghĩa là bất kỳ ai cũng có thể tìm thấy chúng chỉ bằng một vài truy vấn tìm kiếm đơn giản. Sự việc nhanh chóng trở thành chủ đề nóng trong giới công nghệ bởi nó không xuất phát từ một cuộc tấn công mạng hay rò rỉ dữ liệu quy mô lớn, mà đến từ chính cách hoạt động của tính năng “Share” trên Claude.
Nút “Chia sẻ” bị hiểu nhầm: Người dùng tưởng riêng tư, hóa ra công khai với cả Internet
Claude cho phép người dùng tạo một liên kết để chia sẻ toàn bộ cuộc trò chuyện với người khác. Về bản chất, đây là một trang web công khai chứa nội dung hội thoại. Nếu trang đó không được ngăn chặn đúng cách khỏi các công cụ tìm kiếm, Google hoàn toàn có thể thu thập và lập chỉ mục như bất kỳ trang web nào khác. Anthropic cho biết các cuộc trò chuyện mặc định vẫn ở chế độ riêng tư, chỉ khi người dùng chủ động bấm nút tạo liên kết chia sẻ thì nội dung mới được công khai. Tuy nhiên, nhiều người hiểu tính năng này theo kiểu “ai có link thì xem được”, thay vì nhận thức rằng đường dẫn đó có thể bị công cụ tìm kiếm phát hiện. Khi người dùng tạo liên kết chia sẻ, nội dung cuộc trò chuyện trở thành tài nguyên công khai trên web, không thể bị đoán ngẫu nhiên nhưng hoàn toàn có thể được bên thứ ba lưu trữ hoặc lập chỉ mục nếu được chia sẻ ra Internet.
Loạt thông tin nhạy cảm bị phơi bày: Từ bí mật doanh nghiệp đến khóa ví tiền mã hóa
Những người theo dõi vụ việc đã thử sử dụng cú pháp tìm kiếm như “site:claude.ai/share” và phát hiện vô số cuộc trò chuyện thuộc nhiều chủ đề khác nhau. Theo WIRED, trong số đó có các bản thảo dự án doanh nghiệp, tài liệu an ninh mạng, nội dung sáng tác cá nhân, trao đổi liên quan đến công việc pháp lý, thậm chí cả các đoạn chat chứa khóa ví tiền mã hóa và nhiều thông tin nhạy cảm khác do chính người dùng đưa vào cuộc hội thoại. Một số cuộc trò chuyện còn liên quan đến những vấn đề rất riêng tư như nội dung người lớn hoặc tâm sự cá nhân. Dù tất cả đều được người dùng chủ động tạo liên kết chia sẻ, việc chúng bất ngờ xuất hiện trên Google khiến không ít người mới nhận ra rằng Internet gần như không có khái niệm “chia sẻ bán công khai”.
Không phải tấn công, mà là bài học về thiếu minh bạch của nền tảng AI
Truyền thông quốc tế không xem đây là một vụ tấn công hay đánh cắp dữ liệu. Thay vào đó, đây được đánh giá là bài học về cách các nền tảng AI cần truyền đạt rõ hơn cho người dùng về phạm vi hiển thị của một liên kết chia sẻ. Tờ WIRED cho hay Anthropic từ lâu đã sử dụng file robots.txt để yêu cầu các công cụ tìm kiếm không thu thập các cuộc trò chuyện được chia sẻ. Tuy nhiên, các trang này lại không được gắn thẻ “noindex” – cơ chế mà Google và Bing khuyến nghị để ngăn một trang xuất hiện trong kết quả tìm kiếm. Vì vậy, khi các đường dẫn được chia sẻ hoặc liên kết ở nơi khác trên Internet, chúng vẫn có thể bị lập chỉ mục.
Google nói gì? Anthropic phản ứng ra sao?
Phía Google cho rằng việc các cuộc trò chuyện xuất hiện trên công cụ tìm kiếm là trách nhiệm của Anthropic. Theo người phát ngôn của hãng, Google chỉ lập chỉ mục những trang web mà chủ sở hữu công khai và luôn tôn trọng các chỉ dẫn như noindex nếu website triển khai đúng. Sau khi vụ việc lan truyền, phần lớn các liên kết này đã biến mất khỏi kết quả tìm kiếm của Google, nhưng các chuyên gia bảo mật cảnh báo việc xóa khỏi công cụ tìm kiếm không đồng nghĩa dữ liệu chưa từng được công khai.
Bài học cho kỷ nguyên AI: Mỗi cú nhấp chuột đều quyết định phạm vi dữ liệu
Người dùng Claude có thể kiểm tra các cuộc trò chuyện đã chia sẻ bằng cách vào Settings, Privacy, Shared Chats để xóa hoặc thu hồi quyền truy cập. Đây không phải lần đầu Anthropic đối mặt với vấn đề này – từ tháng 9 năm ngoái, Forbes từng chỉ ra rằng chỉ dựa vào robots.txt không đủ để ngăn các công cụ tìm kiếm lập chỉ mục các cuộc trò chuyện được chia sẻ. Một điều thú vị là các hãng như Anthropic, OpenAI và Meta đều sử dụng robots.txt để ngăn trình thu thập dữ liệu AI của đối thủ, nhưng chính cơ chế này lại không đủ để ngăn một số trang xuất hiện trên công cụ tìm kiếm. Sự cố của Claude phản ánh thực tế người dùng đang dần coi chatbot như đồng nghiệp, cố vấn pháp lý, trợ lý lập trình hay nhật ký cá nhân, khiến các cuộc trò chuyện chứa ngày càng nhiều thông tin giá trị. Khi AI trở thành nơi gửi gắm thông tin, ranh giới giữa “chia sẻ” và “công khai” càng mong manh hơn bao giờ hết.



