Hàng nghìn cuộc trò chuyện được người dùng chủ động chia sẻ công khai trên Claude AI – chatbot của startup Anthropic – đã bị Google lập chỉ mục, khiến các thông tin từ bản thảo công việc, tài liệu pháp lý đến khóa ví tiền mã hóa đều có thể được tìm thấy qua truy vấn tìm kiếm thông thường. Điều tra của WIRED, sau đó được Axios, Fortune và TechCrunch đồng loạt phản ánh, chỉ ra rằng vụ việc không xuất phát từ tấn công mạng mà đến từ cách vận hành của tính năng chia sẻ trên chính nền tảng Claude.
Điểm mấu chốt nằm ở chỗ, khi người dùng bấm nút tạo liên kết chia sẻ, Claude sẽ tạo một đường dẫn tới trang web công khai chứa toàn bộ nội dung hội thoại. Trang này về mặt kỹ thuật không khác gì một website thông thường. Nếu không được gắn thẻ chặn thu thập, Google hoàn toàn có thể đưa nội dung vào bộ chỉ mục tìm kiếm. Anthropic cho biết các cuộc trò chuyện mặc định vẫn ở chế độ riêng tư – chỉ khi người dùng chủ động bấm nút chia sẻ thì nội dung mới trở thành công khai. Tuy nhiên, nhiều người hiểu tính năng này theo kiểu “ai có link thì xem được”, thay vì nhận thức rằng đường link đó có thể bị các công cụ tìm kiếm thu thập nếu được đặt ở nơi công cộng trên Internet.
Vì sao link chia sẻ Claude vẫn lọt vào Google?
Theo WIRED, các đường dẫn được tạo ra bởi tính năng chia sẻ của Claude có độ dài phức tạp, không thể bị đoán ngẫu nhiên. Nhưng khi người dùng gửi link qua mạng xã hội, diễn đàn, email hoặc bất kỳ kênh nào khác, các bên thứ ba có thể lưu trữ hoặc đặt liên kết tới nó. Một khi trang đã tồn tại trên web công khai, bộ máy tìm kiếm có thể dò thấy và lập chỉ mục, bất kể chủ sở hữu có chủ đích hay không. Chính khoảng cách giữa kỳ vọng “chia sẻ bán công khai” của người dùng và cách Internet thực sự vận hành đã tạo nên làn sóng tranh cãi.
Nội dung nhạy cảm lộ diện: từ bản thảo công việc tới khóa ví crypto
Những người theo dõi vụ việc chỉ cần dùng cú pháp tìm kiếm site:claude.ai/share để phát hiện vô số cuộc hội thoại thuộc nhiều lĩnh vực. Theo WIRED, trong số đó có bản thảo dự án doanh nghiệp, tài liệu an ninh mạng, tác phẩm sáng tạo cá nhân, trao đổi liên quan đến công việc pháp lý, thậm chí cả đoạn chat chứa khóa ví tiền mã hóa và nhiều dữ liệu nhạy cảm do người dùng nhập vào hội thoại. Một số cuộc trò chuyện liên quan đến nội dung người lớn hoặc tâm sự cá nhân. Dù việc tạo link là hành động chủ động của người dùng, sự xuất hiện của chúng trên Google khiến nhiều người nhận ra rằng trên Internet gần như không có khái niệm “chia sẻ bán công khai”.
Sau khi vụ việc lan truyền rộng rãi, phần lớn các liên kết này đã biến mất khỏi kết quả tìm kiếm của Google. Tuy nhiên, các chuyên gia bảo mật nhấn mạnh: việc bị gỡ khỏi công cụ tìm kiếm không đồng nghĩa với việc dữ liệu chưa từng được công khai. Một khi thông tin đã xuất hiện trên web, khả năng bị lưu trữ, sao chép hoặc thu thập vẫn luôn tồn tại.
Anthropic dùng robots.txt nhưng thiếu thẻ noindex
Theo WIRED, Anthropic từ lâu đã sử dụng file robots.txt với yêu cầu các công cụ tìm kiếm không thu thập các cuộc trò chuyện được chia sẻ. Tuy nhiên, những trang này lại không được gắn thẻ noindex – cơ chế mà Google và Bing khuyến nghị để ngăn một trang xuất hiện trong kết quả tìm kiếm. Vì vậy, khi các đường dẫn được chia sẻ ra ngoài hoặc được đặt liên kết ở nơi khác, chúng vẫn có thể bị lập chỉ mục một cách hợp pháp.
Theo người phát ngôn của Google, việc các cuộc trò chuyện xuất hiện trên công cụ tìm kiếm thuộc trách nhiệm của Anthropic. Google chỉ lập chỉ mục những trang web mà chủ sở hữu công khai và luôn tôn trọng các chỉ dẫn như noindex nếu website triển khai đúng. Tuyên bố này không nêu rõ Anthropic có vi phạm chính sách hay không, nhưng một lần nữa cho thấy việc bảo vệ quyền riêng tư trên nền tảng AI phụ thuộc rất lớn vào cách nhà vận hành cấu hình hệ thống.
Bài học cho người dùng và lời cảnh báo cho kỷ nguyên AI
Người dùng Claude có thể kiểm tra toàn bộ cuộc trò chuyện đã chia sẻ bằng cách vào Settings, Privacy, Shared Chats, sau đó xóa hoặc thu hồi quyền truy cập với những liên kết không còn muốn công khai. Với bất kỳ nền tảng AI nào, người dùng nên coi mọi nội dung được chia sẻ qua liên kết công khai đều có khả năng bị người khác truy cập hoặc được công cụ tìm kiếm phát hiện, trừ khi dịch vụ đó khẳng định rõ ràng liên kết được bảo vệ bằng cơ chế không lập chỉ mục hoặc yêu cầu xác thực.
Đây không phải lần đầu tiên Anthropic đối mặt với vấn đề này. Vào tháng 9/2025, Forbes từng chỉ ra rằng việc chỉ dựa vào robots.txt không đủ để ngăn các công cụ tìm kiếm lập chỉ mục các cuộc trò chuyện được chia sẻ từ Claude. Đáng chú ý, các hãng như Anthropic, OpenAI và Meta đều sử dụng robots.txt để chặn trình thu thập dữ liệu AI của đối thủ tiếp cận chatbot của mình, nhưng chính cơ chế này lại không đủ để bảo vệ các trang khỏi cỗ máy tìm kiếm.
Sự cố của Claude phản ánh một thực tế ngày càng phổ biến: người dùng đang xem chatbot như đồng nghiệp, cố vấn pháp lý, trợ lý lập trình, thậm chí là cuốn nhật ký cá nhân. Kết quả là các cuộc trò chuyện với AI chứa ngày càng nhiều thông tin giá trị – từ kế hoạch kinh doanh, mã nguồn phần mềm đến dữ liệu tài chính và bí mật nghề nghiệp. Khi AI trở thành nơi con người gửi gắm nhiều thông tin hơn bao giờ hết, ranh giới giữa “chia sẻ” và “công khai” càng trở nên mong manh. Vụ việc của Claude vì thế không chỉ là câu chuyện về một tính năng bị hiểu nhầm, mà còn là lời nhắc rằng mỗi cú nhấp chuột đều có thể quyết định phạm vi tồn tại của dữ liệu trên Internet.



