Hàng trăm phiên trò chuyện riêng tư của Claude AI có thể được phát hiện công khai thông qua các truy vấn của công cụ tìm kiếm vì các liên kết được chia sẻ thiếu thẻ 'noindex' thích hợp. Kể từ đó, Anthropic đã thực hiện các bước để xóa các nhật ký này khỏi kết quả tìm kiếm, mặc dù vụ việc đã gây ra một cuộc tranh luận về trách nhiệm bảo mật nội dung web nhạy cảm.
Phạm vi rò rỉ dữ liệu
Vào cuối tuần cuối cùng của tháng 7 năm 2026, người dùng Internet đã phát hiện ra một lỗ hổng bảo mật nghiêm trọng liên quan đến chatbot AI của Anthropic, Claude. Bằng cách sử dụng các toán tử tìm kiếm cụ thể, các nhà nghiên cứu phát hiện ra rằng nhiều phiên trò chuyện riêng tư đã được các công cụ tìm kiếm lớn lập chỉ mục, bao gồm cả Google và Bing. Nhật ký bị lộ chứa nhiều thông tin nhạy cảm, từ các câu hỏi cá nhân về đảng phái chính trị và hoạt động nhập vai khiêu dâm cho đến tài liệu nghiên cứu và chăm sóc sức khỏe có khả năng độc quyền của công ty. Trong một số trường hợp, bản ghi bị rò rỉ bao gồm thông tin liên hệ chi tiết và lịch sử nghề nghiệp có trong CV của người dùng. Mặc dù một số trang bị ảnh hưởng đã bị chủ sở hữu của chúng xóa ngay sau khi được phát hiện, nhưng khả năng hiển thị rộng rãi của các chủ đề này làm nổi bật mối nguy hiểm liên quan đến việc tạo URL công khai cho các phiên AI tạo riêng tư.
Lỗi kỹ thuật và giao thức lập chỉ mục
Nguyên nhân cơ bản của việc lập chỉ mục dường như là do sự mất kết nối giữa các biện pháp bảo mật mà Anthropic sử dụng và các yêu cầu của các công cụ tìm kiếm hiện đại. Trong khi Anthropic cố gắng hạn chế trình thu thập dữ liệu thông qua tệp robots.txt của mình—một tiêu chuẩn công nghiệp lâu đời để báo hiệu khu vực nào trên trang web nên được giữ ở chế độ riêng tư—cả Google và Bing đều cho rằng điều này thường là chưa đủ. Tài liệu kỹ thuật dành cho các công cụ tìm kiếm này nêu rõ rằng hướng dẫn trong robots.txt có thể bị bỏ qua nếu một trang được liên kết ở nơi khác trên internet. Để ngăn chặn việc lập chỉ mục một cách hiệu quả, nhà phát triển phải triển khai thẻ HTML 'noindex' hoặc 'x-robots-tag' trong tiêu đề trang. Phân tích các trang Claude bị ảnh hưởng đã xác nhận sự vắng mặt của các thẻ cụ thể này, cho phép các thuật toán của công cụ tìm kiếm thu thập dữ liệu và lưu trữ dữ liệu cuộc trò chuyện bất chấp các chỉ thị robots.txt của Anthropic.
Tiền lệ và trách nhiệm của ngành
Sự cố này phản ánh những sai sót về quyền riêng tư tương tự mà các nhà phát triển AI lớn khác đã trải qua, bao gồm OpenAI và những người tạo ra X's Grok, cả hai đều thấy nhật ký chatbot của họ xuất hiện trong kết quả tìm kiếm công khai trong những năm gần đây. Những vấn đề tái diễn này đã gây ra một cuộc tranh luận về việc ai chịu trách nhiệm chính trong việc bảo vệ dữ liệu. Người phát ngôn của Google khẳng định rằng công ty không quy định trang nào sẽ được công khai, nhấn mạnh rằng gánh nặng thuộc về chủ sở hữu trang web trong việc thực hiện các biện pháp kiểm soát cần thiết nhằm hạn chế trình thu thập thông tin. Trong khi đó, đại diện của Anthropic lưu ý rằng người dùng được cung cấp cảnh báo rõ ràng rằng bất kỳ ai có quyền truy cập đều có thể xem các liên kết được chia sẻ, đóng khung tính khả dụng công khai như một hệ quả tự nhiên của chức năng 'chia sẻ' vốn xử lý nội dung như các kho lưu trữ web công cộng khác.
Ý nghĩa rộng hơn đối với quyền riêng tư của AI
Tình huống này đóng vai trò như một lời nhắc nhở rõ ràng về sự phức tạp liên quan đến việc cân bằng giữa việc dễ dàng chia sẻ kết quả đầu ra AI với nhu cầu nghiêm ngặt về quyền riêng tư của người dùng. Mặc dù người dùng thường dựa vào các công cụ AI để xử lý dữ liệu cá nhân và chuyên môn nhạy cảm, nhưng dấu chân kỹ thuật số của những tương tác đó có thể tồn tại vĩnh viễn nếu không được xử lý bằng các cấu hình bảo mật chính xác. Tính năng chia sẻ của Anthropic hiện thiếu cảnh báo rõ ràng rằng các liên kết này có thể được các công cụ tìm kiếm sử dụng, dẫn đến sự nhầm lẫn của người dùng về tuổi thọ và khả năng khám phá dữ liệu của họ. Khi các phòng thí nghiệm AI cạnh tranh để tích hợp công nghệ của họ vào quy trình công việc hàng ngày, nhu cầu về quyền riêng tư theo thiết kế mạnh mẽ, bao gồm các biện pháp chủ động để chặn lập chỉ mục tìm kiếm, đã trở thành mối quan tâm quan trọng đối với cả nhà phát triển và ngành công nghệ nói chung.
⚖ The Balanced View
Supporting view
Anthropic khẳng định rằng tính năng chia sẻ hoạt động như dự định, với sự hiểu biết rằng bất kỳ ai sở hữu liên kết đều có thể truy cập cuộc trò chuyện, so sánh nó với nội dung web công khai tiêu chuẩn.
Concerns & criticism
Các nhà phê bình cho rằng chỉ dựa vào robots.txt là một chiến lược bảo mật chưa đủ và việc thiếu thẻ 'noindex' trên các liên kết trò chuyện có thể chia sẻ đã trực tiếp tạo điều kiện cho dữ liệu cá nhân của người dùng bị lộ trái phép.
→What's next
Anthropic đã bắt đầu xóa các nhật ký trò chuyện này khỏi các chỉ mục của công cụ tìm kiếm để giảm thiểu khả năng tiếp xúc thêm. Người dùng lo ngại về nội dung được chia sẻ của chính họ nên chuyển đến phần cài đặt quyền riêng tư trong tài khoản của họ để quản lý, xem xét hoặc thu hồi quyền truy cập vào các liên kết trò chuyện đã tạo trước đó.