Bagaimana Log Obrolan AI Pribadi Bocor: Mengapa Google dan Bing Mengindeks Tautan Claude Publik

Anda pikir percakapan Anda dengan AI tetap bersifat pribadi.

Mereka tidak selalu melakukannya.

Tanyakan saja kepada orang-orang yang menyaksikan percakapan intim atau bermuatan politik mereka dengan Claude dari Anthropic yang muncul di hasil pencarian Google dan Bing akhir pekan ini. Penemuan ini tidaklah halus. Ini dimulai ketika Redditor memperhatikan bahwa URL tertentu—yang dimaksudkan untuk berbagi “snapshot” obrolan—terletak di tempat terbuka.

Ini bukan sembarang obrolan. Mereka termasuk pengguna yang meminta saran mengenai afiliasi partai politik. Pertanyaan hukum dari pengacara Kansas tentang apakah mereka harus melaporkan sendiri pelanggaran etika. Dan ya, skenario permainan peran erotis.

Jika Anda menghargai privasi di era AI generatif, ini adalah pelajaran penting tentang bagaimana mekanisme web mengesampingkan niat baik.

Kesalahpahaman Robots.txt

Inilah realitas teknis yang diabaikan oleh sebagian besar pengguna—dan sering kali perusahaan yang membuat alat ini.

Anthropic menggunakan file robots.txt untuk memberi tahu crawler mesin pencari agar menjauhi URL chat bersama. File ini telah ada setidaknya sejak September 2024 (teks asli dikutip tahun 2025, yang kemungkinan merupakan kesalahan masa depan atau salah ketik untuk timeline saat ini, tetapi mekanismenya tetap sama). robots.txt adalah standar industri yang mengatakan, “Jangan hapus bagian situs ini.”

Ini berhasil sebagian besar waktu.

Itu bukan tembok. Itu adalah permintaan yang sopan.

Mesin pencari seperti Google dan Bing diprogram untuk mengabaikan robots.txt jika mereka menemukan link ke halaman lain di internet. Jika seseorang menautkan ke cuplikan Claude “publik” itu di forum, email, atau postingan media sosial, mesin pencari tetap akan merayapinya.

Untuk benar-benar menghentikan pengindeksan, pengembang perlu menggunakan tag HTML tertentu.

Mengapa “Noindex” Hilang

Menurut WIRED, obrolan yang bocor tidak memiliki tag meta noindex.

Baik Google dan Bing memerlukan arahan eksplisit ini. Jika laman tidak memiliki tag noindex (atau x-robots-tag di header HTTP), mesin telusur menganggap webmaster ingin laman tersebut diindeks dan ditampilkan di hasil penelusuran.

“Baik Google maupun mesin pencari lainnya tidak mengontrol apa yang dipublikasikan di web… Kami memberikan kontrol yang jelas kepada pemilik situs… dan kami selalu menghormati arahan tersebut.”

Ini adalah pendirian yang dapat dipertahankan dari mesin pencari. Hal ini kurang dapat dipertahankan dari pihak Anthropic, terutama karena mereka menghadapi suhu panas yang sama pada bulan September lalu.

Juru bicara Google Ned Adriance mengatakan kepada WIRED bahwa pengindeksan ada pada pemilik situs. Tautan obrolan dirancang untuk publik. Jika URL dapat diakses, maka URL tersebut dapat diindeks.

Microsoft tidak berkomentar. Antropik tidak menanggapi.

Kesenjangan Antara Privasi dan Pengindeksan

Masalah inti di sini bukanlah niat jahat. Ini adalah tabrakan fitur.

Claude memungkinkan pengguna membuat URL publik untuk berbagi percakapan. Ini berguna untuk kolaborasi. Namun membuat URL publik akan memicu perilaku pengindeksan web standar kecuali secara eksplisit diblokir pada tingkat yang lebih dalam.

Sebagian besar pengguna berasumsi bahwa “berbagi” berarti “tautan pribadi saja”. Tidak. Dalam dunia SEO, “URL publik” sama dengan “hasil pencarian potensial”.

Hal ini terjadi pada Bing yang masih menampilkan sekitar 612 hasil untuk site:claude.ai/share saat dilaporkan. Hasil Google untuk kueri “berbagi” tertentu tampaknya sudah jelas setelah WIRED meninjaunya, kemungkinan setelah tautan dihapus atau diperbarui.

Tapi datanya ada di luar sana. Ada salinan cache. Pelajaran ini sangat berharga bagi siapa pun yang menggunakan chatbot AI untuk topik sensitif:

  1. Asumsikan tidak ada yang benar-benar pribadi.
  2. URL publik dapat diindeks secara default kecuali perlindungan teknis diterapkan dengan benar.
  3. robots.txt saja tidak cukup. Anda memerlukan noindex.

Laboratorium AI mengklaim bahwa mereka menghormati aturan crawler. Mereka melakukannya. Namun mereka mengandalkan pengembang untuk menggunakan aturan yang tepat. Jika penerapannya salah, riwayat permainan peran erotis Anda akan muncul di halaman hasil mesin pencari.

Dan Anda tidak dapat menghapusnya dari Google.

Implikasi yang lebih luas? Ketika agen AI menjadi lebih terintegrasi ke dalam kehidupan sehari-hari—mulai dari alur kerja yang dikendalikan ponsel cerdas hingga penggunaan token pemerintah—serangan terhadap kebocoran privasi semakin meluas. Kami sedang membangun sistem yang membalas kami, sementara web terbuka mengindeks setiap percakapan.

Siapa yang mengontrol indeks? Siapa pemilik memori itu?

Mungkin bukan kamu.

попередня статтяPrancis Menghadapi Awan Pyrocumulonimbus Bersejarah di Tengah Kebakaran Hutan yang Belum Pernah Terjadi Sebelumnya