BerandaPusat Berita LBank
Anthropic Diam-Diam Menandai Setiap Output AI Claude dengan Watermark. Para Builder Sudah Mulai Mencoba Memecahkannya
anthropic-quietly-watermarking-ai-claude-output-builders-break
Anthropic Diam-Diam Menandai Setiap Output AI Claude dengan Watermark. Para Builder Sudah Mulai Mencoba Memecahkannya
Anthropic menyematkan watermark yang tak terlihat dan dapat dibaca mesin ke dalam setiap kata yang ditulis oleh model Claude terbarunya—dan perusahaan itu belum mengungkapkan caranya.
2026-08-13 Sumber:decrypt.co

Singkatnya

  • Model Claude baru yang diluncurkan di Uni Eropa pada atau setelah 2 Agustus 2026 menyematkan watermark yang dapat dibaca mesin di setiap bagian teks yang dihasilkan, diterapkan di tingkat model.
  • Tanda ini berlaku di seluruh dunia di Claude, API, Claude Code, dan mitra cloud.
  • Proyek open-source untuk menghapusnya muncul dalam beberapa hari.

Anthropic telah mulai menyematkan watermark yang tidak terlihat dalam semua teks yang dihasilkan oleh model Claude terbarunya. Perubahan ini berlaku untuk model yang diluncurkan di Uni Eropa pada 2 Agustus 2026, dan Anthropic menyatakan ini akan diterapkan di seluruh dunia.

Anthropic memaparkan rencana ini dalam artikel dukungan setelah menandatangani Kode Etik Undang-Undang AI Uni Eropa tentang transparansi. Dengan kata lain, ini bukanlah inisiatif sukarela. Tanda ini menjangkau setiap platform Claude, mulai dari chatbot dan API hingga Claude Code dan mitra cloud seperti AWS, Google Cloud, dan Microsoft Foundry.

Myriad: Kapan OpenAI akan merilis GPT-6? Klik untuk membuat prediksi Anda.

“Ketika model Claude yang didukung menghasilkan teks, ia menyematkan watermark yang tidak terlihat langsung ke dalam teks itu sendiri. Anda tidak akan melihatnya, dan itu tidak mengubah makna, kualitas, atau keterbacaan respons Claude,” kata Anthropic. “Karena watermark adalah bagian dari teks, ia akan ikut bersama teks saat disalin dan ditempel di tempat lain, dan mungkin tetap ada setelah beberapa pengeditan.”

Jadi, ini sedikit lebih kompleks daripada metode biasa yang sering dipikirkan pengguna. Ketika model Claude yang didukung menulis teks, ia menyematkan watermark yang tidak terlihat langsung ke dalam kata-kata, tanpa tanda yang terlihat. Karena tanda ini adalah bagian dari teks, ia tetap ada setelah disalin-tempel dan, Anthropic mengakui, "mungkin tetap ada setelah beberapa pengeditan." File mendapatkan lapisan kedua: metadata yang ditandatangani di bawah standar terbuka C2PA (bayangkan manifes pengiriman digital yang mencatat siapa yang memproduksi file dan apakah ada yang mengubahnya setelahnya).

Metode ini tetap dirahasiakan

Anthropic belum menjelaskan bagaimana watermark itu dibuat. Artikel dukungan menyebutnya sebagai level model (model dilatih dengannya) dan asli teks (bukan alat eksternal seperti generator metadata, misalnya), tetapi dokumentasi deteksi dan teknik pastinya belum dirilis.

Para peneliti menyimpulkan bahwa ini adalah tanda tangan statistik: model mengarahkan pilihan katanya ke arah bias yang samar dan dapat dideteksi, pendekatan yang sama dengan yang digunakan Google dalam SynthID Text. Itu tetap menjadi dugaan sampai Anthropic memublikasikan detektornya.

Namun hal itu tidak menghalangi para penggemar privasi, dan beberapa ahli sudah mengerjakan metode untuk membobol watermarking rahasia Anthropic. mikiane/claude-watermark-cleaner (106 bintang di Github) membersihkan Unicode yang tidak terlihat, lalu menulis ulang teks dengan model non-Claude untuk mengganggu pola token.

Proyek yang lebih besar, guillaumemeyer/watermarks-remover (4,6 ribu bintang di Github), menghilangkan tanda teks Claude plus sinyal kelas C2PA dan SynthID di seluruh PNG, JPEG, SVG, PDF, dan DOCX. Para penulis berpendapat bahwa tanda teks statistik "bukan cara yang dapat diandalkan untuk membuktikan asal" dan sebagian besar mendorong pengguna untuk menghabiskan waktu pemrosesan model kedua untuk membersihkan tulisan mereka sendiri. Tidak ada penghapusan yang dapat dijamin sampai Anthropic merilis detektor dan ambang batasnya.

Sejarah Anthropic sendiri membuat reaksi privasi menjadi lebih tajam. Perusahaan menghapus pelacak Claude Code tersembunyi pada bulan Maret setelah para peneliti menemukan bahwa pelacak tersebut menandai lokasi dan penggunaan proxy beberapa pengguna melalui penanda Unicode yang tidak diungkapkan—teknik penandaan senyap yang sama kini menjadi inti dari rencana watermark.

Tanda ini membuktikan bahwa Claude ikut campur dalam teks, bukan berarti ia menulis keseluruhan, sehingga ia akan memperlakukan tulisan asli dengan sedikit editan sama seperti teks yang sepenuhnya dihasilkan AI. Minta Claude untuk mengoreksi atau menerjemahkan paragraf Anda dan hasilnya masih bisa membawa sinyal tersebut. Anthropic secara terbuka menyatakan bahwa pengeditan yang berat dapat menghilangkannya, dan bahwa tanda yang hilang tidak membuktikan bahwa manusia yang menulis sesuatu.

Sebuah rancangan undang-undang AS, COPIED Act, mendorong gagasan yang sama: cara standar untuk memberi watermark pada konten AI agar platform dapat melacak asalnya. Seperti yang ditunjukkan oleh masalah pemerasan Claude, model perusahaan ini sudah menarik pengawasan ketat atas apa yang mereka lakukan dengan teks yang mereka sentuh.

Anthropic belum menyatakan kapan akan memublikasikan alat deteksi yang akan memungkinkan siapa pun memverifikasi tanda tersebut.