Cara Mendeteksi Watermark Claude dan Mengapa Hasil Bersih Bukan Jaminan

Manifes berkas C2PA Claude dapat diverifikasi saat ini dengan c2patool atau halaman Kredensial Konten. Tanda air teks tertanamnya belum dapat dibaca oleh siapa pun di luar Anthropic. Ditambah lagi asimetri yang membuat hasil deteksi negatif menjadi tidak bernilai.

Ashley Innocent

Ashley Innocent

11 August 2026

Cara Mendeteksi Watermark Claude dan Mengapa Hasil Bersih Bukan Jaminan

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Anthropic kini menyematkan tanda yang dapat dibaca mesin dalam keluaran Claude. Pertanyaan berikutnya yang jelas adalah bagaimana Anda memeriksanya. Jawaban jujur, per Agustus 2026, adalah bahwa Anthropic telah berkomitmen untuk mendukung deteksi tetapi belum menerbitkan alatnya. Pusat bantuannya menyatakan dokumentasi teknis akan segera hadir.

Kesenjangan itu penting, karena permintaan untuk detektor Claude sudah ada dan pasokannya adalah bidang pengklasifikasi pihak ketiga yang hanya menebak. Itu adalah dua hal yang sama sekali berbeda, dan mengacaukannya adalah bagaimana seorang siswa dituduh menjiplak atas kalimat yang mereka tulis sendiri.

Tulisan ini mencakup apa arti deteksi sebenarnya untuk dua teknik penandaan Claude, apa yang dapat Anda periksa hari ini, dan kesalahan penalaran yang membuat sebagian besar alur kerja deteksi tidak aman. Jika Anda mengintegrasikan pemeriksaan asal-usul ke dalam API, Apidog adalah tempat Anda dapat mengubah pemeriksaan tersebut menjadi pernyataan yang berjalan pada setiap build.

Dua tanda, dua kisah deteksi

Claude menandai konten dengan dua cara, dan keduanya tidak memiliki perilaku yang sama.

Tanda air teks tersemat Metadata C2PA yang ditandatangani
Apa itu Sinyal statistik yang ditenun ke dalam teks yang dihasilkan Manifest yang ditandatangani secara kriptografis yang dilampirkan pada file
Berlaku untuk Semua teks yang dihasilkan Jenis file yang didukung: .svg, .png, .jpg
Bertahan dari salin-tempel Ya Tidak, file adalah wadahnya
Bertahan dari pengodean ulang Ya, teks adalah teks Tidak, biasanya dilucuti
Dapat dideteksi hari ini Tidak secara publik. Dukungan deteksi dijanjikan Ya, dengan perangkat C2PA standar
Memberi tahu Anda Konten mungkin telah diproses oleh Claude Sebuah file diproses oleh Claude, dan apakah itu dirusak

Tanda air teks adalah yang tahan lama dan yang tidak dapat Anda baca saat ini. Manifest C2PA adalah yang rapuh dan yang dapat Anda baca sekarang dengan alat yang tersedia di pasaran.

Apa yang dapat Anda periksa hari ini: Manifest C2PA

Jika Claude menghasilkan gambar atau SVG dan tidak ada proses hilir yang menulis ulang byte-nya, manifest tersebut ada di dalam file. Tiga cara untuk melihatnya.

Di browser. Jatuhkan file ke halaman verifikasi Content Credentials. Ini membaca manifest dan melaporkan penanda tangan, klaim, dan apakah tanda tangan tersebut valid.

Dari baris perintah. c2patool adalah CLI referensi dari proyek C2PA:

# Read the manifest summary
c2patool report.png

# Full JUMBF-level detail, useful when debugging a pipeline
c2patool report.png -d

File dengan manifest yang utuh mengembalikan struktur JSON yang menjelaskan generator klaim, pernyataan, dan status tanda tangan. File yang manifest-nya dilucuti tidak mengembalikan apa pun. File yang byte-nya diubah tanpa penandatanganan ulang mengembalikan kesalahan validasi, yang merupakan kasus tengah yang berguna: ini membedakan “tidak ada asal-usul” dari “asal-usul yang telah rusak.”

Dari kode Anda sendiri. Pustaka c2pa membungkus logika yang sama untuk Rust, Python, JavaScript, dan C, sehingga Anda dapat menjalankan pemeriksaan di dalam penangan permintaan atau pengujian. Itu adalah pendekatan di balik membangun API detektor gambar AI dengan C2PA dan pengklasifikasi, di mana manifest memberi Anda jawaban yang percaya diri ketika ada dan pengklasifikasi mengambil alih ketika tidak ada.

Apa yang tidak dapat Anda periksa hari ini: tanda air teks

Tidak ada pembaca publik untuk tanda air teks tersemat Claude. Anthropic telah menyatakan akan mendukung pengguna dan pihak ketiga dalam mendeteksi tanda-tandanya, seperti yang diwajibkan oleh Kode Etik, dan bahwa rinciannya akan datang dalam dokumentasi teknis di masa mendatang. Sampai itu diterbitkan:

Anggap ini sebagai “belum,” bukan “tidak akan pernah.” Ketika Anthropic menerbitkan mekanisme deteksi, pola yang masuk akal adalah pemeriksaan sisi server yang Anda panggil dari layanan Anda sendiri, persis seperti langkah verifikasi C2PA, dengan hasilnya disimpan sebagai sinyal daripada putusan.

Sebagai kontras, Google mengambil jalur yang berlawanan dengan SynthID Text: mereka membuka implementasinya dengan detektor referensi, sehingga siapa pun dapat menjalankannya tanpa meminta akses. Itu adalah satu-satunya skema penandaan teks yang dapat diverifikasi pihak ketiga hari ini, dan kesenjangannya diuraikan dalam penandaan air Claude vs ChatGPT vs Gemini.

Kesalahan penalaran yang merusak alur kerja deteksi

Deteksi menghasilkan hasil asimetris. Kebanyakan orang menggunakannya secara simetris, dan di situlah kerusakan terjadi.

Tanda yang terdeteksi adalah bukti positif yang lemah. Ini mengatakan bahwa konten mungkin telah diproses oleh Claude. Ini tidak menetapkan kepenulisan, karena orang secara rutin menggunakan Claude untuk mengoreksi, menerjemahkan, meringkas, dan mengonversi karya yang sudah ada. Draf 3.000 kata milik seorang peneliti, yang dilewatkan melalui Claude untuk pemeriksaan tata bahasa, kembali ditandai. Ide-ide dan pelaporannya sepenuhnya manusia. Tanda tersebut tidak dapat membedakan itu dari perintah yang mengatakan “tuliskan saya 3.000 kata.”

Konten juga berubah setelah Claude menyentuhnya. Teks yang ditandai diedit, dikutip, dan digabungkan ke dalam dokumen yang lebih besar. Menemukan tanda dalam sebuah file memberi tahu Anda bahwa sesuatu menyentuh bagian dari itu pada suatu waktu.

Tidak ada tanda yang terdeteksi bukan bukti apa pun. Anthropic mencantumkan kasus-kasus tersebut dengan jelas. Konten yang dihasilkan Claude mungkin tidak membawa tanda yang dapat dideteksi ketika berasal dari model yang dirilis sebelum penandaan didukung, ketika teks sangat diedit, diparafrase, diterjemahkan, atau dicampur ke dalam tulisan lain, ketika bagian tersebut terlalu pendek untuk memuat sinyal yang andal, ketika metadata file dilucuti oleh konversi format, penyimpanan ulang, atau tangkapan layar, atau ketika datang melalui platform atau jenis file di mana jenis penandaan tersebut tidak didukung.

Baca daftar itu dan perhatikan betapa biasa setiap itemnya. Jawaban singkat. Paragraf terjemahan. Tangkapan layar grafik. Tidak ada yang merupakan penghindaran; itu adalah hal biasa.

Jadi aturannya adalah: hasil positif mempersempit hal-hal, hasil negatif tidak memberi tahu Anda apa pun. Kebijakan apa pun yang menghukum orang berdasarkan hasil negatif adalah salah secara teknologi, bahkan sebelum Anda mempertimbangkan apakah itu adil. Asimetri yang sama telah menyebabkan masalah dalam pekerjaan gambar, yang merupakan argumen dalam mengapa deteksi gambar AI gagal.

Membangun deteksi ke dalam layanan dengan benar

Jika Anda menambahkan pemeriksaan asal-usul ke suatu produk, pertanyaan desain kurang tentang algoritma dan lebih banyak tentang apa yang Anda lakukan dengan sinyal lunak.

Bentuk minimal yang bertahan:

{
  "asset_id": "img_9f2c41",
  "provenance": {
    "status": "verified",
    "standard": "c2pa",
    "signer": "Anthropic",
    "signature_valid": true,
    "checked_at": "2026-08-11T09:14:22Z",
    "tool": "c2patool/0.9"
  },
  "notes": "Asal-usul menunjukkan file diproses oleh Claude. Ini tidak menetapkan kepenulisan."
}

Bidang terakhir itu bukan hiasan. Jika API Anda mengembalikan data asal-usul ke kode tim lain, peringatan tersebut harus berada di tempat yang dapat dilihat oleh kode mereka, bukan di halaman dokumentasi yang tidak dibaca siapa pun.

Menguji pemeriksaan agar terus berfungsi

Verifikasi asal-usul adalah jenis fitur yang diam-diam rusak. Seseorang menambahkan langkah mengubah ukuran gambar, manifest menghilang, dan setiap aset mulai kembali dengan status: "absent". Tidak ada kesalahan. Dasbor terlihat baik-baik saja.

Empat pernyataan yang layak dimasukkan dalam skenario pengujian:

  1. Fixture yang diketahui baik terverifikasi. Unggah file dengan manifest yang valid, pastikan status adalah verified dan signature_valid adalah true.
  2. Fixture yang diketahui dilucuti melaporkan tidak ada. Unggah file yang sama dengan metadata dihapus, pastikan status adalah absent, bukan kesalahan dan bukan verified.
  3. Fixture yang dirusak melaporkan rusak. Ubah satu byte dalam file yang ditandatangani, pastikan respons membedakan rusak dari tidak ada.
  4. Perjalanan bolak-balik mempertahankan manifest. Unggah file yang ditandatangani, ambil kembali melalui jalur pengiriman normal Anda, dan pastikan manifest masih valid. Ini adalah yang menangkap regresi CDN dan pengubahan ukuran, dibahas secara mendalam dalam API Anda melucuti metadata C2PA.

Di Apidog Anda dapat menyimpan keempatnya sebagai skenario pengujian dengan fixture file biner, memastikan respons JSON dengan pernyataan standar, dan menjalankan skenario dari apidog-cli di CI sehingga perubahan pipeline yang memakan manifest menggagalkan build. Mengaturnya di samping suite yang ada adalah alur yang sama dengan mengotomatiskan pengujian API di GitHub Actions. Unduh Apidog untuk membangunnya terhadap endpoint Anda sendiri.

FAQ

Kesimpulan

Saat ini Anda dapat memverifikasi asal-usul file Claude dengan perangkat C2PA standar dan Anda sama sekali tidak dapat memverifikasi tanda air teksnya. Itu adalah keadaan sementara, tetapi seharusnya membentuk apa yang Anda bangun hari ini: verifikasi file, sinyal jujur daripada putusan, dan tidak ada kebijakan yang memperlakukan hasil bersih sebagai bukti apa pun.

Tanda tersebut adalah petunjuk tentang di mana konten telah berada. Siapa pun yang menjualnya sebagai tes kepenulisan sedang menggambarkan produk yang tidak ada.

tombol

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.