Anthropic kini menyematkan tanda yang dapat dibaca mesin dalam keluaran Claude. Pertanyaan berikutnya yang jelas adalah bagaimana Anda memeriksanya. Jawaban jujur, per Agustus 2026, adalah bahwa Anthropic telah berkomitmen untuk mendukung deteksi tetapi belum menerbitkan alatnya. Pusat bantuannya menyatakan dokumentasi teknis akan segera hadir.
Kesenjangan itu penting, karena permintaan untuk detektor Claude sudah ada dan pasokannya adalah bidang pengklasifikasi pihak ketiga yang hanya menebak. Itu adalah dua hal yang sama sekali berbeda, dan mengacaukannya adalah bagaimana seorang siswa dituduh menjiplak atas kalimat yang mereka tulis sendiri.
Tulisan ini mencakup apa arti deteksi sebenarnya untuk dua teknik penandaan Claude, apa yang dapat Anda periksa hari ini, dan kesalahan penalaran yang membuat sebagian besar alur kerja deteksi tidak aman. Jika Anda mengintegrasikan pemeriksaan asal-usul ke dalam API, Apidog adalah tempat Anda dapat mengubah pemeriksaan tersebut menjadi pernyataan yang berjalan pada setiap build.
Dua tanda, dua kisah deteksi
Claude menandai konten dengan dua cara, dan keduanya tidak memiliki perilaku yang sama.
| Tanda air teks tersemat | Metadata C2PA yang ditandatangani | |
|---|---|---|
| Apa itu | Sinyal statistik yang ditenun ke dalam teks yang dihasilkan | Manifest yang ditandatangani secara kriptografis yang dilampirkan pada file |
| Berlaku untuk | Semua teks yang dihasilkan | Jenis file yang didukung: .svg, .png, .jpg |
| Bertahan dari salin-tempel | Ya | Tidak, file adalah wadahnya |
| Bertahan dari pengodean ulang | Ya, teks adalah teks | Tidak, biasanya dilucuti |
| Dapat dideteksi hari ini | Tidak secara publik. Dukungan deteksi dijanjikan | Ya, dengan perangkat C2PA standar |
| Memberi tahu Anda | Konten mungkin telah diproses oleh Claude | Sebuah file diproses oleh Claude, dan apakah itu dirusak |
Tanda air teks adalah yang tahan lama dan yang tidak dapat Anda baca saat ini. Manifest C2PA adalah yang rapuh dan yang dapat Anda baca sekarang dengan alat yang tersedia di pasaran.
Apa yang dapat Anda periksa hari ini: Manifest C2PA
Jika Claude menghasilkan gambar atau SVG dan tidak ada proses hilir yang menulis ulang byte-nya, manifest tersebut ada di dalam file. Tiga cara untuk melihatnya.
Di browser. Jatuhkan file ke halaman verifikasi Content Credentials. Ini membaca manifest dan melaporkan penanda tangan, klaim, dan apakah tanda tangan tersebut valid.
Dari baris perintah. c2patool adalah CLI referensi dari proyek C2PA:
# Read the manifest summary
c2patool report.png
# Full JUMBF-level detail, useful when debugging a pipeline
c2patool report.png -d
File dengan manifest yang utuh mengembalikan struktur JSON yang menjelaskan generator klaim, pernyataan, dan status tanda tangan. File yang manifest-nya dilucuti tidak mengembalikan apa pun. File yang byte-nya diubah tanpa penandatanganan ulang mengembalikan kesalahan validasi, yang merupakan kasus tengah yang berguna: ini membedakan “tidak ada asal-usul” dari “asal-usul yang telah rusak.”
Dari kode Anda sendiri. Pustaka c2pa membungkus logika yang sama untuk Rust, Python, JavaScript, dan C, sehingga Anda dapat menjalankan pemeriksaan di dalam penangan permintaan atau pengujian. Itu adalah pendekatan di balik membangun API detektor gambar AI dengan C2PA dan pengklasifikasi, di mana manifest memberi Anda jawaban yang percaya diri ketika ada dan pengklasifikasi mengambil alih ketika tidak ada.
Apa yang tidak dapat Anda periksa hari ini: tanda air teks
Tidak ada pembaca publik untuk tanda air teks tersemat Claude. Anthropic telah menyatakan akan mendukung pengguna dan pihak ketiga dalam mendeteksi tanda-tandanya, seperti yang diwajibkan oleh Kode Etik, dan bahwa rinciannya akan datang dalam dokumentasi teknis di masa mendatang. Sampai itu diterbitkan:
- Tidak ada alat yang dapat secara otoritatif memberi tahu Anda bahwa sebuah bagian membawa tanda Claude.
- Produk apa pun yang mengklaim mendeteksi “teks yang dihasilkan Claude” hari ini menjalankan pengklasifikasi, bukan membaca sinyal resmi.
- Pengklasifikasi memiliki tingkat positif palsu yang terdokumentasi dengan baik, dan mereka paling sering salah pada penulis non-penutur asli bahasa Inggris dan pada prosa formal, terstruktur.
Anggap ini sebagai “belum,” bukan “tidak akan pernah.” Ketika Anthropic menerbitkan mekanisme deteksi, pola yang masuk akal adalah pemeriksaan sisi server yang Anda panggil dari layanan Anda sendiri, persis seperti langkah verifikasi C2PA, dengan hasilnya disimpan sebagai sinyal daripada putusan.
Sebagai kontras, Google mengambil jalur yang berlawanan dengan SynthID Text: mereka membuka implementasinya dengan detektor referensi, sehingga siapa pun dapat menjalankannya tanpa meminta akses. Itu adalah satu-satunya skema penandaan teks yang dapat diverifikasi pihak ketiga hari ini, dan kesenjangannya diuraikan dalam penandaan air Claude vs ChatGPT vs Gemini.
Kesalahan penalaran yang merusak alur kerja deteksi
Deteksi menghasilkan hasil asimetris. Kebanyakan orang menggunakannya secara simetris, dan di situlah kerusakan terjadi.
Tanda yang terdeteksi adalah bukti positif yang lemah. Ini mengatakan bahwa konten mungkin telah diproses oleh Claude. Ini tidak menetapkan kepenulisan, karena orang secara rutin menggunakan Claude untuk mengoreksi, menerjemahkan, meringkas, dan mengonversi karya yang sudah ada. Draf 3.000 kata milik seorang peneliti, yang dilewatkan melalui Claude untuk pemeriksaan tata bahasa, kembali ditandai. Ide-ide dan pelaporannya sepenuhnya manusia. Tanda tersebut tidak dapat membedakan itu dari perintah yang mengatakan “tuliskan saya 3.000 kata.”
Konten juga berubah setelah Claude menyentuhnya. Teks yang ditandai diedit, dikutip, dan digabungkan ke dalam dokumen yang lebih besar. Menemukan tanda dalam sebuah file memberi tahu Anda bahwa sesuatu menyentuh bagian dari itu pada suatu waktu.
Tidak ada tanda yang terdeteksi bukan bukti apa pun. Anthropic mencantumkan kasus-kasus tersebut dengan jelas. Konten yang dihasilkan Claude mungkin tidak membawa tanda yang dapat dideteksi ketika berasal dari model yang dirilis sebelum penandaan didukung, ketika teks sangat diedit, diparafrase, diterjemahkan, atau dicampur ke dalam tulisan lain, ketika bagian tersebut terlalu pendek untuk memuat sinyal yang andal, ketika metadata file dilucuti oleh konversi format, penyimpanan ulang, atau tangkapan layar, atau ketika datang melalui platform atau jenis file di mana jenis penandaan tersebut tidak didukung.
Baca daftar itu dan perhatikan betapa biasa setiap itemnya. Jawaban singkat. Paragraf terjemahan. Tangkapan layar grafik. Tidak ada yang merupakan penghindaran; itu adalah hal biasa.
Jadi aturannya adalah: hasil positif mempersempit hal-hal, hasil negatif tidak memberi tahu Anda apa pun. Kebijakan apa pun yang menghukum orang berdasarkan hasil negatif adalah salah secara teknologi, bahkan sebelum Anda mempertimbangkan apakah itu adil. Asimetri yang sama telah menyebabkan masalah dalam pekerjaan gambar, yang merupakan argumen dalam mengapa deteksi gambar AI gagal.
Membangun deteksi ke dalam layanan dengan benar
Jika Anda menambahkan pemeriksaan asal-usul ke suatu produk, pertanyaan desain kurang tentang algoritma dan lebih banyak tentang apa yang Anda lakukan dengan sinyal lunak.
- Kembalikan sinyal, bukan putusan. Badan respons yang mengatakan
{"ai_generated": true}adalah klaim yang tidak dapat didukung oleh API Anda. Respons yang mengatakan{"provenance": {"c2pa": "verified", "signer": "...", "checked_at": "..."}}adalah fakta yang dapat Anda pertahankan. Modelkan skema Anda berdasarkan apa yang sebenarnya Anda amati. - Catat apa yang Anda periksa dan kapan. Hasil asal-usul menjadi usang, alat berubah, dan daftar kepercayaan diperbarui. Simpan hasil pemeriksaan dengan stempel waktu dan versi alat, sama seperti Anda akan menyimpan hasil pemindaian antivirus.
- Pisahkan “tidak ada” dari “rusak.” Ini adalah keadaan yang berbeda dengan arti yang berbeda. Tidak ada berarti tidak ada manifest yang ditemukan, yang tidak informatif. Rusak berarti manifest ada tetapi gagal validasi, yang benar-benar menarik. Menggabungkannya menjadi satu boolean membuang sinyal terbaik Anda.
- Gagal terbuka pada pemeriksaan, bukan pada konten. Layanan verifikasi yang mati tidak boleh secara diam-diam menandai semuanya sebagai belum diverifikasi tanpa jejak. Tunjukkan perbedaan antara “sudah diperiksa dan tidak menemukan apa-apa” dan “tidak dapat diperiksa.”
Bentuk minimal yang bertahan:
{
"asset_id": "img_9f2c41",
"provenance": {
"status": "verified",
"standard": "c2pa",
"signer": "Anthropic",
"signature_valid": true,
"checked_at": "2026-08-11T09:14:22Z",
"tool": "c2patool/0.9"
},
"notes": "Asal-usul menunjukkan file diproses oleh Claude. Ini tidak menetapkan kepenulisan."
}
Bidang terakhir itu bukan hiasan. Jika API Anda mengembalikan data asal-usul ke kode tim lain, peringatan tersebut harus berada di tempat yang dapat dilihat oleh kode mereka, bukan di halaman dokumentasi yang tidak dibaca siapa pun.
Menguji pemeriksaan agar terus berfungsi
Verifikasi asal-usul adalah jenis fitur yang diam-diam rusak. Seseorang menambahkan langkah mengubah ukuran gambar, manifest menghilang, dan setiap aset mulai kembali dengan status: "absent". Tidak ada kesalahan. Dasbor terlihat baik-baik saja.
Empat pernyataan yang layak dimasukkan dalam skenario pengujian:
- Fixture yang diketahui baik terverifikasi. Unggah file dengan manifest yang valid, pastikan
statusadalahverifieddansignature_validadalahtrue. - Fixture yang diketahui dilucuti melaporkan tidak ada. Unggah file yang sama dengan metadata dihapus, pastikan
statusadalahabsent, bukan kesalahan dan bukanverified. - Fixture yang dirusak melaporkan rusak. Ubah satu byte dalam file yang ditandatangani, pastikan respons membedakan rusak dari tidak ada.
- Perjalanan bolak-balik mempertahankan manifest. Unggah file yang ditandatangani, ambil kembali melalui jalur pengiriman normal Anda, dan pastikan manifest masih valid. Ini adalah yang menangkap regresi CDN dan pengubahan ukuran, dibahas secara mendalam dalam API Anda melucuti metadata C2PA.
Di Apidog Anda dapat menyimpan keempatnya sebagai skenario pengujian dengan fixture file biner, memastikan respons JSON dengan pernyataan standar, dan menjalankan skenario dari apidog-cli di CI sehingga perubahan pipeline yang memakan manifest menggagalkan build. Mengaturnya di samping suite yang ada adalah alur yang sama dengan mengotomatiskan pengujian API di GitHub Actions. Unduh Apidog untuk membangunnya terhadap endpoint Anda sendiri.
FAQ
- Apakah ada detektor tanda air resmi Claude? Tidak secara publik, per Agustus 2026. Anthropic telah berkomitmen untuk mendukung deteksi bagi pengguna dan pihak ketiga dan mengatakan akan berbagi detail dalam dokumentasi teknis yang akan datang.
- Bisakah saya menggunakan detektor teks AI untuk menemukan tanda air Claude? Tidak. Alat-alat tersebut adalah pengklasifikasi statistik yang dilatih untuk menebak apakah teks terlihat ditulis oleh mesin. Mereka tidak membaca tanda Anthropic, dan positif palsu mereka paling sering terjadi pada penulis dengan gaya yang tidak biasa atau sangat formal.
- Bagaimana cara memeriksa file untuk metadata C2PA Claude? Jalankan
c2patool <file>secara lokal, atau jatuhkan file ke halaman verifikasi Content Credentials. Keduanya melaporkan penanda tangan dan apakah tanda tangan tersebut valid. - Jika sebuah file tidak memiliki manifest C2PA, apakah itu dibuat oleh manusia? Tidak. Manifest secara rutin dihancurkan oleh pengubahan ukuran, pengodean ulang, konversi format, tangkapan layar, dan CDN gambar. Ketiadaan tidak membuktikan apa pun tentang asal-usul.
- Apakah tanda air teks bertahan dari pengeditan? Sebagian. Ini ikut dalam salin dan tempel dan mungkin bertahan melalui beberapa pengeditan, tetapi parafrase berat, terjemahan, atau pemotongan menjadi kutipan yang sangat pendek dapat mendorongnya di bawah ambang deteksi. Detailnya ada di apakah tanda air Claude bertahan dari salin, tempel, dan pengeditan.
- Apa yang harus saya lakukan sampai deteksi dikirimkan? Verifikasi C2PA di mana pun file terlibat, catat apa yang Anda periksa, dan hindari membangun kebijakan apa pun yang bergantung pada deteksi teks. Rancang antarmuka sekarang sehingga Anda dapat memasukkan pemeriksaan teks resmi nanti tanpa mengubah skema respons Anda.
Kesimpulan
Saat ini Anda dapat memverifikasi asal-usul file Claude dengan perangkat C2PA standar dan Anda sama sekali tidak dapat memverifikasi tanda air teksnya. Itu adalah keadaan sementara, tetapi seharusnya membentuk apa yang Anda bangun hari ini: verifikasi file, sinyal jujur daripada putusan, dan tidak ada kebijakan yang memperlakukan hasil bersih sebagai bukti apa pun.
Tanda tersebut adalah petunjuk tentang di mana konten telah berada. Siapa pun yang menjualnya sebagai tes kepenulisan sedang menggambarkan produk yang tidak ada.
tombol
