ขณะนี้ Anthropic ได้ฝังเครื่องหมายที่เครื่องอ่านได้ในเอาต์พุตของ Claude คำถามต่อไปที่ชัดเจนคือ คุณจะตรวจสอบได้อย่างไร คำตอบที่ตรงไปตรงมา ณ เดือนสิงหาคม 2026 คือ Anthropic ได้ให้คำมั่นสัญญาที่จะรองรับการตรวจจับ แต่ยังไม่ได้เผยแพร่เครื่องมือดังกล่าว ศูนย์ช่วยเหลือระบุว่าเอกสารทางเทคนิคกำลังจะตามมา
ช่องว่างนั้นมีความสำคัญ เพราะความต้องการเครื่องมือตรวจจับ Claude มีอยู่แล้ว และสิ่งที่มีให้คือเครื่องมือจัดหมวดหมู่จากบุคคลที่สามที่ใช้วิธีคาดเดา ซึ่งเป็นสองสิ่งที่แตกต่างกันโดยสิ้นเชิง และการเข้าใจผิดกันก็อาจทำให้มีการกล่าวหานักเรียนว่าโกงจากประโยคที่พวกเขาเขียนขึ้นเองได้
บทความนี้จะกล่าวถึงความหมายที่แท้จริงของการตรวจจับสำหรับเทคนิคการทำเครื่องหมายสองแบบของ Claude สิ่งที่คุณสามารถตรวจสอบได้ในวันนี้ และข้อผิดพลาดในการให้เหตุผลที่ทำให้เวิร์กโฟลว์การตรวจจับส่วนใหญ่ไม่ปลอดภัย หากคุณกำลังเพิ่มการตรวจสอบแหล่งที่มาลงใน API, Apidog คือที่ที่คุณสามารถเปลี่ยนการตรวจสอบเหล่านั้นให้เป็นคำยืนยันที่ทำงานทุกครั้งที่สร้าง
เครื่องหมายสองแบบ เรื่องราวการตรวจจับสองแบบ
Claude ทำเครื่องหมายเนื้อหาด้วยสองวิธี ซึ่งทำงานต่างกันโดยสิ้นเชิง
| ลายน้ำข้อความฝังตัว | เมทาดาต้า C2PA ที่ลงนามแล้ว | |
|---|---|---|
| คืออะไร | สัญญาณทางสถิติที่ถักทอในข้อความที่สร้างขึ้น | ไฟล์ Manifest ที่ลงนามด้วยการเข้ารหัสแนบมากับไฟล์ |
| ใช้กับ | ข้อความที่สร้างขึ้นทั้งหมด | ประเภทไฟล์ที่รองรับ: .svg, .png, .jpg |
| รอดจากการคัดลอก-วาง | ใช่ | ไม่, ไฟล์คือภาชนะ |
| รอดจากการเข้ารหัสใหม่ | ใช่, ข้อความก็คือข้อความ | ไม่, มักจะถูกถอดออก |
| ตรวจจับได้ในวันนี้ | ไม่เปิดเผยต่อสาธารณะ. มีการให้คำมั่นสัญญาว่าจะสนับสนุนการตรวจจับ | ใช่, ด้วยเครื่องมือ C2PA มาตรฐาน |
| บอกคุณว่า | เนื้อหาอาจถูกประมวลผลโดย Claude | ไฟล์ถูกประมวลผลโดย Claude และมีการแก้ไขหรือไม่ |
ลายน้ำข้อความคือแบบที่คงทนและเป็นแบบที่คุณไม่สามารถอ่านได้ในปัจจุบัน ส่วนไฟล์ Manifest ของ C2PA คือแบบที่เปราะบางและเป็นแบบที่คุณสามารถอ่านได้ในตอนนี้ด้วยเครื่องมือสำเร็จรูป
สิ่งที่คุณสามารถตรวจสอบได้ในวันนี้: ไฟล์ Manifest ของ C2PA
หาก Claude สร้างรูปภาพหรือ SVG และไม่มีการเขียนไบต์ใหม่โดยระบบปลายทางใดๆ ไฟล์ Manifest ก็จะอยู่ในไฟล์ มีสามวิธีในการดู
ในเบราว์เซอร์ ลากและวางไฟล์ลงใน หน้ายืนยัน Content Credentials ระบบจะอ่านไฟล์ Manifest และรายงานผู้ลงนาม การอ้างสิทธิ์ และยืนยันว่าลายเซ็นถูกต้องหรือไม่
จากบรรทัดคำสั่ง c2patool คือ CLI อ้างอิงจากโปรเจกต์ C2PA:
# อ่านข้อมูลสรุป manifest
c2patool report.png
# รายละเอียดระดับ JUMBF ฉบับเต็ม มีประโยชน์เมื่อดีบั๊กไปป์ไลน์
c2patool report.png -d
ไฟล์ที่มี manifest ที่สมบูรณ์จะส่งคืนโครงสร้าง JSON ที่อธิบายถึงผู้สร้างการอ้างสิทธิ์ การยืนยัน และสถานะของลายเซ็น ไฟล์ที่ถูกถอด manifest ออกไปจะไม่มีการส่งคืนอะไรเลย ไฟล์ที่ไบต์ถูกแก้ไขโดยไม่ได้ลงนามใหม่จะส่งคืนข้อผิดพลาดในการตรวจสอบความถูกต้อง ซึ่งเป็นกรณีกลางที่มีประโยชน์: มันแยกแยะระหว่าง "ไม่มีแหล่งที่มา" กับ "แหล่งที่มาที่ถูกทำลาย"
จากโค้ดของคุณเอง ไลบรารี c2pa ห่อหุ้มตรรกะเดียวกันสำหรับ Rust, Python, JavaScript และ C ดังนั้นคุณจึงสามารถเรียกใช้การตรวจสอบภายในตัวจัดการคำขอหรือการทดสอบได้ นั่นคือแนวทางเบื้องหลังการ สร้าง AI image detector API ด้วย C2PA และ classifier ซึ่ง manifest จะให้คำตอบที่มั่นใจได้เมื่อมีอยู่ และ classifier จะเข้ามาทำงานเมื่อไม่มี
สิ่งที่คุณยังตรวจสอบไม่ได้ในวันนี้: ลายน้ำข้อความ
ยังไม่มีตัวอ่านสาธารณะสำหรับลายน้ำข้อความฝังตัวของ Claude ทาง Anthropic ระบุว่าจะสนับสนุนผู้ใช้และบุคคลที่สามในการตรวจจับเครื่องหมายของตนตามที่ Code of Practice กำหนดไว้ และจะมีการเปิดเผยรายละเอียดในเอกสารทางเทคนิคในอนาคต จนกว่าจะถึงเวลานั้น:
- ไม่มีเครื่องมือใดที่สามารถบอกได้อย่างเป็นทางการว่าข้อความใดมีเครื่องหมายของ Claude
- ผลิตภัณฑ์ใด ๆ ที่อ้างว่าตรวจจับ "ข้อความที่สร้างโดย Claude" ในวันนี้กำลังใช้ตัวจัดประเภท ไม่ได้อ่านสัญญาณอย่างเป็นทางการ
- ตัวจัดประเภทมีอัตราการผิดพลาดที่เป็นบวกเท็จที่ได้รับการบันทึกไว้เป็นอย่างดี และมักจะทำงานผิดพลาดมากที่สุดกับนักเขียนที่ไม่ใช่เจ้าของภาษาอังกฤษและกับงานเขียนที่เป็นทางการและมีโครงสร้าง
ถือว่านี่เป็น "ยังไม่พร้อม" ไม่ใช่ "ไม่มีวันพร้อม" เมื่อ Anthropic เผยแพร่กลไกการตรวจจับ รูปแบบที่สมเหตุสมผลคือการตรวจสอบฝั่งเซิร์ฟเวอร์ที่คุณเรียกใช้จากบริการของคุณเอง ซึ่งคล้ายกับขั้นตอนการตรวจสอบ C2PA โดยที่ผลลัพธ์จะถูกเก็บเป็นสัญญาณแทนที่จะเป็นคำตัดสิน
ในทางตรงกันข้าม Google เลือกวิธีตรงกันข้ามกับ SynthID Text: พวกเขาเปิดเผยซอร์สโค้ดพร้อมกับเครื่องมือตรวจจับอ้างอิง ดังนั้นทุกคนสามารถใช้งานได้โดยไม่ต้องขอสิทธิ์เข้าถึง นั่นคือแผนการทำเครื่องหมายข้อความแบบเดียวที่บุคคลที่สามสามารถตรวจสอบได้ในวันนี้ และช่องว่างดังกล่าวได้ถูกนำเสนอไว้ใน ลายน้ำของ Claude vs ChatGPT vs Gemini
ข้อผิดพลาดในการให้เหตุผลที่ทำให้เวิร์กโฟลว์การตรวจจับล้มเหลว
การตรวจจับให้ผลลัพธ์ที่ไม่สมมาตร คนส่วนใหญ่ใช้มันอย่างสมมาตร และนั่นคือจุดที่เกิดความเสียหาย
เครื่องหมายที่ตรวจพบเป็นหลักฐานเชิงบวกที่อ่อนแอ มันบอกว่าเนื้อหาอาจถูกประมวลผลโดย Claude มันไม่ได้บ่งชี้ถึงความเป็นผู้เขียน เพราะคนทั่วไปมักใช้ Claude เพื่อตรวจทาน แปล สรุป และแปลงงานที่มีอยู่ ร่างงาน 3,000 คำของนักวิจัยเองที่ถูกส่งผ่าน Claude เพื่อตรวจสอบไวยากรณ์ จะกลับมาพร้อมเครื่องหมาย แนวคิดและการรายงานเป็นของมนุษย์ทั้งหมด เครื่องหมายไม่สามารถแยกแยะสิ่งนั้นออกจากพรอมต์ที่บอกว่า "เขียนข้อความ 3,000 คำให้ฉัน"
เนื้อหายังเปลี่ยนแปลงหลังจาก Claude สัมผัส ข้อความที่มีเครื่องหมายจะถูกแก้ไข อ้างอิง และรวมเข้ากับเอกสารขนาดใหญ่ การพบเครื่องหมายในไฟล์บอกคุณว่ามีบางสิ่งบางอย่างสัมผัสส่วนหนึ่งของมันในบางจุด
ไม่มีเครื่องหมายที่ตรวจพบ ไม่ใช่หลักฐานใดๆ เลย Anthropic ระบุกรณีต่างๆ อย่างชัดเจน เนื้อหาที่ Claude สร้างขึ้นอาจไม่มีเครื่องหมายที่ตรวจจับได้ เมื่อมาจากโมเดลที่เผยแพร่ก่อนที่จะรองรับการทำเครื่องหมาย เมื่อข้อความถูกแก้ไขอย่างหนัก ถูกถอดความ แปล หรือผสมผสานกับงานเขียนอื่นๆ เมื่อข้อความสั้นเกินไปที่จะมีสัญญาณที่น่าเชื่อถือ เมื่อเมทาดาต้าของไฟล์ถูกลบโดยการแปลงรูปแบบ การบันทึกใหม่ หรือการจับภาพหน้าจอ หรือเมื่อมาจากแพลตฟอร์มหรือประเภทไฟล์ที่ไม่รองรับการทำเครื่องหมายประเภทนั้น
อ่านรายการนั้นแล้วสังเกตว่าทุกรายการเป็นเรื่องธรรมดาเพียงใด คำตอบสั้นๆ ย่อหน้าที่แปลแล้ว ภาพหน้าจอของแผนภูมิ ไม่มีสิ่งใดเป็นข้อหลีกเลี่ยง นั่นคือเรื่องปกติทั่วไป
ดังนั้นกฎคือ: ผลลัพธ์เชิงบวกจะจำกัดวงแคบลง แต่ผลลัพธ์เชิงลบไม่ได้บอกอะไรคุณเลย นโยบายใดๆ ที่ลงโทษผู้คนจากผลลัพธ์เชิงลบนั้นผิดพลาดทางเทคโนโลยี ก่อนที่คุณจะพิจารณาว่ามันยุติธรรมหรือไม่ ความไม่สมมาตรเดียวกันนี้ได้ก่อให้เกิดปัญหาในงานด้านภาพแล้ว ซึ่งเป็นข้อโต้แย้งใน ทำไมการตรวจจับภาพ AI ถึงล้มเหลว
การสร้างการตรวจจับเข้าสู่บริการอย่างเหมาะสม
หากคุณกำลังเพิ่มการตรวจสอบแหล่งที่มาลงในผลิตภัณฑ์ คำถามในการออกแบบจะเกี่ยวกับอัลกอริทึมน้อยลง แต่จะเกี่ยวกับสิ่งที่คุณทำกับสัญญาณอ่อนๆ มากขึ้น
- ส่งคืนสัญญาณ ไม่ใช่คำตัดสิน เนื้อหาการตอบกลับที่ระบุว่า
{"ai_generated": true}คือการอ้างสิทธิ์ที่ API ของคุณไม่สามารถรองรับได้ การตอบกลับที่ระบุว่า{"provenance": {"c2pa": "verified", "signer": "...", "checked_at": "..."}}คือข้อเท็จจริงที่คุณสามารถปกป้องได้ สร้างแบบจำลอง schema ของคุณตามสิ่งที่คุณสังเกตเห็นจริง - บันทึกสิ่งที่คุณตรวจสอบและเวลา ผลลัพธ์ของแหล่งที่มาอาจล้าสมัย เครื่องมือเปลี่ยนแปลง และรายการความเชื่อถือได้รับการอัปเดต จัดเก็บผลการตรวจสอบพร้อมด้วยการประทับเวลาและเวอร์ชันของเครื่องมือ เช่นเดียวกับที่คุณจัดเก็บผลการสแกนไวรัส
- แยก "ไม่มี" ออกจาก "เสียหาย" สิ่งเหล่านี้คือสถานะที่แตกต่างกันและมีความหมายต่างกัน "ไม่มี" หมายความว่าไม่พบไฟล์ manifest ซึ่งไม่ให้ข้อมูลอะไรเลย "เสียหาย" หมายความว่ามีไฟล์ manifest อยู่แต่ไม่ผ่านการตรวจสอบ ซึ่งน่าสนใจอย่างแท้จริง การยุบรวมสถานะเหล่านี้เป็นบูลีนเดียวจะทำให้คุณสูญเสียสัญญาณที่ดีที่สุดไป
- ยอมให้ผ่านในการตรวจสอบ ไม่ใช่เนื้อหา บริการยืนยันที่หยุดทำงานไม่ควรทำเครื่องหมายทุกอย่างว่าไม่ได้รับการยืนยันโดยไม่มีร่องรอย แยกความแตกต่างระหว่าง “ตรวจสอบแล้วไม่พบอะไร” กับ “ไม่สามารถตรวจสอบได้”
รูปแบบขั้นต่ำที่ใช้ได้:
{
"asset_id": "img_9f2c41",
"provenance": {
"status": "verified",
"standard": "c2pa",
"signer": "Anthropic",
"signature_valid": true,
"checked_at": "2026-08-11T09:14:22Z",
"tool": "c2patool/0.9"
},
"notes": "Provenance indicates the file was processed by Claude. It does not establish authorship."
}
ฟิลด์สุดท้ายนั้นไม่ใช่แค่การตกแต่ง หาก API ของคุณส่งคืนข้อมูลแหล่งที่มาไปยังโค้ดของทีมอื่น คำเตือนจะต้องอยู่ในตำแหน่งที่โค้ดของพวกเขาจะเห็นได้ ไม่ใช่ในหน้าเอกสารที่ไม่มีใครอ่าน
การทดสอบการตรวจสอบเพื่อให้มั่นใจว่ายังคงทำงานได้
การตรวจสอบแหล่งที่มาเป็นคุณสมบัติประเภทที่มักจะเสียไปอย่างเงียบๆ มีคนเพิ่มขั้นตอนการปรับขนาดรูปภาพ ไฟล์ manifest หายไป และทรัพย์สินทุกชิ้นก็เริ่มกลับมาที่ status: "absent" ไม่มีข้อผิดพลาดใดๆ แดชบอร์ดดูปกติ
สี่ข้อสมมติที่ควรใส่ในสถานการณ์ทดสอบ:
- การตรวจสอบส่วนประกอบที่รู้ว่าดีแล้ว อัปโหลดไฟล์ที่มี manifest ที่ถูกต้อง ยืนยันว่า
statusคือverifiedและsignature_validคือtrue - ส่วนประกอบที่รู้ว่าถูกตัดออกไปแล้วจะรายงานว่าไม่มีอยู่จริง อัปโหลดไฟล์เดียวกันที่ถูกนำเมทาดาต้าออกไป ยืนยันว่า
statusคือabsentไม่ใช่ข้อผิดพลาดและไม่ใช่verified - ส่วนประกอบที่ถูกดัดแปลงรายงานว่าชำรุด แก้ไขไบต์ในไฟล์ที่ลงชื่อแล้ว ยืนยันว่าการตอบกลับแยกแยะระหว่างชำรุดกับไม่มีอยู่จริง
- การวนซ้ำยังคงรักษา Manifest ไว้ อัปโหลดไฟล์ที่ลงชื่อแล้ว ดึงกลับผ่านเส้นทางการส่งมอบปกติของคุณ และยืนยันว่า Manifest ยังคงถูกต้อง นี่คือสิ่งที่ตรวจจับการถดถอยของ CDN และการปรับขนาด ซึ่งครอบคลุมอย่างละเอียดใน API ของคุณกำลังลบเมทาดาต้า C2PA
ใน Apidog คุณสามารถจัดเก็บสี่สิ่งนี้เป็นสถานการณ์ทดสอบด้วยไฟล์ฟิกซ์เจอร์ไบนารี ยืนยันการตอบสนอง JSON ด้วย การยืนยันมาตรฐาน และเรียกใช้สถานการณ์จาก apidog-cli ใน CI เพื่อให้การเปลี่ยนแปลงไปป์ไลน์ที่ลบไฟล์ manifest ทำให้บิลด์ล้มเหลว การตั้งค่าพร้อมกับชุดโปรแกรมที่มีอยู่ของคุณเป็นขั้นตอนเดียวกับการ ทำงานอัตโนมัติของการทดสอบ API ใน GitHub Actions ดาวน์โหลด Apidog เพื่อสร้างมันกับปลายทางของคุณเอง
คำถามที่พบบ่อย
- มีเครื่องมือตรวจจับลายน้ำ Claude อย่างเป็นทางการหรือไม่? ไม่มีการเปิดเผยต่อสาธารณะ ณ เดือนสิงหาคม 2026 Anthropic ได้ให้คำมั่นสัญญาว่าจะสนับสนุนการตรวจจับสำหรับผู้ใช้และบุคคลที่สาม และระบุว่าจะแบ่งปันรายละเอียดในเอกสารทางเทคนิคที่กำลังจะออกมา
- ฉันสามารถใช้เครื่องมือตรวจจับข้อความ AI เพื่อค้นหาลายน้ำของ Claude ได้หรือไม่? ไม่ได้ เครื่องมือเหล่านั้นเป็นเครื่องมือจัดหมวดหมู่ทางสถิติที่ฝึกมาเพื่อคาดเดาว่าข้อความดูเหมือนถูกเขียนโดยเครื่องจักรหรือไม่ พวกเขาไม่ได้อ่านเครื่องหมายของ Anthropic และข้อผิดพลาดที่เป็นบวกเท็จของพวกเขาจะเกิดขึ้นอย่างรุนแรงที่สุดกับนักเขียนที่ไม่ใช่เจ้าของภาษาอังกฤษและกับงานเขียนที่มีรูปแบบไม่ปกติหรือเป็นทางการมาก
- ฉันจะตรวจสอบไฟล์สำหรับเมทาดาต้า C2PA ของ Claude ได้อย่างไร? รัน
c2patool <file>ในเครื่อง หรือลากไฟล์ไปที่หน้ายืนยัน Content Credentials ทั้งสองวิธีจะรายงานผู้ลงนามและยืนยันว่าลายเซ็นถูกต้องหรือไม่ - ถ้าไฟล์ไม่มี Manifest ของ C2PA แสดงว่าเป็นฝีมือมนุษย์ใช่หรือไม่? ไม่ใช่ Manifest มักถูกทำลายโดยการปรับขนาด การเข้ารหัสใหม่ การแปลงรูปแบบ ภาพหน้าจอ และ CDN รูปภาพ การไม่มีอยู่ของมันไม่ได้พิสูจน์อะไรเกี่ยวกับแหล่งที่มาเลย
- ลายน้ำข้อความรอดจากการแก้ไขหรือไม่? บางส่วน มันจะติดไปกับการคัดลอกและวาง และอาจคงอยู่ผ่านการแก้ไขบางอย่าง แต่การถอดความ การแปล หรือการตัดทอนเป็นข้อความสั้นๆ มากๆ อาจทำให้มันต่ำกว่าระดับการตรวจจับ รายละเอียดอยู่ใน ลายน้ำของ Claude รอดจากการคัดลอก วาง และแก้ไขหรือไม่
- ฉันควรทำอย่างไรจนกว่าการตรวจจับจะถูกเปิดตัว? ตรวจสอบ C2PA ในส่วนที่เกี่ยวข้องกับไฟล์ บันทึกสิ่งที่คุณตรวจสอบ และหลีกเลี่ยงการสร้างนโยบายใดๆ ที่ขึ้นอยู่กับการตรวจจับข้อความ ออกแบบอินเทอร์เฟซตอนนี้ เพื่อให้คุณสามารถเพิ่มการตรวจสอบข้อความอย่างเป็นทางการได้ในภายหลังโดยไม่ต้องเปลี่ยนรูปแบบการตอบกลับของคุณ
ประเด็นสำคัญ
ตอนนี้คุณสามารถตรวจสอบแหล่งที่มาของไฟล์ Claude ด้วยเครื่องมือ C2PA มาตรฐาน และคุณไม่สามารถตรวจสอบลายน้ำข้อความได้เลย นี่เป็นสถานะชั่วคราว แต่ควรเป็นสิ่งที่กำหนดสิ่งที่คุณจะสร้างในวันนี้: การตรวจสอบไฟล์ สัญญาณที่ซื่อสัตย์แทนคำตัดสิน และไม่มีนโยบายใดๆ ที่ถือว่าผลลัพธ์ที่สะอาดเป็นหลักฐานของสิ่งใดๆ
เครื่องหมายนี้เป็นคำใบ้ว่าเนื้อหาเคยมาจากที่ใด ใครก็ตามที่ขายมันเป็นการทดสอบความเป็นผู้แต่งกำลังอธิบายผลิตภัณฑ์ที่ไม่มีอยู่จริง
