앤트로픽(Anthropic)은 EU AI법 50조 2항의 AI 생성 콘텐츠 투명성 관련 행동 강령에 서명했으며, 이제 그 약속을 모델 자체에 적용하고 있습니다. 2026년 8월 2일 이후 출시되는 클로드(Claude) 모델은 생성하는 콘텐츠에 기계 판독 가능한 마크를 삽입합니다. 텍스트에는 단어 속에 눈에 띄지 않는 워터마크가 새겨집니다. 생성된 파일에는 암호화 방식으로 서명된 출처 메타데이터가 포함됩니다.
대부분의 사람들이 놓치는 부분은 이것이 EU에만 해당되는 기능이 아니며, 채팅 앱에만 국한되지 않는다는 점입니다. 이는 전 세계 클로드 플랫폼(API), Claude, Claude Code, Claude Cowork, Claude Tag 전반의 지원되는 모델에서 생성되는 모든 출력에 적용됩니다. 백엔드에서 클로드 API를 호출하면, 반환되는 텍스트에는 마크가 포함되어 있으며, 사용자가 전달받는 모든 콘텐츠에도 동일하게 적용됩니다.
이는 모델을 래핑하는 API를 제공하는 모든 사람에게 실제적인 영향을 미칩니다. 아래에서는 마킹이 실제로 무엇이며, 어디에 적용되는지, 무엇을 증명할 수 있고 증명할 수 없는지, 그리고 파이프라인에 추가할 가치가 있는 구체적인 검증 사항들을 설명합니다. 오늘날 AI 기반 엔드포인트를 테스트하고 있다면, Apidog는 이러한 검증 사항들을 누군가의 머릿속에만 두지 않고 모든 빌드에서 실행되도록 하는 좋은 장소입니다.
요약
| 질문 | 답변 |
|---|---|
| 무엇이 마킹되나요? | 생성된 텍스트 (내장 워터마크) 및 .svg, .png, .jpg와 같은 생성된 파일 (서명된 C2PA 메타데이터) |
| 어떤 모델인가요? | 2026년 8월 2일 이후 출시되는 클로드 모델. 이전 모델들은 전환 기간 동안 소급 적용됩니다. |
| 어떤 인터페이스에 적용되나요? | 클로드 플랫폼 (API), Claude, Claude Code, Claude Cowork, Claude Tag |
| 어떤 지역에 적용되나요? | EU뿐만 아니라 클로드가 제공되는 전 세계 모든 지역 |
| 클라우드 리셀러는요? | 내장 워터마크는 AWS, Google Cloud, Microsoft Foundry를 통해 적용됩니다. 서명된 출처 메타데이터는 모든 플랫폼에서 지원되지 않을 수 있습니다. |
| 끌 수 있나요? | 아니요. 텍스트 워터마킹은 모델 수준에서 적용됩니다. |
| 마크가 클로드가 작성했음을 증명하나요? | 아니요. 콘텐츠가 클로드에 의해 처리되었을 수 있음을 나타냅니다. |
| 마크가 없으면 사람이 작성했음을 증명하나요? | 아니요. 마크가 없다고 해서 아무것도 증명되지 않습니다. |
앤트로픽이 실제로 약속한 것
AI 생성 콘텐츠 투명성 관련 행동 강령은 2026년 6월 10일에 발표되었으며, 7월 말까지 약 190개의 서명자가 참여했습니다. 유럽연합 집행위원회와 AI 이사회는 이 강령이 AI법 50조 준수를 입증하는 적절한 자발적 경로임을 확인했습니다. 앤트로픽은 생성형 AI 모델과 생성형 AI 시스템 제공자로서 서명했습니다.
앤트로픽 자체의 틀에 따르면, 네 가지 약속이 나옵니다.
- 새로운 모델은 첫날부터 마킹됩니다. 2026년 8월 2일 이후 EU에 출시되는 클로드 모델은 출시 시부터 기계 판독 가능한 마킹을 지원합니다.
- 마킹은 제품 전체에 걸쳐 적용됩니다. 지원되는 모델의 출력은 API, Claude, Claude Code, Claude Cowork, Claude Tag에서 마킹됩니다.
- 탐지가 지원될 예정입니다. 앤트로픽은 사용자와 제3자가 기술 문서를 통해 자사 마크를 탐지할 수 있도록 지원할 것이라고 말했습니다.
- 이전 모델은 진행 중입니다. 법률은 2026년 8월 2일 이전에 출시된 모델에 대해 전환 기간을 허용하며, 소급 적용이 진행 중입니다.
마지막 두 가지는 보이는 것보다 더 중요합니다. 탐지는 약속되었지만 아직 출시되지 않았습니다. 그리고 모델군은 혼합되어 있습니다. 2026년 초 모델은 완전히 마크되지 않은 텍스트를 생성할 수 있고, 바로 옆에 있는 새로운 모델은 모든 것을 마킹할 수 있습니다.
기법 1: 텍스트 내의 보이지 않는 워터마크
지원되는 클로드 모델이 텍스트를 생성할 때, 텍스트 자체에 워터마크를 새겨 넣습니다. 이는 눈에 보이지 않으며, 응답의 의미, 품질 또는 가독성을 변경하지 않습니다. 눈에 보이는 태그도, 추가된 문장도, 헥스 에디터에서 확실하게 발견할 수 있는 숨겨진 유니코드 문자도 없습니다.
이러한 설계에서 두 가지 특성이 따릅니다.
이동성이 있습니다. 워터마크는 파일 래퍼가 아닌 텍스트 자체에 존재하기 때문에 복사 및 붙여넣기 후에도 유지됩니다. 클로드에서 이메일, CMS 필드, 풀 리퀘스트 설명 또는 슬랙 메시지로 문단을 옮겨도 신호는 그대로 따라갑니다. 이것이 핵심입니다. 메타데이터 기반 접근 방식은 콘텐츠가 컨테이너를 벗어나는 순간 효력을 잃지만, 텍스트 워터마킹은 이러한 실패 모드가 없습니다.
모델 수준에서 적용됩니다. 제품 레이어에서 적용되는 것이 아니며, API 앞의 필터에 의해 적용되는 것도 아닙니다. 즉, 설정할 헤더도, 변경할 요청 매개변수도, 제거하는 엔터프라이즈 티어도 없습니다. API를 기반으로 구축하고 있으며 화이트 라벨 제품을 위해 제거하려고 한다면, 그러한 옵션은 존재하지 않습니다.
절충점은 통계적입니다. 단어 선택에 내장된 워터마크는 읽을 수 있는 충분한 단어가 필요합니다. 세 단어 응답은 신호를 숨길 곳이 없으므로, 매우 짧은 구절은 탐지 한계점 아래로 떨어집니다.
기법 2: 파일에 서명된 C2PA 출처 메타데이터
클로드가 지원되는 파일 형식, 현재는 .svg, .png, .jpg를 생성할 때, 업계 전반에 사용되는 동일한 콘텐츠 인증 형식인 C2PA 개방형 표준을 따라 서명된 출처 메타데이터를 첨부합니다.
C2PA는 워터마크와는 다르게 작동합니다. 콘텐츠 내에 신호를 숨기는 대신, 파일이 어디에서 왔는지, 어떤 작업이 수행되었는지 설명하는 암호화 방식으로 서명된 매니페스트를 첨부합니다. 매니페스트가 서명되어 있기 때문에 변조를 감지할 수 있습니다. 바이트가 변경되고 매니페스트가 재서명되지 않으면 서명이 깨지고 모든 C2PA 리더는 이를 알려줄 것입니다.
이는 정말 유용한 속성이지만, 동시에 정말 성가신 속성도 가지고 있습니다. C2PA 메타데이터는 컨테이너 수준의 첨부 파일이므로, 컨테이너를 재작성하는 모든 것이 이를 제거할 수 있습니다. 재인코딩, 크기 조정, 형식 변환, 스크린샷 또는 자동 최적화를 수행하는 이미지 CDN은 모두 매니페스트를 기꺼이 버릴 것입니다. 여러분의 업로드 파이프라인이 이러한 일이 발생할 가능성이 가장 높은 장소 중 하나이므로, 누구에게든 출처 보장을 약속하기 전에 API가 C2PA 메타데이터를 제거하는지 테스트하는 것이 중요합니다.
매니페스트를 직접 검사하고 싶다면, c2patool을 명령줄에서 읽을 수 있고, 콘텐츠 인증 확인 페이지는 브라우저에서 이를 수행합니다. 동일한 도구는 C2PA를 이용한 AI 이미지 감지기 API 구축에서 분류기 + 매니페스트 접근 방식을 지원합니다.
마크가 적용되는 곳
적용 범위는 일반적인 출시 기능보다 넓으므로, 경계를 신중하게 읽는 것이 중요합니다.
모델. 마킹은 2026년 8월 2일 이후 출시되는 모델과 함께 제공됩니다. 그 이전의 모든 모델은 소급 적용 중입니다. 실제로 앱이 올해 초 모델 ID를 고정하고 있다면, 앤트로픽이 달리 말하기 전까지는 출력이 마크되지 않는다고 가정해야 합니다.
제품. 내장 워터마크는 클로드 플랫폼(API), Claude, Claude Code, Claude Cowork, Claude Tag의 모든 생성된 텍스트에 적용됩니다. 출처 메타데이터는 클로드가 파일 처리를 지원하는 곳에 적용됩니다.
클라우드 파트너. 지원되는 모델이 AWS, Google Cloud 또는 Microsoft Foundry를 통해 액세스될 때 내장 워터마크가 전달됩니다. 서명된 출처 메타데이터는 각 플랫폼의 파일 처리 지원 여부에 따라 전달되지 않을 수 있습니다. 규정 준수 스토리가 특히 C2PA에 의존하고 Bedrock 또는 Vertex를 통해 라우팅하는 경우, 가정하기보다 확인해야 합니다.
지역. 전 세계. 의무는 유럽에서 비롯되었지만, 구현은 전 세계적입니다.
탐지된 마크가 실제로 알려주는 것
이 섹션은 두 번 읽어야 합니다. "클로드가 출력에 워터마크를 찍는다"는 마케팅의 축약 표현이 기술이 지원하지 않는 결론을 유도하기 때문입니다.
탐지된 마크는 콘텐츠가 클로드에 의해 처리되었을 수 있음을 의미합니다. 이는 저작권을 확립하지 않으며, 앤트로픽은 이에 대해 명확히 밝힙니다. 두 가지 실패 모드로 인해 사람들이 예상하는 것보다 약합니다.
클로드가 저자가 아닐 수 있습니다. 사람들은 클로드를 사용하여 교정, 번역, 요약 및 파일 변환을 수행합니다. 사람이 900단어를 작성하고 클로드에게 문체를 다듬도록 요청하면, 결과물에 마크가 포함됩니다. 아이디어, 보고 내용, 그리고 대부분의 문장은 인간의 것입니다. 마크는 이러한 경우와 전체 생성을 구별할 수 없습니다.
사후 콘텐츠 변경. 마크가 찍힌 출력은 편집되고, 발췌되고, 다른 자료와 혼합됩니다. 문서에서 발견된 마크는 특정 시점에 일부에 영향을 미쳤다는 것을 의미하며, 현재 문서가 모델에서 나왔다는 것을 의미하지는 않습니다.
마크가 없다는 것이 알려주는 것: 아무것도 아님
반대의 오류는 더 나쁩니다. 사람들에게 불리하게 사용될 수 있기 때문입니다. 클로드에 의해 실제로 생성된 콘텐츠는 다음과 같은 경우에 탐지 가능한 마크가 없을 수 있습니다.
- 마킹이 지원되기 전에 출시된 모델에서 생성되었을 때;
- 텍스트가 심하게 편집되거나, 의역되거나, 번역되거나, 다른 글과 혼합되었을 때;
- 구절이 신뢰할 수 있는 신호를 포함하기에는 너무 짧을 때;
- 파일의 메타데이터가 형식 변환, 재저장 또는 스크린샷으로 인해 제거되었을 때;
- 해당 마킹 유형이 지원되지 않는 플랫폼, 기능 또는 파일 형식을 통해 생성되었을 때.
"워터마크 없음"을 인간 저작권의 증거로 취급하는 모든 워크플로우는 설계상 결함이 있습니다. 여기에는 학문적 진실성 도구, 채용 심사 및 콘텐츠 조정 파이프라인이 포함됩니다. 동일한 비대칭성은 AI 이미지 탐지가 실패하는 이유에서 주장된 바와 같이 이미지 분류기에 의존하는 사람들을 이미 곤란하게 만들었습니다.
클로드 기반으로 구축하는 경우의 의미
앤트로픽의 개발자 지침은 짧고 명확합니다. 제품에 클로드를 배포하는 경우, 50조가 제품 및 서비스에 요구하는 사항을 독립적으로 평가하십시오. 규정을 준수하는 공급자의 고객이라고 해서 규정을 준수하는 것은 아닙니다.
구분이 중요합니다. 앤트로픽은 공급자이며 50조 2항에 따라 기계 판독 가능한 마킹 의무를 가집니다. 여러분은 일반적으로 배포자이며, 50조 4항은 딥페이크 및 공익 관련 AI 생성 텍스트 게시에 대한 별도의 의무를 부여합니다. 이는 서로 다른 의무와 다른 구제책이며, API 개발자를 위한 AI법 50조 분석에서 어떤 의무가 여러분에게 해당하는지 설명합니다.
엔지니어링 팀을 위한 세 가지 실제적인 항목:
어떤 모델 ID가 마킹되는지 아십시오. 모델 라우팅 구성과 동일한 위치에 보관하고, "이 모델이 마킹되었는가?"를 모델의 속성으로 취급하고 전역적인 예/아니요로 취급하지 마십시오. 혼합된 모델군은 현재 일반적인 상태입니다.
실수로 출처를 제거하는 것을 멈추십시오. 파일을 수락, 변환 또는 재서빙하는 모든 엔드포인트는 C2PA 매니페스트를 조용히 삭제할 수 있는 후보입니다. 크기 조정, 썸네일 생성, 트랜스코딩 및 CDN 경로는 일반적인 용의자입니다.
UI뿐만 아니라 자체 계약서에도 공개하십시오. API가 모델 출력을 다른 팀의 코드에 반환하는 경우, 웹 앱의 배너는 도움이 되지 않습니다. 응답 필드 또는 헤더가 도움이 됩니다. 이것이 자체 API에 AI 공개를 추가하는 데 대한 주장입니다.
실제로 실행하는 테스트로 전환
규정 준수 논의는 문서에서 정체되는 경향이 있습니다. 제대로 유지되는 부분은 CI에 연결된 부분입니다.
AI 기반 API를 위한 실행 가능한 계약 테스트 세트:
- 모델 고정. 예상하는 모델 ID를 응답이 보고하는지 확인합니다. 자동 업그레이드 또는 폴백은 출력이 마킹되는지 여부를 변경합니다.
- 공개 필드 존재. 스키마가 `ai_generated: true` 또는 `X-AI-Generated` 헤더를 약속하는 경우, 오류 및 캐시된 경로를 포함하여 모델 출력을 반환하는 모든 경로에서 이를 확인합니다.
- 출처 유지. 이미지를 반환하거나 재서빙하는 모든 엔드포인트에 대해, 파이프라인이 바이트를 건드린 후에도 C2PA 매니페스트가 여전히 존재하고 여전히 확인되는지 확인합니다.
- 스키마 준수. 리팩토링 시 공개 필드가 조용히 사라지지 않도록 OpenAPI 정의에 대해 응답을 검증합니다.
이 네 가지 모두 일반적인 어설션입니다. Apidog에서는 이를 응답 어설션과 후처리 스크립트로 표현하고, 테스트 시나리오로 저장한 다음, 파이프라인에서 `apidog-cli`를 통해 시나리오를 실행하여 회귀 오류가 감사에서 발견되는 대신 빌드를 실패시키도록 할 수 있습니다. 메커니즘은 API 어설션 및 GitHub Actions에서 API 테스트 자동화에서 다룬 것과 동일합니다. 읽으면서 시나리오를 구축하고 싶다면 Apidog를 다운로드하십시오.
FAQ
내 제품에 대해 클로드 워터마크를 비활성화할 수 있나요? 아니요. 텍스트 워터마킹은 모델 수준에서 적용되므로, 텍스트가 어떤 클로드 제품이나 인터페이스에서 왔는지에 관계없이 존재합니다. 이를 제거하는 API 매개변수, 헤더 또는 요금제 티어는 없습니다.
워터마크가 클로드 출력의 품질을 변경하나요? 앤트로픽은 응답의 의미, 품질 또는 가독성을 변경하지 않는다고 말합니다. 사용자도 여러분도 이를 볼 수 없습니다.
클로드 워터마크를 확인하는 공개 도구가 있나요? 아직 없습니다. 앤트로픽은 사용자와 제3자를 위한 탐지 지원을 약속했으며, 기술 문서가 나올 예정이라고 합니다. 공식 마크의 판독기가 아닌, 검증되지 않은 분류기로서 어떠한 제3자 "클로드 감지기"도 그 전까지는 그렇게 취급하십시오. 자세한 내용은 클로드 워터마크를 탐지하는 방법에 있습니다.
이전 클로드 모델도 출력에 워터마크를 찍나요? 자동으로 찍지 않습니다. AI법은 2026년 8월 2일 이전에 출시된 모델에 대해 전환 기간을 포함하고 있으며, 앤트로픽은 이들 모델에 마킹을 추가하는 작업을 진행 중입니다. 출시될 때까지는 이전 모델 ID가 마크되지 않은 텍스트를 생성한다고 가정하십시오.
Bedrock 또는 Vertex를 통해 클로드를 호출하는 경우에도 적용되나요? 내장 텍스트 워터마크는 적용됩니다. 서명된 출처 메타데이터는 각 플랫폼이 제공하는 파일 처리 기능에 따라 적용되지 않을 수 있습니다.
OpenAI 및 Google이 하는 것과는 어떻게 다른가요? Google의 SynthID는 이미지, 오디오, 비디오 및 텍스트를 다루며, 텍스트 버전은 오픈 소스로 공개되었습니다. OpenAI는 생성된 이미지에 C2PA 콘텐츠 인증을 첨부하며, 2026년 5월에 SynthID를 함께 내장하기로 약속했지만, 텍스트 워터마크는 아직 출시하지 않았습니다. 비교 내용은 Claude vs ChatGPT vs Gemini 워터마킹에 자세히 나와 있습니다.
결론
클로드의 마킹은 두 가지 다른 작업을 수행하는 두 가지입니다. 텍스트 워터마크는 내구성이 있고 텍스트와 함께 이동하지만, 읽기에 충분한 텍스트가 필요한 확률적 신호이며 "클로드가 이걸 건드렸을 수도 있다"고만 말할 수 있습니다. C2PA 메타데이터는 정밀하고 변조를 감지할 수 있지만, 자체 이미지 파이프라인이 아무도 모르게 파괴할 수 있을 만큼 취약합니다.
둘 다 표절 감지기가 아니며, 둘 다 자체적으로 규정 준수를 보장하지 않습니다. 이들이 제공하는 것은 여러분이 정직하게 다루고 통제하는 체인의 부분을 테스트하는 한, 여러분이 기반으로 구축할 수 있는 신호입니다.
