클로드 텍스트 워터마크, 무엇이 바뀌고 무엇은 바뀌지 않나 | DAKER 커뮤니티

이제 클로드가 만든 글은 겉으로는 예전과 같아 보여도, 나중에 관여 가능성을 확인할 수 있는 흔적을 남길 수 있습니다. 숨은 문자를 심는 방식도 아니고, 토큰이 늘어나는 것도 아니며, 문장 품질을 떨어뜨리는 조정도 아닙니다. 하지만 공개 글, 제출문, 고객에게 나가는 메일처럼 바깥으로 나가는 텍스트를 다루는 방식은 분명 달라집니다.

특히 중요한 점은 이 흔적이 저자를 증명하는 도장이 아니라는 사실입니다. 클로드가 처음부터 썼는지, 일부만 고쳤는지까지는 말해주지 못합니다. 그래서 지금 읽어둘 가치는 기술 자체보다도, 이 결과를 팀과 조직이 어떻게 해석해야 하는지에 있습니다.

클로드가 고른 단어 사이에 남는 보이지 않는 텍스트 지문

2026년 8월 14일 Anthropic이 클로드 텍스트 워터마크를 설명했습니다. 앞으로 나오는 클로드 모델의 글에는 워터마크가 들어갑니다. 배경에는 유럽연합 AI법과, 그해 7월 서명한 AI 생성물 투명성 실천강령이 있습니다. 서명한 곳은 주요 모델사와 약 190개 참여자입니다. 8월 2일부터 유럽 시장에 서비스를 내는 사업자는 생성 텍스트를 표시해야 합니다. Anthropic은 지역마다 켜고 끄는 안정적인 방법이 아직 없다고 했고, 그래서 전 세계에 같이 적용합니다. 이는 품질 개선을 위한 후훈련이 아니라 유럽 시장 규칙에 따른 조치입니다.

실제로 도입된 것은 무엇인가

방법은 SynthID-Text입니다. 2024년 구글 딥마인드가 Nature에 실은 기법이고, 2022년 스콧 아론슨이 제안한 계열입니다. 언어 모델은 다음 단어를 고를 때 거의 비슷한 후보들 사이에서 선택하는 경우가 많습니다. 워터마크는 이 선택 자체를 바꾸는 것이 아니라, 선택을 정하는 난수의 출처를 바꾸는 방식으로 작동합니다. 비밀 키와 바로 앞 단어들이 다음 선택에 영향을 주고, 키를 가진 쪽은 나중에 그 선택 순서가 해당 키와 맞는지 확률적으로 계산할 수 있습니다.

중요한 점은 문장 안에 숨은 글자를 심는 방식이 아니라는 것입니다. 공식 설명의 비유를 따르면, 주사위를 던지는 대신 원주율 자리수를 따라 말을 옮기는 게임과 비슷합니다. 플레이어에게는 여전히 무작위처럼 보이지만, 나중에 전체 이동을 보면 특정 규칙과 맞는지 확인할 수 있습니다. 클로드도 마찬가지로 희귀한 단어를 억지로 넣거나 특정 표현만 반복하도록 밀어붙이지 않습니다. 이미 후보에 있던 말들 가운데 어떤 난수로 고를지만 달라집니다.

워터마크는 문장 속에 숨은 글자를 심는 일이 아니라, 단어 선택을 정하는 난수의 출처를 바꾸는 방식입니다.

Anthropic이 적어 둔 한계에 따르면 품질·창의성·가독성에서 내부 실험 차이는 없었습니다. 딥마인드 논문도 제미니 트래픽 일부에 워터마크를 넣고 좋아요·싫어요를 비교했지만 통계적으로 유의미한 차이를 보지 못했다고 설명합니다. 사람이 나란히 읽어도 품질 차이를 확인하지 못했습니다. 토큰이 늘지 않으므로 속도 부담은 무시할 만하고, 가격도 같습니다. 또한 텍스트 워터마크에는 사람·조직·채팅을 가리키는 정보가 들어가지 않으며, 특정 사용자를 역추적하는 용도로 쓰이지 않습니다.

텍스트와 파일은 같은 방식으로 표시되지 않는다

파일은 텍스트와 다르게 처리됩니다. 클로드가 만드는 png, jpg, svg 같은 지원 파일에는 C2PA 콘텐츠 자격 증명이 붙습니다. 이는 파일 메타데이터에 클로드가 만들거나 처리했다는 서명된 메모를 남기는 방식입니다. 카메라나 편집 소프트웨어가 출처를 남길 때 쓰는 표준과 같은 계열입니다.

여기서 텍스트와 파일을 같은 대응으로 다루면 이해가 어긋납니다. 텍스트는 단어 선택 패턴에 흔적이 남고, 파일은 메타데이터에 기록이 남습니다. 이미지를 다시 저장하면 메타데이터는 쉽게 떨어질 수 있지만, 텍스트 지문은 단어를 거의 그대로 둘 때 남을 수 있습니다. Anthropic은 C2PA를 읽는 도구를 직접 내놓겠다고 밝혔지만, 그 도구가 이미 공개됐다는 문장은 없습니다. 지금 시점에서 확인할 수 있는 사실은 파일이 이런 메모를 가질 수 있다는 점입니다.

탐지 API가 의미하는 것과 의미하지 않는 것

탐지 API는 곧 나온다고만 적혀 있습니다. 구현 방법은 아직 확정되지 않았습니다. 따라서 지금 확실한 사실은 워터마크가 켜진다는 점이지, 누구나 바로 검사할 수 있다는 점은 아닙니다. 기존 AI 탐지 서비스와도 성격이 다릅니다. 공식 글은 Pangram 같은 탐지기를 예로 들며, 이런 서비스들은 특정 문장 버릇이나 단어 사용 경향을 본다고 설명합니다.

하지만 워터마크 검사는 비밀 키를 바탕으로 단어 선택 순서를 확인하는 일입니다. 문장 버릇을 보는 방식과는 전혀 다릅니다. 이 둘을 같은 판정으로 묶으면 잘못된 탐지와 근거 없는 확신이 함께 따라옵니다.

비밀 키가 없는 판정을, 키가 있는 판정처럼 쓰지 않는 것이 이번 변화의 핵심입니다.

워터마크는 저자 표시도, 소유권 도장도 아니다

워터마크는 저작권 도장이 아닙니다. 소유권과 법적 책임을 바꾸지 않으며, Anthropic 약관에서 사용자가 갖던 권리도 그대로입니다. 지문이 검출되더라도 그것이 곧 이 글의 저자가 클로드라는 뜻은 아닙니다. 공식 설명은 더 좁습니다. 클로드가 그 내용에 어느 시점엔가 관여했을 가능성을 보여줄 뿐입니다.

따라서 클로드가 처음부터 썼는지, 사람이 쓴 초안을 깊게 고쳤는지, 일부만 손봤는지는 구분하지 못합니다. 이 차이를 무시하면 워터마크 결과를 과장해서 해석하게 됩니다.

워터마크가 검출됐다는 결과는 저자 표시가 아니라 관여 가능성입니다.

어떤 경우에는 약하고, 어떤 경우에는 사라질 수 있다

짧은 글에서는 워터마크가 약합니다. 선택이 일어나는 자리가 적기 때문입니다. 사실상 정답이 하나뿐인 문장도 마찬가지입니다. 예를 들어 사실 문장이나 산수처럼 다음에 올 말이 거의 정해진 자리에는 워터마크를 넣기 어렵습니다. 뜻을 바꾸거나 프로그램을 망가뜨릴 수 있는 자리에도 넣지 않습니다.

교정만 맡긴 경우에는 워터마크가 붙을 자리가 교정된 몇 군데뿐일 수 있습니다. 코드는 더 극단적입니다. 실행 코드 자체에는 거의 남지 않고, 주석처럼 선택의 여지가 있는 부분에만 남을 수 있습니다. 그래서 코드 제출의 출처 증명을 워터마크에 기대는 것은 공식 설명이 경계한 해석과 가깝습니다.

또한 워터마크는 지워질 수도 있습니다. 가벼운 수정만으로는 완전히 사라지지 않을 수 있지만, 단어를 전면적으로 바꾸는 다시 쓰기는 지문을 지웁니다. Anthropic도 이 지점에서는 이미 AI가 생성한 글이라고 부르기 어렵다고 적었습니다. 반대로 번역은 다릅니다. 클로드가 번역하면 모든 단어를 클로드가 고르므로 워터마크가 붙습니다. 원문이 사람이 썼더라도 번역문은 지문을 가질 수 있습니다.

한국어로 다시 쓰거나 영어로 돌리는 파이프라인을 쓰는 팀이라면 이 점이 특히 중요합니다. 사람 원고를 지키려면 번역 모델과 검수 단계를 나누는 것이 좋습니다. 그렇지 않으면 사람이 쓴 초안도 번역문 단계에서 클로드 지문을 얻게 됩니다.

모든 클로드 출력이 한꺼번에 같아지는 것은 아니다

2026년 8월 2일 이전에 나온 옛 모델은 전환 기간에 있습니다. 유럽 법이 그 모델들에 유예 기간을 두었고, Anthropic은 앞으로 몇 달에 걸쳐 워터마크를 넣겠다고 했습니다. 따라서 같은 클로드라도 모델과 시점에 따라 지문이 있는 출력과 없는 출력이 섞일 수 있습니다.

이 때문에 클로드니까 워터마크가 있다고 단정할 수는 없습니다. 지문이 보이지 않는 이유는 키가 다르거나, 글이 짧거나, 옛 모델이거나, 사람이 거의 다 쓴 것일 수 있습니다. 이 네 가지를 같은 이유로 묶어 해석하면 안 됩니다. 모델명과 날짜를 함께 남겨야 하는 이유도 여기에 있습니다.

또한 다른 모델사도 같은 실천강령에 서명했습니다. 다만 키가 다르면 다른 모델의 지문은 이 키로 보이지 않습니다. 그래서 워터마크가 없다는 말은 AI가 쓰지 않았다는 뜻이 아니라, 이 키와는 맞지 않는다는 뜻에 더 가깝습니다.

검출되지 않았다는 결과는 사람이 썼다는 증명이 아니라, 이 키와 맞지 않는다는 뜻에 가깝습니다.

가장 먼저 바뀌는 것은 제출문이다

DAKER에서 배포가 제출입니다. 채팅 안에서만 머문 초안은 제출이 아니지만, 바깥으로 나가는 글은 제출입니다. 해커톤 제출문, 데모 소개, 투자자 메일, 블로그처럼 외부로 공개되는 문서는 특히 그렇습니다. 이런 글은 처음부터 클로드에게 초안을 맡기는 경우가 많기 때문에, 앞으로는 표시될 수 있는 텍스트라는 전제를 두고 작업을 나눌 필요가 있습니다.

사실과 숫자는 사람 문서에서 가져오고, 클로드에게는 배열과 윤문을 맡기는 방식이 더 분명해집니다. 다만 윤문도 문장을 통째로 다시 쓰게 하면 지문이 더 뚜렷하게 남을 수 있습니다. 짧은 교정과 다시 쓰기 사이의 기준을 팀마다 정해 두는 것이 좋습니다. 그렇지 않으면 배포된 문장에 지문이 남았을 때 어느 단계에서 생겼는지 설명하기 어려워집니다.

탐지 API가 공개되면 사람 초안, 클로드 초안, 깊게 고친 글 같은 샘플을 넣어 보고 팀 규칙에 반영하면 됩니다. 다만 결과가 같게 나오더라도 그것이 저자를 증명하지는 않습니다. 클로드가 초안을 썼다면 그 사실을 숨기지 않는 편이 낫습니다. 나중에 탐지 API 결과와 설명이 충돌할 수 있기 때문입니다.

공개 평가가 있는 대회라면 더 일찍 기준을 정하는 편이 좋습니다. 사람 초안과 모델 초안을 같은 폴더에 섞지 않고, 파일 이름에 draft-human, draft-claude, draft-final을 남기면 어느 단계에서 관여가 있었는지 설명하기 쉬워집니다. 설명하지 못하면 지문은 곧 다툼의 근거가 됩니다. 다툼의 대상은 모델이 아니라 제출한 사람입니다.

지문은 남습니다. 책임은 여전히 제출한 사람에게 있습니다.

지금 실무에서 가장 조심할 두 가지 착각

실무에서 가장 위험한 착각은 두 가지입니다. 하나는 워터마크가 있으니 출처가 증명된다고 믿는 일이고, 다른 하나는 사람이 고쳤으니 지문이 없을 것이라고 여기는 일입니다. 전자는 소유권을 과장하고, 후자는 관여를 지웁니다. 둘 다 제출 이후에 문제를 만듭니다.

지금 필요한 것은 탐지기를 사는 일이 아니라, 어떤 초안이 사람 손에서 시작됐는지 파일로 남기는 일입니다. 사람 초안을 가진 팀이 가장 자유롭습니다. 처음부터 클로드에게 쓰게 한 글과 사람이 쓰고 교정만 맡긴 글은 지문이 남는 정도가 다를 수 있기 때문입니다. 이 차이를 기록하지 않으면 나중에 설명할 말이 줄어듭니다.

참고 자료

How Claude’s text watermark works — Anthropic, 2026년 8월 14일
Scalable watermarking for identifying large language model outputs — Google DeepMind, Nature, 2024
Code of Practice on Transparency of AI-generated Content — European Commission
C2PA — Coalition for Content Provenance and Authenticity

여러분의 팀에서는 공개 글과 제출문을 사람 초안, 모델 초안, 최종본으로 나눠 관리할 필요가 있다고 보시는지 궁금합니다.