보고서를 하나 떠올려 보자. 한국어 초안은 처음부터 끝까지 사람이 썼다. 영어 버전이 필요해서, 번역만 클로드에 맡겼다. 원문은 온전히 사람 손이다. 그런데 나중에 이 영어 번역본이 '이거 AI로 썼네'라는 판정을 받을 수 있다.

사람이 직접 쓴 글이라도 클로드에 번역이나 요약을 맡기면, 그 문장 속에 표식이 남기 때문이다. 앤트로픽(Anthropic)은 2026년 8월 11일, 클로드가 생성하거나 편집한 텍스트에 눈에 보이지 않는 표식을 심겠다고 밝혔다. 이 발표로 앞의 걱정은 더 이상 가정이 아니라 실제 문제가 됐다.

여기서부터가 헷갈린다. '표식이 남았다'는 것과 '클로드가 그 글을 썼다'는 것은 같은 말이 아니다. 표식은 어디서 남고 어디서 안 남는가. 그리고 남았을 때 그게 무엇을 증명하고 무엇을 증명하지 못하는가. 이 경계를 알아야 자기 글이 억울하게 분류되는 일을 피할 수 있다.

눈에 안 보이는 표식이 어떻게 문장에 심기나요

클로드는 구글 딥마인드(Google DeepMind)가 2024년 네이처(Nature) 논문으로 공개한 신스아이디-텍스트(SynthID-Text) 방식을 가져다 쓴다. 원리는 생각보다 단순하다.

클로드의 워터마크는 다음 단어 후보들의 점수가 엇비슷한 ‘아무거나 골라도 되는’ 자리에서 비밀 열쇠로 특정 후보 쪽에 무게를 실어 만들어진다. 수백 단어가 쌓이면 통계로 측정 가능한 패턴이 되며, 이 표식은 클로드가 실제로 고른 단어에만 붙고 사람이 쓴 단어에는 붙지 않는다.
워터마크가 심기는 3단계

언어 모델은 다음 단어를 고를 때마다 수천 개의 후보에 점수를 매긴다. 그런데 그중 여럿은 점수가 엇비슷하다. 어느 걸 골라도 문장이 자연스럽다는 뜻이다. 바로 이 '아무거나 골라도 되는' 자리에서, 비밀 열쇠를 이용해 특정 후보 쪽으로 살짝 무게를 실어 준다.

한두 단어로는 티가 나지 않는다. 하지만 수백 단어가 쌓이면 통계적으로 측정 가능한 패턴이 된다. 그게 바로 워터마크다.

이 패턴은 읽는 사람 눈에는 보이지 않는다. 복사해서 붙여 넣어도 따라오고, 어느 정도 문장을 손봐도 살아남는다. 여기서 딱 하나만 기억하면 된다. 표식은 클로드가 실제로 고른 단어에만 붙는다. 사람이 쓴 단어에는 붙을 자리가 아예 없다. 이 한 줄이 뒤에 나오는 모든 한계의 뿌리다.

워터마크는 클로드가 고른 단어에만 붙는다.

"The watermark only applies to words Claude chooses."

— Anthropic, 〈How Claude's text watermarking works〉, 2026

번역만 시켰는데 왜 AI 워터마크가 남나요

한국어 원문을 사람이 써도 클로드가 영어로 번역하면 문장을 이루는 단어는 사실상 전부 클로드가 고르기 때문에 워터마크가 진하게 남는다. 뜻과 구조는 사람이 정했더라도 단어 선택이 클로드에게 넘어가는 번역·요약일수록 표식이 짙게 실린다.
번역·요약이 표식을 남기는 이유

앞의 보고서 담당자로 돌아가 보자. 한국어 원문을 클로드에 넣고 영어로 번역시켰다. 번역은 사정이 좀 특별하다. 원문의 뜻은 사람이 정했지만, 영어 문장을 이루는 단어는 사실상 전부 클로드가 골라낸다. 그래서 앤트로픽도 못을 박는다 — 클로드가 만든 번역문에는 워터마크가 실린다(a translation produced by Claude carries a watermark, because in this case every word is chosen by Claude).

요약도 마찬가지다. 원문은 사람이 썼더라도, 요약본을 이루는 문장은 대부분 클로드가 새로 짜낸다. 그러니 표식이 남을 여지가 크다. 정리하면, 번역·요약처럼 결과물의 단어 대부분을 클로드가 만든 작업일수록 표식은 진하게 남는다.

앤트로픽은 이 표식을 읽어 내는 검출 API도 곧 내놓겠다고 했다. 다만 2026년 9월 기준으로는 아직 공개 전이다. 그게 나오면 학교 과제나 기업 보고서에 클로드가 만든 문장이 섞였는지를 기계로 확인할 수 있게 된다. 번역본을 통째로 제출한 담당자 입장에서는, 원문을 자기가 다 썼다는 사실과는 상관없이 '클로드 관여' 신호가 뜰 수 있다는 뜻이다.

그럼 사람이 쓴 글은 무조건 걸리나요

가벼운 교정은 바뀐 단어가 적어, 무거운 재작성은 클로드가 고른 단어가 사라져, 사실 나열 문장과 코드는 바꿀 선택지가 드물어, 짧은 글은 표본이 부족해 워터마크가 약하거나 검출되지 않는다. 따라서 ‘표식 없음’이 곧 ‘사람이 씀’을 뜻하지는 않는다.
표식이 약하거나 안 남는 5가지

아니다. 그리고 여기가 이 기술의 진짜 값어치이자 함정이다. 표식은 클로드가 고른 단어에만 붙는다. 그래서 아래 경우에는 잘 잡히지 않거나, 아예 안 잡힌다.

  1. 가벼운 교정 — 오타 몇 개, 조사 몇 개만 클로드가 손봤다면 바뀐 단어가 너무 적다. 앤트로픽도 인정한다. 그 정도 수정으로는 클로드의 관여를 검출할 만큼이 안 될 수 있다(those changes might not be enough to make Claude's involvement detectable)고 말이다.
  2. 무거운 재작성 — 반대 경우다. AI가 쓴 초안을 사람이 문장 단위로 갈아엎으면, 클로드가 골랐던 단어가 사라진다. 그러면 표식도 함께 지워진다.
  3. 사실이 정해진 문장 — "아이작 뉴턴의 대표작은 《프린키피아》다" 같은 문장을 떠올려 보자. 바꿔 쓸 단어 선택지가 거의 없다. 치우치게 만들 자리가 없으니 표식도 약하다.
  4. 짧은 글 — 표식은 단어가 쌓여야 패턴이 된다. 두세 문장짜리 글은 표본이 모자라 판정이 흐릿하다.
  5. 코드 — 코드는 정확해야 한다. 그만큼 '아무거나 골라도 되는' 자리가 드물다. 그래서 표식이 덜 실린다.

그래서 앤트로픽 스스로도 검출의 의미를 좁혀서 말한다.

워크숍에서 번역 초안을 들고 온 담당자에게 "원문은 누가 썼냐"고 물으면, 대부분 "내가 다 썼다"고 답한다. 문제는 그걸 증명할 방법이다. 검출 도구는 '사람 70%, 클로드 30%' 같은 비율을 내주지 않는다. 그냥 '관여함' 아니면 '판정 불가', 둘 중 하나다. 저작권을 주장하려면 사람이 얼마나 기여했는지를 따로 입증해야 하는데, 표식은 그 답을 주지 않는다.

이용자 반발도 여기서 나왔다. 내가 쓴 글인데 클로드에 도움을 받았다는 이유만으로 AI 생성물로 분류돼 불이익을 받는 것 아니냐는 우려다. 아래 영상에는 구독을 취소하겠다는 반발과, 반대로 이건 남을 속이려던 사람이나 반발할 일이라는 시각이 함께 담겨 있다.

유튜브 영상 미리보기

그래서 지금 뭘 준비해야 하나요

검출 도구가 나오기 전에 원문 초안·작성 날짜·수정 이력을 기록으로 남기고, 민감한 문서는 클로드 번역본을 그대로 내지 말고 사람이 다시 손보는 단계를 두며, 검출 결과는 오탐과 미탐 양쪽으로 의심해야 한다. 표식이 정교해질수록 필요한 것은 사람의 기여를 남기고 보여 주는 방법이다.
검출 전에 준비할 3가지

검출 도구가 나오기 전에, 표식이 실릴 만한 문서를 다루는 사람이 미리 해 둘 일이 있다.

  • 원문 기여를 기록으로 남긴다. 한국어 원문 초안, 작성 날짜, 수정 이력을 따로 보관해 두자. 나중에 번역본에서 '클로드 관여' 신호가 떠도, 뜻과 구조를 사람이 정했다는 근거가 손에 있어야 한다.
  • 통째로 맡기는 것과 다시 손보는 것을 구분한다. 민감한 문서라면 클로드 번역본을 그대로 내지 말자. 사람이 문장을 다시 만지는 단계를 한 번 두는 게 좋다. 앞서 봤듯, 무겁게 고칠수록 표식은 옅어진다.
  • 검출 결과를 양쪽으로 의심한다. 사람이 쓴 글을 잘못 잡을 수도 있고, AI가 쓴 글을 놓칠 수도 있다. '표식 없음 = 사람이 씀'도, '표식 있음 = AI가 씀'도 성립하지 않는다.

시점도 알아 두면 좋다. EU의 AI 투명성 의무가 2025년 8월 2일 발효됐다. 앤트로픽은 그 이전에 나온 모델에도 12월 2일까지 워터마크를 넣겠다고 했다. 규제가 강제하는 흐름인 만큼, 다른 회사 모델에도 비슷한 표식이 따라올 가능성이 크다. 실제로 구글은 이미 신스아이디를 자사 AI 콘텐츠에 적용해 왔다.

한눈에 정리

클로드에 맡긴 작업 워터마크가 남는 정도 한계 — 무엇을 못 하나
번역 (원문은 사람) 진하게 남음 원문을 사람이 썼다는 사실은 표식으로 증명 안 됨
요약 남는 편 요약 문장이 짧으면 판정이 흐려짐
가벼운 교정 거의 안 남음 바뀐 단어가 적어 검출 실패가 잦음
무거운 재작성 지워짐 AI 초안이어도 표식이 사라져 놓칠 수 있음
코드 약함 정확해야 하는 코드엔 심을 자리가 드묾
사실 나열 문장 약함 바꿀 단어 선택지가 없어 표식이 안 실림
클로드에 맡긴 작업별로 워터마크가 남는 정도가 다르다. 번역은 진하게, 요약은 남는 편, 가벼운 교정은 거의 안 남고, 무거운 재작성은 지워지며, 코드와 사실 나열 문장은 약하다. 어느 경우든 표식은 사람이 원문을 썼다는 사실이나 기여 비율을 증명하지 못한다.
작업별 워터마크 한눈 정리

표식이 있는지 없는지는 이 표로 어느 정도 가늠할 수 있다. 그런데 검출 도구가 '사람이 몇 %'를 못 내놓는다면, 내가 원문을 다 썼다는 걸 무엇으로 증명하나. 표식을 심는 기술이 정교해질수록, 정작 필요해지는 건 사람의 기여를 남기고 보여 주는 방법이다.

자주 묻는 질문

클로드 무료로 써도 워터마크가 남나요

요금제와 무관하게, 워터마킹을 지원하는 클로드 모델이 생성·편집한 텍스트에는 표식이 실립니다. 무료·유료 차이가 아니라 '클로드가 그 단어를 골랐는가'가 기준입니다.

워터마크를 지우는 방법이 있나요

문장을 사람이 무겁게 재작성하면 표식은 옅어지거나 사라집니다. 다만 표식을 겨냥한 별도 기능이 있어서가 아니라 클로드가 고른 단어 자체가 남지 않아 생기는 결과이며, 남을 속이려는 용도라면 애초에 표식 도입의 취지와 충돌합니다.

AI 워터마크 검출 도구는 지금 쓸 수 있나요

2026년 9월 기준 앤트로픽의 검출 API는 아직 공개 전입니다. "곧 제공하겠다"고만 밝힌 상태라, 지금 시점에 제3자가 클로드 표식을 확인할 공식 수단은 없습니다.

챗GPT(ChatGPT) 같은 다른 AI도 워터마크를 넣나요

EU의 투명성 규제가 발효된 만큼 다른 회사도 도입 압박을 받습니다. 구글은 이미 신스아이디(SynthID)를 적용해 왔고, 앤트로픽도 다른 기업 모델에 표식이 확산될 것으로 봤습니다. 회사·모델마다 방식과 시점은 갈립니다.

출처 · 참고

참고 문헌

이미지 출처