AI가 쓴 글을 내가 다시 타이핑해도 워터마크가 남을까?

복사해서 붙이지 않고 직접 쓰면 없어지는 줄 알았습니다

안녕하세요, 프리버드입니다.

저는 블로그 글을 쓸 때 AI를 꽤 많이 이용합니다.

제가 아이디어를 하나 생각해 내면 ChatGPT와 거창하진 않지만 기획 비스무리한 대화를 나눕니다. 제가 먼저 뼈대를 만들고 ChatGPT가 궁금해하는 걸 묻게 한 후 초안을 작성하고, Claude에게 문장을 다듬어 달라고 하는 식입니다.

그리고 Claude란 녀석, 이건 이렇다 콕 집어서 얘기를 잘합니다. 자기주장이 좀 강하고 구글의 누구처럼 아부를 잘하는 타입은 아니라서 많이 의지하는 편입니다.

그런데 최근 Claude에 텍스트 워터마크가 적용된다는 내용을 보고 갑자기 궁금한 게 생겼습니다.

AI가 수정해 준 문장을 복사해서 붙이지 않고 내가 직접 타이핑하면 어떻게 되는 걸까?

처음에는 아주 단순하게 생각했습니다.

워터마크라고 하니까 문장 어딘가에 눈에 보이지 않는 마크 같은 것이 숨어 있고, 복사해서 붙여넣을 때 그것까지 따라가는 것 아닐까 싶었습니다.

그렇다면 화면에 있는 문장을 보고 제가 워드프레스에 직접 타이핑하면 끝나는 것 아닌가?

역쉬 그렇게 쉬울 거라 생각한 제가 바보였습니다.

Claude의 워터마크는 문장 뒤에 몰래 뭔가 붙이는 방식이 아니었습니다

Anthropic은 2026년 8월 Claude의 텍스트 워터마크 방식을 공개했습니다.

먼저 중요한 건 숨겨진 문자나 별도의 표시를 문장 안에 집어넣는 방식이 아니라는 것입니다.

AI는 문장을 만들면서 다음에 올 단어를 하나씩 선택합니다.

예를 들어 어떤 문장에서 다음 단어로 A를 써도 자연스럽고 B를 써도 자연스럽다면 AI는 그중 하나를 선택해야 합니다.

Claude의 워터마크는 바로 이런 선택에 일정한 패턴을 남기는 방식입니다.

그러니까,

문장 안에 워터마크를 집어넣는 것이 아니라 AI가 어떤 단어를 골랐는지 그 선택의 흐름에 워터마크를 남기는 겁니다.

뭔지는 모르지만, Claude는 Google DeepMind가 공개한 SynthID-Text 계열 기술을 이용한다고 설명하고 있습니다.

사람이 읽었을 때는 일반 문장과 차이를 느낄 수 없지만, 워터마크를 확인할 수 있는 키를 가진 시스템에서는 이 단어들의 선택 패턴을 분석해 Claude가 작성에 관여했을 가능성을 판단할 수 있다는 겁니다.

그러면 다시 처음 질문으로 돌아와서,

그럼 내가 직접 타이핑하면?

처음에는 복사와 붙여넣기가 핵심이라고 생각했습니다.

그런데 워터마크가 특수문자나 파일 속 정보가 아니라 단어의 배열과 선택에 남는 패턴이라면 이야기가 달라집니다.

Claude가 만들어 준 문장이

나는 오늘 날씨가 좋아서 천천히 걸어서 집에 갔다.

라고 가정해 보면, 이 문장을 복사해서 워드프레스에 붙이든, 제가 화면을 보면서

나는 오늘 날씨가 좋아서 천천히 걸어서 집에 갔다.

라고 직접 타이핑하든 완성된 문장은 똑같습니다.

입력 방법만 다를 뿐 단어와 문장의 배열은 그대로입니다.

그러니 직접 타이핑했다고 해서 워터마크가 자동으로 없어지는 것은 아닙니다.

제가 생각했던 ‘복붙 흔적’ 같은 것이 아니었던 겁니다.

한두 문장을 고치면 어떻게 될까?

이러면 얘기가 조금 달라집니다.

Anthropic의 설명에 따르면 가벼운 수정 정도로는 워터마크가 완전히 사라지지 않을 수 있습니다.

반대로 문장을 전부 다시 써서 모든 단어가 바뀌는 수준이라면 워터마크 신호가 약해지거나 사라질 수 있다고 합니다.

그러니까 이런 차이가 생길 수 있습니다.

Claude가

최근 인공지능 기술은 빠르게 발전하면서 우리의 일상에도 깊숙이 들어오고 있습니다.

라고 써준 문장에서

최근 AI 기술은 빠르게 발전하면서 우리의 생활에도 깊숙이 들어오고 있습니다.

정도로 몇 단어만 바꾼 것과, 제가 내용을 이해한 뒤

몇 년 전만 해도 AI는 신기한 기술 정도로 봤는데 요즘은 하루에도 몇 번씩 쓰고 있습니다.

라고 새로 쓰는 것은 완전히 다른 이야기입니다.

첫 번째는 Claude가 결정한 단어 상당수가 그대로 남아 있지만 두 번째는 제가 다시 문장을 만든 것이니까요.

Anthropic도 가벼운 편집에서는 워터마크가 남을 가능성이 있지만, 완전히 다시 작성하면 제거될 수 있다고 밝히고 있습니다.

맞춤법만 고쳐달라고 하면?

이 부분은 저처럼 AI를 편집용으로 이용하는 사람에게 더 중요했습니다.

제가 쓴 글을 Claude에게 넘기면서

“내용과 말투는 건드리지 말고 어순이나 맞춤법하고 띄어쓰기만 고쳐줘.”

이렇게 이야기했을 때, 이 경우 글의 대부분은 원래 제가 선택한 단어입니다.

Claude가 바꾸는 것은 몇몇 어순과 조사나 띄어쓰기, 오탈자 정도일 수 있습니다.

Anthropic도 이런 경우에는 Claude가 실제로 선택한 단어가 너무 적기 때문에 워터마크를 검출할 만큼 충분한 패턴이 생기지 않을 수 있다고 설명합니다.

즉,

Claude를 썼느냐 안 썼느냐만으로 모든 글에 똑같은 수준의 워터마크가 생기는 것은 아니었습니다.

Claude가 얼마나 많은 문장을 직접 만들었느냐가 중요합니다.

번역처럼 거의 모든 단어를 Claude가 새로 선택하는 작업에는 워터마크가 들어갈 가능성이 높지만, 사람이 쓴 글의 맞춤법 몇 군데만 고치는 작업에서는 검출하기 어렵지 않을까요?

워터마크가 발견되면 ‘이 글은 AI가 썼다’는 뜻일까?

이 부분은 Anthropic이 꽤 분명하게 밝히는 부분입니다.

워터마크가 검출되더라도 알 수 있는 것은

“Claude가 이 글 작성 과정에 관여했을 가능성이 있다” 정도입니다.

Claude가 글 전체를 처음부터 썼는지, 사람이 쓴 글을 Claude가 많이 수정했는지, 그것까지 구별할 수는 없습니다.

반대로 워터마크가 검출되지 않았다고 해서 사람이 전부 썼다는 증거가 되는 것도 아닙니다.

짧은 글은 애초에 분석할 단어가 부족해서 검출이 어렵고, 사실 위주의 문장이나 코드처럼 선택할 수 있는 표현이 적은 경우에도 워터마크가 약할 수 있기 때문입니다.

그러니 이것은 흔히 생각하는, 개가 산책을 하다가 간간이 소변을 찔끔하는 것 처럼

AI 작성 = “삑, AI 마킹 발견”

같은 단순한 장치는 아니었습니다.

그런데 왜 갑자기 워터마크를 넣는 걸까?

배경에는 EU AI Act가 있습니다.

EU의 AI Act 투명성 관련 의무가 2026년 8월 2일부터 적용되면서 AI 생성·조작 콘텐츠를 기계가 판독할 수 있는 형태로 표시하고 탐지할 수 있도록 하는 투명성 의무가 본격적으로 적용됐습니다.
“하여튼 유럽넘X 겁나 까다롭고 유별나” 사실 맞는 것일 수도 있습니다.

Anthropic 역시 이에 대응하기 위해 텍스트 워터마크를 적용하고 있습니다.

다만 2026년 8월 2일부터 과거의 모든 Claude 모델에 한꺼번에 적용된 것은 아닙니다.

8월 2일 이후 출시되는 지원 모델에는 처음부터 적용되고, 그 이전에 출시된 모델은 전환 기간을 거쳐 순차적으로 지원하는 방식입니다.

그리고 Anthropic은 이 워터마크를 유럽에서만 적용하는 것이 아니라 지원 모델에서는 전 세계에 적용한다고 설명하고 있습니다.

현재 워터마크를 누구나 사이트에 글을 넣고 바로 검사할 수 있는 것도 아닙니다.

검출 기능은 아직 제한된 대상에게 제공되고 있고, Anthropic은 향후 검출 API의 접근 범위를 확대할 계획이라고 밝히고 있습니다.

프리버드의 발견

처음에는 AI 워터마크라는 말을 듣고 이런 생각을 했습니다.

“그럼 복사하지 말고 내가 직접 치면 되는 거 아냐?”

아주 단순무식이죠. 결국 EU 요구사항에 워터마크 이야기가 나왔고 저는 무식한 상상을 하다 여기까지 오게 되었네요.

그런데 알아보니 워터마크가 붙어 있는 곳은 클립보드도 아니고 워드 파일도 아니고 문장 뒤에 숨어 있는 이상한 문자도 아니었습니다.

AI가 어떤 단어를 선택했느냐, 바로 문장 그 자체였습니다.

그래서 Claude가 쓴 문장을 토씨 하나 바꾸지 않고 제가 손으로 다시 입력한다고 해서 갑자기 제 문장이 되는 것도 아니고 워터마크가 사라지는 것도 아닙니다.

반대로 제가 원래 쓴 글을 AI에게 맞춤법 정도만 확인받았다면 AI를 사용했다는 이유만으로 글 전체가 AI 글로 변하는 것도 아니었습니다.

결국 제가 블로그를 쓰면서 더 중요하게 생각해야 할 것은 워터마크를 없애는 방법이 아닌 것 같습니다.

AI에게 자료를 찾게 하고, 문장을 다듬게 하고, 틀린 부분을 확인하게 할 수는 있습니다.

그런데 최종적으로

내가 무슨 말을 하고 싶은지, 왜 이 이야기를 쓰는지, 실제로 내가 겪은 것은 무엇인지.

이건 여전히 제가 가지고 있어야 합니다.

워터마크를 조사하다가 엉뚱하게도 다시 그 생각으로 돌아왔습니다.

AI를 썼느냐보다 어쩌면 더 중요한 건, AI에게 보편적인 노가다 글을 시키더라도 내 주장과 내 경험을 얼마나 집어넣느냐,

이 글에 내가 있느냐였습니다.

그런데 뭘까요? 내 맘속 쩌기 쩌기 구석에 찌그러진 한 가닥 찔림은…. -_-

댓글 달기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

위로 스크롤