AI 텍스트 워터마크 뜻, 숨은 글자 없이 단어 선택에 남는 표시

AI 텍스트 워터마크 뜻, 숨은 글자 없이 단어 선택에 남는 표시

클로드나 챗지피티(ChatGPT)가 써준 글을 옮겨 쓰다 보면 그 글에 눈에 안 보이는 표시가 남는다는 이야기를 듣게 돼요.

AI 텍스트 워터마크는 AI가 글을 쓰면서 단어를 고르는 방식에 남기는 보이지 않는 표시예요.

그 표시는 같은 비밀 키를 쓰는 탐지기로만 확인할 수 있어요.

클로드에는 8월부터 차례로 들어가고 있고 챗지피티도 10월에 유럽연합(EU) 사용자에게 넣겠다는 계획을 내놨어요.


비밀 키가 다음 말 고르기를 살짝 기울여요

AI는 글을 한 번에 쓰지 않고 다음에 올 말을 하나씩 골라 이어 붙여요.

앤트로픽이 설명 글에서 든 예와 비슷하게 우리말로 들면 “오늘 날씨는 춥고” 다음에는 ‘흐렸어요’가 오든 ‘잿빛이었어요’가 오든 뜻이 거의 같아요.

이런 자리에서는 원래 여러 후보 가운데 하나를 확률에 따라 골라요.

워터마크를 켜면 비밀 키와 바로 앞의 몇 단어를 바탕으로 일부 후보가 조금 더 선택되도록 조정해요.

한 번의 선택만 봐서는 차이가 거의 없지만 이런 선택이 글 전체에 충분히 쌓이면 키를 가진 쪽은 그 패턴을 찾아낼 수 있어요.

"오늘 날씨는 춥고" 다음에 올 후보 흐렸어요와 잿빛이었어요 중 하나를 보통은 확률에 따라 고르고 워터마크를 켜면 비밀 키와 앞 단어로 고르는 과정을 나란히 비교한 개념도
AI 텍스트 워터마크 작동 방식 개념도 (출처: 앤트로픽 설명 글의 예를 바탕으로 직접 그린 그림)

그래서 글에 숨은 문자나 보이지 않는 공백이 따로 들어가지 않아요.

누가 어떤 대화에서 받은 글인지 같은 사용자 정보도 표시에 담기지 않는다고 앤트로픽과 OpenAI 모두 밝혔어요.


보이는 워터마크나 AI 탐지기와는 다른 표시예요

이름이 비슷하거나 함께 언급되는 것들과 나란히 놓으면 차이가 분명해져요.

보이는 워터마크와 C2PA 메타데이터와 AI 텍스트 워터마크와 AI 탐지기를 어디에 남는지와 확인하는 쪽과 약해지는 경우로 비교한 표
AI 텍스트 워터마크와 헷갈리기 쉬운 것들 비교

사진이나 그림은 제미나이처럼 보이는 워터마크를 꺼도 SynthID 표시가 남게 여러 표시를 겹쳐 쓰기도 해요.

AI 탐지기는 미리 심어 둔 표시 없이 다 쓴 글의 말투 같은 특징을 보고 판정하는데 Epoch AI 평가에서 문체를 흉내 낸 글에는 흔들리기도 했어요.

반면 워터마크는 심어 둔 표시가 있는지를 키로 직접 확인하는 방식이라 다른 회사 AI가 쓴 글은 가려내지 못해요.

이 방식 자체는 갑자기 나온 게 아니에요.

  • 2022년: 당시 OpenAI 객원 연구원이던 스콧 아론슨이 이 방식의 바탕이 된 아이디어를 제안했어요.
  • 2024년 10월: 구글 딥마인드가 SynthID-Text 논문을 공개하고 오픈소스로 풀었어요.
  • 2026년 8월: EU AI법이 생성형 AI 제공자에게 기계가 읽을 수 있는 표시를 요구하기 시작했고 앤트로픽이 클로드에 넣기 시작했어요.
  • 2026년 10월: OpenAI가 자체 방식인 textGrain과 EU 사용자 대상 도입 계획을 발표했어요.

내 글에 남는지는 쓰는 방식에 따라 달라요

워터마크는 골라야 하는 자리가 많을수록 또렷해지는 방식이라 그런 자리가 적은 글에서는 약해져요.

앤트로픽·OpenAI·구글의 도움말과 설명 글을 바탕으로 상황별로 정리하면 이래요.

클로드 글을 그대로 옮길 때와 맞춤법만 맡길 때와 번역을 맡길 때와 직접 많이 고칠 때와 다른 언어로 옮길 때와 짧은 답이나 코드일 때와 한국에서 챗지피티로 쓸 때와 제미나이로 쓸 때 표시가 남는지와 그 이유를 정리한 표
상황별로 정리한 AI 텍스트 워터마크가 남는지 여부

클로드도 모든 모델에 들어간 건 아니라서 8월 2일 이후 나온 모델에는 처음부터 들어갔고 그 전 모델은 차례로 추가되는 중이에요.

고쳐 쓴 정도에 따른 변화는 OpenAI가 자체 평가 수치로 공개했어요.

400토큰 분량의 영어 글에서 단어의 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로 내려갔고 25%를 바꾸자 17%까지 떨어졌어요.

400토큰 영어 글에서 단어를 바꾸지 않았을 때 약 92%, 10%를 동의어로 바꿨을 때 66%, 25%를 바꿨을 때 17%로 떨어진 OpenAI 텍스트 워터마크 탐지율 막대그래프
단어를 동의어로 바꾼 비율에 따른 OpenAI 텍스트 워터마크 탐지율

글이 짧아도 약해져서 심리학 같은 주제의 200토큰 글은 약 80%가 잡혀 400토큰 글(약 95%)보다 낮았어요(표시가 없는 글을 있다고 잘못 판정하는 비율 1% 기준).

언어별로도 달라서 OpenAI 도움말의 EU 공식 언어 24개 평가에서는 스페인어 69.0%부터 루마니아어 42.2%까지 차이가 났고 한국어는 평가 대상에 없었어요.

앤트로픽은 클로드의 이런 수치를 아직 공개하지 않았고 가볍게 고친 정도로는 아마 완전히 사라지지 않고 모든 단어를 바꿔 다시 쓰면 사라진다고만 설명했어요.

모두 각 회사가 직접 밝힌 내용이라 독립된 검증 결과는 아니에요.

표시를 찾아낸다고 해도 알 수 있는 건 생각보다 적어요.

표시가 잡혀도 AI가 글에 관여했을 가능성만 알 수 있고 사람이 얼마나 고쳤는지는 알 수 없어요.

반대로 표시가 안 잡혔다고 해서 사람이 쓴 글이라는 증거가 되지도 않는다고 두 회사 모두 밝혔어요.

같이 알아두면 좋은 용어는 이 글들에서 다뤘어요.


AI가 다듬어 준 글과 AI가 쓴 글은 어디부터 다르다고 보세요?

댓글 달기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

위로 스크롤