
Anthropic, Google ‘SynthID-Text’ 기술 사용 공식 확인
단순 교정은 탐지 안 될 수도…번역·대폭 재작성은 워터마크 가능성 높아
워터마크는 'Claude의 관여'일 뿐, 저자 증명 아니다
미국 현지 날짜 8월 15일, 앤트로픽(Anthropic)의 ‘텍스트 워터마크’ 발표를 토대로 TechCrunch는 워터마크가 교정·번역·코드 등에 어떻게 적용되는지를 후속 보도했다. 앤트로픽 발표 이후 TechCrunch가 현지 날짜 8월 15일 후속보도를 통해 이 기술의 작동방식과 편집·교정·코드 작성 과정에서 워터마크가 어떻게 적용되는지 집중적으로 다루었다.
앞서 AI로 작성한 글에 비가시적 ‘텍스트 워터마크’를 도입하겠다고 밝혔던 앤트로픽은 구체적인 방법을 언급하지 않았었다. 이번 후속 보도는 텍스트 워터마크를 둘러싼 추측과 우려 중 일부를 해소했다. 그러나 사람이 직접 쓴 글을 AI로 가볍게 교정을 보았는지, 모든 글을 AI가 썼는지 구분하는 문제에 대해서 명시했지만, 여전히 해결되지 않은 문제점들이 존재한다.
관련기사 : 내가 쓴 글도 AI 글로 오인될 수 있다...텍스트 워터마크 논란
‘숨은 문자’는 없다
앤트로픽은 글에 어떤 것을 추가하는 방식이 아니라는 것을 분명히 밝혔다. 그동안 추측 가능했던 방식었던, 특수 유니코드 문자나 비가시적 공백문자, HTML 코드나 별도의 표시가 문장 뒤에 붙는 방식 등 모두 해당되지 않는다. 앤트로픽은 “텍스트에 어떤 것도 추가되지 않으며 숨겨진 문자도 없다”고 설명했다. 따라서 워터마크 토큰 추가에 따른 사용료 상승도 없다.
그렇다면 아무것도 넣지 않는데 어떻게 텍스트 워터마크를 만든다는 것일까?
발표된 바에 의하면, 비밀은 AI가 단어를 선택하는 과정에 있다. 지난 기사에서 언급했듯, 대규모언어모델(LLM)은 문장을 한꺼번에 완성하는 것이 아니라 앞에 나온 내용을 바탕으로 다음에 올 단어, 정확히 말하면 토큰의 확률을 계산하면서 문장을 하나씩 이어간다. 토큰(token: 단어 또는 말조각)이란 AI가 문장을 처리하는 최소 단위로, 단어 전체일 수도 있고 단어의 일부일 수도 있다.
예를 들어, “전화가 왔는데…”라는 문장을 쓸 때 뒤에 올 표현으로 ‘받지 못했다’, ‘받을 수 없었다’ 등 의미상 비슷한 여러 선택지 중 어느 쪽을 선택하더라도 문장의 의미에 큰 차이가 없는 경우가 있다. 바로 이런 ‘어느 쪽을 골라도 큰 차이가 없는 선택’의 기로에서, 단어 선택 과정에 일정한 규칙을 더해 통계적 흔적을 남긴다. 이런 선택이 글 전체에서 반복되면서 사람의 눈에는 전혀 보이지 않지만, 해당 키를 가진 탐지 시스템이 분석하면 특정한 통계적 규칙을 발견할 수 있게 된다.
다시 말해서, Claude가 문장을 생성하면서 여러 표현 가운데 어떤 단어를 선택했는지가 글 전체에 통계적 패턴으로 누적되고, 이 패턴이 워터마크 역할을 한다. 따라서 일부 단어를 바꾸는 정도로는 흔적이 남을 수 있지만, 문장구조와 표현을 크게 바꾸거나 완전히 다시 쓰면 워터마크가 약해지거나 사라질 수 있다.
앤트로픽은 새로 도입하는 Claude의 텍스트 워터마크가 Google DeepMind가 2024년 국제학술지 Nature에 발표한 ‘SynthID-Text’ 접근법을 기반으로 한다고 밝혔다.
Google 연구진은 이 기술을 Gemini 서비스에 적용해서 약 2천만 건에 가까운 응답을 대상으로 실험했으며, 워터마크 모델과 일반 모델의 사용자 평가를 비교했다. 그 결과 좋아요·싫어요 비율이나 인간과 AI 평가에서 큰 차이가 없었다고 보고했다. Anthropic 자체 실험에서도 워터마크가 글 내용과 창의성, 가독성에 영향을 주는 조짐을 발견하지 못했다고 밝혔다.
다만 앤트로픽이 사용하는 것이 Google의 Gemini 시스템과 완전히 동일한 구현이라고 단정할 수는 없다. 앤트로픽이 밝힌 것은 단지 SynthID-Text ‘접근법의 한 버전’이라는 뜻이고, 기본적인 설계원리는 공개되었지만 Claude에 실제로 적용되는 세부 매개변수나 탐지 기준까지 공개하지는 않은 상태다.

인위적으로 없앨 수 있을까
Claude가 작성한 글을 메모장이나 다른 편집기에 복사한 뒤 다시 붙여 넣는다고 해서 워터마크가 자동으로 제거되지는 않는다. 단어 선택의 비밀 방법으로는 없애야 할 숨은 문자나 HTML 코드는 존재하지 않기 때문이다. 앤트로픽 역시 워터마크가 텍스트 선택 패턴에 포함되기 때문에 복사·붙여넣기를 하거나 일부 편집을 해도 남을 수 있다고 설명했다.
반면, 문장을 대폭 다시 쓰면 사라질 가능성이 커진다. 편집 정도가 클수록 워터마크가 사라질 확률이 커질 수 있다. 이는 텍스트 워터마크의 근본적인 한계로 보인다.
그렇다면 사람이 쓴 글을 Claude를 통해 교정한다면 어떻게 될까? 이는 이번 발표에 민감하게 떠오른 문제점이다. 처음 텍스트 워터마크에 대해 발표했을 때, 사람이 직접 작성한 원고라도 Claude를 통해 교정하거나 번역·요약하면 워터마크가 붙을 수 있다고 해서 논란이 일었다.
이에 대해, 앤트로픽은 사람이 직접 쓴 글을 Claude가 가볍게 교정한 경우에는 일부 수정된 단어에만 워터마크가 적용될 수 있고, 그 신호가 너무 약해서 탐지되지 않을 수 있다고 밝혔다. 다만 Claude가 많은 량을 다시 쓰면 워터마크 탐지 가능성은 높아진다.
예를 들어, 사람이 긴 글을 직접 작성한 뒤 Claude에게 “오탈자와 문장부호만 바로잡아 달라. 다른 문장은 바꾸지 말라.”고 요청했을 때, 수정 정도가 쉼표나 일부 조사 정도에 해당된다면, 워터마크가 너무 적어서 탐지되지 않을 수 있다. 즉, 그 글은 여전히 사람의 글로 인식될 가능성이 크다. 따라서 “Claude에게 오탈자 하나만 고쳐도 글 전체가 AI 워터마크로 표시된다”는 우려는 어느 정도 해소되었다.
반면, “문장을 더 자연스럽게 다듬어 달라”, “논리 구조를 살려 다시 작성해 달라”고 요청해서 Claude가 상당수의 단어와 문장을 새롭게 쓴다면 워터마크가 들어갈 공간도 그만큼 많아진다. 앤트로픽은 “Claude가 더 많이 쓸수록 워터마크가 들어갈 공간도 더 많아진다”고 설명했다.
텍스트 워터마크의 한계
1. 우선 번역의 경우다. 사람이 직접 쓴 한국어 글을 Claude에게 영어로 번역시킬 경우, 글의 생각과 논리, 원문의 저자는 분명 인간이지만, 번역 문장에서 어떤 단어와 문장구조를 선택할지는 Claude가 결정한다. 따라서 Claude가 번역한 글에는 워터마크가 적용된다.
그러나 번역의 경우는 매우 다른 개념으로 접근한다. 한국어 원문을 사람이 직접 썼고 Claude가 번역했는데 번역문에서 Claude 워터마크가 검출됐다고 해서 “이 글의 저자는 AI다.”라고 결론 내릴 수는 없다. 이는 텍스트 워터마크의 한계다.
2. 짧은 글의 경우도 적용이 어렵다. 워터마크는 통계적 패턴을 이용하기 때문에 충분한 양의 텍스트가 필요하다. 앤트로픽은 짧은 텍스트의 경우 선택할 수 있는 단어 자체가 적기 때문에 탐지에 필요한 정보가 충분하지 않다고 했다. 따라서 워터마크가 검출되지 않았다는 이유만으로는 사람이 직접 작성한 글이라고 단정할 수도 없다. 이 역시 텍스트 워터마크의 한계다.
앤트로픽은 아직 탐지를 위해 몇 자 이상이거나 몇 토큰 이상이 있어야 한다는 기준을 공개하지 않았다.
3. 사실을 전달하는 글에서도 워터마크가 적을 수 있다. 워터마크는 AI에게 단어 선택의 여지가 있을 때만 작동한다. 그러나 사실관계가 정확해야 하는 문장에서는 대체 단어를 선택할 여지가 없는 경우가 많다.
이에 대해 앤트로픽은 아이작 뉴턴의 저서를 예로 들었다. “뉴턴의 가장 유명한 저서는 Principia…”라는 문장이 있다면 뒤에는 정확한 명칭이 와야 한다. 사실관계를 유지하기 위해 특정 표현이 사실상 정해져 있을 때는 워터마크를 위한 단어 선택의 여지가 없다. 따라서 문장구성과 단어 선택에 있어서 여지가 있는 에세이나 설명문에 비해 정확한 사실·수치·고유명사가 많이 들어가는 글은 워터마크가 상대적으로 적게 나타날 수 있다.
4. 이 원리는 프로그램 코드에도 적용된다. 프로그램 코드는 정확성이 중요하다. 변수명이나 명령어 하나가 달라지면 코드가 작동하지 않을 수도 있기 때문이다. 다만 프로그램의 설명 주석처럼 표현 선택의 여지가 있는 부분에는 워터마크 신호가 들어갈 수 있다.
따라서 워터마크 탐지 결과를 곧바로 ‘AI 글 확정’이라 하는 것은 위험하다. 앤트로픽 역시 워터마크가 저작권이나 저자성, 법적 책임을 결정하지 않는다고 명시했다.
기존 ‘AI 탐지기’와도 다르다
기존 AI 판독기는 글의 규칙성 정도와 같은 표현의 반복, 문장구조와 단어 선택이 일반적인 AI 문체와 얼마나 비슷한지 분석한다. 이 방법은 사람이 작성한 글도 AI 글로 잘못 판단하는 오탐 확률이 커서 문제가 되어 왔다.
그러나 Claude 텍스트 워터마크는 텍스트를 생성할 당시 의도적으로 만들어 놓은 통계적 패턴과 해당 워터마크 키가 일치하는지를 검사한다. 앤트로픽은 기존 AI 판독기가 글에서 AI 특유의 표현이나 문체상의 ‘흔적’을 찾는 것과 워터마크를 검사하는 것은 근본적으로 다른 방식이라고 설명한다.
따라서 특정 AI가 실제로 남긴 표시를 찾는다는 점에서는 기존 스타일 기반 탐지기보다 훨씬 직접적인 접근이다. 그러나 직접적인 탐지와 저자 판정은 같은 문제가 아니다. Claude의 흔적을 정확하게 찾아냈다고 하더라도 그것이 Claude가 글의 사상과 주장, 논리와 내용을 만든 저자라는 뜻은 아니기 때문이다.
사용자나 회사까지 추적하는 장치 아니다
텍스트 워터마크가 일종의 사용자 추적장치가 아니냐는 우려도 제기되었다. Anthropic은 이번 발표에서 워터마크에는 개인 사용자, 회사나 조직, 혹은 Claude와 나눈 대화를 확인할 수 있는 정보가 들어 있지 않다고 밝혔다. 워터마크 키를 가지고 있더라도 특정 글이 어느 계정에서 생성되었는지, 어느 회사 직원이 작성했는지를 역추적할 수는 없다는 뜻이다.
따라서 Claude의 텍스트 워터마크는 개인 식별용 추적코드는 아니며, 오로지 특정 생성규칙에 따라 만들어진 문장인지 통계적으로 확인하는 장치라고 보아야 한다.
탐지 API 공개 논란
현재 일반 이용자가 글을 넣어 공식 워터마크 여부를 즉시 검사할 수 있는 공개 서비스는 아직 제공되지 않았지만, 앤트로픽은 워터마크 탐지 API를 곧 제공할 예정이라고 밝혔다. 향후 이 API가 학교나 출판사, 언론사, 기업 등의 시스템에 적용된다면 Claude가 작성하거나 상당 부분 수정한 문서를 자동으로 확인하려는 시도가 나타날 가능성이 있다.
이는 또다른 문제를 불러 올 수 있다. 탐지 시스템이 기술적으로 “Claude가 이 문서에 관여했을 가능성이 있다”고 판단한 것을 조직이나 사회가 “이 문서는 Claude가 작성했다”로 받아들인다면 사실과 다른 판단이 된다. 이는 예상보다 큰 혼란을 가져올 수 있다.
EU AI법으로 인한 변화…Claude는 시작일 뿐
EU AI Act의 투명성 규정이 이번 텍스트 워터마크를 도입의 직접적인 배경이다. 앤트로픽은 지난 2026년 7월 주요 AI 기업들과 함께 AI 생성 콘텐츠 투명성 실천규범에 서명했다. 이후 EU AI Act의 투명성 의무에 따라 AI 콘텐츠에 워터마크를 도입한다고 밝혔다. EU 규제가 도입의 계기가 됐지만, Claude 모델의 텍스트에는 전 세계적으로 동일하게 적용된다.
앤트로픽은 2026년 8월 2일 이후 출시되는 지원 모델에는 적용하고, 그 이전에 출시된 기존 모델에는 향후 몇 달에 걸쳐 순차적으로 워터마킹 기능을 추가할 계획이다. 또한 앤트로픽은 Claude만 이런 조치를 취하는 것이 아니라 EU 규정에 따라 다른 주요 AI 사업자들도 생성 콘텐츠 표시 체계를 도입하게 될 것이라고 덧붙였다.
관련기사 : 내가 쓴 글도 AI 글로 오인될 수 있다...텍스트 워터마크 논란
/ AI 전문 기자·칼럼니스트 최은경
노바토포스 ‘AI 뉴스’ 코너는 자료 조사·정리 과정에서 디지털 자료 검색과 생성형 AI 사용을 병행합니다.
모든 기사는 노바토포스 기자 및 편집자가 출처와 사실관계를 확인하고, 필요한 수정과 편집을 거쳐 최종 게재합니다.
미국 현지 날짜 8월 15일, 앤트로픽(Anthropic)의 ‘텍스트 워터마크’ 발표를 토대로 TechCrunch는 워터마크가 교정·번역·코드 등에 어떻게 적용되는지를 후속 보도했다. 앤트로픽 발표 이후 TechCrunch가 현지 날짜 8월 15일 후속보도를 통해 이 기술의 작동방식과 편집·교정·코드 작성 과정에서 워터마크가 어떻게 적용되는지 집중적으로 다루었다.
앞서 AI로 작성한 글에 비가시적 ‘텍스트 워터마크’를 도입하겠다고 밝혔던 앤트로픽은 구체적인 방법을 언급하지 않았었다. 이번 후속 보도는 텍스트 워터마크를 둘러싼 추측과 우려 중 일부를 해소했다. 그러나 사람이 직접 쓴 글을 AI로 가볍게 교정을 보았는지, 모든 글을 AI가 썼는지 구분하는 문제에 대해서 명시했지만, 여전히 해결되지 않은 문제점들이 존재한다.
관련기사 : 내가 쓴 글도 AI 글로 오인될 수 있다...텍스트 워터마크 논란
‘숨은 문자’는 없다
앤트로픽은 글에 어떤 것을 추가하는 방식이 아니라는 것을 분명히 밝혔다. 그동안 추측 가능했던 방식었던, 특수 유니코드 문자나 비가시적 공백문자, HTML 코드나 별도의 표시가 문장 뒤에 붙는 방식 등 모두 해당되지 않는다. 앤트로픽은 “텍스트에 어떤 것도 추가되지 않으며 숨겨진 문자도 없다”고 설명했다. 따라서 워터마크 토큰 추가에 따른 사용료 상승도 없다.
그렇다면 아무것도 넣지 않는데 어떻게 텍스트 워터마크를 만든다는 것일까?
발표된 바에 의하면, 비밀은 AI가 단어를 선택하는 과정에 있다. 지난 기사에서 언급했듯, 대규모언어모델(LLM)은 문장을 한꺼번에 완성하는 것이 아니라 앞에 나온 내용을 바탕으로 다음에 올 단어, 정확히 말하면 토큰의 확률을 계산하면서 문장을 하나씩 이어간다. 토큰(token: 단어 또는 말조각)이란 AI가 문장을 처리하는 최소 단위로, 단어 전체일 수도 있고 단어의 일부일 수도 있다.
예를 들어, “전화가 왔는데…”라는 문장을 쓸 때 뒤에 올 표현으로 ‘받지 못했다’, ‘받을 수 없었다’ 등 의미상 비슷한 여러 선택지 중 어느 쪽을 선택하더라도 문장의 의미에 큰 차이가 없는 경우가 있다. 바로 이런 ‘어느 쪽을 골라도 큰 차이가 없는 선택’의 기로에서, 단어 선택 과정에 일정한 규칙을 더해 통계적 흔적을 남긴다. 이런 선택이 글 전체에서 반복되면서 사람의 눈에는 전혀 보이지 않지만, 해당 키를 가진 탐지 시스템이 분석하면 특정한 통계적 규칙을 발견할 수 있게 된다.
다시 말해서, Claude가 문장을 생성하면서 여러 표현 가운데 어떤 단어를 선택했는지가 글 전체에 통계적 패턴으로 누적되고, 이 패턴이 워터마크 역할을 한다. 따라서 일부 단어를 바꾸는 정도로는 흔적이 남을 수 있지만, 문장구조와 표현을 크게 바꾸거나 완전히 다시 쓰면 워터마크가 약해지거나 사라질 수 있다.
앤트로픽은 새로 도입하는 Claude의 텍스트 워터마크가 Google DeepMind가 2024년 국제학술지 Nature에 발표한 ‘SynthID-Text’ 접근법을 기반으로 한다고 밝혔다.
Google 연구진은 이 기술을 Gemini 서비스에 적용해서 약 2천만 건에 가까운 응답을 대상으로 실험했으며, 워터마크 모델과 일반 모델의 사용자 평가를 비교했다. 그 결과 좋아요·싫어요 비율이나 인간과 AI 평가에서 큰 차이가 없었다고 보고했다. Anthropic 자체 실험에서도 워터마크가 글 내용과 창의성, 가독성에 영향을 주는 조짐을 발견하지 못했다고 밝혔다.
다만 앤트로픽이 사용하는 것이 Google의 Gemini 시스템과 완전히 동일한 구현이라고 단정할 수는 없다. 앤트로픽이 밝힌 것은 단지 SynthID-Text ‘접근법의 한 버전’이라는 뜻이고, 기본적인 설계원리는 공개되었지만 Claude에 실제로 적용되는 세부 매개변수나 탐지 기준까지 공개하지는 않은 상태다.
인위적으로 없앨 수 있을까
Claude가 작성한 글을 메모장이나 다른 편집기에 복사한 뒤 다시 붙여 넣는다고 해서 워터마크가 자동으로 제거되지는 않는다. 단어 선택의 비밀 방법으로는 없애야 할 숨은 문자나 HTML 코드는 존재하지 않기 때문이다. 앤트로픽 역시 워터마크가 텍스트 선택 패턴에 포함되기 때문에 복사·붙여넣기를 하거나 일부 편집을 해도 남을 수 있다고 설명했다.
반면, 문장을 대폭 다시 쓰면 사라질 가능성이 커진다. 편집 정도가 클수록 워터마크가 사라질 확률이 커질 수 있다. 이는 텍스트 워터마크의 근본적인 한계로 보인다.
그렇다면 사람이 쓴 글을 Claude를 통해 교정한다면 어떻게 될까? 이는 이번 발표에 민감하게 떠오른 문제점이다. 처음 텍스트 워터마크에 대해 발표했을 때, 사람이 직접 작성한 원고라도 Claude를 통해 교정하거나 번역·요약하면 워터마크가 붙을 수 있다고 해서 논란이 일었다.
이에 대해, 앤트로픽은 사람이 직접 쓴 글을 Claude가 가볍게 교정한 경우에는 일부 수정된 단어에만 워터마크가 적용될 수 있고, 그 신호가 너무 약해서 탐지되지 않을 수 있다고 밝혔다. 다만 Claude가 많은 량을 다시 쓰면 워터마크 탐지 가능성은 높아진다.
예를 들어, 사람이 긴 글을 직접 작성한 뒤 Claude에게 “오탈자와 문장부호만 바로잡아 달라. 다른 문장은 바꾸지 말라.”고 요청했을 때, 수정 정도가 쉼표나 일부 조사 정도에 해당된다면, 워터마크가 너무 적어서 탐지되지 않을 수 있다. 즉, 그 글은 여전히 사람의 글로 인식될 가능성이 크다. 따라서 “Claude에게 오탈자 하나만 고쳐도 글 전체가 AI 워터마크로 표시된다”는 우려는 어느 정도 해소되었다.
반면, “문장을 더 자연스럽게 다듬어 달라”, “논리 구조를 살려 다시 작성해 달라”고 요청해서 Claude가 상당수의 단어와 문장을 새롭게 쓴다면 워터마크가 들어갈 공간도 그만큼 많아진다. 앤트로픽은 “Claude가 더 많이 쓸수록 워터마크가 들어갈 공간도 더 많아진다”고 설명했다.
텍스트 워터마크의 한계
1. 우선 번역의 경우다. 사람이 직접 쓴 한국어 글을 Claude에게 영어로 번역시킬 경우, 글의 생각과 논리, 원문의 저자는 분명 인간이지만, 번역 문장에서 어떤 단어와 문장구조를 선택할지는 Claude가 결정한다. 따라서 Claude가 번역한 글에는 워터마크가 적용된다.
그러나 번역의 경우는 매우 다른 개념으로 접근한다. 한국어 원문을 사람이 직접 썼고 Claude가 번역했는데 번역문에서 Claude 워터마크가 검출됐다고 해서 “이 글의 저자는 AI다.”라고 결론 내릴 수는 없다. 이는 텍스트 워터마크의 한계다.
2. 짧은 글의 경우도 적용이 어렵다. 워터마크는 통계적 패턴을 이용하기 때문에 충분한 양의 텍스트가 필요하다. 앤트로픽은 짧은 텍스트의 경우 선택할 수 있는 단어 자체가 적기 때문에 탐지에 필요한 정보가 충분하지 않다고 했다. 따라서 워터마크가 검출되지 않았다는 이유만으로는 사람이 직접 작성한 글이라고 단정할 수도 없다. 이 역시 텍스트 워터마크의 한계다.
앤트로픽은 아직 탐지를 위해 몇 자 이상이거나 몇 토큰 이상이 있어야 한다는 기준을 공개하지 않았다.
3. 사실을 전달하는 글에서도 워터마크가 적을 수 있다. 워터마크는 AI에게 단어 선택의 여지가 있을 때만 작동한다. 그러나 사실관계가 정확해야 하는 문장에서는 대체 단어를 선택할 여지가 없는 경우가 많다.
이에 대해 앤트로픽은 아이작 뉴턴의 저서를 예로 들었다. “뉴턴의 가장 유명한 저서는 Principia…”라는 문장이 있다면 뒤에는 정확한 명칭이 와야 한다. 사실관계를 유지하기 위해 특정 표현이 사실상 정해져 있을 때는 워터마크를 위한 단어 선택의 여지가 없다. 따라서 문장구성과 단어 선택에 있어서 여지가 있는 에세이나 설명문에 비해 정확한 사실·수치·고유명사가 많이 들어가는 글은 워터마크가 상대적으로 적게 나타날 수 있다.
4. 이 원리는 프로그램 코드에도 적용된다. 프로그램 코드는 정확성이 중요하다. 변수명이나 명령어 하나가 달라지면 코드가 작동하지 않을 수도 있기 때문이다. 다만 프로그램의 설명 주석처럼 표현 선택의 여지가 있는 부분에는 워터마크 신호가 들어갈 수 있다.
따라서 워터마크 탐지 결과를 곧바로 ‘AI 글 확정’이라 하는 것은 위험하다. 앤트로픽 역시 워터마크가 저작권이나 저자성, 법적 책임을 결정하지 않는다고 명시했다.
기존 ‘AI 탐지기’와도 다르다
기존 AI 판독기는 글의 규칙성 정도와 같은 표현의 반복, 문장구조와 단어 선택이 일반적인 AI 문체와 얼마나 비슷한지 분석한다. 이 방법은 사람이 작성한 글도 AI 글로 잘못 판단하는 오탐 확률이 커서 문제가 되어 왔다.
그러나 Claude 텍스트 워터마크는 텍스트를 생성할 당시 의도적으로 만들어 놓은 통계적 패턴과 해당 워터마크 키가 일치하는지를 검사한다. 앤트로픽은 기존 AI 판독기가 글에서 AI 특유의 표현이나 문체상의 ‘흔적’을 찾는 것과 워터마크를 검사하는 것은 근본적으로 다른 방식이라고 설명한다.
따라서 특정 AI가 실제로 남긴 표시를 찾는다는 점에서는 기존 스타일 기반 탐지기보다 훨씬 직접적인 접근이다. 그러나 직접적인 탐지와 저자 판정은 같은 문제가 아니다. Claude의 흔적을 정확하게 찾아냈다고 하더라도 그것이 Claude가 글의 사상과 주장, 논리와 내용을 만든 저자라는 뜻은 아니기 때문이다.
사용자나 회사까지 추적하는 장치 아니다
텍스트 워터마크가 일종의 사용자 추적장치가 아니냐는 우려도 제기되었다. Anthropic은 이번 발표에서 워터마크에는 개인 사용자, 회사나 조직, 혹은 Claude와 나눈 대화를 확인할 수 있는 정보가 들어 있지 않다고 밝혔다. 워터마크 키를 가지고 있더라도 특정 글이 어느 계정에서 생성되었는지, 어느 회사 직원이 작성했는지를 역추적할 수는 없다는 뜻이다.
따라서 Claude의 텍스트 워터마크는 개인 식별용 추적코드는 아니며, 오로지 특정 생성규칙에 따라 만들어진 문장인지 통계적으로 확인하는 장치라고 보아야 한다.
탐지 API 공개 논란
현재 일반 이용자가 글을 넣어 공식 워터마크 여부를 즉시 검사할 수 있는 공개 서비스는 아직 제공되지 않았지만, 앤트로픽은 워터마크 탐지 API를 곧 제공할 예정이라고 밝혔다. 향후 이 API가 학교나 출판사, 언론사, 기업 등의 시스템에 적용된다면 Claude가 작성하거나 상당 부분 수정한 문서를 자동으로 확인하려는 시도가 나타날 가능성이 있다.
이는 또다른 문제를 불러 올 수 있다. 탐지 시스템이 기술적으로 “Claude가 이 문서에 관여했을 가능성이 있다”고 판단한 것을 조직이나 사회가 “이 문서는 Claude가 작성했다”로 받아들인다면 사실과 다른 판단이 된다. 이는 예상보다 큰 혼란을 가져올 수 있다.
EU AI법으로 인한 변화…Claude는 시작일 뿐
EU AI Act의 투명성 규정이 이번 텍스트 워터마크를 도입의 직접적인 배경이다. 앤트로픽은 지난 2026년 7월 주요 AI 기업들과 함께 AI 생성 콘텐츠 투명성 실천규범에 서명했다. 이후 EU AI Act의 투명성 의무에 따라 AI 콘텐츠에 워터마크를 도입한다고 밝혔다. EU 규제가 도입의 계기가 됐지만, Claude 모델의 텍스트에는 전 세계적으로 동일하게 적용된다.
앤트로픽은 2026년 8월 2일 이후 출시되는 지원 모델에는 적용하고, 그 이전에 출시된 기존 모델에는 향후 몇 달에 걸쳐 순차적으로 워터마킹 기능을 추가할 계획이다. 또한 앤트로픽은 Claude만 이런 조치를 취하는 것이 아니라 EU 규정에 따라 다른 주요 AI 사업자들도 생성 콘텐츠 표시 체계를 도입하게 될 것이라고 덧붙였다.
관련기사 : 내가 쓴 글도 AI 글로 오인될 수 있다...텍스트 워터마크 논란
/ AI 전문 기자·칼럼니스트 최은경
노바토포스 ‘AI 뉴스’ 코너는 자료 조사·정리 과정에서 디지털 자료 검색과 생성형 AI 사용을 병행합니다.
모든 기사는 노바토포스 기자 및 편집자가 출처와 사실관계를 확인하고, 필요한 수정과 편집을 거쳐 최종 게재합니다.