• 로그인
  • 장바구니에 상품이 없습니다.

클로드 글에 박힌 워터마크는 어떻게 넣은 것일까



AI가 생성한건 AI생성물이라고 꼭 표시를 하라는 EU의 AI법이 생겼습니다.

안그러면 매출의 3퍼를 과징금으로 내야합니다.

구글은 이미 SynthID를 가동중인데 여러분이 생성한 이미지, 글에 워터마크를 박고 있습니다.

Gemini는 아무도 안쓰니까 이래도 아무도 신경을 안썼는데 

근데 최근에 앤트로픽에서도 클로드가 생성한 글에 추노마크를 새기겠다고 발표하니까 난리가 났습니다.

클로드 성능이 떨어지는거 아닌건지 

제거는 할 수 있는건지 의견이 분분한데

일단 어떻게 동작하는건지부터 알아보도록 합시다.





LLM이 뭐냐면


귀에 피가 나도록 들었을텐데

LLM은 그냥 다음 단어가 뭐가 나올지 확률적으로 예측하는 모델입니다.



예를 들어 Teachers work at ____ 이런 문장을 입력하면 

LLM은 다음에 나올 단어가 뭘지 단어마다 각각 확률을 계산해주고

그 다음에 확률에 따라서 다음 단어를 뽑아줍니다.

다음 단어 뽑기를 계속 반복하면 그게 LLM인 것임



그럼 여기서 단어를 뽑을 때 추노마크가 들어있는 단어들을 미리정해놓고

이걸 강제로 뽑게 만들면 워터마크를 넣을 수 있습니다.

그걸 구현하기 위한 여러가지 알고리즘을 소개하는 논문들이 있습니다.




가장 쉬운건 red/green 이라고 해서 전체 단어들을 반으로 쪼개서 워터마크용 단어라고 표시해두고

워터마크용 단어들을 살짝 더 선택하게 만드는 것입니다.

그럼 나중에 글을 읽어보고 워터마크용 단어 비율을 따져보면 끝나는 것임




아니면 랜덤시드주작 알고리즘도 있습니다.

 LLM이 확률에 따라서 다음 단어를 뽑는다고 했는데

확률을 구현하려면 일단 컴퓨터에서 랜덤 숫자를 하나 출력해야하구요


근데 컴퓨터에서 랜덤 숫자를 뽑을 때는 항상 시작 숫자가 하나 필요합니다.

왜냐면 숫자를 먼저 인간이 넣어 줘야 거기다가 뭔가 더하고 곱하고 나눠서 랜덤한 숫자를 뽑을 수 있을거아니에요.

시작 숫자를 seed라고 부릅니다.

그걸 앤트로픽 의도대로 주작을 하는 것입니다.




시드 <= 앤트로픽이 정하는 암호키 + 이전에 나온 단어들의 숫자치환값

이런 식으로 시드를 주작해서 랜덤숫자를 뽑아서 다음 단어를 뽑게 하는 것입니다.

시드를 알면 무슨 랜덤숫자가 나올지도 보통 예측할 수 있기 때문에 

무슨 문자가 올지 앤트로픽이 항상 예측할 수가 있습니다.

그럼 이제 문장들을 봤을 때 앤트로픽은 "우리 시드를 이용했군" 이걸 판단할 수 있으며

이게 곧 클로드의 추노마크입니다.




참고로 Gemini는 이미 비슷한 알고리즘으로 SynthID를 만들어서 적용중인데

문자를 뽑을 때 샘플링함수를 새로 만들어서 랜덤성을 조금 더해서 뽑고 있습니다.

근데 SynthID를 넣어도 사람들의 만족도 수치는 딱히 변화가 없었다고 합니다.





단점


동작원리를 알았는데 그럼 단점이 뭐겠습니까

1. 당연히 확률 모델이니까 인간이 쓴것도 AI가 쓴것처럼 오탐이 될 확률이 매우 적게 있음

2. 짧은 글은 통계적으로 유의미한 결과를 낼 수가 없으니까 워터마크가 의미 없음

3. 정확성이 요구되는 문장은 워터마크가 의미 없음


그니까 예를 들어 2+2= 다음엔 4를 무조건 넣어야하는데 여기에 워터마크 넣어봤자 뭐합니까

항상 정확해야하는 문장은 인간이 쓴 것인지 AI 모델인지 구분이 애초에 어렵습니다.

코딩할 때도 마찬가지로 정확한 답이 정해져있는 경우가 많아가지고 주석이나 그런 곳에만 제한적으로 적용될 것 같습니다.





클로드 워터마크 제거 방법?


그럼 워터마크를 없애는 방법도 있지 않을까요.



요즘 ai가 못하는거 없다니까 이러면 되는거 아닌가 생각할 수 있겠지만

내가 클로드가 아니라면 어떤 단어가 추노마크인지 구분이 안되니까 불가능합니다.




아니면 생성한 글을 영어로 번역한다음에 또 다시 한글로 번역하라고 해도 되는거 아닌가 싶은데

이것도 어쨌든간에 문장을 새로 생성하는 행위니까 없어지진 않을것 같습니다.


https://github.com/guillaumemeyer/watermarks-remover

하지만 깃헙에 워터마크 리무버가 이미 존재하긴 합니다.

파이썬으로 실행하는데 어떤 식이냐면

그냥 단어들을 비슷한 단어로 대체해버리는 식으로 동작합니다. 

그래서 "말의 톤이나 정확도나 그런게 달라질 수 있다" 이런 주의사항이 있습니다.



그래서 아마 나중에 워터마크 검사해주는 클로드 API가 공개되면 역추론을 해보는 사람들이 있을텐데

그때까지는 딱히 워터마크만 깔끔하게 제거해주는 방법은 없을 것 같습니다.






결론


AI로 글써가지고 날먹할 시간이 얼마 안남았습니다.

지속적으로 날먹하려면

중국모델 쓰거나

열등한 로컬모델 가져다가 수정해보거나

아니면 ai썼다고 투명하게 공개하든가 그런 방법밖에 없지 않을까요.

아니면 사람들이 잘 모르는 고전적인 해결책이 있는데 직접 뇌를 쓰는 방법도 있긴 있습니다.





2026년 8월 26일

About

현재 월 700명 신규수강중입니다.

  (09:00~20:00) 빠른 상담은 카톡 플러스친구 코딩애플 (링크)
  admin@codingapple.com
  이용약관, 개인정보처리방침
ⓒ Codingapple, 강의 예제, 영상 복제 금지
top

© Codingapple, All rights reserved. 슈퍼로켓 에듀케이션 / 서울특별시 강동구 고덕로 19길 30 / 사업자등록번호: 212-26-14752 온라인 교육학원업 / 통신판매업신고: 제 2017-서울강동-0002 호 / 개인정보관리자: 박종흠 / 대표자명: 박해윤