TECH 으로 돌아가기
TECH HACKER NEWS 오늘 6분 읽기 30 READS

워터마크가 아니라 '스파이마크', AI 생성물 표시 기술이 감시 도구가 되는 순간

워터마크가 아니라 '스파이마크', AI 생성물 표시 기술이 감시 도구가 되는 순간
SOURCE IMAGE · HACKER NEWS
워터마크가 아니라 '스파이마크', AI 생성물 표시 기술이 감시 도구가 되는 순간

요즘 AI가 만든 글이나 이미지에 '이건 AI 생성물입니다'라는 표시를 넣자는 이야기가 많죠. EU의 AI 법은 생성물 표시를 의무화하는 방향이고, 구글은 SynthID라는 기술로 제미나이가 만든 이미지와 텍스트에 보이지 않는 표시를 심고 있고, 오픈AI를 비롯한 여러 회사가 C2PA라는 출처 인증 표준에 참여하고 있어요. 다들 이걸 '워터마크'라고 부르는데요. brand.io에 올라온 이 글은 여기에 정면으로 딴지를 걸어요. 지금 논의되는 기술 대부분은 워터마크가 아니라 '스파이마크(spymark)'라고 불러야 맞다는 거예요.

워터마크와 스파이마크, 뭐가 다른데요

워터마크는 원래 지폐나 문서에 넣는 무늬처럼 '이건 진짜야' 또는 '이건 누구 소유야'라고 누구나 볼 수 있게 알리는 표시예요. 핵심은 공개성이에요. 보는 사람이 그 표시의 존재를 알고, 의미를 알고, 확인할 수 있어야 하죠. 반면 스파이마크는 표시를 받는 사람도, 그걸 보는 사람도 모르게 심어지는 식별자예요. '이 콘텐츠는 AI가 만들었다'가 아니라 '이 콘텐츠는 어느 계정이 몇 시에 어떤 기기로 만들었다'까지 담을 수 있는 거죠. 글쓴이의 주장은 간단해요. 같은 기술로 두 가지를 다 할 수 있는데, 어느 쪽이 실제로 구현될지는 기술이 아니라 그걸 쥔 회사와 정부의 의도에 달려 있다는 거예요.

가장 유명한 선례가 컬러 레이저 프린터예요. 1980년대부터 대부분의 컬러 레이저 프린터는 출력물마다 사람 눈에 안 보이는 노란 점 패턴을 찍어 왔어요. 이 점들을 해독하면 프린터의 시리얼 번호와 인쇄 시각이 나와요. 원래는 위조지폐 추적 목적이었다고 하는데, 2017년에 미국 정부 기밀 문서를 언론에 넘긴 내부고발자의 신원을 특정하는 데 이 노란 점이 쓰였다고 알려지면서 널리 회자됐죠. 수십 년 동안 사용자 대부분은 이런 게 있는지조차 몰랐어요. 이게 바로 스파이마크의 전형이에요.

AI 생성물에서는 어떻게 심어지나

텍스트 워터마킹이 뭐냐면, 모델이 다음 단어를 고를 때 확률이 비슷한 후보들 중에서 특정 규칙에 따라 편향되게 고르도록 만드는 거예요. 사람이 읽기엔 전혀 티가 안 나지만, 규칙을 아는 쪽에서 통계적으로 검사하면 '이건 우리 모델이 만든 글'이라고 판별할 수 있죠. 그런데 이 규칙을 계정마다 다르게 주면 어떻게 될까요? 그 순간 '어느 모델이 만들었나'가 아니라 '누가 만들었나'를 추적하는 도구가 돼요. 이미지도 마찬가지예요. 픽셀 값에 아주 미세한 패턴을 넣는 방식은 모델 식별용으로도, 사용자 식별용으로도 쓸 수 있어요. 여기에 눈에 안 보이는 유니코드 문자(폭이 0인 공백 같은 것들)를 텍스트에 섞는 원시적인 방법까지 더하면, 우리가 복사해서 붙여넣는 글 속에 무엇이 들어 있는지 알 길이 없죠.

C2PA 같은 출처 인증 방식은 조금 달라요. 이건 숨기는 게 아니라 콘텐츠에 서명된 메타데이터를 붙여서 '어떤 카메라로 찍혔고, 어떤 도구로 편집됐고, 어떤 AI가 관여했는지'를 공개적으로 기록하는 방식이에요. 투명성 면에서는 워터마크에 가깝지만, 여기에 사용자 신원까지 붙이기 시작하면 역시 같은 문제가 생겨요. 결국 기술의 이름이 아니라 '무엇을 기록하고, 누가 읽을 수 있고, 당사자가 알고 있는가'가 워터마크와 스파이마크를 가르는 기준이에요.

왜 개발자가 신경 써야 하나

한국에서도 AI 생성물 표시 의무화 논의가 진행 중이에요. 그런데 표시 방식이 '공개된 워터마크'인지 '숨겨진 식별자'인지에 따라 결과는 완전히 달라져요. 후자라면 익명으로 글을 쓰는 내부고발자, 활동가, 혹은 그냥 프라이버시를 원하는 평범한 사용자까지 추적당할 수 있거든요. 개발자 입장에서는 몇 가지 실천이 가능해요. 첫째, AI API 출력물을 서비스에 넣을 때 폭 0 문자 같은 비가시 문자를 걸러내는 처리를 습관처럼 넣으세요. 둘째, 이미지 업로드를 받는 서비스라면 메타데이터를 어디까지 보존하고 어디까지 지울지 정책을 명확히 하세요. 셋째, 여러분이 만드는 서비스에 워터마크를 넣게 된다면, 그 표시가 무엇을 담는지 사용자에게 공개하는 걸 기본값으로 삼으세요. 규제가 요구하는 건 'AI가 만들었다'는 사실이지 '누가 만들었다'는 신원이 아니니까요.

마무리

정리하면, 'AI 생성물 표시'라는 착한 이름 뒤에 사용자 추적 기술이 숨어 들어올 수 있고, 그 둘을 가르는 건 기술이 아니라 공개 여부와 의도라는 이야기예요. 여러분은 AI 생성물에 표시를 의무화하는 것에 찬성하시나요? 찬성한다면 어떤 정보까지 담겨도 괜찮다고 생각하세요?


🔗 출처: Hacker News

SOURCE · HACKER NEWS
원문 전체 보기 → https://brand.io/article/spymarks/
SHARE
NEXT · CHOOSE

변화를 읽었다면,
내가 만들 수익 구조를 고릅니다.

정보를 더 모으는 데서 멈추지 않고, 광고·외주·판매·중개·구독 중 내 상황에 맞는 출발점을 정해보세요.

21가지 수익 구조 살펴보기
처리 중...