오픈AI가 챗GPT로 생성한 텍스트에 눈에 보이지 않는 식별 신호를 심는 기술을 도입했어요. 이름은 '텍스트그레인(textGrain)'이고, 유럽연합(EU) AI법의 생성형 AI 투명성 의무 규정에 대응하기 위한 조치예요. YTN 보도에 따르면, 이 기술은 앞으로 몇 주 안에 EU 지역 챗GPT와 코덱스 이용자에게 우선 적용될 예정이에요.
텍스트그레인이 작동하는 방식은 조금 특이해요. 글 속에 별도의 기호나 문자를 삽입하는 게 아니에요. AI가 문장을 만들 때 다음 단어나 토큰을 고르는 과정에서 특정한 통계적 패턴이 남도록 미세하게 조정하는 방식이에요. 사람이 읽을 때는 전혀 표시가 보이지 않아요. 별도의 탐지기가 이 패턴을 분석해서 오픈AI 모델이 생성한 글인지 판단하는 거예요.
오픈AI는 워터마크를 적용해도 답변 품질이나 가독성에는 실질적인 차이가 없다고 설명했어요. 다만 한계도 솔직하게 인정했어요. 글이 짧거나, 수학 공식처럼 단어 선택의 폭이 좁은 콘텐츠에서는 탐지 정확도가 떨어져요. 사람이 나중에 내용을 편집하면 워터마크 신호도 약해지고요.
구체적인 실험 결과도 공개됐어요. 400토큰 분량의 글에서 단어 10%를 유의어로 바꾸면 탐지율이 92%에서 66%로 내려가요. 단어의 25%를 바꾸면 탐지율이 17%까지 떨어지고요. 그러니까 워터마크가 없다고 해서 사람이 직접 쓴 글이라고 단정할 수도 없고, 반대로 워터마크가 감지됐다고 해서 누가 썼는지, 얼마나 수정했는지, 내용이 사실인지까지 알 수 있는 건 아니에요.
개발자용 API에는 전 세계 어디서나 워터마크 기능을 선택적으로 켤 수 있도록 하되, 기본 설정은 꺼진 상태로 운영해요. 탐지 도구는 우선 승인된 연구자와 전문 기관에만 제공할 방침이에요.
오픈AI가 이 기술을 도입한 건 처음이 아니에요. 앤트로픽이 먼저예요. 앤트로픽은 지난 8월 자사 AI 모델 클로드에 유사한 AI 생성물 식별 기능을 적용했어요. 당시 일부 이용자들이 유료 구독 취소를 언급하며 반발하자, 앤트로픽은 EU 규제에 따른 의무 사항이며 다른 기업 AI 모델에도 순차적으로 적용될 것이라고 설명했어요. 구글도 제미나이에 '신스ID-텍스트(SynthID-Text)'라는 이름의 텍스트 워터마크 기술을 적용하고 있어요. 주요 AI 기업들이 비슷한 방향으로 움직이고 있는 셈이에요.