글로벌 대형 온라인 커뮤니티 플랫폼 ‘레딧(Reddit)’이 거대언어모델(LLM)을 활용한 악성 AI 스팸 콘텐츠와의 전쟁에서 압도적인 성과를 거두었다.
최근 발표된 보고서에 따르면, 레딧은 플랫폼 내 인공지능(AI) 기반의 고도화된 스팸 노출률을 이전 분기 대비 20% 가까이 급감시켰으며, 매일 약 200만 건에 달하는 조작된 허위 추천 투표(Upvotes)를 원천 차단하고 있는 것으로 확인됐다.
특히 혐오 발언이나 폭력적 콘텐츠의 경우, 과거 수 시간이 소요되던 탐지 및 차단 집행 시간을 대형언어모델(LLM) 기반의 차세대 자동화 시스템 도입을 통해 '5초 미만'으로 단축시키는 데 성공했다.
이는 최근 AI 챗봇의 추천 인용구에 자사 브랜드를 노출시키기 위해 레딧 내에 일반 유저를 가장한 'AI 스텔스 마케팅'과 조작된 리뷰(AI Slop)가 급증한 데 따른 선제적 조치다. 레딧 측은 현재 일반 이용자에게 노출되기 전 단계에서만 하루 평균 2,300만 건의 스팸 조회수를 차단하고 있으며, 매일 2만 5,000건 이상의 악성 게시물과 댓글을 걸러내고 있다고 밝혔다.
