구글, AI로 AI 스팸을 잡아낸다
구글이 바르셀로나 딥다이브 행사에서 AI 생성 스팸을 AI로 걸러낸다고 밝혔습니다. SAFE 탐지 시스템 구조와 정상 콘텐츠와의 구분 기준을 정리했습니다.
결론부터 말하면 이렇다. 구글이 2026년 10월 2일부터 3일 사이 스페인 바르셀로나에서 열린 서치 센트럴 라이브 딥다이브 행사에서, AI로 대량 생성된 스팸을 구글도 AI로 잡아내고 있다고 공식적으로 밝혔다. AI 콘텐츠가 늘면서 스팸 업데이트가 더 자주 나오는 배경과, 구글이 쓰는 탐지 방식을 함께 설명한 자리였다.
다만 핵심은 "AI로 썼는지"가 아니다. 구글이 보는 기준은 콘텐츠의 품질과 생산 방식이지, AI 사용 여부 자체가 아니다. 이 구분을 모르면 정상적으로 AI를 보조 도구로 쓰는 사이트까지 괜히 겁먹을 수 있다.
구글이 정확히 뭐라고 밝혔나요?
행사 3일차(10월 2일에서 3일)에 나선 구글 서치 리레이션 팀의 개리 일리예스(Gary Illyes)는 "AI가 콘텐츠 생산량을 늘리기 때문에 스팸 업데이트도 더 자주 나오고, 구글도 AI를 써서 더 많이 잡아낸다"는 취지로 설명했다. 스팸 업데이트가 잦아진 이유를 구글이 직접 인정한 셈이다.
동시에 그는 "특정 글이 AI로 쓰였는지를 판별하는 시스템은 따로 없다"고 선을 그었다. 구글의 품질 평가 모델은 사람이 쓴 글을 기준으로 학습돼 있고, 판단 대상은 "AI냐 사람이냐"가 아니라 "품질이 괜찮은가"라는 뜻이다. 같은 자리에서 다른 발표자도 "사람이 직접 쓴 글도 대량으로 찍어내면 똑같이 스케일드 콘텐츠 어뷰즈(대량 생산형 콘텐츠 남용)로 분류될 수 있다"고 덧붙였다.
이 행사에서는 구글이 지금 가장 신경 쓰는 스팸 영역 세 가지도 공개됐다.
| 우선순위 영역 | 내용 |
|---|---|
| 스케일드 콘텐츠 어뷰즈 | 품질과 무관하게 대량으로 찍어내는 콘텐츠 |
| 백버튼 하이재킹 | 뒤로가기를 막거나 조작하는 수법 |
| AI 응답 조작 | AI 검색 결과·답변을 왜곡하려는 시도 |
백버튼 하이재킹 정책은 이미 별도로 정리해 둔 글이 있으니 함께 참고하면 좋다.
어떤 방식으로 AI 스팸을 걸러내나요?
구체적인 기술은 구글 리서치가 공개한 논문에 담겨 있다. 구글은 'SAFE(Scaled Abuse Forensics Examiner)'라는 다중 에이전트 AI 시스템으로 AI 생성 스팸 네트워크를 탐지한다. 이 논문은 5월 28일 날짜로 작성됐고, 9월 24일 구글 9월 스팸 업데이트 발표 시점과 겹치며 업계에 본격적으로 알려졌다.
SAFE는 역할이 다른 네 개의 에이전트가 하나의 수사팀처럼 움직이는 구조다.
- 콘텐츠 이해 에이전트: 소량의 예시만으로 학습하는 방식(few-shot)으로 알려진 위반 사례뿐 아니라, 규정을 교묘히 피해 간 '정책의 취지 위반' 사례까지 잡아낸다.
- 행동 이해 에이전트: 동시 업로드, 급증하는 발행 패턴처럼 사람이라면 부자연스러운 타이밍 신호를 찾는다.
- 클러스터 이해 에이전트: 서로 다른 채널·도메인이 같은 인프라를 공유하는지 그래프 분석으로 추적해, 흩어져 있는 스팸 네트워크를 하나로 엮는다.
- 루트 에이전트: 앞선 세 에이전트의 신호를 종합해 최종 판정을 내린다.
구글은 이 시스템이 "사람이 직접 하나씩 조사하는 방식보다 새로운 유형의 합성 콘텐츠 위협을 훨씬 빠르게 찾아낸다"고 설명했다. 다만 논문 분량이 짧고, 정확도나 적중률 같은 구체적인 성과 수치는 공개하지 않았다.
구글은 과거 발표(2020년 기준)에서 하루 수백억 개 단위, 약 400억 개의 스팸 페이지를 걸러낸다고 밝힌 적이 있다. SAFE 같은 시스템은 이런 규모를 사람 손으로 감당할 수 없기 때문에 나온 대응으로 보면 된다.
그럼 AI로 쓴 글은 다 걸리는 건가요?
아니다. 걸리는 쪽은 'AI로 썼다는 사실'이 아니라 '대량으로, 조율된 방식으로, 검증 없이 찍어낸다는 사실'이다. 정상적으로 AI를 보조 도구로 쓰되 사람이 사실을 확인하고 발행하는 글은 이번 탐지 방식의 대상이 아니다.
실제로 구분선은 아래 같은 신호 차이에서 나온다.
| 구분 | 정상적인 AI 활용 | 탐지 대상이 되는 스팸 |
|---|---|---|
| 발행 속도 | 사람 검토를 거친 일반적인 속도 | 짧은 시간에 대량 동시 발행 |
| 내용 | 사실 확인을 거친 고유한 정보 | 같은 틀을 여러 지역어로 복제 |
| 운영 구조 | 단일 사이트·브랜드 | 같은 인프라를 공유하는 다수 채널 |
이미 구글은 "생성형 AI 결과물을 발행 전 사람이 수동으로 검증하라"는 가이드라인도 별도로 내놓은 바 있다. AI 콘텐츠 수동 팩트체크 가이드라인에서 자세히 다뤘으니 같이 보면 기준이 더 명확해진다. 최근 스팸 업데이트가 2차 웨이브까지 이어진 배경이 궁금하다면 9월 스팸 업데이트 타임라인도 참고할 만하다.
AI를 활용해 콘텐츠를 만드는 것 자체는 문제가 아니며, 품질과 검증 절차를 갖추고 있다면 걱정할 이유가 없습니다. 다만 사이트 전반의 콘텐츠 운영 구조와 스팸 정책 준수 여부를 점검받고 싶으시다면 이루웹에 문의해 주시기 바랍니다. SEO 최적화 홈페이지 제작부터 콘텐츠 운영 컨설팅까지 상황에 맞게 살펴봐 드리고 있으며, 무료 상담으로 편하게 문의해 주시면 됩니다.
함께 보면 좋은 글
전체 보기네이버 서치어드바이저 등록 완벽 가이드, 사이트맵까지
자체 도메인 홈페이지와 워드프레스 사이트를 네이버 검색에 노출시키는 등록부터 사이트맵 제출, 수집 요청까지 전 과정을 단계별로 정리했습니다.
23분 분량구글, 품절 상품 '구매' 버튼 비활성화 의무화
구글이 품절 상품의 구매 버튼을 화면에서 지우지 말고 비활성화하라고 못박았습니다. 머천트 센터 피드와 화면 표시를 맞추는 법을 정리했습니다.
5분 분량자바스크립트 SEO, SPA가 구글에 안 잡히는 이유
리액트·뷰 기반 SPA가 검색에 안 잡히는 이유와 CSR·SSR·SSG 차이, 렌더링 예산 관리법까지 예시로 쉽게 정리했습니다.
24분 분량구글 비즈니스 프로필 vs 네이버 플레이스, 뭐부터
동네 가게가 구글 비즈니스 프로필과 네이버 플레이스 중 어디부터 등록하고 관리해야 하는지, 손님 기준으로 우선순위를 정리했습니다.
5분 분량