대부분의 트래픽 봇 캠페인은 시시한 이유로 실패합니다. 페이싱이 잘못됐거나, 리퍼러 구성이 개연성이 없거나, 애널리틱스 속성을 애초에 분리해 두지 않았거나, 좋은 결과가 어떤 모습일지 아무도 적어 두지 않았기 때문입니다. 캠페인이 쓸 만한 검증 데이터를 남길지, 아니면 해석할 수 없는 한 달치 숫자를 남길지는 이런 운영 세부 사항이 결정합니다.
핵심 요약
- 시작하기 전에 태그를 붙이십시오. 아래의 거의 모든 문제는 나중에 트래픽을 분리할 수 있으면 되돌릴 수 있고, 분리할 수 없으면 사실상 되돌릴 수 없습니다.
- 일일 총량이 아니라 곡선에 맞춰 페이싱하십시오. 24시간 내내 균일한 흐름은 합성 트래픽임을 가장 분명하게 드러내는 신호이며, 계산하는 모든 평균값을 왜곡합니다.
- 자기 사이트의 개연성을 그대로 베끼십시오. 기존 애널리틱스가 이미 그럴듯한 지역 분포와 기기 구성을 보여주고 있습니다. 그것을 사양서로 쓰십시오.
- 성공 지표를 먼저 정하십시오. 검증 목적의 캠페인이라면 그 지표는 대개 세션 수가 아니라 이벤트 정확도입니다.
데이터를 읽을 수 있게 트래픽 봇 캠페인을 설정하기
되돌리기가 가장 어려운 설정 실수는 합성 방문을 실제 사용자와 같은 애널리틱스 보기로 보내는 것입니다. 나중에도 세그먼트와 비교 기능으로 분리할 수는 있지만, 그것은 태그가 처음부터 붙어 있었을 때의 이야기이고 세션 자체는 어느 쪽이든 속성에 남습니다. 절대 할 수 없는 일은 데이터 필터를 소급 적용하는 것입니다. 첫 세션이 들어오기 전에 결정하십시오.
- 모든 캠페인에 자연 유입에서는 절대 쓰지 않을 UTM 매개변수를 붙이십시오. 전용
utm_source가 있으면 나중에 제외가 클릭 한 번으로 끝납니다. 이것은 선택적인 정리 작업이 아니라, 되돌릴 수 있는 실험과 영구히 오염된 속성을 가르는 차이입니다. - 제외 필터는 시작 후가 아니라 시작 전에 만드십시오. GA4의 필터는 소급 적용되지 않습니다. 12일째에 추가한 필터는 앞으로 돌릴 모든 과거 보고서에 11일치 혼합 데이터를 남깁니다.
- 사이트에 매출 보고가 걸려 있다면 별도 속성이나 전용 데이터 스트림을 쓰십시오. 경영 보고 자료나 광고 플랫폼의 전환 신호로 흘러가는 곳에는 합성 세션이 아예 들어가서는 안 됩니다.
- 비용을 쓰기 전에 캠페인의 목적을 한 문장으로 적어 두십시오. "세 개 국가에서 부하가 걸린 상태에서 결제 퍼널이 이벤트를 정확히 발생시키는지 확인한다"는 목적입니다. "트래픽을 늘린다"는 목적이 아닙니다.
트래픽 봇 페이싱: 일일 총량보다 모양이 중요합니다
캠페인은 대상 시장의 하루 곡선에 맞춰 페이싱하고, 처음부터 최대 속도로 켜지 말고 며칠에 걸쳐 물량을 올리십시오. 24시간 내내 균일한 흐름은 합성 트래픽을 가장 분명하게 드러내는 신호인 동시에, 자기 평균값을 무의미하게 만드는 가장 빠른 길입니다.
하루 3,000회 방문을 균일한 간격으로 고르게 뿌리는 캠페인은 사람 트래픽과 전혀 닮지 않았고, 실제 조건에서 사이트가 어떻게 동작하는지도 전혀 알려주지 않습니다. 실제 사용자는 곡선을 그리며 들어옵니다. 현지 활동 시간대에는 몰리고 밤에는 줄어들며, 평일과 주말의 모양도 다릅니다.
실무 규칙은 두 가지입니다.
- 전달 곡선을 대상 지역의 시간대에 맞추십시오. 독일어 랜딩 페이지를 테스트하는데 트래픽이 중부유럽 시간 04:00에 정점을 찍는다면 설정이 잘못됐다는 신호이고, 잘못된 시간대를 평균 내는 셈이므로 계산한 참여도 평균값도 무의미해집니다.
- 한 번에 켜지 말고 단계적으로 올리십시오. 0에서 최대 물량으로 한 번에 가면 어느 물량 수준에서 서버나 추적 문제가 생겼는지 알 수 없습니다. 며칠에 걸쳐 단계적으로 올리면 수수께끼 대신 임계값을 얻습니다.
페이싱은 측정 대상 자체도 보호합니다. 서버 응답 시간은 부하가 걸리면 비선형으로 나빠지고, 갑작스러운 폭주는 트래픽 소스 품질과 무관한 이유로 페이지 로딩을 느리게 만들어 참여 지표를 끌어내릴 수 있습니다.
리퍼러와 기기 구성: 다양성보다 개연성입니다
다양하면 자연스러워 보인다는 생각에 리퍼러도 기기도 국가도 최대한 늘리고 싶어지는 유혹이 있습니다. 대개는 오히려 더 나빠 보입니다. 한 나라 밖에서 한 번도 검색 노출된 적 없는 작은 사이트에 갑자기 마흔 개 나라에서 방문자가 오지는 않습니다.
| 설정 항목 | 흔한 실수 | 더 나은 방식 |
|---|---|---|
| 지역 | 단일 시장 사이트에 전 세계 분산 | 자연 유입 데이터에 이미 있는 국가를 그대로 반영 |
| 기기 구성 | 데스크톱 100% 또는 정확히 50 대 50 | 애널리틱스의 기존 모바일/데스크톱 비율을 그대로 복사 |
| 리퍼러 | 서로 무관한 도메인 수십 개 | 개연성 있는 두세 곳, 또는 직접 유입만 |
| 세션 깊이 | 모든 세션이 동일 | 분포를 두기: 대부분은 짧게, 일부는 깊게 |
바탕에 깔린 원칙은 이렇습니다. 기존 애널리틱스 데이터가 이미 내 사이트에서 개연성 있는 모습이 무엇인지 말해 주고 있습니다. 새로 지어내지 말고 그것을 사양서로 쓰십시오.
대시보드를 보기 전에 성공 지표를 정하십시오
데이터가 나온 뒤에 고른 지표는 지표가 아니라 듣기 좋은 숫자 찾기입니다. 주요 지표 하나와 가드레일 지표 하나를 미리 정하십시오.
검증 목적의 캠페인이라면 주요 지표는 대개 트래픽이 아니라 이벤트 정확도입니다. 발생하기로 한 이벤트가 실제로, 예상한 비율로, 예상한 매개변수와 함께 발생했는가? 망가진 purchase 이벤트를 찾아낸 캠페인은 세션 수가 어떻게 나왔든 이미 값을 한 것입니다.
가드레일은 캠페인을 멈추게 하는 숫자입니다. 보통 서버 오류율, 페이지 로딩 시간 중앙값, 참여 세션 비율 같은 것입니다. 가드레일이 나쁜 쪽으로 움직이면 주요 지표가 좋아 보이더라도 캠페인을 일시 중지합니다.
일찍 알아둘 만한 트래픽 봇 실패 유형 다섯 가지
- 이탈률 신기루. 체류 시간이 스크립트로 지정된 합성 세션은 아무 의미 없는 아름다운 이탈률을 만들어냅니다. 캠페인을 시작한 주에 이탈률이 좋아졌다면 그것은 개선이 아니라 측정 인공물입니다.
- 테스트 양식으로 인한 전환 부풀리기. 봇이 양식에 도달하고 그 양식이 전환 이벤트를 발생시키면 전환 수가 올라가고 전환율도 올라갈 수 있습니다. 그 숫자는 하류로 흘러가 광고 플랫폼 최적화에 들어가고, 실제 입찰을 조용히 왜곡할 수 있습니다.
- 캐시된 페이지 착시. 같은 URL을 반복해서 때리면 CDN 캐시가 데워져 로딩 시간이 떨어집니다. 성능이 좋아진 것처럼 보입니다. 캐시되지 않은 URL로 확인해 보십시오.
- 속도 제한에 가려짐. 호스팅이나 WAF가 알리지 않고 그 트래픽을 제한하거나 인증 화면을 내보내기 시작합니다. 세션은 계속 기록되지만 기록되는 것은 실패입니다. 애널리틱스만 보지 말고 서버 측 로그를 보십시오.
- 뒤늦게 발견되는 보고서 오염. 누군가 분기 트래픽 수치를 뽑았는데 거기에 캠페인이 섞여 있습니다. 이것은 사내 신뢰를 무너뜨리는 실패이며, 태그 관리 원칙만 지키면 완전히 예방할 수 있습니다.
애널리틱스만이 아니라 서버 로그와 대조해 결과를 읽으십시오
이것은 자동 트래픽의 종류를 서로 구분하는 방법이기도 합니다. 애널리틱스는 자바스크립트를 실행하고 보고를 돌려보낸 세션에 대해 알려줍니다. 서버 로그는 도착한 모든 요청에 대해 알려줍니다. 흥미로운 문제는 그 둘의 간극에 살고 있습니다.
공급자는 방문 10,000회를 보고하고, 애널리틱스에는 세션 6,000회가 잡히고, 액세스 로그에는 요청 10,000건이 남았다면 구체적인 사실 하나를 알게 된 것입니다. 트래픽의 약 40%가 추적 코드를 실행하지 않고 있습니다. 부하 테스트에는 상관없고 행동 테스트에는 쓸모없는 상태일 수 있습니다. 어느 쪽이든 이제 어느 쪽인지는 알게 됐습니다.
트래픽 봇 캠페인을 언제 멈출 것인가
중단 조건은 시작 전에 적어 두어야 하고, 동료가 내 의견을 묻지 않고도 적용할 수 있을 만큼 기계적이어야 합니다.
- 서버 5xx 비율이 평소 범위를 한 시간 넘게 초과할 때.
- 페이지 로딩 시간 중앙값이 합의한 기준선을 넘어 나빠질 때.
- 보낸 물량에 비해 개연성 없는 비율로 전환 이벤트가 발생할 때.
- 공급자가 보고한 물량과 서버 로그가 합의한 허용 범위 이상 벌어질 때.
- 캠페인의 목적에 답이 나왔을 때. 가장 자주 잊히는 중단 조건입니다.
끝난 뒤에 적어 둘 것
설정값(물량, 페이싱, 지역, 기기 구성, 리퍼러, 기간), 무엇을 테스트했는지, 무엇을 관찰했는지, 그 결과로 무엇을 바꿨는지를 기록하십시오. 효과가 없었던 설정도 포함하십시오. 그러지 않으면 다음에 캠페인을 돌리는 사람이 같은 비용을 치르며 그것을 다시 발견하게 됩니다.
쓸 만한 기록은 한 단락에 들어가고 질문 하나에 답합니다. 내일 이걸 다시 돌린다면 무엇을 다르게 하겠는가?
자주 묻는 질문
트래픽 봇 캠페인이 순위를 올려줍니까?
아닙니다. 순위는 콘텐츠, 링크, 크롤링 가능성, 검색 의도 부합도에 반응하며 그중 어느 것도 판매 대상이 아닙니다. 이 점은 SEO 트래픽이라는 이름으로 실제 팔리는 것을 다룬 글에서 설명합니다. 캠페인은 애널리틱스와 서버와 퍼널이 제대로 동작하는지 검증하는 데는 도움이 되며, 그것은 진짜 엔지니어링상의 이득이지만 성격이 다른 이득입니다.
쓸 만한 테스트를 하려면 물량이 얼마나 필요합니까?
판매 패키지가 암시하는 것보다 훨씬 적습니다. 이벤트가 제대로 발생하는지 확인하는 데는 수천 세션이 아니라 수십 세션이면 됩니다. 큰 물량이 필요한 경우는 질문 자체가 부하에 관한 것일 때뿐입니다.
합성 트래픽은 애널리틱스에서 영구히 제외해야 합니까?
사업 의사결정에 쓰이는 보고 보기에서는 그렇습니다. 테스트 데이터 자체는 계속 확인할 수 있도록 전용 보기나 세그먼트에서는 보이게 두십시오.
가장 값어치 있는 습관 하나는 무엇입니까?
첫 세션부터 모든 캠페인에 구분되는 태그를 붙이는 것입니다. 이 목록에 있는 거의 모든 심각한 문제는 나중에 트래픽을 분리할 수 있으면 되돌릴 수 있고, 분리할 수 없으면 거의 되돌릴 수 없습니다.