Shadowban Radar
블로그쉐도우밴 테스트
블로그/가이드
가이드

X의 'multi-step reply spam' 필터: 코드가 보여 주는 것 (2026)

2026년 9월 4일 X는 팔로워 1,000명 이상 계정 아래의 자기 답글 연쇄를 겨냥한 필터를 추가했습니다. 공개 코드가 무엇을 확인하고 어떻게 처리하는지 정리했습니다.

SE

작성자 Sébastien Ego

Shadowban Radar 창업자

게시일 2026년 10월 7일 · 6분 소요

X의 multi-step reply spam 필터 요약: 자기 답글에 다는 답글, 팔로워 1,000명 이상인 원글, 표시된 게시물 2개 이상, 라벨 하나와 점수 0
  • X는 2026년 9월 4일에 오픈 소스 코드에 무엇을 추가했나요?
  • 'multi-step reply spam' 필터는 어떤 답글을 겨냥하나요?
  • 필터가 제외하는 계정은 무엇인가요?
  • 모델은 무엇을 스팸으로 판단하나요?
  • 모델의 답변 뒤에는 어떤 안전장치가 있나요?
  • 필터가 표시한 답글은 어떻게 되나요?
  • 공개된 파일이 보여 주지 않는 것
  • 내 답글이 영향을 받는지 어떻게 알 수 있나요?
  • 코드로 보아 어떻게 하면 좋을까요?
  • 출처

이 페이지의 내용

  • X는 2026년 9월 4일에 오픈 소스 코드에 무엇을 추가했나요?
  • 'multi-step reply spam' 필터는 어떤 답글을 겨냥하나요?
  • 필터가 제외하는 계정은 무엇인가요?
  • 모델은 무엇을 스팸으로 판단하나요?
  • 모델의 답변 뒤에는 어떤 안전장치가 있나요?
  • 필터가 표시한 답글은 어떻게 되나요?
  • 공개된 파일이 보여 주지 않는 것
  • 내 답글이 영향을 받는지 어떻게 알 수 있나요?
  • 코드로 보아 어떻게 하면 좋을까요?
  • 출처

X의 오픈 소스 코드에는 2026년 9월 4일에 추가된 필터가 있습니다. 팔로워가 1,000명 이상인 계정의 게시물 아래에서 이어지는 자기 답글 연쇄가 대상입니다. AI 모델이 그런 연쇄에서 같은 작성자의 게시물 2개 이상을 스팸으로 표시하면, X의 코드는 표시된 게시물마다 reply spam 라벨과 답글 랭킹 점수 0을 붙입니다.

X는 2026년 9월 4일에 오픈 소스 코드에 무엇을 추가했나요?

X의 공개 저장소 xai-org/x-algorithm에 2026년 9월 4일, 새로운 답글 스팸 흐름 multi_step_reply_spam이 추가되었습니다. 이 커밋은 grox/flows/reply_spam/에 파일 네 개를 넣었습니다.

  • plan_multi_step_reply_spam.py는 4단계를 잇습니다. 적격성 필터, 미디어 불러오기, 스팸 탐지, 기록 단계입니다.
  • task_multi_step_reply_spam.py에는 필터, 탐지 단계, 기록 단계가 들어 있습니다.
  • classifier_multi_step_reply_spam.py는 모델이 읽는 스레드를 만들고, 모델의 답을 해석하고, 안전장치 3가지를 적용합니다.
  • state_multi_step_reply_spam.py는 결과를 저장합니다. 표시된 게시물 ID 목록과 이유입니다.

X의 README는 grox/ 폴더를 게시물이 올라오는 대로 실행되는 코드로 설명하며, 스팸 같은 범주를 위한 분류기가 들어 있다고 합니다. 새 계획은 X의 다른 답글 랭킹 흐름과 같은 스트림 생성기에 등록되어 있습니다.

작업 파일은 2026년 9월 8일에 다시 수정되었습니다. 기록 단계가 이제 별도 기록 두 번 대신 게시 함수 하나를 호출합니다. 기록하는 값은 여전히 0.0입니다.

'multi-step reply spam' 필터는 어떤 답글을 겨냥하나요?

지금 내 계정 확인하기

무료, 로그인 불필요, 몇 초 만에 결과 확인.

쉐도우밴 테스트

필터(TaskMultiStepReplySpamFilter)는 다음 조건이 모두 참일 때만 답글을 선택합니다.

  • 조상이 있는 답글이고, 그중 삭제된 것이 없다.
  • 직접 부모가 같은 작성자의 게시물이다. 계정이 자기 자신에게 답하고 있다.
  • 원글보다 2단계 이상 아래에 있다.
  • 작성자가 원글 작성자가 아니다.
  • 원글 작성자의 팔로워가 1,000명 이상이다(FOLLOWER_COUNT_THRESHOLD_FOR_SPAM_DETECTION = 1000). 그보다 적으면 코드는 low_blast_radius라는 이유로 그 답글을 건너뜁니다.

조건을 충족하는 가장 작은 형태는 다른 계정의 게시물 하나, 평가 대상 계정의 답글 하나, 그리고 같은 계정이 자기 첫 답글에 단 두 번째 답글입니다. 필터는 답글 작성자 본인의 팔로워 수를 보지 않습니다.

직접 부모가 다른 사람의 게시물인 답글은 건너뜁니다(parent_not_same_author). 답글 작성자 본인의 게시물 아래에 있는 답글도 마찬가지입니다(same_user_reply_as_root).

필터가 제외하는 계정은 무엇인가요?

X의 multi-step reply spam 필터는 어떤 모델이 실행되기 전에 5가지 경우를 건너뜁니다.

  • Grok 또는 Gork 계정이 쓴 답글.
  • high page rank(버전 2)로 분류된 작성자. is_high_page_rank_v2_user로 확인합니다.
  • 회색 배지가 있는 작성자. is_grey_badge_user로 확인합니다.
  • 팔로워 1,000명 미만인 원글 작성자 아래의 답글.
  • 조상 게시물이 삭제되었거나, 작성자 정보가 없는 게시물이 있는 스레드.

이 파일들은 'high page rank'와 '회색 배지'를 정의하지 않습니다.

모델은 무엇을 스팸으로 판단하나요?

X의 코드가 보여 주는 것은 모델에 무엇이 전달되는지, 모델이 답한 뒤 무슨 일이 일어나는지이며, 모델이 적용하는 기준은 아닙니다. 점수 매기기 모듈은 constants.py에 정의된 모델 식별자 oai-gemma4-26b-2에 묶여 있습니다.

모델이 읽는 내용은 다음과 같습니다.

  • 답글 작성자의 프로필(이름, 사용자 이름, 소개, 프로필 위치).
  • 번호가 매겨진 게시물로 나열한 스레드. 'Post 0'이 원글이며 'never flag'라고 표시되고, 마지막 게시물에는 'the reply being evaluated'라고 표시됩니다.
  • 각 게시물의 핸들, 팔로워 수, 표시 이름, 본문, URL, 최대 2개의 미디어.
  • 원글에 덧붙여진 원글 작성자의 소개.

조상이 10개를 넘는 스레드는 앞 5개와 뒤 5개로 줄어듭니다(MAX_THREAD_SIZE = 10). 모델은 JSON으로 답합니다. 스팸으로 판단한 게시물의 번호와 이유입니다.

프롬프트 자체는 공개되지 않았습니다. prompts.py는 multi_step_reply_spam_system.j2라는 템플릿을 불러오는데, 이 파일은 저장소에 없고, 같은 파일의 주석에는 시스템 악용을 어렵게 하려고 프롬프트를 제외한다고 적혀 있습니다. X의 README도 Grox 프롬프트를 공개하지 않는 파일로 꼽습니다.

모델의 답변 뒤에는 어떤 안전장치가 있나요?

세 가지 확인이 이 순서대로 실행되며, 각각 표시를 없앨 수 있습니다.

  1. 가장 최근 답글이 표시된 게시물에 없으면, 모든 표시가 버려집니다.
  2. 다른 작성자가 쓴 표시된 게시물은 제거됩니다.
  3. 표시된 게시물이 정확히 1개만 남으면, 그것도 버려집니다.

따라서 제재에는 가장 최근 답글을 포함한, 같은 작성자의 표시된 게시물이 2개 이상 필요합니다.

필터가 표시한 답글은 어떻게 되나요?

스레드에서 표시된 게시물마다, X의 코드는 reply spam 안전 라벨을 붙이고 답글 랭킹 점수 0.0을 게시합니다. 기록 단계(TaskWriteMultiStepReplySpamReplyRanking)는 DisableTaskForNonProd로 프로덕션이 아닌 환경에서는 꺼져 있습니다.

표시된 게시물마다 코드는 다음을 합니다.

  • 안전 라벨 RiskyHighVizReply를 붙입니다. 단, 작성자가 high page rank(점수가 있을 때 신뢰도 점수 62 이상)이거나, 회색 배지가 있거나, 테스트 사용자이면 붙이지 않습니다.
  • 모델이 낸 이유와 함께 답글 랭킹 점수 0.0을 게시합니다. 이유는 마지막 500자로 잘립니다.

같은 폴더의 주된 답글 랭킹 점수 모듈은 0에서 3 범위를 벗어나는 점수를 거부하므로, 0은 그 척도의 가장 낮은 값입니다. 게시물이 0을 가지면, 답글 랭킹의 표준 기록 단계는 저장된 값보다 낮지 않은 새 점수를 건너뜁니다.

이 파일들은 개별 게시물에 작용합니다. 계정을 정지하거나 계정 전체에 라벨을 붙이지 않습니다.

공개된 파일이 보여 주지 않는 것

대화 화면이 점수나 라벨을 어떻게 쓰는지는 저장소에 나와 있지 않습니다. 점수의 이름을 검색하면 reply_spam 폴더에서만 나옵니다. 라벨 이름 RiskyHighVizReply는 저장소의 under-the-hood 폴더 어디에도, 라벨 목록을 포함해서 나오지 않으므로, 공개된 코드에는 Under the Hood에 이 라벨 항목이 있다는 근거가 없습니다.

내 답글이 영향을 받는지 어떻게 알 수 있나요?

내 답글이 영향을 받는지 알려면, 대화에서 답글이 어디에 놓이는지 보세요. 답글 디부스팅(답글 순위 하락)이란 내 답글이 대화 맨 아래로 밀려나거나 '더 많은 답글 보기' 뒤에 숨겨지는 것입니다.

Shadowban Radar는 이 검사를 바깥에서 정의합니다. 답글 순위 하락은 대화를 시간순으로 읽으면 X가 답글을 보여 주지만, 같은 대화의 기본 보기에서는 그 답글을 빼놓을 때 감지됩니다. 직접 확인하는 방법은 reply deboosting 페이지에서 설명합니다.

Shadowban Radar의 무료 검사는 로그인 없이 어떤 공개 핸들에도 이 테스트를 실행합니다. 보여 주는 것은 답글의 위치이지 원인이 아닙니다. 순위가 낮은 답글은 여러 신호에서 비롯될 수 있으므로, 이 필터가 표시했는지는 검사로 알 수 없습니다.

대화에서 답글이 아예 사라졌다면 다른 제한인 ghost ban입니다.

코드로 보아 어떻게 하면 좋을까요?

X는 모델의 기준을 공개하지 않았으므로, 아래 내용은 필터의 조건에서만 나온 것입니다.

  • 한 번만 말하기. 필터는 같은 작성자의 게시물이 2개 이상 표시될 때만 작동하며, 다른 사람의 게시물 아래에 단 답글 하나만으로는 조건을 충족할 수 없습니다. 짧은 답글 여러 개를 하나로 합치면 필터가 찾는 연쇄를 피할 수 있습니다.
  • 추가 내용은 내 게시물에 쓰기. 후속 설명, 링크, 긴 설명은 내 게시물이나 스레드에 둘 수 있습니다. 내 게시물 아래의 답글은 평가되지 않습니다(same_user_reply_as_root).
  • 나 자신이 아니라 다른 사람에게 답하기. 직접 부모가 다른 계정의 게시물인 답글은 필터 밖입니다(parent_not_same_author).
  • 연쇄는 함께 판단됩니다. 모델이 스레드 전체를 한 번에 읽으며, 같은 작성자의 표시된 게시물은 각각 자기 점수 0을 받습니다.

reply_spam 파일에는 기록된 라벨을 해제하거나 0을 끌어올리는 단계가 없습니다.

출처

2026년 10월 7일에 xai-org/x-algorithm 저장소의 커밋 78460ca에서 읽었습니다. 필터의 파일 4개는 2026년 9월 4일 커밋 9b0dc31에서 추가되었습니다.

  • plan_multi_step_reply_spam.py: 4단계와 그 순서.
  • task_multi_step_reply_spam.py: 적격성, 탐지, 기록 단계.
  • classifier_multi_step_reply_spam.py: 모델에 전달되는 스레드와 안전장치 3가지.
  • state_multi_step_reply_spam.py: 저장되는 결과.
  • task_write.py: 라벨 함수와 답글 랭킹의 표준 기록.
  • README.md: grox/ 설명과 비공개 파일 목록.
  • 커밋 9b0dc31: 2026년 9월 4일.

Shadowban Radar는 X Corp와 제휴 관계가 아닙니다. X의 공식 보고서와 실시간 검사의 관계는 X의 Under the Hood를 참고하세요.

자주 묻는 질문

2026년 9월 4일 X의 오픈 소스 코드에 추가된 필터입니다. 팔로워가 1,000명 이상인 계정의 게시물 아래에서 한 계정이 자기 답글에 계속 답글을 다는 연쇄를 찾습니다. AI 모델이 스레드를 읽고 스팸으로 판단한 게시물에 표시를 합니다. 표시된 게시물에는 reply spam 라벨과 답글 랭킹 점수 0이 붙습니다.

직접 부모가 같은 작성자의 게시물이고, 원글보다 2단계 이상 아래에 있는 답글만 해당합니다. 답글 작성자는 원글 작성자와 다른 계정이어야 하고, 원글 작성자의 팔로워는 1,000명 이상이어야 합니다. 다른 사람의 게시물에 단 답글이나 내 게시물 아래의 답글은 선택되지 않습니다.

코드는 Grok과 Gork 계정, high page rank(버전 2)로 분류되었거나 회색 배지가 있는 작성자, 팔로워 1,000명 미만인 원글 작성자 아래의 답글을 건너뜁니다. 조상 게시물이 삭제된 스레드도 건너뜁니다. 이 파일들은 high page rank와 회색 배지를 정의하지 않습니다.

X의 코드는 표시된 각 게시물에 안전 라벨 RiskyHighVizReply를 붙이고, 모델이 낸 이유와 함께 답글 랭킹 점수 0.0을 게시합니다. 이 기록은 프로덕션이 아닌 환경에서는 꺼져 있습니다. 대상은 개별 게시물이며, 네 파일 중 어느 것도 계정을 정지하거나 계정 전체에 라벨을 붙이지 않습니다.

저장소에서는 알 수 없습니다. 기록 단계가 프로덕션에서만 실행된다는 점(DisableTaskForNonProd)과, 필터와 탐지 코드가 2026년 9월 4일에 공개되었다는 점은 확인됩니다. 실제 운영 시스템이 공개된 파일과 일치하는지, 언제부터인지는 코드로 알 수 없습니다.

공개되지 않았습니다. 프롬프트 템플릿 multi_step_reply_spam_system.j2는 저장소에 없고, X의 README도 Grox 프롬프트를 공개하지 않는 파일로 꼽습니다. 공개된 코드가 보여 주는 것은 모델에 전달되는 내용과 답변 뒤의 안전장치이며, 판단 기준은 아닙니다.

Shadowban Radar의 무료 검사에 내 핸들을 입력하세요. reply deboosting(답글 순위 하락) 검사가 답글이 대화의 기본 보기에서 빠져 있는지 보여 줍니다. 보여 주는 것은 답글의 위치이지 원인이 아니므로, 이 필터가 표시했는지는 알 수 없습니다.

관련 글

X 쉐도우밴 용어집의 네 가지 제한(search suggestion ban, search ban, ghost ban, reply deboosting)과 전체 37개 용어
2026년 10월 3일가이드

트위터(X) 쉐도우밴 용어집: 37개 용어 정리 (2026)

쉐도우밴 뜻부터 고스트밴, 서치밴, 답글 디부스팅, Under the Hood, 읽기 전용 모드까지. 트위터(X) 용어 37개를 쉬운 말로 정리했습니다.

트위터(X) 계정 제한 확인 방법 (2026): 보이는 제한 vs 숨겨진 제한
2026년 9월 29일가이드

트위터(X) 계정 제한 확인 방법 (2026): 보이는 제한 vs 숨겨진 제한

트위터(X) 계정이 제한됐는지 확인하는 방법. X는 잠김, 일시적 제한, 읽기 전용은 알려주지만 4가지 제한은 알려주지 않습니다. 약 2분이면 둘 다 확인됩니다.

Postiz 홈페이지, Tweet Hunter 검색 화면, superX workers 화면. 이 순위에서 비교한 도구들
2026년 10월 3일비교

2026년 트위터(X) 성장 도구 추천: 3가지 직접 테스트하고 점수 매김

2026년 트위터(X) 성장 툴 추천, 직접 테스트하고 점수 매겼습니다. superX 8.8/10, Postiz 8.4/10, Tweet Hunter 8.3/10. 월 29달러부터, 무료 체험과 선택 가이드까지.

지금 바로 원하는 아이디를 확인해 보세요: 무료, 로그인 필요 없음

@

하루 최대 10회 무료 검사. 로그인이나 비밀번호가 필요 없습니다.

Shadowban Radar

제한 유형

  • 검색 추천 제한
  • 검색 노출 제한
  • 답글 숨김
  • 답글 순위 하락

가이드

  • 제가 쉐도우밴되었나요?
  • 얼마나 지속되나요?
  • 해결 방법
  • 모니터링
  • 검사 도구 비교
  • 검사 방법
  • 통계
  • 블로그

제품

  • 요금
  • 감사 안내
  • 진단 보고서 예시
  • 새로운 소식
  • Radar를 만든 이유
  • 로그인
  • 개인정보 보호
  • 이용약관

SX에서 팔로우하기·의견 또는 버그

X Corp.와 관련이 없습니다. X는 X Corp.의 상표입니다.

다른 언어EnglishFrançaisEspañolPortuguês (Brasil)日本語中文한국어ภาษาไทย