Skip to content
KitploitKITPLOIT
도구블로그
제출
도구블로그
제출

해킹, 침투 테스트 및 사이버 보안 도구를 당신의 보안 무기고에!

Kitploit은 해킹, 사이버 보안 및 침투 테스트 도구 디렉토리입니다. 최신 프로젝트 업데이트를 발견하여 취약점을 찾고, 시스템을 분석하고, 테스트를 자동화하고, 보안을 강화하세요.

··피드·문의·개인정보·© 2026 Kitploit

도구 디렉토리

카테고리

모든 카테고리 보기
Loading categories
ai-ublock-blacklist — 제가 직접 찾은 AI가 완전히 생성한 웹사이트들입니다. 풀 리퀘스트를 환영합니다. | Kitploit
도구/GitHubGitHub/alvi-se/ai-ublock-blacklist
Defensive ToolsGeneral Purpose UtilitiesWeb SecurityLearning & EducationCurated Resources
GitHubalvi-se/ai-ublock-blacklist

ai-ublock-blacklist

제가 직접 찾은 AI가 완전히 생성한 웹사이트들입니다. 풀 리퀘스트를 환영합니다.

저장소 보기
6471225일 전Kitploit 검토 완료

인기

모두 보기 →

커뮤니티에서 가장 많이 사용되는 도구를 찾아보세요.

모든 도구 탐색

도구 컬렉션을 둘러보세요

모든 도구 보기 →
공유
웹사이트

AI uBlock Origin 블랙리스트

유블록 오리진에서 AI 콘텐츠 팜을 차단하기 위한 개인 목록입니다. 풀 리퀘스트를 환영합니다.

설치

여기를 클릭하여 이 목록을 자동으로 구독할 수 있습니다. 이 링크는 유블록 오리진이 설치된 경우에만 작동합니다.

또는 다음 URL을 유블록 오리진의 타사 목록으로 가져오십시오.

  • https://raw.githubusercontent.com/alvi-se/ai-ublock-blacklist/master/list.txt

왜?

인터넷을 검색하다 보면 가끔 대부분의 경우 생성형 AI가 작성한 텍스트가 있는 웹사이트를 접하게 됩니다. 이러한 웹사이트는 유용한 정보를 제공하지 않으며, 내용이 평범하고, 광고와 수익을 위한 추천 링크로 가득 차 있습니다. 그래서 이런 종류의 웹사이트를 발견하면 여기에 추가합니다.

핵심 아이디어는 간단합니다. AI가 내 질문에 답해주길 원한다면, 내가 AI에게 물어볼 것입니다. 온라인에서 검색한다면, 그것은 사람이 쓴 답변을 원한다는 뜻입니다. 사람은 경험, 의견, 아이디어, 창의성, 그리고 웹과 공유하고 싶은 더 많은 정보를 가지고 있습니다. AI는 그렇지 않습니다.

게다가 AI 콘텐츠는 위험할 수도 있습니다. 콘텐츠 팜의 글은 대량으로 생성되기 때문에 게시 전에 누구의 검토도 거치지 않습니다. AI는 위험한 주제에 대해 환각을 일으킬 수 있습니다. 예를 들어 회로 기판을 단락시키라고 조언하거나, PC에서 rm -rf / 같은 위험한 명령을 실행하라고 권할 수 있습니다. 또는 표백제와 암모니아를 혼합하라고 할 수도 있습니다 (이런 행동은 하지 마세요). AI가 생성한 콘텐츠는 신뢰할 수 없으며, 게시되는 내용을 아무도 확인하지 않는다면 차단해야 합니다.

앞서 말했듯이, 저는 검색하면서 페이지를 추가하고 있으므로 각 항목이 수동으로 추가됩니다. 자동화 도구를 사용하는 것은 고려하지 않고 있습니다. 단순히 알고리즘이 페이지가 AI로 생성되었는지 판단하기 어렵기 때문이며, 특히 제가 다음에 작성한 지침을 고려할 때 더 그렇습니다. 이 목록이 너무 짧아서 쓸모없다는 주장이 있을 수 있습니다. 그러나 이러한 웹사이트들은 검색 엔진에서 가장 먼저 노출되기 위해 SEO를 사용하기 때문에, 비슷한 검색어를 사용하면 같은 웹사이트를 여러 번 만나게 됩니다. 이 목록을 작성하기 시작한 첫날부터 차단 효과를 보았으며, 항목이 매우 적었을 때도 마찬가지였습니다.

하지만 제 항목에는 분명 편향이 있습니다. 예를 들어, 저는 이탈리아 시민이므로 이탈리아 웹사이트가 많습니다. 이것이 풀 리퀘스트를 환영하는 또 다른 이유입니다.

웹사이트 추가 방법

기술 사용자가 아니고 GitHub 사용법을 모르신다면, 여기를 클릭하여 이슈를 생성해 의심되는 사이트를 신고해 주세요.

풀 리퀘스트를 생성하려면, 웹사이트를 목록에 추가하는 방법은 다음과 같습니다. 먼저, AI 스팸 발송자의 범위를 찾으십시오. 일반적으로 도메인 단위이지만, Medium 블로그나 dev.to 블로그도 많이 발견했습니다. 이러한 플랫폼 전체를 차단해서는 안 되며, 스팸을 보내는 블로그만 차단해야 합니다.

example.com/@slopUser 항목을 추가하려면 list.txt 파일에 다음과 같은 줄을 추가하십시오:

root@kitploit:~
||example.com/@slopUser^$doc

example.com 도메인 전체가 AI 쓰레기를 호스팅하고 있다고요? 도메인만 추가하십시오:

root@kitploit:~
||example.com^$doc

AI를 정말 싫어하고 시간이 많다면, 발견한 웹사이트에 대해 조사해 보시기 바랍니다. 이러한 콘텐츠 팜의 대부분은 SEO 및 디지털 마케팅을 판매하는 사람이나 조직에 의해 구축됩니다. 출처를 찾으면 그들이 만든 다른 콘텐츠 팜도 발견할 수 있습니다. 발견하면 파일 하단에 추가하십시오.

웹사이트 추가 기준

콘텐츠 팜에는 식별 가능한 패턴이 있습니다. 제가 파악한 패턴은 다음과 같습니다. 물론 엄격한 규칙은 아닙니다.

  • 불필요한 서론과 결론: 콘텐츠 팜을 식별하는 가장 쉬운 방법일 것입니다. 종종 서론은 꽤나 화려합니다. 예를 들어, Flutter의 특정 기능 사용 방법에 대한 가이드를 클릭했다고 가정해 보십시오. 기사는 Flutter 자체에 대한 소개로 다음과 같이 시작할 것입니다:

    오늘날 빠르게 변화하는 디지털 환경에서 사용자는 앱이 빠르고 아름다우며 모든 기기에서 일관되게 작동하기를 기대합니다.

    아마도 사람은 이런 서론을 특정 기능을 설명하기 위해 쓰지 않을 것입니다. 일반적으로 Flutter에 대해 이야기할 때는 적합할 수 있지만 (여전히 너무 화려하지만), 경험 많은 개발자만 이해할 수 있는 매우 구체적인 코드에 대해서는 그렇지 않습니다. 이런 기사를 쓴다면 독자가 이미 Flutter가 무엇인지 알고 있다고 가정할 것입니다!

  • [주제]: 종합 가이드/단계별 가이드/궁극의 가이드: LLM은 튜토리얼과 가이드 제목에 이런 캐치프레이즈를 좋아합니다.

  • 외부 콘텐츠로의 링크가 없거나 적음

  • 출처 및 참고 자료 없음: 위와 동일하지만 사실에 대한 출처에 해당합니다. 특히 (의사)과학, 정치 및 잘못된 정보를 퍼뜨릴 수 있는 콘텐츠에 대한 기사에서 확인하는 것이 매우 중요합니다.

  • 곳곳에 있는 추천 링크: 콘텐츠 팜은 돈을 벌기 위해 존재합니다. 개인적으로 네비게이션 바나 푸터에 구매 조언을 부끄럽지 않게 넣는 사이트를 본 적이 있습니다.

  • 회사 제품에 대한 언급: 웹사이트가 어떤 제품이나 서비스를 판매하는 회사 소유입니다. 페이지는 아마도 "[문제] 해결 방법" → "우리 제품 구매" 식일 것입니다.

  • 수십만 개의 기사를 가진 블로그: 특히 매우 짧은 시간 내에 게시된 경우. 많은 AI 쓰레기 블로그가 하루에 수십 또는 수백 개의 기사를 게시하며, 대부분 같은 작성자가 씁니다.

  • 환각: 콘텐츠가 명백히 잘못되었습니다.

  • 2022년 11월 이후의 날짜: AI 열풍은 2022년 11월 ChatGPT 출시와 함께 시작되었습니다. 확실히 약한 지침이지만 다른 모든 것과 합쳐집니다. 그러나 날짜는 쉽게 조작될 수 있습니다.

  • 이미지, 비디오, 비텍스트 미디어가 없거나 적음: 이러한 페이지는 자동으로 생성되고 게시되며, 페이지에 넣을 다른 종류의 콘텐츠를 생성하기 어렵습니다.

  • AI 생성 이미지, 로고: 보통 기사의 배너나 블로그 로고입니다.

  • 형편없는 텍스트 서식

  • 렌더링되지 않은 마크다운 문자: 텍스트에 서식이 없고 마크다운 구문이 있습니다.

  • 불필요하거나 맥락에 맞지 않는 내용이 포함된 긴 게시물: 기사가 어느 시점에서 원래 주제와 관련 있지만 무관한 다른 주제에 대해 이야기하기 시작할 수 있습니다.

  • 항상 검색 엔진 결과 상위에 위치: 물론 SEO를 악용하고 있습니다.

  • 모든 것을 아는 블로그: 같은 블로그가 완전히 다른 주제의 검색 결과에 나타납니다.

  • 모호한 내용: 많은 제목이 있고 각각 짧은 내용이 있지만 유용한 정보를 제공하지 않습니다.

  • 비전문적이거나 누락된 연락처 정보: 도메인을 샀는데 왜 연락처로 Gmail을 사용하나요?

  • 모호하거나 누락된 '소개' 페이지

  • AI 열성 콘텐츠: 누군가 ChatGPT를 좋아한다면 모든 것에 사용할 것입니다. 따라서 AI 전용 블로그를 발견하면 100% AI 생성입니다.

Google Dorks

AI 사용자들은 LLM 응답을 읽지도 않고 복사-붙여넣기 할 만큼 어리석기 때문에, LLM이 때때로 자신을 드러냅니다. 예를 들어 콘텐츠 서론에서 말이죠. 다음은 100% AI 생성된 페이지를 찾기 위한 몇 가지 Google Dorks입니다. 이러한 페이지의 전체 도메인이 uBlock 목록에 추가됩니다. Dorks는 LLM에게 순진한 콘텐츠를 생성하도록 요청하여 쉽게 생성할 수 있습니다. 예를 들어 "내 블로그에 강아지에 관한 기사를 생성해 줘"라고 프롬프트를 입력하면 됩니다. LLM은 "물론입니다! 여기 강아지에 관한 기사가 있습니다." 같은 서론으로 답할 것입니다. 이 문구를 따옴표로 묶어 검색하십시오.

root@kitploit:~
# 영어
"Sure! Here's an article about"

# 이탈리아어
"Certo! Ecco un articolo"

(실험적) SEO 백링크 스프레드시트

SEO 마케터가 자신을 광고할 때, 때때로 자신이 관리하는 웹사이트를 나열한 Google 스프레드시트를 공개합니다. 이는 대개 백링크를 판매하기 위한 것입니다. 다른 많은 사이트에서 귀하의 웹사이트로 링크되면 검색 엔진이 더 신뢰할 수 있다고 간주하여 순위를 높이는 경향이 있습니다. 또는 적어도 백링크를 판매하는 사람들이 그렇게 말합니다. 저는 SEO 전문가가 아니므로 이것이 실제로 효과가 있는지 잘 모릅니다. 하지만 제가 알아차린 것은, 이러한 스프레드시트에 나열된 웹사이트가 대부분 AI 쓰레기라는 점입니다. 이는 목록에 대량으로 웹사이트를 추가하는 효과적인 방법이 될 수 있습니다. 그러나 이는 오탐(false positive) 가능성을 높입니다. 웹사이트가 실제로 AI 쓰레기라는 보장이 없습니다. 이슈 31은 인기 있는 웹사이트가 실수로 목록에 추가된 명확한 예를 보여줍니다.

제가 권장하는 방법은 스프레드시트를 다운로드하여 분석하고, 잠재적인 오탐을 찾아 목록에서 제거하는 것입니다. 스프레드시트를 분석하는 몇 가지 방법은 다음과 같습니다.

  • Tranco 목록과 비교: 이슈 31에서 수행한 대로입니다. 사이트 순위가 너무 높으면 오탐일 수 있습니다.
  • 트래픽/가격별 정렬: 스프레드시트에는 웹사이트 트래픽도 표시됩니다. 웹사이트가 더 인기 있을수록 백링크 가격이 더 비쌉니다. 다른 사이트에 비해 트래픽이 특히 높은 웹사이트는 검사하는 것이 좋습니다.

유사 프로젝트

  • uBlockOrigin & uBlacklist Huge AI Blocklist: 이 프로젝트는 검색 엔진에서 AI 관련 모든 결과를 숨깁니다. 여기에는 제가 합법적인 도구라고 생각하는 웹사이트(예: ChatGPT)도 포함됩니다. 반면 제가 원하는 것은 쓰레기 AI 콘텐츠 팜에 대한 접근만 차단하는 것입니다.
  • Stevo's GenAI Blocklist: 웹사이트에서 AI 위젯을 숨깁니다.
도구 다운로드