
Real-world infosec wordlists, updated regularly

Эти словники основаны на исходном коде CMS/серверов/фреймворков, перечисленных здесь. Текущие словники включают:
Есть 2 версии каждого словника:
webapps/examples/WEB-INF/classes/websocket/echo/servers.json
webapps/examples/WEB-INF/classes/websocket/echo/servers.json
examples/WEB-INF/classes/websocket/echo/servers.json
WEB-INF/classes/websocket/echo/servers.json
websocket/echo/servers.json
echo/servers.json
servers.json
Эти словники вдохновлены проектом RobotsDisallowed Дэниела Мисслера и содержат пути Allow и Disallow из robots.txt для первых 100, 1000 и 10000 веб-сайтов по данным набора данных Open PageRank от Domcop.
Этот словник содержит поддомены, найденные для каждой цели в проекте Inventory. Он состоит из 1,4 миллиона слов, сгенерированных из поддоменов более 50 публичных программ bug bounty.
Этот словник содержит поддомены, найденные при перечислении активов cloud. Он состоит из 940 тысяч слов, сгенерированных из поддоменов, извлечённых из Common Name и Subject Alternative Name более 7 миллионов SSL-сертификатов.
И ещё больше словников впереди!
Рабочий процесс Trickest клонирует репозитории из technology-repositories.json, составляет список путей всех их файлов, удаляет неинтересные файлы, генерирует комбинации и отправляет словники в этот репозиторий.

Другой рабочий процесс Trickest получает первые 100, 1000 и 1000 веб-сайтов из набора данных Open PageRank от Domcop, использует meg для получения их файлов robots.txt (Спасибо, @tomnomnom!), удаляет нерелевантные записи, очищает пути и отправляет словники в этот репозиторий.

Все вклады/предложения/вопросы приветствуются! Не стесняйтесь создавать новый тикет через GitHub issues, написать нам в твиттере @trick3st или присоединиться к обсуждению на Discord.
Мы верим в ценность экспериментов. Запишитесь на демо на trickest.com, чтобы настроить этот рабочий процесс под свой сценарий, получить доступ к множеству других рабочих процессов или создать свой собственный с нуля!