
검색 엔진(Google, Bing, Baidu)을 통해 도메인 내 문서를 검색합니다. 목표는 메타데이터를 추출하는 것입니다.
검색 엔진을 통해 도메인 내 문서를 검색합니다. 목표는 메타데이터를 추출하는 것입니다.
> pip3 install metafinder
업그레이드는 다음 명령어로 가능합니다:
> pip3 install metafinder --upgrade
MetaFinder는 2가지 방법으로 사용할 수 있습니다:
metafinder -d domain.com -l 20 -o folder [-t 10] -go -bi -ba
매개변수:
import metafinder.extractor as metadata_extractor
documents_limit = 5
domain = "target_domain"
result = metadata_extractor.extract_metadata_from_google_search(domain, documents_limit)
# result = metadata_extractor.extract_metadata_from_bing_search(domain, documents_limit)
# result = metadata_extractor.extract_metadata_from_baidu_search(domain, documents_limit)
authors = result.get_authors()
software = result.get_software()
for k,v in result.get_metadata().items():
print(f"{k}:")
print(f"|_ URL: {v['url']}")
for metadata,value in v['metadata'].items():
print(f"|__ {metadata}: {value}")
document_name = "test.pdf"
try:
metadata_file = metadata_extractor.extract_metadata_from_document(document_name)
for k,v in metadata_file.items():
print(f"{k}: {v}")
except FileNotFoundError:
print("File not found")

이 프로젝트는 다음 사람에 의해 개발되었습니다:
이 소프트웨어는 도메인에 업로드하는 문서에 흔적을 남기지 않도록 설계되었습니다. 작성자는 불법적인 사용에 대해 책임을 지지 않습니다.