通过搜索引擎在域名中搜索文档。目标是提取元数据。
> pip3 install metafinder
也可通过以下命令升级:
> pip3 install metafinder --upgrade
MetaFinder 可以通过两种方式使用:
metafinder -d domain.com -l 20 -o folder [-t 10] -go -bi -ba
参数:
import metafinder.extractor as metadata_extractor
documents_limit = 5
domain = "target_domain"
result = metadata_extractor.extract_metadata_from_google_search(domain, documents_limit)
# result = metadata_extractor.extract_metadata_from_bing_search(domain, documents_limit)
# result = metadata_extractor.extract_metadata_from_baidu_search(domain, documents_limit)
authors = result.get_authors()
software = result.get_software()
for k,v in result.get_metadata().items():
print(f"{k}:")
print(f"|_ URL: {v['url']}")
for metadata,value in v['metadata'].items():
print(f"|__ {metadata}: {value}")
document_name = "test.pdf"
try:
metadata_file = metadata_extractor.extract_metadata_from_document(document_name)
for k,v in metadata_file.items():
print(f"{k}: {v}")
except FileNotFoundError:
print("File not found")

本项目由以下人员开发:
该软件设计为在我们上传到域名的文档中不留痕迹。作者不对任何非法使用负责。