Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
tsfresh — Extração automática de características relevantes de séries temporais: | Kitploit
Ferramentas/GitHubGitHub/blue-yonder/tsfresh
Utilitários de Propósito GeralAprendizado de MáquinaDetecção de Anomalias
GitHubblue-yonder/tsfresh

tsfresh

Extração automática de características relevantes de séries temporais:

Ver RepositórioSite
9.3k1.3khá 1 mêsRevisado pelo Kitploit

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar

tsfresh

Documentation Status Build Status codecov license Binder Downloads

Este repositório contém o pacote Python TSFRESH. A abreviatura significa

"Extração de características de séries temporais baseada em testes de hipóteses escaláveis".

O pacote fornece extração sistemática de características de séries temporais ao combinar algoritmos consolidados de estatística, análise de séries temporais, processamento de sinais e dinâmica não linear com um algoritmo robusto de seleção de características. Nesse contexto, o termo série temporal é interpretado no sentido mais amplo possível, de modo que qualquer tipo de dados amostrados ou até mesmo sequências de eventos possa ser caracterizado.

Gaste menos tempo com engenharia de características

Cientistas de dados muitas vezes passam a maior parte do tempo limpando dados ou construindo características. Embora não possamos mudar a primeira parte, a segunda pode ser automatizada. O TSFRESH libera seu tempo gasto na construção de características ao extraí-las automaticamente. Assim, você tem mais tempo para estudar o artigo mais recente sobre deep learning, ler o Hacker News ou construir modelos melhores.

Extração automática de centenas de características

O TSFRESH extrai automaticamente centenas de características de séries temporais. Essas características descrevem propriedades básicas da série temporal, como o número de picos, o valor médio ou máximo, ou características mais complexas, como a estatística de simetria por reversão temporal.

As características extraídas de uma série temporal exemplar

O conjunto de características pode então ser usado para construir modelos estatísticos ou de aprendizado de máquina sobre as séries temporais, utilizados, por exemplo, em tarefas de regressão ou classificação.

Esqueça as características irrelevantes

As séries temporais frequentemente contêm ruído, redundâncias ou informações irrelevantes. Como resultado, a maioria das características extraídas não será útil para a tarefa de aprendizado de máquina em questão.

Para evitar a extração de características irrelevantes, o pacote TSFRESH possui um procedimento de filtragem embutido. Esse procedimento de filtragem avalia o poder explicativo e a importância de cada característica para as tarefas de regressão ou classificação em questão.

Ele é baseado na teoria bem estabelecida de testes de hipóteses e utiliza um procedimento de testes múltiplos. Como resultado, o processo de filtragem controla matematicamente a porcentagem de características irrelevantes extraídas.

O pacote TSFRESH é descrito no seguinte artigo de acesso aberto:

  • Christ, M., Braun, N., Neuffer, J., and Kempa-Liehr A.W. (2018). Time Series FeatuRe Extraction on basis of Scalable Hypothesis tests (tsfresh -- A Python package). Neurocomputing 307, p. 72-77, doi: 10.1016/j.neucom.2018.03.067.

O algoritmo FRESH é descrito no seguinte whitepaper:

  • Christ, M., Kempa-Liehr, A.W., and Feindt, M. (2017). Distributed and parallel time series feature extraction for industrial big data applications. ArXiv e-print 1610.07717, https://arxiv.org/abs/1610.07717.

Modelos de normalidade simulam como os humanos detectam anomalias em séries temporais:

  • Teh, H.Y., Wang, K.I-K., Kempa-Liehr, A.W. (2021). Expect the Unexpected: Unsupervised feature selection for automated sensor anomaly detection. IEEE Sensors Journal 15.16, p. 18033-18046, doi: 10.1109/JSEN.2021.3084970.

  • Teh, H.Y., Wang, K.I-K., Kempa-Liehr, A.W. (2025). Feature-based normality models for anomaly detection. Sensors 25.4757, p. 1-25, doi: 10.3390/s25154757.

A extração sistemática de características de séries temporais também funciona para problemas não supervisionados:

  • Abrasaldo, P.M., Zarrouk, S.J., Kempa-Liehr, A.W. (2026). Feature-Based Time Series Clustering for Efficient Labeling of Geothermal Data. Geothermics 138.103656, p. 1–13, doi: 10.1016/j.geothermics.2026.103656

Devido ao fato de o tsfresh basicamente fornecer extração de características de séries temporais de forma gratuita, você pode agora se concentrar em projetar novas séries temporais, como, por exemplo, diferenças de sinais de medições síncronas, que fornecem características de séries temporais ainda melhores:

  • Kempa-Liehr, A.W., Oram, J., Wong, A., Finch, M., Besier, T. (2020). Feature engineering workflow for activity recognition from synchronized inertial measurement units. In: Pattern Recognition. ACPR 2019. Ed. by M. Cree et al. Vol. 1180. Communications in Computer and Information Science (CCIS). Singapore: Springer, p. 223–231. doi: 10.1007/978-981-15-3651-9_20.

  • Simmons, S., Jarvis, L., Dempsey, D., Kempa-Liehr, A.W. (2021). Data Mining on Extremely Long Time-Series. In: 2021 International Conference on Data Mining Workshops (ICDMW). Ed. by B. Xue et al. Los Alamitos: IEEE, p. 1057-1066. doi: 10.1109/ICDMW53433.2021.00137.

A engenharia sistemática de características de séries temporais permite trabalhar com amostras de séries temporais de diferentes comprimentos, porque cada série temporal é projetada em um espaço de características bem definido. Essa abordagem permite o projeto de algoritmos robustos de aprendizado de máquina em aplicações com dados ausentes.

  • Kennedy, A., Gemma, N., Rattenbury, N., Kempa-Liehr, A.W. (2021). Modelling the projected separation of microlensing events using systematic time-series feature engineering. Astronomy and Computing 35.100460, p. 1–14, doi: 10.1016/j.ascom.2021.100460

O seu problema de classificação de séries temporais é desbalanceado? Há uma boa chance de que a subamostragem das matrizes de características de séries temporais resolva o seu problema:

  • Dempsey, D.E., Cronin, S.J., Mei, S., Kempa-Liehr, A.W. (2020). Automatic precursor recognition and real-time forecasting of sudden explosive volcanic eruptions at Whakaari, New Zealand. Nature Communications 11.3562, p. 1-8, doi: 10.1038/s41467-020-17375-2.

Você não trabalha com séries temporais, mas com imagens 2D e 3D? Sequências de variação espacial (SVS) são uma excelente aplicação do tsfresh:

  • Jeune, H., Pechan, N., Reitsma, S., Kempa-Liehr, A.W. (2021). Spatial Variation Sequences for Remote Sensing Applications with Small Sample Sizes. In: 2024 Image and Video Technology. 11th Pacific-Rim Symposium, Ed. by W.Q. Yan et al., Lecture Notes in Computer Science (14403). Springer Nature: Singapore, p. 153-166. doi: {10.1007/978-981-97-0376-0_12.

  • Koptev, I., Tian, J., Peel, E., Parker, R., Walker, C., Kempa-Liehr, A.W. (2025). Interpretable Dimensionality Reduction in 3D Image Recognition with Small Sample Sizes. Journal of Nondestructive Evaluation 44.44, p. 1-12, doi: 10.1007/s10921-025-01183-z.

O processamento de linguagem natural de textos escritos é um exemplo de aplicação da engenharia sistemática de características de séries temporais a sequências de eventos, descrito no seguinte artigo de acesso aberto:

  • Tang, Y., Blincoe, K., Kempa-Liehr, A.W. (2020). Enriching Feature Engineering for Short Text Samples by Language Time Series Analysis. EPJ Data Science 9.26, p. 1–59. doi: 10.1140/epjds/s13688-020-00244-9

Vantagens do tsfresh

O TSFRESH tem vários pontos fortes, por exemplo

  1. é testado em campo
  2. possui testes unitários
  3. o processo de filtragem é estatística/matematicamente correto
  4. possui uma documentação abrangente
  5. é compatível com sklearn, pandas e numpy
  6. permite que qualquer pessoa adicione facilmente suas características favoritas
  7. executa tanto na sua máquina local quanto em um cluster

Próximos passos

Se você está interessado nos detalhes técnicos, consulte nossa documentação abrangente no Read-The-Docs em http://tsfresh.readthedocs.io.

O algoritmo, especialmente a parte de filtragem, também é descrito no artigo mencionado acima.

Agradecemos qualquer contribuição. Se você tiver interesse em nos ajudar a tornar o TSFRESH o maior arquivo de métodos de extração de características em Python, basta acessar nossas instruções em How-To-Contribute.

Se você quiser experimentar o tsfresh rapidamente ou integrá-lo ao seu fluxo de trabalho, também temos uma imagem docker disponível:

root@kitploit:~
docker pull nbraun/tsfresh

Compatibilidade com versões anteriores

Se você precisar reproduzir ou atualizar características de séries temporais que foram calculadas com os calculadores de características matrixprofile, você precisa criar um ambiente Python 3.8:

root@kitploit:~
conda create --name tsfresh__py_3.8 python=3.8
conda activate tsfresh__py_3.8
pip install tsfresh[matrixprofile]

Agradecimentos

A pesquisa e o desenvolvimento do TSFRESH foram financiados em parte pelo Ministério Federal Alemão de Educação e Pesquisa, sob o número de subsídio 01IS14004 (projeto iPRODICT).

Baixar ferramenta