
Strumento di ricerca per analizzare i modelli comportamentali degli agenti AI attraverso l'analisi multidisciplinare dei corpus. Analizza i log delle sessioni, esegue 23 tecniche analitiche e genera report narrativi basati su LLM.
Un progetto di ricerca di Lightless Labs che studia il comportamento degli agenti AI su larga scala attraverso l'analisi multidisciplinare di corpus (fondamentalmente, lanciare cose contro il muro e vedere cosa rimane attaccato).
Prende il nome dal concetto di Tiffany Aching del Mondo Disco: primi pensieri (gli agenti pensano), secondi pensieri (gli agenti analizzano il proprio pensiero), terzi pensieri (questo progetto analizza quello).
Terzi Pensieri ha due parti che condividono un corpus e una metodologia:
middens/ — una CLI in Rust per estrarre pattern comportamentali dai log di sessione degli agenti AI. Analizza trascrizioni da sessioni di Claude Code, Codex, OpenClaw e Pi coding-agent (stub per Gemini), classifica messaggi e sessioni, ed esegue una batteria di 23 tecniche analitiche (6 native Rust + 17 Python, raggruppate tramite un ponte Python incorporato). La CLI ha tre comandi principali: analyze (esegue tecniche → archiviazione Parquet), interpret (narrazione cross-tecnica basata su LLM) ed export (notebook Jupyter). Vedi middens/README.md.docs/. È qui che risiedono le affermazioni scientifiche.Il corpus stesso (corpus/, experiments/) è gitignorato — le sessioni contengono dati privati e non possono essere ridistribuite. Gli strumenti e la metodologia sono aperti; i dati grezzi non lo sono.
Regola di ambito composta: qualsiasi risultato principale sul pensiero o sul comportamento testuale deve sopravvivere a quattro assi — session_type, thinking_visibility, language e una finestra temporale. Un risultato che non sopravvive a tutti e quattro non è un risultato. Maggiori informazioni in CLAUDE.md e docs/HANDOFF.md.
middens/ CLI Rust — parser, classificatori, tecniche, ponte Python
docs/
HANDOFF.md Documento di continuità della sessione, leggere prima questo
methods-catalog.md 20 famiglie di metodi, 80+ riferimenti
examples/ Esempi pratici per il flusso di lavoro della triade CLI
nlspecs/ Specifiche in linguaggio naturale (Perché / Cosa / Come / Fatto)
reports/ Rapporti di ricerca
reviews/ Revisioni tra pari multi-modello
brainstorms/ Documenti sui requisiti
plans/ Piani di implementazione
solutions/ Conoscenza istituzionale — lezioni documentate
scripts/ Batteria analitica Python (26 script, in gran parte sostituiti da middens)
todos/ File todo individuali con frontmatter YAML
Gitignorato: corpus/, corpus-full/, corpus-split/, corpus-frozen/, experiments/, data/labeled-messages.json.
Installa la CLI con Homebrew su macOS o Linux:
brew install lightless-labs/tap/middens
middens --help
Su Linux senza Homebrew, scarica direttamente il tarball della release:
# x86_64 Linux
curl -LO https://github.com/Lightless-Labs/third-thoughts/releases/download/v0.0.1-beta.4/middens-0.0.1-beta.4-x86_64-unknown-linux-gnu.tar.gz
tar xzf middens-0.0.1-beta.4-x86_64-unknown-linux-gnu.tar.gz
./middens-0.0.1-beta.4-x86_64-unknown-linux-gnu/middens --help
middens attualmente distribuisce binari per macOS Apple Silicon, Linux x86_64 e Linux arm64. Homebrew è la via più semplice se lo usi già; i tarball delle release e le build da sorgente sono documentati in middens/README.md.
Se vuoi eseguire la CLI sui tuoi log di sessione, vai in middens/. Se vuoi leggere la metodologia e i risultati, inizia con docs/methods-catalog.md e i rapporti in docs/reports/.
middens archive copia i log JSONL locali degli agenti in un archivio privato indirizzato per contenuto prima che i vendor, le politiche di conservazione o i tuoi stessi impulsi di pulizia notturna li facciano sparire. Memorizza le trascrizioni grezze, quindi tratta la radice dell'archivio come dati privati:
middens archive --to ~/agent-session-archive --dry-run
middens archive --to ~/agent-session-archive --yes
Plugin di automazione autonomi risiedono in integrations/ e non richiedono il binario middens nel PATH:
integrations/pi/middens-archive/ — estensione Pi con /middens-archive-now e /middens-archive-status.integrations/claude-code/middens-archive/ — hook di Claude Code più /middens-archive-now.integrations/codex/middens-archive/ — hook di Codex più abilità di archiviazione.Tutti e tre richiedono un MIDDENS_ARCHIVE_ROOT esplicito; nessun percorso di archivio predefinito viene scelto per te, perché cartelle di trascrizioni grezze a sorpresa sono scortesi.
AGPL-3.0-or-later. Vedi LICENSE.
| Risultato | Stato | Ambito |
|---|
| Soppressione del 99,99% dei token di rischio nelle sessioni con pensiero visibile | Rafforzato | language=en ∧ thinking_visibility=Visible. N=4.518 sessioni, 31.679 token di rischio, 2 perdite. |
| Stato pre-fallimento/pre-correzione HSMM | Provvisorio — direzione replicata, magnitudine instabile | Riesecuzione pubblica HF fissa: attuali middens 5,61× Boucle-esclusi; script legacy 41,32× sotto i propri filtri/campionamento. Non citare un titolo in stile 24,6×. |
| MVT violato — gli agenti esplorano meno del dovuto | Robusto | Vedi experiments/full-corpus/information-foraging.md. |
| Degrado della sessione (gli agenti peggiorano nel tempo) | Vale solo per interattivo | Vedi experiments/interactive/survival_analysis.txt. |
| Contaminazione Boucle W10–W12 nel bucket "interattivo" | Confermato | 1.820/1.826 sessioni portano marcatori di loop autonomo. |