
Kit de herramientas de investigación para analizar patrones de comportamiento de agentes de IA mediante análisis de corpus multidisciplinar. Analiza registros de sesión, ejecuta 23 técnicas analíticas y genera informes narrativos impulsados por LLM.
Un proyecto de investigación de Lightless Labs que estudia el comportamiento de los agentes de IA a escala mediante análisis multidisciplinario de corpus (básicamente, lanzando cosas contra la pared y viendo qué se queda pegado).
Nombrado a partir del concepto de Tiffany Aching de Mundodisco: primeros pensamientos (los agentes piensan), segundos pensamientos (los agentes analizan su pensamiento), terceros pensamientos (este proyecto analizando eso).
Terceros Pensamientos tiene dos mitades que comparten un corpus y una metodología:
middens/ — una CLI de Rust para extraer patrones de comportamiento de los registros de sesiones de agentes de IA. Analiza transcripciones de sesiones de agentes de codificación de Claude Code, Codex, OpenClaw y Pi (stub de Gemini), clasifica mensajes y sesiones, y ejecuta una batería de 23 técnicas analíticas (6 nativas de Rust + 17 de Python, empaquetadas mediante un puente de Python integrado). La CLI tiene tres comandos principales: analyze (ejecuta técnicas → almacenamiento Parquet), interpret (narrativa entre técnicas impulsada por LLM) y export (notebook de Jupyter). Consulta middens/README.md.docs/. Aquí es donde viven las afirmaciones científicas.El corpus en sí (corpus/, experiments/) está en gitignore — las sesiones contienen datos privados y no pueden redistribuirse. Las herramientas y la metodología son abiertas; los datos sin procesar no lo son.
Regla de alcance compuesta: cualquier hallazgo principal sobre el pensamiento o el comportamiento del texto debe sobrevivir cuatro ejes — session_type, thinking_visibility, language, y una ventana temporal. Un hallazgo que no sobrevive los cuatro no es un hallazgo. Más contexto en CLAUDE.md y docs/HANDOFF.md.
middens/ Rust CLI — parser, classifiers, techniques, Python bridge
docs/
HANDOFF.md Session-continuity document, read this first
methods-catalog.md 20 method families, 80+ references
examples/ Worked examples for the CLI triad workflow
nlspecs/ Natural-language specs (Why / What / How / Done)
reports/ Research reports
reviews/ Multi-model peer reviews
brainstorms/ Requirements docs
plans/ Implementation plans
solutions/ Institutional knowledge — documented learnings
scripts/ Python analytical battery (26 scripts, mostly superseded by middens)
todos/ Individual todo files with YAML frontmatter
Ignorado por git: corpus/, corpus-full/, corpus-split/, corpus-frozen/, experiments/, data/labeled-messages.json.
Instala la CLI con Homebrew en macOS o Linux:
brew install lightless-labs/tap/middens
middens --help
En Linux sin Homebrew, descarga el tarball de la versión directamente:
# x86_64 Linux
curl -LO https://github.com/Lightless-Labs/third-thoughts/releases/download/v0.0.1-beta.4/middens-0.0.1-beta.4-x86_64-unknown-linux-gnu.tar.gz
tar xzf middens-0.0.1-beta.4-x86_64-unknown-linux-gnu.tar.gz
./middens-0.0.1-beta.4-x86_64-unknown-linux-gnu/middens --help
middens actualmente distribuye binarios para macOS con Apple Silicon, Linux x86_64 y Linux arm64. Homebrew es la vía más fácil si ya lo usas; los tarballs de las versiones y las compilaciones desde el código fuente están documentados en middens/README.md.
Si quieres ejecutar la CLI sobre tus propios registros de sesiones, dirígete a middens/. Si quieres leer sobre la metodología y los hallazgos, empieza por docs/methods-catalog.md y los informes en docs/reports/.
middens archive copia los registros JSONL locales de los agentes a un archivo privado y direccionado por contenido antes de que los proveedores, las políticas de retención o tus propios impulsos de limpieza de madrugada los hagan desaparecer. Almacena transcripciones sin procesar, así que trata la raíz del archivo como datos privados:
middens archive --to ~/agent-session-archive --dry-run
middens archive --to ~/agent-session-archive --yes
Los plugins de automatización autocontenidos viven en integrations/ y no requieren el binario middens en el PATH:
integrations/pi/middens-archive/ — extensión de Pi con /middens-archive-now y /middens-archive-status.integrations/claude-code/middens-archive/ — hooks de Claude Code más /middens-archive-now.integrations/codex/middens-archive/ — hooks de Codex más habilidades de archivado.Los tres requieren un MIDDENS_ARCHIVE_ROOT explícito; no se elige ninguna ruta de archivo predeterminada por ti, porque las carpetas sorpresa de transcripciones sin procesar son de mala educación.
AGPL-3.0-or-later. Consulta LICENSE.
| Hallazgo | Estado | Alcance |
|---|
| Supresión del 99.99% de los tokens de riesgo en sesiones con pensamiento visible | Reforzado | language=en ∧ thinking_visibility=Visible. N=4,518 sesiones, 31,679 tokens de riesgo, 2 filtraciones. |
| Estado previo al fallo/pre-corrección HSMM | Provisional — dirección replicada, magnitud inestable | Re-ejecución pública corregida de HF: middens actual 5.61× con Boucle excluido; script heredado 41.32× bajo sus propios filtros/muestreo. No cites un titular de estilo 24.6×. |
| MVT violado — los agentes subexploran | Robusto | Ver experiments/full-corpus/information-foraging.md. |
| Degradación de la sesión (los agentes empeoran con el tiempo) | Solo se mantiene en interactivo | Ver experiments/interactive/survival_analysis.txt. |
| Contaminación W10–W12 de Boucle en el grupo "interactivo" | Confirmado | 1,820/1,826 sesiones llevan marcadores de bucle autónomo. |