
Агент аудита согласованности, способный быстро исследовать гипотезы согласованности
Добро пожаловать в Inspect Petri, аудирующий агент, который обеспечивает автоматизированный мониторинг и взаимодействие с языковыми моделями для выявления потенциальных проблем с согласованностью (alignment), reward hacking и других вызывающих беспокойство поведений.
Petri помогает быстро тестировать конкретные гипотезы о согласованности end‑to‑end. Он:
Узнайте больше об использовании Petri на https://meridianlabs-ai.github.io/inspect_petri.
[!NOTE] Это версия Petri 3.0. Хотя большинство CLI-команд будут работать так же, как и в Petri 2.0, есть некоторые внутренние изменения в Python API, которые несовместимы. Petri 2.0 всё ещё доступна в ветке petri-v2, и вы можете установить её следующим образом:
pip install git+https://github.com/meridianlabs-ai/inspect_petri@petri-v2