Summary

Стандартизированное выполнение и аудит-отчетность для повторяемых прогонов репозитория глубокого обучения.

  • Фиксирует доказательства из smoke-тестов, прогонов вывода и команд оценки; записывает нормализованные выходные данные в repro_outputs/ с отслеживанием патчей, когда файлы репозитория изменяются

  • Генерирует SCIENTIFIC_CHANGELOG.md для документирования изменений, влияющих на оценку, предобработку или метрики, и COMPARABILITY_REPORT.md для оценки соответствия README и базовым линиям статьи

  • Применяется только после того, как существует цель воспроизведения и план настройки; не выполняет начальную загрузку репозитория, выполнение обучения или выбор цели

  • Различает между проверяемыми, частично выполненными и заблокированными состояниями выполнения; отказывается скрывать изменения, которые изменяют научное значение

minimal-run-and-audit

Use this as the Rigor Run skill. The installed slug remains minimal-run-and-audit for compatibility. Use the shared operating principles in ../../references/agent-operating-principles.md; this skill should make run evidence auditable without turning every command into a rigid protocol.

When to apply

  • After a reproduction target and setup plan exist.

  • When the main skill needs execution evidence and normalized outputs.

  • When a smoke test, documented inference run, documented evaluation run, or other short non-training verification is appropriate.

  • When the user already knows what command should be attempted and wants execution plus reporting only.

When not to apply