# 🔧 Lab Handoff

## lab_requirement
- **build_status:** NO_BUILD
- **readiness_score:** 0.3
- **no_build_reason:** Несмотря на продуманную цель и доказательства подготовленности оборудования, проект не готов к инженерному развертыванию из-за отсутствия чёткой декомпозиции human-machine workflow, неопределённости р

> _sources:_ [db_row project_lineages:lin-8641f62275 · high]; [analysis_json orchestrator_run:ar-52dbbab73f · high]

## v2_mve
### Minimal Viable Experiment

**Hypothesis** (что проверяем): Педагогические ответы ЭГ (ИИ-тренажёр в 3 ролях) статистически более обоснованы (rubric ≥ 4/5) vs активная КГ (карточки возражений без ИИ) на новом сценарии.

**Intervention** (что меняем): ЭГ (2 группы × 25 чел.) проходят 15-20 диалогов через тренажёр за семестр. Активная КГ (2 группы × 25 чел.) — те же 15-20 сценариев через карточки возражений без ИИ.

**Control** (с чем сравниваем): Активная КГ (не пассивная) — изолирует эффект ИИ от эффекта практики.

**Observable change** (что должно измениться): Rubric ЭГ > активная КГ p<0.05, N=50 per группа; ≥ 95% правовых фактов сверены с КонсультантПлюс; ≤ 10% диалогов, где ИИ сдался.

**Evidence needed** (какие данные): Сценарный банк 15-20 диалогов; интеграция КонсультантПлюс (RAG); rubric с 2+ калиброванными rater'ами; логи диалогов для audit.

## Архитектура · v2_agentity_audit
### Agenticity Check

**Verdict — Agent Level: 1** (Adaptive assistant (ролевой))

- **Memory (устойчивое состояние):** NO — per-session диалоги; state не накапливается
- **Goal (собственная цель):** NO — цель — задача сценария, не ИИ
- **Planning (самостоятельная последовательность):** NO — нет планирования, только реагирование
- **Autonomy (действия без запроса):** NO — все реплики — по запросу студента
- **Human Gate (где остаётся человек):** YES — тренажёр — не реальный диалог; преподаватель + юрист-эксперт валидируют


---

## 🔬 Sem-6 v2 · Evidence-Grounded Analysis

### Minimal Viable Experiment

**Hypothesis** (что проверяем): Педагогические ответы ЭГ (ИИ-тренажёр в 3 ролях) статистически более обоснованы (rubric ≥ 4/5) vs активная КГ (карточки возражений без ИИ) на новом сценарии.

**Intervention** (что меняем): ЭГ (2 группы × 25 чел.) проходят 15-20 диалогов через тренажёр за семестр. Активная КГ (2 группы × 25 чел.) — те же 15-20 сценариев через карточки возражений без ИИ.

**Control** (с чем сравниваем): Активная КГ (не пассивная) — изолирует эффект ИИ от эффекта практики.

**Observable change** (что должно измениться): Rubric ЭГ > активная КГ p<0.05, N=50 per группа; ≥ 95% правовых фактов сверены с КонсультантПлюс; ≤ 10% диалогов, где ИИ сдался.

**Evidence needed** (какие данные): Сценарный банк 15-20 диалогов; интеграция КонсультантПлюс (RAG); rubric с 2+ калиброванными rater'ами; логи диалогов для audit.

### Failure Analysis 2.0

**Mechanism Failure** (где механизм не сработает):
- ИИ-роль скептика может сдаться под давлением студента (jailbreaking).
- Правовые нормы часто имеют несколько интерпретаций; ИИ навяжет одну как консенсусную.
- 3 роли одновременно = сложная промпт-конфигурация; при её сбое роль подростка деградирует в помощника.

**Incentive Failure** (кто как обойдёт):
- 100 студентов + активная КГ = большой объём rubric-оценки; преподаватель может упрощать.
- Юрист-эксперт для валидации базы правовых фактов — не мотивирован работать бесплатно.

**Delegation Failure** (что ИИ заберёт у человека):
- Студент делегирует формулировку 'простого объяснения' ИИ через reverse loop.
- Готовые правовые факты снимают навык поиска в КонсультантПлюс.

**Measurement Failure** (как решим что успех, ошибочно):
- Рубрика 'простой язык' субъективна без калибровки.
- Активная КГ (карточки возражений) может не быть эквивалентной по объёму нагрузки → сравнение искажено.

### Agenticity Check

**Verdict — Agent Level: 1** (Adaptive assistant (ролевой))

- **Memory (устойчивое состояние):** NO — per-session диалоги; state не накапливается
- **Goal (собственная цель):** NO — цель — задача сценария, не ИИ
- **Planning (самостоятельная последовательность):** NO — нет планирования, только реагирование
- **Autonomy (действия без запроса):** NO — все реплики — по запросу студента
- **Human Gate (где остаётся человек):** YES — тренажёр — не реальный диалог; преподаватель + юрист-эксперт валидируют
