🎯 Seminar Brief
Несущий разрыв
Разлом: ИИ должен одновременно (а) моделировать реалистичного скептического подростка/родителя/студента СПО (сложная роль, требующая психологической правдоподобности), (б) обеспечивать корректность правовых фактов (требует интеграции с КонсультантПлюс и защиты от галлюцинаций), (в) быть педагогическим тренажёром (давать обратную связь педагогу-студенту о качестве его ответа). Три роли требуют разной конфигурации — если ИИ хорошо играет подростка, но плохо интегрирует правовую базу, тренажёр даст студенту неправильную обратную связь; если хорошо интегрирует базу, но не убедителен как подросток, теряется реалистичность. Балансировка не операционализирована в исходном тексте. Второй разлом — оценка педагогического качества ответа студента (умение объяснить сложную норму простым языком, построить доверительный диалог, не навредить) — эти критерии субъективны и требуют экспертной калибровки.
sources: [art-92217a4081 slides «Право в диалоге ИИ-тренажёр для педагог…» · high]; [art-cfe615f363 slides «Право в диалоге ИИ-тренажёр для педагог…» · medium]; [analysis_json orchestrator_run:ar-52dbbab73f · high]
frame_tensions
- {"tension_id": "ft-a92204092d", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-PRJ\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-562eff49de", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-PRJ\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-36bb0f239d", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-RES\", \"F-PRJ\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-205da53908", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-EDU\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-ff38699e53", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-RES\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-062f1ac6fc", "analysis_run_id": "ar-52dbbab73f", "frames_involved_json": "[\"F-RES\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
sources: [db_row project_lineages:lin-8641f62275 · high]; [analysis_json orchestrator_run:ar-52dbbab73f · high]
position_invocations
- {"invocation_id": "piv-c0a085031f", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}
- {"invocation_id": "piv-416b8dad09", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}
sources: [db_row project_lineages:lin-8641f62275 · high]; [db_row position_invocation_records:piv-c0a085031f · high]; [analysis_json orchestrator_run:ar-52dbbab73f · high]
🔬 Sem-6 v2 · Evidence-Grounded Analysis
Failure Analysis 2.0
Mechanism Failure (где механизм не сработает): - ИИ-роль скептика может сдаться под давлением студента (jailbreaking). - Правовые нормы часто имеют несколько интерпретаций; ИИ навяжет одну как консенсусную. - 3 роли одновременно = сложная промпт-конфигурация; при её сбое роль подростка деградирует в помощника.
Incentive Failure (кто как обойдёт): - 100 студентов + активная КГ = большой объём rubric-оценки; преподаватель может упрощать. - Юрист-эксперт для валидации базы правовых фактов — не мотивирован работать бесплатно.
Delegation Failure (что ИИ заберёт у человека): - Студент делегирует формулировку 'простого объяснения' ИИ через reverse loop. - Готовые правовые факты снимают навык поиска в КонсультантПлюс.
Measurement Failure (как решим что успех, ошибочно): - Рубрика 'простой язык' субъективна без калибровки. - Активная КГ (карточки возражений) может не быть эквивалентной по объёму нагрузки → сравнение искажено.
Minimal Viable Experiment
Hypothesis (что проверяем): Педагогические ответы ЭГ (ИИ-тренажёр в 3 ролях) статистически более обоснованы (rubric ≥ 4/5) vs активная КГ (карточки возражений без ИИ) на новом сценарии.
Intervention (что меняем): ЭГ (2 группы × 25 чел.) проходят 15-20 диалогов через тренажёр за семестр. Активная КГ (2 группы × 25 чел.) — те же 15-20 сценариев через карточки возражений без ИИ.
Control (с чем сравниваем): Активная КГ (не пассивная) — изолирует эффект ИИ от эффекта практики.
Observable change (что должно измениться): Rubric ЭГ > активная КГ p<0.05, N=50 per группа; ≥ 95% правовых фактов сверены с КонсультантПлюс; ≤ 10% диалогов, где ИИ сдался.
Evidence needed (какие данные): Сценарный банк 15-20 диалогов; интеграция КонсультантПлюс (RAG); rubric с 2+ калиброванными rater'ами; логи диалогов для audit.