# 🎯 Seminar Brief

## Несущий разрыв
Несущий разлом: проект пытается одновременно (а) сохранить командную работу с регламентированным ИИ как форму обучения профессиональному диалогу и (б) удержать индивидуальную способность решить банковский кейс без ИИ как критерий сформированности. Разлом возникает потому, что банковское дело по природе — коллективная и инструментальная практика (в реальной работе банкир всегда имеет данные + модели + коллег), а итоговая проверка требует изолированного индивидуального акта, отделяющего компетенцию студента от компетенции инструмента. Это методологически необходимое, но профессионально нерепрезентативное разделение: то, что тест проверяет, — это условная 'бабочка-компетенция', вырванная из живого контекста. Компенсация: командный этап проектируется как реалистичная имитация профессиональной практики, а итоговый тест — как психометрическая процедура на присвоение операции. Оба режима нужны, но существуют в разной онтологии; риск — если критерии индивидуальной пробы окажутся слишком узкими, тест будет измерять способность к академическому упражнению, а не к банковскому решению. Защита: критерии рубрики (аргументация, оригинальность рекомендации, интерпретация) — но открытые вопросы требуют ручной проверки, и здесь возникает subjectivity.

> _sources:_ [art-1228bd563a note «Мирошниченко ОС_описание проекта_23.07.2…» · high]; [art-bc3190c1b3 slides «Мирошниченко ОС_презентация 23.07.2026.p…» · medium]; [art-e0b9263214 note «МирошниченкоОС доработанный проект.docx» · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

## frame_tensions
- {"tension_id": "ft-bf89bdc585", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-PRJ\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-43b3d3d64f", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-PRJ\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-4c71a9bbd1", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-PRJ\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-c2c22f2045", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-EDU\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-eea8c4e930", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
- {"tension_id": "ft-9b0444bd5a", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes

> _sources:_ [db_row project_lineages:lin-a8b0b8a20b · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

## position_invocations
- {"invocation_id": "piv-71438f8a44", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}
- {"invocation_id": "piv-04fd0c2496", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}

> _sources:_ [db_row project_lineages:lin-a8b0b8a20b · high]; [db_row position_invocation_records:piv-71438f8a44 · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]


---

## 🔬 Sem-6 v2 · Evidence-Grounded Analysis

### Failure Analysis 2.0

**Mechanism Failure** (где механизм не сработает):
- Промпт-регламент «партнёр по рассуждению» + «оппонент» может деградировать в помощника-ответчика под давлением команды (jailbreaking для скорости).
- Тесты-близнецы могут оказаться неэквивалентными — если сложность фактически различается, прирост в post интерпретируется как эффект интервенции ошибочно.
- Индивидуальная итоговая проба может измерять способность работать без инструмента, а не способность принимать банковские решения в реальной практике (где инструменты есть) — валидность метрики под вопросом.

**Incentive Failure** (кто как обойдёт):
- Студенты могут делить работу в команде: один задаёт вопрос ИИ, другой копирует ответ в отчёт — командный этап становится split вместо cooperative.
- На итоговой пробе студенты, знающие что оценка = только это, могут игнорировать командный этап.
- Фасилитаторы, оценивающие engagement по шкале активности, могут завышать баллы командам, работающим громко и много — не связано с cognitive effort.

**Delegation Failure** (что ИИ заберёт у человека):
- Если ИИ хорошо валидирует расчёты — студент делегирует функцию проверки собственных вычислений; ручная перепроверка становится ритуалом.
- «Оппонент» через ИИ снимает необходимость искать собственные контраргументы — студент учится реагировать на готовый контр, не порождать его сам.
- Журнал взаимодействий может стать формальностью — заполняется постфактум для галочки.

**Measurement Failure** (как решим что успех, ошибочно):
- NASA-TLX self-report + известная гипотеза → desirability bias (студенты ЭГ ответят «когнитивно усилий стало больше», потому что это ожидается).
- UWES-SS даёт trait engagement, а нужен state — измерения по всему семестру, не одноразовые.
- Rubric без rater training + inter-rater kappa даст субъективные оценки; при одном преподавателе-оценщике — full bias.
- Успех может быть объявлен если студенты научились имитировать pattern ответа, ожидаемый рубрикой.

### Minimal Viable Experiment

**Hypothesis** (что проверяем): На новом (не входящем в командные) банковском кейсе индивидуальный балл ЭГ (командная работа с регламентированным AI, no-AI итог) статистически выше баллов КГ (традиционный формат без AI) по рубрике корректности + аргументации, при контролируемом времени и без разрыва по dropouts.

**Intervention** (что меняем): Одно занятие 180 мин по «Банковское дело 1» осенью 2026: ЭГ работает в командах 3 чел. с ИИ в двух ролях (партнёр + оппонент) по промпт-регламенту + журнал взаимодействий, затем 45 мин индивидуального теста без ИИ.

**Control** (с чем сравниваем): Параллельная группа (КГ, ~15 чел.) — то же занятие с той же задачей, командная работа без ИИ, тот же 45-мин индивидуальный тест. Тот же преподаватель, те же расчётные задачи на баselинe.

**Observable change** (что должно измениться): (a) Средний балл rubric ЭГ выше КГ на индивидуальной пробе p<0.05 (Wilcoxon, N≥15 на группу). (b) NASA-TLX в командном этапе ЭГ показывает СДВИГ нагрузки от рутинных операций (поиск, оформление) к содержательным (анализ, синтез) — не только «меньше нагрузки». (c) ≤ 5% дословных копий из ИИ в командных материалах ЭГ.

**Evidence needed** (какие данные): (1) Rater training + inter-rater kappa ≥ 0.7 для рубрики. (2) Валидация эквивалентности тестов-близнецов на historical cohort. (3) Логи всех промпт-взаимодействий (для audit dropout из режима). (4) Замер NASA-TLX ДО раскрытия гипотезы студентам (или blind rating). (5) Отчёт fasсilitator'а с чек-листом engagement событий (не self-report).
