Paideia
Корпус
📋 Каталог · 291 кейс 🗺 Карта корпуса 🎯 Подбор аналогов 📚 Теория ⚡ ТРИЗ-приёмы 📖 Библиотека
Моё
📁 Рабочие пространства 🎓 Курсы 🔎 Разборы ∇ Дискуссия с Kaiyona + новое пространство
Сервис
Organs (диагностика) 🔑 Войти по коду 🚪 Сменить роль ⚙️ Свой LLM-ключ (BYOK) 💛 Поддержать ⚙️ Сервисный режим 📊 Аудит LLM

seminar_brief

6921c 8 packages raw md json

🎯 Seminar Brief

Несущий разрыв

Несущий разлом: проект пытается одновременно (а) сохранить командную работу с регламентированным ИИ как форму обучения профессиональному диалогу и (б) удержать индивидуальную способность решить банковский кейс без ИИ как критерий сформированности. Разлом возникает потому, что банковское дело по природе — коллективная и инструментальная практика (в реальной работе банкир всегда имеет данные + модели + коллег), а итоговая проверка требует изолированного индивидуального акта, отделяющего компетенцию студента от компетенции инструмента. Это методологически необходимое, но профессионально нерепрезентативное разделение: то, что тест проверяет, — это условная 'бабочка-компетенция', вырванная из живого контекста. Компенсация: командный этап проектируется как реалистичная имитация профессиональной практики, а итоговый тест — как психометрическая процедура на присвоение операции. Оба режима нужны, но существуют в разной онтологии; риск — если критерии индивидуальной пробы окажутся слишком узкими, тест будет измерять способность к академическому упражнению, а не к банковскому решению. Защита: критерии рубрики (аргументация, оригинальность рекомендации, интерпретация) — но открытые вопросы требуют ручной проверки, и здесь возникает subjectivity.

sources: [art-1228bd563a note «Мирошниченко ОС_описание проекта_23.07.2…» · high]; [art-bc3190c1b3 slides «Мирошниченко ОС_презентация 23.07.2026.p…» · medium]; [art-e0b9263214 note «МирошниченкоОС доработанный проект.docx» · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

frame_tensions

  • {"tension_id": "ft-bf89bdc585", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-PRJ\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
  • {"tension_id": "ft-43b3d3d64f", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-PRJ\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
  • {"tension_id": "ft-4c71a9bbd1", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-PRJ\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
  • {"tension_id": "ft-c2c22f2045", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-EDU\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
  • {"tension_id": "ft-eea8c4e930", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-EDU\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes
  • {"tension_id": "ft-9b0444bd5a", "analysis_run_id": "ar-2f27115f22", "frames_involved_json": "[\"F-RES\", \"F-AIH\"]", "conflicting_units_json": null, "conflicting_criteria_json": null, "project_stakes

sources: [db_row project_lineages:lin-a8b0b8a20b · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

position_invocations

  • {"invocation_id": "piv-71438f8a44", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}
  • {"invocation_id": "piv-04fd0c2496", "profile_id": "SEMINAR_PREP", "position_id": "SEMINAR_PREP"}

sources: [db_row project_lineages:lin-a8b0b8a20b · high]; [db_row position_invocation_records:piv-71438f8a44 · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]


🔬 Sem-6 v2 · Evidence-Grounded Analysis

Failure Analysis 2.0

Mechanism Failure (где механизм не сработает): - Промпт-регламент «партнёр по рассуждению» + «оппонент» может деградировать в помощника-ответчика под давлением команды (jailbreaking для скорости). - Тесты-близнецы могут оказаться неэквивалентными — если сложность фактически различается, прирост в post интерпретируется как эффект интервенции ошибочно. - Индивидуальная итоговая проба может измерять способность работать без инструмента, а не способность принимать банковские решения в реальной практике (где инструменты есть) — валидность метрики под вопросом.

Incentive Failure (кто как обойдёт): - Студенты могут делить работу в команде: один задаёт вопрос ИИ, другой копирует ответ в отчёт — командный этап становится split вместо cooperative. - На итоговой пробе студенты, знающие что оценка = только это, могут игнорировать командный этап. - Фасилитаторы, оценивающие engagement по шкале активности, могут завышать баллы командам, работающим громко и много — не связано с cognitive effort.

Delegation Failure (что ИИ заберёт у человека): - Если ИИ хорошо валидирует расчёты — студент делегирует функцию проверки собственных вычислений; ручная перепроверка становится ритуалом. - «Оппонент» через ИИ снимает необходимость искать собственные контраргументы — студент учится реагировать на готовый контр, не порождать его сам. - Журнал взаимодействий может стать формальностью — заполняется постфактум для галочки.

Measurement Failure (как решим что успех, ошибочно): - NASA-TLX self-report + известная гипотеза → desirability bias (студенты ЭГ ответят «когнитивно усилий стало больше», потому что это ожидается). - UWES-SS даёт trait engagement, а нужен state — измерения по всему семестру, не одноразовые. - Rubric без rater training + inter-rater kappa даст субъективные оценки; при одном преподавателе-оценщике — full bias. - Успех может быть объявлен если студенты научились имитировать pattern ответа, ожидаемый рубрикой.

Minimal Viable Experiment

Hypothesis (что проверяем): На новом (не входящем в командные) банковском кейсе индивидуальный балл ЭГ (командная работа с регламентированным AI, no-AI итог) статистически выше баллов КГ (традиционный формат без AI) по рубрике корректности + аргументации, при контролируемом времени и без разрыва по dropouts.

Intervention (что меняем): Одно занятие 180 мин по «Банковское дело 1» осенью 2026: ЭГ работает в командах 3 чел. с ИИ в двух ролях (партнёр + оппонент) по промпт-регламенту + журнал взаимодействий, затем 45 мин индивидуального теста без ИИ.

Control (с чем сравниваем): Параллельная группа (КГ, ~15 чел.) — то же занятие с той же задачей, командная работа без ИИ, тот же 45-мин индивидуальный тест. Тот же преподаватель, те же расчётные задачи на баselинe.

Observable change (что должно измениться): (a) Средний балл rubric ЭГ выше КГ на индивидуальной пробе p<0.05 (Wilcoxon, N≥15 на группу). (b) NASA-TLX в командном этапе ЭГ показывает СДВИГ нагрузки от рутинных операций (поиск, оформление) к содержательным (анализ, синтез) — не только «меньше нагрузки». (c) ≤ 5% дословных копий из ИИ в командных материалах ЭГ.

Evidence needed (какие данные): (1) Rater training + inter-rater kappa ≥ 0.7 для рубрики. (2) Валидация эквивалентности тестов-близнецов на historical cohort. (3) Логи всех промпт-взаимодействий (для audit dropout из режима). (4) Замер NASA-TLX ДО раскрытия гипотезы студентам (или blind rating). (5) Отчёт fasсilitator'а с чек-листом engagement событий (не self-report).

🔍