# 📇 Project Card

## Идентичность

- **lineage_id:** lin-a8b0b8a20b
- **label:** Мирошниченко О.С. · Регламентированное использование ИИ в расчётных заданиях (v2)
- **project_id:** miroshnichenko-regulated-ai-v2
- **current_version_id:** ver-b2566dfb0b
- **owner:** Мирошниченко О.С.

> _sources:_ [db_row project_lineages:lin-a8b0b8a20b · high]

## Protected core

Защищённое ядро: (1) разделение командного человеко-машинного контура (allowed AI) и индивидуальной пробы (no AI) — это несущий принцип разрешения противоречия «ИИ помогает vs ИИ подменяет»; убрать — и вернётся исходная неразличимость; (2) тесты-близнецы как метод baseline vs post — единственный способ методологически корректно измерить эффект вмешательства без confounding; (3) индивидуальная итоговая задача = новый банковский кейс, требующий отбора данных, расчёта, сравнения альтернатив и последствий — целевая компетенция «принятие обоснованного банковского решения»; (4) журнал взаимодействий с ИИ на командном этапе — обеспечивает след профессиональной операции, без него теряется главное педагогическое основание; (5) множественная операционализация (Q, CE, Eng, Integrity) — редундантность как защита от одной shining metric; (6) три уровня итогового теста (выбор данных из набора + расчёт до 2 знаков + сравнение альтернатив + сравнение последствий) — минимальная триангуляция «может ли студент это без ИИ». Убрать любое — это уже другой проект.

> _sources:_ [art-1228bd563a note «Мирошниченко ОС_описание проекта_23.07.2…» · high]; [art-bc3190c1b3 slides «Мирошниченко ОС_презентация 23.07.2026.p…» · medium]; [art-e0b9263214 note «МирошниченкоОС доработанный проект.docx» · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

## Несущий разрыв

Несущий разлом: проект пытается одновременно (а) сохранить командную работу с регламентированным ИИ как форму обучения профессиональному диалогу и (б) удержать индивидуальную способность решить банковский кейс без ИИ как критерий сформированности. Разлом возникает потому, что банковское дело по природе — коллективная и инструментальная практика (в реальной работе банкир всегда имеет данные + модели + коллег), а итоговая проверка требует изолированного индивидуального акта, отделяющего компетенцию студента от компетенции инструмента. Это методологически необходимое, но профессионально нерепрезентативное разделение: то, что тест проверяет, — это условная 'бабочка-компетенция', вырванная из живого контекста. Компенсация: командный этап проектируется как реалистичная имитация профессиональной практики, а итоговый тест — как психометрическая процедура на присвоение операции. Оба режима нужны, но существуют в разной онтологии; риск — если критерии индивидуальной пробы окажутся слишком узкими, тест будет измерять способность к академическому упражнению, а не к банковскому решению. Защита: критерии рубрики (аргументация, оригинальность рекомендации, интерпретация) — но открытые вопросы требуют ручной проверки, и здесь возникает subjectivity.

> _sources:_ [art-1228bd563a note «Мирошниченко ОС_описание проекта_23.07.2…» · high]; [art-bc3190c1b3 slides «Мирошниченко ОС_презентация 23.07.2026.p…» · medium]; [art-e0b9263214 note «МирошниченкоОС доработанный проект.docx» · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]

## Готовность

Готовность: READINESS_SEMINAR_DISCUSSION → PILOT_READY_AFTER_CLOSURE. Проект имеет теоретическую рамку, дизайн, метрики, определённое ядро. До пилота нужно закрыть 6 UNKNOWN и разрешить 2 contradiction: (1) операционализировать регламент 'партнёр/оппонент' в шагах (это несущий стержень интервенции); (2) валидировать эквивалентность тестов-близнецов на предыдущем потоке или через экспертный обзор; (3) обеспечить рейтерскую согласованность фасилитаторов; (4) решить приоритет CE/Eng/Q как первичного/вторичного outcome (v1 vs v2 разное); (5) minimize desirability bias в NASA-TLX (замер до раскрытия гипотезы или blind rating). При закрытии этих пунктов — готов к пилоту в осеннем семестре 2026 на одном потоке (без КГ) с последующим полным экспериментом весной 2027.

> _sources:_ [art-1228bd563a note «Мирошниченко ОС_описание проекта_23.07.2…» · high]; [art-bc3190c1b3 slides «Мирошниченко ОС_презентация 23.07.2026.p…» · medium]; [art-e0b9263214 note «МирошниченкоОС доработанный проект.docx» · high]; [analysis_json orchestrator_run:ar-2f27115f22 · high]


---

## 🔬 Sem-6 v2 · Evidence-Grounded Analysis

### Claim–Evidence Matrix

**FACT** (следует из источников):
- Автор: Мирошниченко О.С., проф. каф. экономики и финансов ФЭИ ТюмГУ, д.э.н. · _docx art-e0b9263214 header + art-1228bd563a header_ · conf=high
- Курс: «Банковское дело 1» (1-я половина), 4 курс бакалавриат 38.03.01 Экономика, очная форма, практическое занятие 180 мин. · _docx art-1228bd563a §Пространство эксперимента_ · conf=high
- Планируемая когорта — 2 параллельные группы (~25-30 чел.) осенью 2026 (сентябрь-октябрь). · _docx design section_ · conf=high
- Заявленный дизайн: тесты-близнецы (Baseline + Post), эквивалентные по структуре/числу/сложности/критериям, единая шкала. · _docx art-e0b9263214 §Baseline и эмпирический корпус_ · conf=high
- Теоретическая рамка: Sweller (cognitive load), Выготский (соц-конструктивизм), Mezirow (transformative learning), Schön (рефлексия), Cronbach/Campbell-Stanley/Wilcoxon, Slavin/Johnson (cooperative learning). · _docx art-1228bd563a §Теоретическая рамка_ · conf=high
- Инструменты измерения: NASA-TLX (когнитивная нагрузка), UWES-SS (вовлеченность), Likert (пост-анкета), rubric (качество). · _docx §Операционализация_ · conf=high

**AUTHOR CLAIM** (заявляет автор):
- Регламентированное использование ИИ как «партнёра по рассуждению» и «оппонента» повысит качество работы, когнитивные усилия и вовлечённость. · _docx research question + hypothesis_ · conf=asserted_by_author
- Разделение allowed-AI командного этапа и no-AI индивидуальной пробы решает проблему подмены операции продуктом. · _docx §Единица анализа_ · conf=asserted_by_author
- Тесты-близнецы обеспечивают методологически корректное сравнение baseline vs post. · _docx §Baseline_ · conf=asserted_by_author_requires_pilot_validation

**ANALYTICAL INFERENCE** (вывод системы):
- Проект решает не «как использовать ИИ», а более узкую задачу: переопределить единицу оценивания так, чтобы наличие/отсутствие ИИ не искажало сигнал о сформированной способности. · _system reading of Единица анализа section_ · conf=high
- Теоретическая рамка (5 теорий + 3 методики) — не декоративный список: Sweller → NASA-TLX, Slavin+Johnson → cooperative формат, Cronbach → эквивалентность тестов, Wilcoxon → непараметрика. · _system reading — теории связаны с конкретными инструментами_ · conf=high
- v1 (14k docx) и v2 (41k docx) расходятся в приоритетах — v1 акцентирует CE+Eng+Critical Thinking+Integrity как измеряемые величины; v2 смещает акцент на тесты-близнецы и рубрики. Приоритет outcome не разрешён. · _diff between art-1228bd563a and art-e0b9263214_ · conf=high
- NASA-TLX self-report чувствителен к desirability bias при известной студентам гипотезе — может дать эффект социального ожидания вместо реального изменения когнитивной нагрузки. · _system methodological analysis_ · conf=high

**HYPOTHESIS** (требует проверки):
- Разделение allowed-AI/no-AI действительно даёт валидное измерение сформированной способности, а не только «умение работать без инструмента» (последнее не эквивалентно первому). · _requires validation on post-test scores AND cross-check с внешним ассессмент банковских задач в реальной практике_ · conf=requires_pilot
- Тесты-близнецы эквивалентны — прирост post vs baseline объясним интервенцией, а не свойствами теста. · _requires pilot на предыдущем потоке или экспертный обзор_ · conf=requires_pilot
- Операциональный протокол «партнёр по рассуждению» и «оппонент» удерживает роль ИИ без деградации в помощника-ответчика. · _requires prompt engineering + iterated user trials_ · conf=requires_pilot

### Agenticity Check

**Verdict — Agent Level: 1** (Adaptive assistant (партнёр по рассуждению + промпт-регулируемый оппонент))

- **Memory (устойчивое состояние):** NO — ИИ используется как chat-partner в моменте; журнал диалогов ведёт студент, не ИИ
- **Goal (собственная цель):** NO — цель определяется задачей курса; ИИ не имеет собственной
- **Planning (самостоятельная последовательность):** NO — ИИ реагирует на запросы студента, не строит план действий
- **Autonomy (действия без запроса):** NO — все взаимодействия инициируются студентом; ИИ отвечает после запроса
- **Human Gate (где остаётся человек):** YES — преподаватель ставит задачу + оценивает; студент держит первичный тезис; итоговая проба физически изолирована от ИИ

### Educational Mechanism Model

**Current educational practice:** Расчётные задачи по банковскому делу решались в малых группах: разбор логики, построение схем на доске, представление в общем чате. Оценивалась в основном финальный продукт (правильный расчёт + логика).

**Limitation / failure point:** При нерегламентированном доступе к ИИ студенты получают готовый продукт (текст + расчёт) без прохождения операции (проблематизация, отбор данных, расчёт, обоснование, критическая оценка). Преподаватель видит хороший продукт, но не имеет следа процесса. Университет рискует принять достижимый с ИИ продукт за сформированную способность.

**Changed activity (что действие меняется):** Единица оценивания переносится с «финальный продукт группы» на «индивидуальный акт принятия решения на новом кейсе без ИИ и без командных материалов». Командная работа с ИИ сохраняется как форма обучения (партнёр по рассуждению + оппонент), но не как основание для итоговой оценки способности.

**Role of AI (компонент механизма):** Двойная функция: (1) «Партнёр по рассуждению» — реагирует на тезис студента, предлагает альтернативы, проверяет расчёты; (2) «Оппонент» — обязан формулировать контраргументы, а не соглашаться. Обе роли — на командном этапе. На итоговой индивидуальной пробе — ИИ физически исключён.

**Role of human (сохранённая функция):** (a) Студент — формулирует первичный тезис ДО запроса к ИИ; фиксирует в журнале взаимодействий (запрос → ответ → оценка ответа → следующий шаг); финальную индивидуальную пробу проходит без ИИ и без командных материалов. (b) Преподаватель — постановка задачи, разбор результатов, ручная проверка открытых вопросов итогового теста, экспертная оценка по рубрике. (c) Фасилитатор — модерация команды, шкала активности, наблюдение engagement.

**Expected competence change:** Прирост качества принятия банковских решений (rubric-scored) на индивидуальной пробе с новым кейсом; прирост когнитивных усилий (NASA-TLX) в командном этапе; прирост вовлечённости (UWES-SS + Likert); сохранение академической честности (≤ 5% дословных копий из ИИ).

**Measurement method:** Pre/post тест-близнец с валидированной эквивалентностью (пилот на historical cohort или экспертный consensus). Cohen's kappa рубрики ≥ 0.7. Wilcoxon signed-rank для парных сравнений (N≥15 на группу). NASA-TLX измеряется в идеале ДО раскрытия гипотезы студентам (или double-blind rating), чтобы избежать desirability bias.

### Readiness — 4 tiers
- **Idea readiness:** STRONG — принцип «сменить единицу оценивания» — методологически глубокая постановка; тесты-близнецы + командный/индивидуальный split — грамотная архитектура
- **Mechanism readiness:** PARTIAL — механизм описан, но операциональный протокол «партнёр/оппонент» отсутствует — центральный несущий шов; v1/v2 приоритет outcome не разрешён
- **Implementation readiness:** MEDIUM — теория готова, инструменты (NASA-TLX/UWES/Likert) известные и standardized; нужна разработка (a) промпт-протокола, (b) тестов-близнецов, (c) rubric с rater training. Реалистично сделать за 2-3 месяца до пилота.
- **Evaluation readiness:** PARTIAL — psychometric инструменты валидированы, но собственный дизайн (эквивалентность близнецов, desirability bias controls) требует пилота на одном потоке до полного эксперимента
