Paideia
Корпус
📋 Каталог · 291 кейс 🗺 Карта корпуса 🎯 Подбор аналогов 📚 Теория ⚡ ТРИЗ-приёмы 📖 Библиотека
Моё
📁 Рабочие пространства 🎓 Курсы 🔎 Разборы ∇ Дискуссия с Kaiyona + новое пространство
Сервис
Organs (диагностика) 🔑 Войти по коду 🚪 Сменить роль ⚙️ Свой LLM-ключ (BYOK) 💛 Поддержать ⚙️ Сервисный режим 📊 Аудит LLM

lab_handoff

4654c 8 packages raw md json

🔧 Lab Handoff

lab_requirement

  • build_status: NO_BUILD
  • readiness_score: 0.3
  • no_build_reason: Проект не готов к инженерии: отсутствуют четко описанные наблюдаемые самостоятельные исследовательские действия студентов и формальный регламент использования ИИ, а также функциональная декомпозиция р

sources: [db_row project_lineages:lin-635f50f5be · high]; [analysis_json orchestrator_run:ar-28ba291536 · high]

v2_mve

Minimal Viable Experiment

Hypothesis (что проверяем): ЭГ (работавшая по промпт-протоколам) демонстрирует более высокое качество методологического аппарата ВКР по оценке научного руководителя vs КГ; ≤ 5% галлюцинированных источников vs ≥ 20% в КГ.

Intervention (что меняем): ЭГ (~15 студентов) — 5 промпт-протоколов + журнал + отсроченный срез руководителя. КГ (~15) — традиционный семинар без протоколов.

Control (с чем сравниваем): Параллельные группы того же курса, тот же преподаватель.

Observable change (что должно измениться): Экспертный балл методологии ЭГ > КГ p<0.05; галлюц.ссылки ≤ 5% ЭГ vs ≥ 20% КГ; защита ВКР — владение формулировками ≥ 4/5 у ЭГ.

Evidence needed (какие данные): 5 разработанных промпт-протоколов; сокращённая рубрика для руководителей; журнал диалогов через LMS; калибровка руководителей (мини-обучение); cross-LLM тестирование устойчивости протокола.

Архитектура · v2_agentity_audit

Agenticity Check

Verdict — Agent Level: 1 (Adaptive assistant (протокольно-регулируемый))

  • Memory (устойчивое состояние): PARTIAL — журнал ведёт студент (не ИИ); ИИ per session не помнит контекст ВКР между сессиями
  • Goal (собственная цель): NO — цель — задача студента, ИИ реагирует
  • Planning (самостоятельная последовательность): NO — промпт-протокол ведёт последовательность, не ИИ
  • Autonomy (действия без запроса): NO — все действия — по запросу студента
  • Human Gate (где остаётся человек): YES — тройной: студент + преподаватель + научный руководитель + регламент

🔬 Sem-6 v2 · Evidence-Grounded Analysis

Minimal Viable Experiment

Hypothesis (что проверяем): ЭГ (работавшая по промпт-протоколам) демонстрирует более высокое качество методологического аппарата ВКР по оценке научного руководителя vs КГ; ≤ 5% галлюцинированных источников vs ≥ 20% в КГ.

Intervention (что меняем): ЭГ (~15 студентов) — 5 промпт-протоколов + журнал + отсроченный срез руководителя. КГ (~15) — традиционный семинар без протоколов.

Control (с чем сравниваем): Параллельные группы того же курса, тот же преподаватель.

Observable change (что должно измениться): Экспертный балл методологии ЭГ > КГ p<0.05; галлюц.ссылки ≤ 5% ЭГ vs ≥ 20% КГ; защита ВКР — владение формулировками ≥ 4/5 у ЭГ.

Evidence needed (какие данные): 5 разработанных промпт-протоколов; сокращённая рубрика для руководителей; журнал диалогов через LMS; калибровка руководителей (мини-обучение); cross-LLM тестирование устойчивости протокола.

Failure Analysis 2.0

Mechanism Failure (где механизм не сработает): - Промпт-протоколы могут не удержать режим при адверсариальном давлении студента (просит «просто напиши»). - Иностранцы могут не распознать семантические ошибки даже с reverse translation — если ошибка глубоко в стилистике. - Устойчивость протокола на разных ЛЛМ (GigaChat/YandexGPT/GPT/DeepSeek) не гарантирована.

Incentive Failure (кто как обойдёт): - «Иллюзия компетентности» блокирует запрос на обучение — уверенные студенты игнорируют протокол. - Научные руководители могут не иметь мотивации разбирать журналы диалогов и заполнять рубрику.

Delegation Failure (что ИИ заберёт у человека): - Регулярное использование ИИ для формулировки → студент теряет способность формулировать сам. - Верификация ссылок через второй промпт → студент делегирует и это; ручной manual check пропадает.

Measurement Failure (как решим что успех, ошибочно): - Рубрика без калибровки rater'ов — субъективна. - Проверка галлюцинированных ссылок вручную требует времени руководителя; при бездействии — не проверяется.

Agenticity Check

Verdict — Agent Level: 1 (Adaptive assistant (протокольно-регулируемый))

  • Memory (устойчивое состояние): PARTIAL — журнал ведёт студент (не ИИ); ИИ per session не помнит контекст ВКР между сессиями
  • Goal (собственная цель): NO — цель — задача студента, ИИ реагирует
  • Planning (самостоятельная последовательность): NO — промпт-протокол ведёт последовательность, не ИИ
  • Autonomy (действия без запроса): NO — все действия — по запросу студента
  • Human Gate (где остаётся человек): YES — тройной: студент + преподаватель + научный руководитель + регламент
🔍