1. Подтвердите проблему evidence
Результат: Проблема подтверждена, а не придумана ради AI.
Задачи
- →Соберите user evidence
- →Опишите текущий workflow
- →Определите non-AI baseline
Проверки
- ✓Задокументирована рабочая non-AI альтернатива
Подготовьте decision-ready пакет по AI-функции: проблема, capability fit, UX, метрики, риски, экономика и план эксперимента.
Сценарий
Команда предлагает AI-функцию без чёткой метрики ценности. Нужно решить, стоит ли её строить, как измерять качество и при каких условиях rollout должен быть остановлен.
Результат: Проблема подтверждена, а не придумана ради AI.
Задачи
Проверки
Результат: Сильные и слабые стороны модели известны.
Задачи
Проверки
Результат: Ценность оценивается вместе с quality, latency и cost.
Задачи
Проверки
Результат: Есть bounded experiment и путь rollback.
Задачи
Проверки
Рубрика оценки
Проблема подтверждена user evidence и non-AI baseline.
Недостаточно
AI ищет проблему.
Компетентно
Есть evidence и baseline.
Сильно
Есть quantified pain, альтернативы и различия сегментов.
Необходимые доказательства
Ограничения модели, impact сбоев и controls задокументированы.
Недостаточно
Capabilities декларируются без tests.
Компетентно
Есть representative tasks и controls.
Сильно
Есть eval dataset, approval policy и residual risk.
Необходимые доказательства
Value, quality, safety, latency и cost имеют thresholds.
Недостаточно
Есть только vanity metrics.
Компетентно
Release metrics имеют thresholds.
Сильно
Есть sensitivity analysis, routing options и margin model.
Необходимые доказательства
Offline eval, pilot, monitoring и rollback ограничены контролируемыми рамками.
Недостаточно
Запланирован big-bang launch.
Компетентно
Есть phased rollout и stop conditions.
Сильно
Есть holdout, counterfactual baseline и sunset criteria.
Необходимые доказательства