1. Классифицируйте данные по назначению, а не по удобству
Результат: В pipeline попадают только поля, необходимые для конкретной аналитической задачи.
Задачи
- →Инвентаризируйте columns и derived fields
- →Отметьте прямые и косвенные идентификаторы и чувствительные категории
- →Привяжите каждое поле к явному purpose
- →Удалите или агрегируйте поля без task necessity
Проверки
- ✓«Может пригодиться» не является purpose
- ✓Derived field наследует privacy classification от source inputs
- ✓Минимизированное представление воспроизводится из version-controlled transformation