Обсуждение:Дрейф данных
Материал из MachineLearning.
От тревоги к диагнозу
Исходные запросы к LLM в присланном коде статьи не сохранились, а страница Обсуждение:Дрейф данных на момент редактирования ещё не была создана. Поэтому ниже приведены два запроса, использованные именно для подготовки текущей редакции. Это не попытка задним числом восстановить прежнюю переписку.
Первый запрос был сформулирован как проектирование системы мониторинга:
После первой редакции я проверял текст не по количеству названных детекторов, а по тому, отвечает ли он на три разные задачи: обнаружить изменение, установить его практическую опасность и выбрать допустимую реакцию. На этом этапе понадобился второй, более узкий запрос.
Ручная проверка спорных мест
После выполнения запросов были отдельно проверены следующие положения:
- data drift в узком смысле отделён от общего distribution shift;
- типы сдвига определены равенствами условных и маргинальных распределений, а не только примерами;
- исправлена опечатка в определении сдвига априорных вероятностей и уточнено различие постепенного и инкрементального дрейфа;
- для importance weighting добавлено требование покрытия и предупреждение о дисперсии больших весов;
- для label shift указано условие неизменности
и ограничение BBSE через невырожденную матрицу ошибок;
- ADWIN больше не выглядит универсальным детектором любых изменений и автоматическим механизмом переобучения;
- статистические тревоги отделены от деградации метрики, причины изменения и ошибки конвейера;
- добавлены множественные сравнения, многомерный мониторинг, задержанные и селективные метки;
- конференционная работа об ADWIN оформлена как статья, а не как книга;
- сноски и литература разделены, категории заменены на тематические.
В результате статья описывает дрейф не как единственное число на панели мониторинга, а как последовательность проверок: что изменилось, затронуло ли это решения модели, почему это произошло и какая реакция подтверждена данными.

