Почему калибровка важнее «красивой» точности в антифроде
В антифроде легко соблазниться одной метрикой: модель поймала больше подозрительных конверсий, значит всё хорошо. Но для оператора качества трафика точность сама по себе ещё не гарантия. Важнее, насколько модель умеет честно оценивать собственную уверенность.
Это особенно заметно в задачах, где есть динамика во времени: всплески по источникам, смена паттернов у паблишеров, сезонные сдвиги, новые креативы и резкая деградация качества на длинном отрезке. В такой среде модель может давать вроде бы верные прогнозы, но при этом быть чрезмерно уверенной в ложных сигналах или, наоборот, занижать риск там, где уже начинается проблема.
Именно калибровка отвечает на вопрос: совпадает ли заявленная уверенность модели с реальной частотой событий. Если система говорит «90% риск», а в реальности это срабатывает в половине случаев, оператор получает не сигнал, а шум. А шум в антифроде быстро превращается в лишние ручные проверки, спорные блокировки и потерю доверия к системе.
Практический вывод для команды качества простой:
- смотрите не только на recall, precision и ROC-AUC;
- проверяйте, как ведёт себя confidence score на новых источниках и в длинных временных окнах;
- отдельно тестируйте модель на переоценку и недооценку риска;
- не забывайте про калибровку после смены фичей, heads или логики агрегации.
Для антифрод-оператора хороший скоринг — это не тот, что «угадал больше всех», а тот, которому можно доверять в спорных случаях. Если модель стабильно показывает адекватную уверенность, ею проще управлять: легче ставить пороги, объяснять решения и не душить качественный трафик ложными срабатываниями.
Vector Fraud & Quality Signals
@VectorFraudQualitySignals
Почему калибровка важнее «красивой» точности в антифроде
Этот пост опубликован в Telegram-канале Vector Fraud & Quality Signals. Подписаться можно по ссылке: @VectorFraudQualitySignals.