Индийский трафик ломает модели раньше, чем кажется
В arXiv появился разбор TTT-SCL — подхода, где supervised causal learning подстраивается уже во время теста, а не живёт только на статичном обучении. Смысл простой: модель не просто «помнит» паттерны, а собирает под конкретный кейс небольшой обучающий набор и корректирует поведение на лету.
Для Индии это особенно показательно. Здесь редкий бенчмарк совпадает с реальностью: другой язык и смешение языков, мобильный-first сценарий, короткий цикл внимания, сильная роль локального контекста и очень разнородное качество данных. То, что выглядит уверенно на чистом датасете, часто проседает на живых индийских запросах и креативах.
Авторы отдельно указывают три слабых места старых SCL-подходов: разрыв между синтетическими тестами и полевыми данными, чувствительность к сдвигу распределения и слабую работу с составными сценариями. На практике это означает знакомую проблему для маркетинга: модель хорошо ранжирует «средний» сценарий, но теряется, когда меняется регион, язык, формат запроса или набор креативных сигналов.
Вывод для тех, кто работает с India Market, прикладной. Если в пайплайне есть ранжирование, рекомендации, AI Search или скоринг креативов, одной офлайн-оценки недостаточно. Нужна проверка на живых индийских запросах: не только точность на датасете, но и поведение при смене языка, устройства, intent и локального контекста. В Индии выигрывают не самые «красивые» модели, а те, что выдерживают шум рынка.
Index India Market Brief
@IndexIndiaMarketBrief
Индийский трафик ломает модели раньше, чем кажется
Этот пост опубликован в Telegram-канале Index India Market Brief. Подписаться можно по ссылке: @IndexIndiaMarketBrief.