2500 слоёв, а внутри — обычный MD5 🤯
Разбор показывает, как по весам и структуре нейросети удалось восстановить спрятанную программу: распознать MD5 и дойти до ответа, когда модель выглядела как чёрный ящик. Для этого использовали механистическую интерпретируемость, SAT и несколько тупиковых гипотез.
Полезная штука для тех, кто копает в ML и хочет понимать, что реально происходит внутри моделей, а не только смотреть на метрики.
IT Ижевск — t.me/it_izhevsk
IT Ижевск
@it_izhevsk
2500 слоёв, а внутри — обычный MD5 🤯
Источники:
Этот пост опубликован в Telegram-канале IT Ижевск. Подписаться можно по ссылке: @it_izhevsk.