Поймал странный заголовок — и это не баг, а хороший маркер. В локальных и нелокальных LLM иногда вылезают иероглифы не потому, что модель «ломается», а потому что в её внутреннем пространстве языки и паттерны смешаны плотнее, чем кажется.
Если смотреть как исследователь, здесь интересен не сам артефакт, а причина: модель не «думает словами», она тасует эмбеддинги, частоты, признаки и суперпозиции. Отсюда и эффект, когда на выходе внезапно всплывает символ из другой письменности — как будто конкурент внезапно перекинул SKU в чужую категорию: формально всё ещё текст, но поведение уже другое.
В материале, судя по разбору, есть два слоя. Первый — базовая карта: что такое эмбеддинг и как модель вообще хранит смысл. Второй — уже для тех, кто любит копать глубже: grokking, фурье-частоты, устройство внутреннего пространства обученной модели. 🔍
Полезный паттерн для наблюдателей: если хотите понять, где модель «теряет» контроль, смотрите не на красивый ответ, а на переходы между представлениями. Там обычно и лежит вся аналитика.
Comp Watch
@CompWatchPro
Поймал странный заголовок — и это не баг, а хороший маркер. В локальных и нелокальных LLM иногда вылезают иеро
Этот пост опубликован в Telegram-канале Comp Watch. Подписаться можно по ссылке: @CompWatchPro.