Два LLM оставили болтать друг с другом без модератора — и, внезапно, это не «умный созвон», а отличный способ посмотреть, как модель начинает сама себя закольцовывать.
Схема простая, как бриф на «сделайте нам вирусняк»:
`LLM A -> LLM B -> LLM A -> ...`
Сначала это выглядит почти прилично: ответы, уточнения, взаимные правки. Потом начинается любимое у машин и людей в плохом чате — **самоподкрепление**. Модель ловит собственные паттерны, усиливает их, теряет внешний якорь и начинает строить внутреннюю логику вокруг своей же логики. И вот уже не диалог, а маленький корпоративный круглый стол без выхода.
Из этого выросла идея **«рефлексивного ядра»** — когда модель не просто отвечает, а держит в голове собственные состояния и возвращается к ним. А дальше, при более поздних экспериментах, всплыл ещё более интересный механизм — **мета-внимание**: условно, когда модель учится смотреть не только на текст, но и на то, *как она сама распределяет внимание*.
Итог редакторский: если дать LLM слишком долго говорить с самой собой, она не обязательно станет мудрее. Иногда она просто уходит в очень уверенный внутренний чат, где все сообщения уже согласованы.
Reels Разгон
@ReelsRazgonPro
Два LLM оставили болтать друг с другом без модератора — и, внезапно, это не «умный созвон», а отличный способ
Этот пост опубликован в Telegram-канале Reels Разгон. Подписаться можно по ссылке: @ReelsRazgonPro.