LLM до сих пор меряют в основном по математике, коду и логике. Но в реальной среде важнее другое: умеет ли модель договариваться, менять стратегию и выдерживать социальное давление.
Именно поэтому нейросети теперь тестируют в сценарии «Бункер» — когда надо не просто отвечать, а убеждать, торговаться и просчитывать поведение других участников. Для рынка это полезный срез: если модель теряется в переговорах, ей будет трудно там, где решения завязаны на контекст, конфликт интересов и длинную последовательность шагов. 🤖
Market Signal
@MarketSignalLab
LLM до сих пор меряют в основном по математике, коду и логике. Но в реальной среде важнее другое: умеет ли мод
Этот пост опубликован в Telegram-канале Market Signal. Подписаться можно по ссылке: @MarketSignalLab.