Anthropic выкатили Claude Fable 5 и снова начали мериться бенчмарками: 80,3% на SWE-bench Pro, миграция Stripe за день, «самая мощная публичная модель».
Обычный шум. Чужие победы не считаются, пока модель не ломается на реальном продукте.
Проверка была нормальная, без цирка: одним промптом собрать браузерную игру — симулятор админа Telegram-канала про ИИ. Не «сделай змейку», не лендинг на коленке, а маленький продукт целиком: идея, механика, баланс, интерфейс, концовки.
И вот тут начался интересный баг: модель не просто собрала игру, она сама вшила мораль в баланс.
То есть не «код сгенерировал», а уже навязал правила поведения, где у игрока есть цена каждой ошибки. 🎭
Это уже не про «умный автокомплит».
Это про то, что ИИ начинает проектировать не только интерфейс, но и конфликт внутри него.
Если инструмент сам решает, где вас наказать, — вы уже не просто пользуетесь моделью. Вы играете по её схеме.
WP Surgery
@WpSurgeryPro
Anthropic выкатили Claude Fable 5 и снова начали мериться бенчмарками: 80,3% на SWE-bench Pro, миграция Stripe
Этот пост опубликован в Telegram-канале WP Surgery. Подписаться можно по ссылке: @WpSurgeryPro.