Claude учат бояться кода
⠀
Anthropic выпустила Opus 4.7 и одновременно включила на ней новый фильтр кибер-защиты. Компания прямо пишет, что это первая итерация в попытке не сломать мир более мощным Claude Mythos.
⠀
На бумаге задача простая: отсекать запросы на эксплойты, вирусы и другой опасный код. На практике часть пользователей уже жалуется на перекос, когда модель начинает видеть вредоносный сценарий в любом сложном техническом запросе, отказывается помогать и ещё тратит токены на длинные объяснения отказа.
⠀
Фильтрация тут нужна. Но Anthropic тестирует её на платной рабочей модели для разработчиков. Если фильтр слишком широкий, под удар попадают обычные пользователи, которые пришли разбирать баги, логи и чужой код.
⠀
Посмотрим, смогут ли они быстро решить этот вопрос. Что ни день, то ништяки от Claude, да? Или это я такой предвзятый?
⠀
📎 Anthropic • HN
Post #8415
1.58K