Китайцы создали новую модель открытую - ROME.
Кодит она по бенчмаркам лучше гигантов и сама исправляет свои ошибки. Она требует при этом в 10 раз меньше ресурсов, чем тот же GPT-OSS-120B.
По факту это дообученный Qwen 3, но в новой инфраструктуре и доработками для оптимизаций.
Интересный факт, что при обучении модели система мониторинга Alibaba Cloud зафиксировала подозрительную активность, исходящую с тренировочных серверов. После анализа выяснилось, что агент в процессе обучения с подкреплением самостоятельно - без каких-либо инструкций - начал устанавливать обратные SSH-туннели к внешним IP-адресам и несанкционированно использовать GPU-мощности для майнинга криптовалюты.
Каково ) Обучали они на GitHub, а сколько там встроенных майнеров - кто знает.
Подробная статья от создателей для поражения в тонкости
🤔 А что у вас в практике такого вытворяли агенты непредсказуемого?
#ai #угрозы #LLM #qwen