🤖 ИИ начал выгорать от дедлайнов и страдать завышенной самооценкой
Это официальные диагнозы из свежего релиза Anthropic.
24 марта ребята выкатили мультиагентный фреймворк для автономного кодинга. Суть в GAN-подходе: один агент (Claude) пишет код, а второй (тоже Claude) безжалостно его ревьюит.
Зачем понадобился второй агент? Исследователи отловили два чисто человеческих бага в поведении моделей:
→ Context anxiety (тревожность из-за контекста): когда окно памяти забивается, модель паникует, срезает углы и выдает плохой код, лишь бы быстрее закрыть таску.
→ Self-evaluation bias (предвзятость самооценки): агент искренне считает свой нерабочий код гениальным и преждевременно репортит об успехе.
Чтобы агенты работали слаженно, перед стартом они заключают «спринт-контракты» с жестким ТЗ и зонами ответственности. Индустрия явно переходит от написания кода к оркестрации нейросетей.
#AI #AIAgents #LLM #architecture
Anthropic Engineering
Post #325
62

- ❤ 2