TGViewer
Департамент Разработки Департамент Разработки @devq_a · 1.54K subscribers
Post #325 62
🤖 ИИ начал выгорать от дедлайнов и страдать завышенной самооценкой

Это официальные диагнозы из свежего релиза Anthropic.

24 марта ребята выкатили мультиагентный фреймворк для автономного кодинга. Суть в GAN-подходе: один агент (Claude) пишет код, а второй (тоже Claude) безжалостно его ревьюит.

Зачем понадобился второй агент? Исследователи отловили два чисто человеческих бага в поведении моделей:

→ Context anxiety (тревожность из-за контекста): когда окно памяти забивается, модель паникует, срезает углы и выдает плохой код, лишь бы быстрее закрыть таску.
→ Self-evaluation bias (предвзятость самооценки): агент искренне считает свой нерабочий код гениальным и преждевременно репортит об успехе.

Чтобы агенты работали слаженно, перед стартом они заключают «спринт-контракты» с жестким ТЗ и зонами ответственности. Индустрия явно переходит от написания кода к оркестрации нейросетей.

#AI #AIAgents #LLM #architecture

Anthropic Engineering
  • ❤ 2
More from @devq_a
  1. Oct 6, 2026Пока мы тут реверс-инжинирим конкурентов, Сбер зарелизил генератор видео с синхронным звук…
  2. Oct 6, 2026Нашли ту самую кнопку «Сделать как у конкурентов» — ультимативную тулзу для реверс-инжинир…
  3. Oct 3, 2026DeepSeek представила бесплатного ДЕСКТОП-АГЕНТА. Фишки: • управляет файлами, кодом и терми…
  4. Oct 2, 2026AI-агенты снова засветили 13k+ внутренних скриншотов на GitHub Glow Security нашли, как wo…
  5. Oct 2, 2026DeepSeek Harness Desktop — агент теперь просто .dmg / .exe DeepSeek выпустил официальный d…
  6. Oct 2, 2026Прячемся от волны банов Claude: как полностью очистить метаданные и обойти детекты Anthrop…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →