TGViewer
Life-Hack - AI Life-Hack - AI @life_hack_ai · 1.92K subscribers
Post #440 594
GPT-5.2 написала браузер за неделю: результаты эксперимента Cursor с агентами

#ai #ии #новость

Разработчики Cursor опубликовали результаты эксперимента по масштабированию автономных кодинг-агентов. Компания запускала сотни агентов параллельно на одном проекте — они работали неделями и написали более миллиона строк кода. Цель — понять, можно ли решать задачи, которые у команд разработчиков занимают месяцы.

Главной проблемой оказалась координация. Когда агентам дали равный статус и позволили самим делить задачи, двадцать агентов выдавали производительность двух-трех — остальные ждали освобождения блокировок. Хуже того, без иерархии агенты избегали сложных задач и делали мелкие безопасные правки. Решением стало разделение ролей: планировщики исследуют код и создают задачи, воркеры их выполняют и пушат изменения.

Для проверки системы агентам на GPT-5.2 поручили написать браузер с нуля. За неделю непрерывной работы они сгенерировали более трех миллионов строк кода. Движок рендеринга написан на Rust и включает парсинг HTML, каскад CSS, layout, отрисовку текста и кастомную виртуальную машину JavaScript. По словам CEO Cursor Майкла Труэлла, простые сайты браузер рендерит быстро и в основном корректно — хотя до паритета с WebKit или Chromium ещё далеко.

При этом GPT-5.2 оказалась значительно лучше других моделей для долгих автономных задач: держит фокус, следует инструкциям, не дрейфует. Opus 4.5, по наблюдениям Cursor, склонна останавливаться раньше и срезать углы. При этом разные модели лучше справляются с разными ролями: GPT-5.2 лучше планирует, чем специализированная на коде GPT-5.1-codex.

Главный инсайт команды: промпты важнее, чем выбор модели или архитектура системы. Координация сотен агентов, избегание патологий и удержание фокуса на протяжении недель потребовали долгих экспериментов именно с инструкциями. Система пока не оптимальна — агенты иногда работают слишком долго, а периодические перезапуски нужны для борьбы с "туннельным зрением". Но ответ на главный вопрос оказался оптимистичнее ожиданий: масштабирование работает.

Life-Hack - AI
  • ❤ 7
  • 👍 4
More from @life_hack_ai
  1. Oct 5, 2026Отключение мозга ничего хорошего не сулит #программирование #искусственныйинтеллект #ai #m…
  2. Oct 4, 2026Что такое JailBreak-атаки: почему ИИ нарушает собственные правила и как это работает #стат…
  3. Oct 3, 2026VoiceStudio клонирует голос по 10 секундам записи и работает без облака #ai #ии #нейросети…
  4. Oct 2, 2026Человечество, ослепленное чуждой силой. Что сверх-ИИ грядущий нам готовит? #статья #ai К в…
  5. Oct 1, 2026Как определить ИИ в тексте: проверка на нейросеть онлайн #статья #ai #полезное Наш коллега…
  6. Sep 30, 2026Arena AI Leaderboard #ai #полезное Народный рейтинг ИИ-моделей. Независимый бенчмарк, где…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →