TGViewer
STARTOBUS STARTOBUS @startobus · 2.42K subscribers
Post #6575 393
Ох, как кучно Китайцы пошли. Сегодня зарелизили - GLM 5.3

База та же, что у 5.2, весь прирост Z.ai выжали чистым пост-трейнингом на длинных агентных задачах. И теперь заявляют сильнейшую открытую модель для кодинга. На Terminal-Bench 3.0 скачок с 4.6 до 28.3, лучше чем Kimi K3 (17.4) и даже Opus 4.8 (21.1), выше только Fable 5 и GPT-5.6. Плюс экономность, на их внутреннем бенче GLM обходит Opus 4.8, тратя в два с лишним раза меньше токенов на задачу.

Самое интересное, у модели неожиданно прокачалась кибербезопасность. Лучший результат на CyberGym (84.5, впереди топов Anthropic и OpenAI), а в полевых тестах с безопасниками она нашла 2436 реальных уязвимостей в 269 опенсорс-проектах. Самый старый баг сидел в коде с 1981 года, в среднем дыры жили по 26 лет до обнаружения.
  • ❤ 1
More from @startobus
  1. Oct 7, 2026У consumer AI еще полно незанятых ниш A16Z сравнил крупнейшие категории эпохи Web 1.0/2.0…
  2. Sep 29, 2026Google представила говорящих ИИ-персонажей Они видят, слышат собеседника и отвечают в реал…
  3. Sep 28, 2026ElevenLabs выпустили Eleven v4 и v4 Turbo: модели озвучки с точным управлением эмоциями, т…
  4. Sep 28, 2026Раньше будущее было лучше. По крайней мере, прогнозы о нём мне нравились больше. Сейчас чи…
  5. Sep 22, 2026Xiaomi выпустила MiMo V2.6 Pro и Flash с открытыми весами Pro — топ-1 в Artificial Analysi…
  6. Sep 19, 2026Тут господа из Devin.ai (ex Windsurf) сделали знатный подгон халявы страждущим любителям в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →