TGViewer
Мысли-НеМысли Мысли-НеМысли @mislinemisli · 154K subscribers
Post #20828 9.42K
В сети опубликовали результаты двухнедельного независимого тестирования Алисы и GigaChat на открытых бенчмарках. В ходе проверок оценивали работу моделей при написании кода, анализе документов и ведении многошагового диалога со сложными правилами.

По итогам серии испытаний наиболее высокие результаты на сложных задачах и длинных текстах показали модели Сбера. GigaChat Ultra продемонстрировал наибольшую точность при обработке объёмных данных и соблюдении пошаговых инструкций, а GigaChat Max занял второе место. Алиса же оказалась ориентирована преимущественно на базовые веб-запросы.
More from @mislinemisli
  1. Sep 21, 2026Морская логистика становится новым фактором роста нефтяных цен. Из-за дефицита супертанкер…
  2. Sep 21, 2026Телефонные мошенники нашли новый способ отнимать деньги у россиян, используя тему долгов з…
  3. Sep 21, 2026Яндекс выложил в публичный доступ Alice AI Foundation LLM — суверенную языковую модель, об…
  4. Sep 21, 2026Россия и США планируют в ближайшие недели провести новую встречу по накопившимся проблемам…
  5. Sep 20, 2026Резкий рост стоимости авиакеросина уже начал выдавливать с рынка наиболее уязвимых перевоз…
  6. Sep 20, 2026В августе цены в большинстве российских регионов росли медленнее, чем в июле, либо снижали…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →