TGViewer
Android Broadcast Android Broadcast @android_broadcast · 14.5K subscribers
Post #10119 6.45K
🤖 Kimi K3, GPT 5.6, Qwen3.8 Max и OPUS 5 добавили в результаты официального AI Android Бенчмарка

Как поменялся рейтинг?
🏆 Claude Opus 5 новый лидер с результатов 91.8%. Прошлый лидер Fable 5 был с результатов 90.9%. По цене Opus вышел дороже
🥉 GPT 5.6 Sol попал на 3 строку с результатом 90.8%
‼️ На 4 месте расположился Kimi K3 с результатов 90.2%
👉 GPT 5.6 Luna показала результат 86.8% но при этом стоимость указана 7.2$ 🤯 (кажется тут закралась ошибка все верно и это шок по эффективности)
👉 GPT 5.6 Terra набрала 86.8% потратив 48$, что сейчас точно является лучшим показателем в соотношение результата на затраченный 1$.
🤔 Qwen3.8 Max
показал достойные 87.0% но при этом потратил больше всех моделей - 196.7$

Бенчмарк все также игнорирует Grok и Compose модели 😡 Что-то не так в отношениях между компаниями Google и Илоном - загадка

UPD Kimi K3 не считается открытой моделью, что неверно. Изначально веса были закрыты и потом открываются. Видно в бенч попадают данные на момент запуска проверки модели.

#AI #Android #AndroidDev
  • 🔥 21
  • 👎 6
  • ❤ 2
More from @android_broadcast
  1. Sep 22, 2026🤖 Одно Android-приложение — куча процессов. Зачем это может понадобиться Android-приложен…
  2. Sep 21, 2026🤖 Правильно собирай билд для оценки производительности Чтобы оценить скорость работы прил…
  3. Sep 21, 2026🔥 ОТКРЫВАЕМ ГОРОДСКОЙ СЕЗОН С ЭРГОСТОЛ! С 21 по 30 сентября вас ждут скидки до -20% на ст…
  4. Sep 21, 2026🔴 Как получить офер в Amazon? Сегодня, 21 сентября, 19:00 (время по Минску, GMT+3) В чате…
  5. Sep 18, 2026Post #10189
  6. Sep 17, 2026🤖 GPT-6 Astra в большом отрыве 🤯 для решения задач и дешевле, чем Fable 5.1 и Opus 5 😂…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →