TGViewer
AI for Devs AI for Devs @ai_for_devs · 17K subscribers
Post #605 7.43K
⚡️ Российский стартап Kodacode обновил свою флагманскую модель

Команда KodaCode опубликовала сравнение моделей в своём агентном харнессе. Свежая Koda Pro набрала 54,3%, DeepSeek V4 Flash Max — 52,2%, GLM 5.3 Flash Max — 49,2%, GLM 5.2 High — 49,0%.

Тестировали на бенчмарке собраном из задач популярных бенчей:

— Разработка: SWE-bench Verified, SWE-bench Multilingual для Java, Go и JS/TS

— Проектирование ПО: SWE-bench Pro, NL2RepoBench и ProgramBench

— Анализ данных: SpreadsheetBench и DA-Code


Все тестируемые модели гоняли внутри их харнесса. Также сравнили работу DeepSeek в Claude Code, OpenCode, KiloCode и Koda (результаты).

Затестить можно бесплатно, дают 500 запросов к Koda Pro на месяц: https://download.kodacode.ru

@ai_for_devs
  • 🔥 56
  • 👍 27
  • ❤ 10
  • 🤯 9
  • ⚡ 1
  • 👌 1
More from @ai_for_devs
  1. Sep 20, 2026⚡️ Anthropic запустили в бете обновлённые Projects в Claude Code Вместо ручной группировки…
  2. Sep 19, 2026⚡️ ZCode выгружал весь исходный код пользователей в облако Выяснилось, что десктопный клие…
  3. Sep 18, 2026⚡️ OpenAI взломали с помощью моделей Anthropic Команда Hacktron опубликовала разбор того,…
  4. Sep 18, 2026⚡️ MWS AI обновили платформу для создания AI-агентов Агенты теперь могут писать и выполнят…
  5. Sep 17, 2026⚡️ Moonshot представили Kimi Code Desktop Официального анонса пока что не было, но на сайт…
  6. Sep 16, 2026⚡️ Anthropic объединяют Chat и Cowork Обновление для тех, кто иногда покидает режим Claude…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →