TGViewer
Лаборатория Z Лаборатория Z @lab365 · 159 subscribers
Post #156927 4
Лаборатория Z Америка наживается на россиянах. Российские запросы в Claude вчетверо дороже американских Обработка русскоязычного текста в Claude Opus 5 стоит почти в четыре раза дороже, чем в GPT-5.5. Claude видит в нем на 390% больше токенов, и в итоге пользователи вынужденно…
На проблему обратил внимание пользователь Habr под псевдонимом donseo. В своей публикации он опытным путем установил, что проблема скрывается в том, что нейросети совершенно по-разному работают с токенами.

Исследование donseo показало, что корень зла кроется в специализированном алгоритме – токкенизаторе, который используется для разделения текста на отдельные фрагменты непосредственно перед обработкой нейросетью. В одних случаях текст делится на крупные фрагменты, в других – разбивается едва ли не до отдельной буквы, что и приводит к весомой переплате.

Разница налицо

По словам donseo, в своем исследовании он загрузил один и тот же текст сперва в Claude Opus 5 , затем в GPT-5.5. Детище Anthropic после обработки насчитало в нем на 390%, то есть в 3,9 раза, больше токенов по сравнению с результатом в GPT-5.5.

Vardan Papikyan / Unsplash
Общаться с нейросетями на русском обходится значительно дороже, нежели на английском
«Значит, при одинаковой цене за токен счет за русскоязычный продукт на Opus 5 будет почти вчетверо выше, и это не зависит от того, у кого вы покупаете доступ. Никакой ошибки тут нет, просто у разных моделей разные токенизаторы. «Токен» у каждой модели свой, и сравнивать модели по цене за токен без поправки на язык нельзя», – отметил автор исследования.

В общей сложности donseo сравнил 11 популярных нейросетей, включая российские GigaChat ( Сбербанк ) и YandexGPT (« Яндекс »). В списке также есть Gemini, DeepSeek , Qwen, GLM, Kimi и Grok. «Методика, сырые числа, пересчет в рубли за тысячу символов и код, чтобы повторить замер на своих текстах», – добавил donseo.

Результаты исследования показали, что при сравнении русского текста с английским при одинаковом смысле русский текст «весит» почти в три раза (почти на 300%) больше. Следом идет Kimi (86%), затем Qwen (52%) и DeekSeek (38%). В случсае GPT-5. x/6, Gemini, Grok и GLM дизбаланс в сторону текста на русском языке составляет 18-23%.

Российские нейросети показали прямо противоположный результат. Русский текст в них «весит» меньше английского, но donseo не уточнил, насколько меньше.

Методика проверки

В ходе эксперимента donseo использовал собственноручно написанные тексты в четырех жанрах.

donseo / habr
Жанры текста
More from @lab365
  1. Oct 5, 2026Трамп назвал неожиданную причину роста цен на бензин в США. Что стоит за этим утверждением…
  2. Oct 5, 2026ПВО за ночь обнулила 199 украинских БПЛА над приграничными регионами, Крымом и акваториями…
  3. Oct 5, 2026Депутат Верховной рады исключён из партии после высказываний о России. @lab365
  4. Oct 5, 2026Президент США прокомментировал случай пневмонии неустановленной этиологии в Иркутской обла…
  5. Oct 5, 2026https://t.me/proxy?server=gole-sorati.golabkashan.info&port=8443&secret=1603010200010001fc…
  6. Oct 5, 2026Рубио допускает приостановку работы посольства США в Киеве из-за безопасности. @lab365
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →