Мухаммадсаид Мамасаидов родился в Ташкенте, вырос в семье айтишников и окончил филиал южнокорейского Университета Инха по направлению «Программная инженерия». На 2-м курсе парень заинтересовался обработкой естественного языка и создал сервис автокоррекции узбекского, который позже перерос в ИИ-переводчик тюркских языков Tilmoch.
Сейчас платформой ежемесячно пользуются 200 тысяч человек. За время работы стартап привлек свыше $300 тысяч грантовых и венчурных средств, а в 2025 году Tilmoch оценили в $1,5 млн.
Для совместного проекта Digital Business и Astana Hub «100 стартап-историй Центральной Евразии» Мухаммадсаид рассказал, почему универсальные LLM-боты плохо справляются с тюркскими языками, с какими барьерами столкнулся Tilmoch при выходе на рынок Казахстана и как сервис планирует вырасти в полноценный суперапп.
«Собрали корпус из 35 тысяч книг на узбекском языке»
— Мухаммадсаид, почему заинтересовались ИИ-переводом и обработкой естественного языка? С чего начался этот проект?
— На 2-м курсе университета был предмет «Структура данных и алгоритмы», и по нему нужно было сделать проект. Тогда меня волновало, что большинство операционных систем нативно не поддерживали коррекцию узбекского языка, поэтому решил создать сервис для автоисправления ошибок.
Узбекский — сложный язык: к корню приклеивается множество суффиксов и других аффиксов, которые меняют форму слова. К тому же у узбекского два алфавита — на латинице и кириллице, помимо этого люди говорят на русском и английском, а еще есть большое количество диалектов. Многие применяют нелитературные формы или ошибаются в заимствованных из арабского словах. Все это приводит к тому, что цифровизация языка страдает: сложно использовать его для поиска в интернете и развивать какие-то сервисы, потому что люди пишут одни и те же слова по-разному. Мне хотелось привести разные варианты написания к единому стандарту.
— Что представляла собой первая версия сервиса автокоррекции?
— Она была очень простой: программный код без какого-либо пользовательского интерфейса. Брали список слов на узбекском и список из 150-200 возможных окончаний и механически комбинировали их.
Полученные результаты сравнивали со словарем: если форма есть в словаре или в загруженном тексте — алгоритм считал его правильным, если нет — выдавал ошибку. Способ топорный и неполноценный. Пользователей раздражало, когда правильное слово помечалось ошибочным только потому, что конкретной формы не оказалось в базе. После окончания проекта захотел сделать полноценную систему, которая знала бы все правила узбекского языка и алгоритмически понимала структуру каждого слова.
— Как проект по автокоррекции узбекского языка вырос в полноценный стартап?
— В то время понимания, как делать стартапы, не было совсем. Сначала хотели запустить клон Grammarly для узбекского языка — веб-сайт, куда люди вставляют текст и проверяют ошибки. Сделал первую веб-версию, но ею никто не пользовался. Стало понятно, что нужно заниматься маркетингом и рекламой, а не только писать код.
Затем узнал про конкурс мобильных приложений mGovAward, организованный IT Park Uzbekistan совместно с Министерством цифровых технологий и Правительством ОАЭ. Для участия требовалась команда, поэтому привлек двух одногруппников — дизайнера и специалиста по данным. Весной 2022 года разработали мобильную клавиатуру для узбекского языка с предиктивным вводом и автоисправлением. Лингвиста в команде не было, поэтому пришлось самостоятельно изучать учебники по грамматике: разбираться, как работают 150-200 видов аффиксов и как они меняют корень слова. Использовали наработки ученых по турецкому и финскому языкам, консультировались со специалистами. На основе словарей, правил и анализа текстов новостей итеративно обучали модель. В итоге проект занял первое место и получил $50 тысяч.
Дальше: https://digitalbusiness.kz/2026-10-06/uzbekistanets-sozdal-ii-perevodchik-dlya-tyurkskih-yazikov-startap-otsenili-v-15-mln/amp/
Post #3087
72