TGViewer
Роман с данными Роман с данными @roma_data · 2.72K subscribers
Post #32 1.05K
Выложил на kaggle Russian Open Speech To Text (STT/ASR) Dataset.

Датасет содержит 118 000 аудиозаписей. Аудиозаписи были получены с помощью краудсорсинговой платформы Яндекс.Толока. В создании датасета участвовало 66 человек. Людям предлагались предложения для озвучки, необходимо было произносить предложения и записывать этот процесс на телефон.

Изначально датасет создавался для китайского заказчика Gstar-Marketing, но он пропал, так и не заплатив полную стоимость работ за проект. В связи с этим решено было выложить все уже собранные записи в открытый доступ (не пропадать же добру). К сожалению, мы так и не реализовали проект по валидации и проверке аудиозаписей, поэтому датасет немного "шумный" и может содержать "бракованные" аудиозаписи.

Но все-равно надеюсь, что кому-нибудь он пригодится.
More from @roma_data
  1. Aug 11, 2026⭐️ Новая арена и вклад в развитие сообщества В этом году LLM Arena стала победителем на пр…
  2. Jun 30, 2026Так, я не дурак 😀 Yupp сжег 33 ляма баксов и закрылся 😬😬😬 Что произошло: мы запустилис…
  3. Jun 21, 2026Ездил в апреле в США в SF - там все обсуждали harness Приехал на Саусхаб - снова harness,…
  4. Jun 10, 2026photo post
  5. Jun 10, 2026photo post
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →