Асель Ермекова собрала все датасеты на казахском языке доступные в открытом доступе The catalog currently includes 50+ datasets across three areas:
• NLP, LLMs, and text-based tasks
• ASR, TTS, and other speech technologies
• Computer vision, OCR, and multimodal tasks ссылка на репу: https://github.com/Allessyer/awesome-kaz-datasets . Телеграм канал Асель https://t.me/zametki_polukrovki. @devs_kz
Post #7229
1.5K


- 🔥 15
- ❤ 2