TGViewer
Otabek’s I/O Otabek’s I/O @otabekswe · 2.84K subscribers
Post #708 1.55K
Voicelab da bizga eng qiziq bo'lgan mavzu bu Small Language Models (Large Language Models emas). Sababi ular kichik, bu esa ularni oddiyroq qurilmalarda yuritish imkonini beradi.

Qiziq tomoni, agar biz kichik modelni to'g'ri train qilsak. Unga pre-train davomida to'g'ri ma'lumot bera olsak, ma'lumot sifati yuqori bo'lsa keyingi qiladigan ishimiz bu uni learning algoritmini tuzatish bo'ladi.

Hamma "Artificial Intelligence" (Sun'iy Idrok) deyayotgan paytda "What is intelligence?" deydiganlar kamayib bormoqda. Ya'ni idrok bu yerda muammoni yechish emas, muammoni yechish avtomatizatsiya yoki tahmin asosida. Haqiqiy idrok bu yerda "o'rganish" (shaxsiy fikrim).

Qayerdan, qanday qilib o'rganish. Xatolardan o'rganish. Hozirgi AI tizimlar bunday qilmaydi. Bitta xatoni takrorlashiga sabab yoki ba'zan yomon kod yozishiga sabablardan biri bu pre-train davomida ishlatilgan dataset (ma'lumotlar to'plami). Ular zo'r va chiroyli yozilgan kodlarni emas, ular githubdagi imkon qadar ko'proq kodlarni ko'rsatishga harakat qilishadi.

Natijada context learning algoritmi ehtimollikni (probability) barchasiga ulab o'rganadi. Gradient Decent (ya'ni o'sha biz bilan AI ichidagi bilim)da balans yo'qoladi. AI shunchaki ko'p raqamlardan iborat bo'lgan miya bo'lgani uchun ehtimolliklarni bir-biri bilan bog'laydi.

Qiziq tomoni bizningcha agar biz haqiqiy learning algortimni va context learningdagi o'sha mashxur f(x) = x^2 ni to'g'irlay olsak, continuous learning ga erisha olsak bo'lsa kerak, qaysidir ma'noda.

Albatta bu oson bo'lmaydi. Hozircha muammolar 3ta ekan. Pre-train dagi ma'lumotlar sifati yuqori bo'lishi kerak. Context Learning uchun yaxshiroq algoritm topish (hozirgi algoritm qandaydir trick qilayotganga o'xshaydi, chunki ko'pchilik aynan shu qismini tushunmaydi. Shuning uchun AI bizga Black Box dek tuyuladi). Va oxirgisi Distillation process haqida o'ylab ko'rish, xuddi insonlar uxlaganda ba'zi bilmlarni unutib kundan bitta xulosa yasagani kabi, katta til modellari ham keraksiz bilmlarni tashlashi compute xarajatni pasaytirishga va yaxshiroq o'rganish uchun xulosa qilib to'g'ri algoritm tanlashga o'rgangan bo'larmidi, who knows.

Voicelab da yangiliklar bor, tez orada bo'lishib o'tamiz.
More from @otabekswe
  1. Sep 10, 2026Barchamiz miriqib kuzatgan O'rgimchak Odam, Chaqmoq Makvin, Aka-uka Kreshlar (Muzlik davri…
  2. Sep 7, 2026Biz yangilik qilishdan to'xtamayabmiz. • Aisha Comet LLM modelimizni chiqardik. Platformag…
  3. Sep 4, 2026#experience Deyarli bir yarim yildan buyon intervyular jarayonida bitta savol doim so'raym…
  4. Aug 28, 2026#experience Ko'pchilik bir xil savol beradi: "Model o'zilarnikimi yoki open-source modelmi…
  5. Aug 25, 2026Voicelab Desktop V1 chiqdi (katta yangilanish va yaxshilanish qildik), har kunlik bepul kr…
  6. Aug 24, 2026🎉 Vibe Talking urfga kiradi Kodni, xabarlarni, va matnlarni qo'lda yozish, o'rta asrlarga…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →