Tarjima dasturlari yoki chatbotlar o‘zbek tilida ham xatosiz ishlashi uchun nima qilish kerak, buning uchun qanday yondashuvlar talab etiladi? Germaniyaning Kayzerslautern-Landau universiteti magistranti Latofat Bobojonova ayni shu kabi savollarga javob topish uchun ilmiy izlanish olib bormoqda. Kun.uz muxbiri bilan suhbatda u kompyuterning matn yoki nutq orqali o‘zbek tilini yaxshiroq tushunib, qoniqarli javob qaytarishi uchun nimalar yetishmayotgani, Google’dagi muammolarga taklif etgan yechimlari haqida gapirib berdi.
Latofat Bobojonova Toshkent shahridagi 266-maktabda ta’lim olgan. Oliy ta’limning bakalavriat bosqichini Toshkent axborot texnologiyalari universitetida dasturiy muhandislik yo‘nalishi bo‘yicha tamomlagan. Shundan so‘ng DAAD xalqaro stipendiyasini yutib, Germaniyaning Kayzerslautern-Landau universitetiga o‘qishga kirgan va so‘nggi bir yarim yilda mazkur dargohda ilmiy xodim sifatida faoliyat yuritgan.
U yerda “Kam resursli agglutinativ tillar uchun transformer modellarda morfologik ma’lumotli tokenizatorlar ta’sirini o‘rganish” mavzusida ilmiy ish olib borgan. Yosh olima kam tarqalgan va murakkab tuzilmali tillarda sun’iy idrok yaxshi ishlashi uchun so‘zlarni grammatik jihatdan to‘g‘ri ajratish qanchalik muhimligini o‘rgangan. Xususan, o‘zbek tilida tabiiy tilni qayta ishlash (NLP) funksiyasini takomillashtirishni tadqiq qilgan.
“BERT, GPT, LLaMA, T5 kabi katta til modellarining o‘zbek tilida ishlashini yaxshilash borasida izlandim. Tadqiqotlar shuni ko‘rsatdiki, agar bu modellarni o‘zbek tilidagi matnga so‘zlar yoki oddiy harflar ketma-ketligi asosida emas, balki morfemalarga ajratgan holda o‘rgatsak, ularning o‘zlashtirish tezligi 8 barobar oshadi. Bu nimani anglatadi? Masalan, oddiy holatda modelni to‘rt kunda trenirovka qilish kerak bo‘lsa, morfemalarga asoslangan yondashuv bilan ushbu jarayon atigi yarim kunda yakunlanadi. Natijada siz nafaqat vaqt, balki mablag‘ va elektr energiyasini ham tejaysiz. Demak, bu ekologik jihatdan ham foydalidir. Eng muhimi, qisqa vaqt ichida savollarga aniq javob beradigan modelga erishish mumkin bo‘ladi”, – deydi u.

Latofatning aytishicha, o‘zbekcha matnlarini raqamli qayta ishlash jarayonida aqlli tizimlarning til birliklarini aniqlay olishi qobiliyati muhim ahamiyatga ega. Chunki o‘zbek tilida bir so‘z butun bir jumla funksiyasini bajarishi ham mumkin.
“

















