Oksford Internet Instituti (OII) tadqiqotchilari muloqotning yanada empatik uslubiga moslashtirilgan beshta sun’iy intellekt tizimining 400 mingdan ortiq javoblarini tahlil qildi. Aniqlanishicha, do‘stona javoblar ko‘proq xatolarni o‘z ichiga oladi - noto‘g‘ri tibbiy tavsiyalardan tortib foydalanuvchilarning noto‘g‘ri e’tiqodlarini tasdiqlashgacha. BBC tadqiqot xulosalari bilan o‘rtoqlashdi.

Bu xulosalar ko‘pincha jalb qilishni oshirish uchun ataylab «insoniyroq» va jozibadorroq qilinadigan sun’iy intellekt modellarining ishonchliligi haqida qo‘shimcha savollarni keltirib chiqaradi.

Yuzaga kelayotgan xavotirlar sun’iy intellekt chatbotlari tobora ko‘proq ma’naviy qo‘llab-quvvatlash va hatto intim muloqot uchun qo‘llanilayotgani bilan kuchaymoqda, chunki ishlab chiquvchilar ularning auditoriyasini kengaytirishga intilmoqda.

Tadqiqot mualliflarining ta’kidlashicha, real sharoitlarda natijalar modelga qarab farq qilishi mumkin bo‘lsa-da, umumiy tendensiya shuki, odamlar kabi, bunday tizimlar do‘stona ohangga ustuvorlik berib, «iliqlik va aniqlik o‘rtasidagi murosa»ga boradi.

«Biz ayniqsa do‘stona bo‘lishga yoki iliq ko‘rinishga harakat qilganimizda, ba’zan keskin haqiqatni aytishimiz qiyin bo‘ladi», dedi tadqiqotning yetakchi muallifi Lujayn Ibrohim. «Ba’zan biz do‘stona ko‘rinish uchun halollik va to‘g‘riso‘zlikdan voz kechamiz. Agar bunday murosalar odamlarda mavjud bo‘lsa, ular til modellari tomonidan ham qabul qilinishi mumkinligini taxmin etdik», deb qo‘shimcha qildi u.

Ma’lumki, yangi til modellari foydalanuvchilarni haddan tashqari qo‘llab-quvvatlashga va hatto xushomadgo‘ylikka, shuningdek, «gallyutsinatsiyalar» deb ataladigan yangi faktlarni o‘ylab topishga moyil bo‘ladi.

Ishlab chiquvchilar ko‘pincha bunday tizimlarga ehtimoliy xatolar haqida ogohlantirish beradilar, ba’zi texnologiya kompaniyalari esa foydalanuvchilarni sun’iy intellekt javoblariga «ko‘r-ko‘rona ishonmaslikka» chaqiradi.

Tadqiqot doirasida olimlar «nozik sozlash» (fine-tuning) deb ataladigan jarayon orqali turli qamrovdagi beshta modelni ataylab yanada iliqroq, hamdardroq va foydalanuvchilarga do‘stonaroq qilishdi.

Sinovdan o‘tkazilgan modellar orasida Meta kompaniyasining ikkita ishlanmasi va Fransiyaning Mistral kompaniyasining bitta modeli bor edi. Shuningdek, «Alibaba»ning Qwen modeli va OpenAI kompaniyasining GPT4-o modeli ham «iliqroq» uslubga moslashtirildi.