Оксфорд Интернет Институти (OII) тадқиқотчилари мулоқотнинг янада эмпатик услубига мослаштирилган бешта сунъий интеллект тизимининг 400 мингдан ортиқ жавобларини таҳлил қилди. Аниқланишича, дўстона жавоблар кўпроқ хатоларни ўз ичига олади - нотўғри тиббий тавсиялардан тортиб фойдаланувчиларнинг нотўғри эътиқодларини тасдиқлашгача. BBC тадқиқот хулосалари билан ўртоқлашди.
Бу хулосалар кўпинча жалб қилишни ошириш учун атайлаб «инсонийроқ» ва жозибадорроқ қилинадиган сунъий интеллект моделларининг ишончлилиги ҳақида қўшимча саволларни келтириб чиқаради.
Юзага келаётган хавотирлар сунъий интеллект чатботлари тобора кўпроқ маънавий қўллаб-қувватлаш ва ҳатто интим мулоқот учун қўлланилаётгани билан кучаймоқда, чунки ишлаб чиқувчилар уларнинг аудиториясини кенгайтиришга интилмоқда.
Тадқиқот муаллифларининг таъкидлашича, реал шароитларда натижалар моделга қараб фарқ қилиши мумкин бўлса-да, умумий тенденция шуки, одамлар каби, бундай тизимлар дўстона оҳангга устуворлик бериб, «илиқлик ва аниқлик ўртасидаги муроса»га боради.
«Биз айниқса дўстона бўлишга ёки илиқ кўринишга ҳаракат қилганимизда, баъзан кескин ҳақиқатни айтишимиз қийин бўлади», деди тадқиқотнинг етакчи муаллифи Лужайн Иброҳим. «Баъзан биз дўстона кўриниш учун ҳалоллик ва тўғрисўзликдан воз кечамиз. Агар бундай муросалар одамларда мавжуд бўлса, улар тил моделлари томонидан ҳам қабул қилиниши мумкинлигини тахмин этдик», деб қўшимча қилди у.
Маълумки, янги тил моделлари фойдаланувчиларни ҳаддан ташқари қўллаб-қувватлашга ва ҳатто хушомадгўйликка, шунингдек, «галлюцинациялар» деб аталадиган янги фактларни ўйлаб топишга мойил бўлади.
Ишлаб чиқувчилар кўпинча бундай тизимларга эҳтимолий хатолар ҳақида огоҳлантириш берадилар, баъзи технология компаниялари эса фойдаланувчиларни сунъий интеллект жавобларига «кўр-кўрона ишонмасликка» чақиради.
Тадқиқот доирасида олимлар «нозик созлаш» (fine-tuning) деб аталадиган жараён орқали турли қамровдаги бешта моделни атайлаб янада илиқроқ, ҳамдардроқ ва фойдаланувчиларга дўстонароқ қилишди.
Синовдан ўтказилган моделлар орасида Meta компаниясининг иккита ишланмаси ва Франциянинг Mistral компаниясининг битта модели бор эди. Шунингдек, «Alibaba»нинг Qwen модели ва OpenAI компаниясининг GPT4-o модели ҳам «илиқроқ» услубга мослаштирилди.
Кейин бу моделларга, тадқиқотчиларнинг сўзларига кўра, «объектив, текшириладиган жавоблар» мавжуд бўлган саволлар берилди, аммо улардаги хатолар ҳақиқий хавф туғдириши мумкин. Топшириқлар тиббиёт, викторина ва фитна назарияларига оид мавзуларни ўз ичига олган.















