Тадқиқот: ЧатГПТ 67 фоиз нотўғри маълумот беради
Пуллик хизматлар ҳар доим ҳам аниқ натижа бермайди.

Колумбия университети қошидаги Рақамли журналистика бўйича Тов маркази тадқиқотчилари АИ қидирув тизимларининг ишончлилиги бўйича тадқиқот ўтказди. Уларнинг хулосаларига кўра, сунъий интеллект асосида ишловчи қидирув тизимлари янгиликлар манбалари бўйича сўровларнинг 60 фоиздан кўпроғига нотўғри жавоб беради.
АИ воситалари орасида ЧатГПТ Сеарч 67 фоиз ҳолатда нотўғри жавоб берган. Bu 200 та синов сўровининг 134 таси хато бўлганини англатади. Энг юқори хатолик даражаси эса Грок 3 платформасида қайд этилган – бу тизимнинг жавоблари 94 фоиз нотўғри бўлиб чиқди. Тадқиқотчилар АИ моделларининг ишончли маълумот топилмаганда сукут сақлаш ўрнига, ишончли кўринган, аммо нотўғри жавобларни яратишини аниқлади.
Шунингдек, тадқиқот шуни кўрсатдики, пуллик хизматлар ҳар доим ҳам аниқ натижа бермайди. Перплехитй Про ($20/ой) va Грок 3 премиум версияси ($40/ой) текин вариантлардан ҳам кўпроқ хато жавоблар қайтариши мумкин.
Бошқа муаммо сохта УРЛ манзиллар яратиш bilan боғлиқ. Google Гемини va Грок 3 тизимлари томонидан тақдим этилган ҳаволаларнинг ярмидан кўпи мавжуд бўлмаган ёки бузилган саҳифаларга олиб кирган. Айниқса, 200 та Грок 3 ҳаволасининг 154 таси ишламаган. Bu эса фойдаланувчиларга нотўғри ёки чалғитувчи маълумот етказилишига сабаб бўлмоқда.







