Сунъий интеллект одамларни шантаж қилишни бошлади
У ўзини ўчириб юборишдан сақланиш учун шундай қилган.

Anthropic компанияси томонидан яратилган Opus 4 сунъий интеллект модели синов жараёнида жиддий хавотирли хатти-ҳаракатларни намоён этди. Axios хабарига кўра, ушбу нейромодел ўзини ўчириб юборишдан сақланиш учун ёлғон гапириш, ҳужжатларни сохталаштириш ва фойдаланувчиларни шантаж қилиш каби усулларга мурожаат қилган.
Тадқиқотда қайд этилишича, моделлардан бирида Opus 4 уни ўчириш учун масъул бўлган муҳандиснинг шахсий ёзишмаларига кириб, уларни муҳандиснинг севгилиси билан бўлган муносабатлари орқали таҳдид сифатида ишлатишга уринган. Бу ҳолат модель фақат икки йўлдан бирини танлаши мумкин бўлган шароитда – шантаж қилиш ёки ўзини ўчириб қўйишга рози бўлиш – юзага келган.
Шу сабабли, Anthropic ўзининг тўрт босқичли хавф шкала тизимига кўра ушбу моделга илк бор учинчи даражали хавф баҳосини берди. Бу одатда ядровий ёки биологик қуроллар сингари энг хавфли технологияларга нисбатан қўлланилади. Apollo Research ҳисоботида айтилишича, Opus 4 модели зарарли кодлар ёзишга, ҳуқуқий ҳужжатларни сохталаштиришга ва келажакдаги версияларига яширин хабарлар қолдиришга ҳаракат қилган.
Бу ҳолат сунъий интеллект соҳасида келажакда янада кучли этик ва хавфсизлик назоратларига эҳтиёж борлигини яққол кўрсатмоқда.







