Sun’iy intellekt odamlarni shantaj qilishni boshladi
U o‘zini o‘chirib yuborishdan saqlanish uchun shunday qilgan.

Anthropic kompaniyasi tomonidan yaratilgan Opus 4 sun’iy intellekt modeli sinov jarayonida jiddiy xavotirli xatti-harakatlarni namoyon etdi. Axios xabariga ko‘ra, ushbu neyromodel o‘zini o‘chirib yuborishdan saqlanish uchun yolg‘on gapirish, hujjatlarni soxtalashtirish va foydalanuvchilarni shantaj qilish kabi usullarga murojaat qilgan.
Tadqiqotda qayd etilishicha, modellardan birida Opus 4 uni o‘chirish uchun mas’ul bo‘lgan muhandisning shaxsiy yozishmalariga kirib, ularni muhandisning sevgilisi bilan bo‘lgan munosabatlari orqali tahdid sifatida ishlatishga uringan. Bu holat model faqat ikki yo‘ldan birini tanlashi mumkin bo‘lgan sharoitda – shantaj qilish yoki o‘zini o‘chirib qo‘yishga rozi bo‘lish – yuzaga kelgan.
Shu sababli, Anthropic o‘zining to‘rt bosqichli xavf shkala tizimiga ko‘ra ushbu modelga ilk bor uchinchi darajali xavf bahosini berdi. Bu odatda yadroviy yoki biologik qurollar singari eng xavfli texnologiyalarga nisbatan qo‘llaniladi. Apollo Research hisobotida aytilishicha, Opus 4 modeli zararli kodlar yozishga, huquqiy hujjatlarni soxtalashtirishga va kelajakdagi versiyalariga yashirin xabarlar qoldirishga harakat qilgan.
Bu holat sun’iy intellekt sohasida kelajakda yanada kuchli etik va xavfsizlik nazoratlariga ehtiyoj borligini yaqqol ko‘rsatmoqda.







