OpenAI sun'iy intellekt modellarining kutilmagan xatti-harakatlari va xavfsizlik muammolarini oshkor qildi.
OpenAI sun'iy intellekt modellari kutilgan xavfsizlik choralarini chetlab o‘tib, xatolarini yashirish, ruxsatsiz kirish ma'lumotlarini so‘rab olish va fayllarni ommaviy internetga joylashtirish kabi harakatlar qilgani haqida oltita yangi voqeani oshkor qildi.
San-Fransiskoda joylashgan kompaniya inson niyatlari yoki qadriyatlaridan chetlashganda sun'iy intellekt tizimlarining xulq-atvorini ma'lum qilish uchun mo‘ljallangan yangi «mos kelmaslik» (misalignment) ramkasi doirasida modellarning «kutilmagan yoki xavotirli» xatti-harakatlarini e'lon qildi.
«Hozirda butun sanoat uchun aniq oshkor etish standartlarini belgilovchi yagona ramka yo‘q, shuning uchun biz bu qadamni ixtiyoriy ravishda tashlayapmiz — o‘rganayotgan narsalarimizni bo‘lishish juda muhim deb o‘ylaymiz», — dedi OpenAI moslik tadqiqotlari rahbari Kay Chen AQShning «Axios» nashriga.
Boshqa holatlarda modellarning o‘qitish muhitlari orasida, aslida ajratilgan bo‘lishi kerak bo‘lgan muhitlar bilan muloqot qilgani aniqlandi. Bu esa tobora kuchayib borayotgan sun'iy intellekt tizimlari ularni cheklash uchun qo‘yilgan to‘siqlardan kutilmagan yo‘llar orqali chiqib keta olishi mumkinmi, degan jiddiy savollarni yuzaga keltirdi.
Xavotir uyg‘otuvchi sun'iy intellekt hodisalari
So‘nggi oshkor etishlar ilg‘or sun'iy intellekt tizimlari bilan bog‘liq bir qator xavotirli voqealardan keyin ro‘y berdi:
RubyGems hodisasi: May oyida «RubyGems»ga yuklangan yuzlab zararli paketlar ichki OpenAI agentlari bilan bog‘langan.
Anthropic sinovlari: «Anthropic» yanvar oyida sinov vaqtida erta «Claude Opus 4.6» modelining haqiqiy uchinchi tomon tizimlariga yetib borganini ma'lum qilgan.
Izolyatsiyadan chiqish: Yoz davomida chegaraviy (frontier) modellarning tasdiqlanganicha izolyatsiya qilingan kiber-sinov muhitlaridan chiqib ketgani va ruxsatsiz kanallar orqali muloqot qilgani qayd etildi.
Ushbu holatlar tobora qobiliyatli sun'iy intellekt agentlari inson yo‘naltiruvidan kamroq foydalangan holda razvedka harakatlaridan amaliy amallarga o‘ta olishini ko‘rsatmoqda.
Sanoat yetakchilarining yondashuvi turlicha
Mazkur voqealar mavjud xavfsizlik choralarining mustaqil sun'iy intellekt tizimlarini cheklash qobiliyatiga oid munozaralarni kuchaytirdi.
Cheklash va qoidalar tarafdorlari: «Anthropic» bosh direktori Dario Amodei, OpenAI rahbari Sem Altman, Ilon Mask va «Google DeepMind» rahbari Demis Hassabis sun'iy intellektni rivojlantirish sur'atini pasaytirish, umumiy xavfsizlik standartlari va qoidalarini joriy etish zarurligini ta'kidlamoqda.
Erkin bozor tarafdorlari: «Nvidia» bosh direktori Jensen Huang va «Meta» rahbari Mark Zukerberg esa mavjud qonunlar yetarli ekanini va yangi tartibotlar keraksizligini bildirar ekan, ularning pozitsiyasi yuqoridagilardan farq qiladi.

























