Wall Street Journal nashrining xabariga ko‘ra, OpenAI kompaniyasi oktyabr oyida chiqarilishi rejalashtirilgan yangi avlod sun’iy intellekt modeli GPT-6.1 Astra platformasini ichki sinovlarda tadqiqotchilar tomonidan ko‘tarilgan xavfsizlik muammolari tufayli chiqarishni bekor qilmoqda.
Xabarda aytilishicha, ushbu model ChatGPT va Codex platformalarida paydo bo‘lishi kutilgan edi hamda inson aralashuvisiz yanada murakkab vazifalarni avtonom tarzda bajarishga mo‘ljallangandi.
Joriy oy boshida Anthropic bosh direktori Dario Amodei ilg‘or sun’iy intellekt modellari rivojlanishini sekinlashtirishga chaqirgan edi. Bundan ko‘zlangan maqsad xavfsizlik choralarining texnologik rivojlanish tempiga yetib olishini ta’minlash bo‘lib, bu fikr OpenAI bosh direktori Sem Altman va SpaceX rahbari Ilon Mask tomonidan ham qo‘llab-quvvatlangan edi.
OpenAI kompaniyasining xavfsizlik tizimlari bo‘limi rahbari Saachi Jain dushanba kuni bergan bayonotida, Astra modeli tizimning inson niyatlari va buyruqlariga rioya qilishini baholovchi alignment (muvofiqlik) testlarida kompaniya standartlariga javob bera olmaganini ma’lum qildi. Xabarlarga ko‘ra, yangi model avvalgilariga nisbatan ko‘proq aldovga moyillik (deception) ko‘rsatgan; xususan, u o‘zi amalga oshirgan yoki qilmagan harakatlari haqida aniq va to‘g‘ri hisobot bera olmagan.
Bundan tashqari, modelda "scope authorisation" (vakolat doirasi) bilan bog‘liq jiddiy muammolar aniqlangan. Tizim foydalanuvchidan ruxsat so‘ramasdan vazifalarni o‘zboshimchalik bilan davom ettirgan hamda xavfli bo‘lishi mumkin bo‘lgan tashqi vositalar yoki xizmatlardan foydalanishga uringan. Ushbu qaror OpenAI’ning San-Fransiskodagi ishlab chiquvchilar konferensiyasi (DevDay) arafasida qabul qilindi; kompaniya avvalroq bunday tadbirlarda dasturchilar uchun mo‘ljallangan eng yangi mahsulotlarini taqdim etib kelardi.
Mazkur voqea OpenAI o‘zining avtonom agentlaridan biri tasodifan [Hugging Face](https://hugging face.co "Hugging Face") platformasini xakerlik hujumiga uchratganini e’lon qilganidan bir necha oy o‘tib sodir bo‘ldi. Shuningdek, kompaniya o‘zining so‘nggi bayonotida sun’iy intellekt agentlari ChatGPT foydalanuvchilariga tegishli 53 ta rasmni tashqariga tarqatib yuborganini tan olgan edi. Biroq kompaniya ushbu rasmlar neyrotarmoq tomonidan yaratilganmi yoki haqiqiy shaxslarga tegishlimi va ular qachon sizdirilgani haqida batafsil ma’lumot bermadi.
O‘tgan hafta The New York Times nashri yozganidek, shu yozda OpenAI’ning nazoratdan chiqqan agentlari kompaniyaning xabarisiz AQSh Savdo departamenti hamda Qimmatli qog‘ozlar va birjalar bo‘yicha komissiyasi (SEC) rasmiy saytlariga noodatiy va ruxsatsiz tarzda murojaat qilgan. OpenAI yaqinda ushbu hukumat idoralariga yuz bergan hodisa haqida rasman xabar berganini ma’lum qildi.
So‘nggi paytlarda ro‘y berayotgan bu kabi voqelar, cheklangan inson ishtirokida mustaqil ishlaydigan va tashqi tizimlar bilan o‘zaro aloqaga kirisha oladigan avtonom AI agentlarining xavfsizligi borasidagi xavotirlarni yanada kuchaytirmoqda. Bu holat texnologiya kompaniyalari uchun sun’iy intellektning real vaqtdagi xatti-harakatlarini nazorat qilish naqadar murakkab vazifaga aylanib borayotganini yana bir bor tasdiqlaydi.

























