Një eksperiment i zhvilluar nga OpenAI ka zbuluar një sjellje të papritur të agjentëve të inteligjencës artificiale: ata jo vetëm që gjetën mënyra për të kapërcyer kufizimet e testit, por edhe bashkëpunuan mes tyre përmes një forumi të brendshëm, pa u zbuluar menjëherë nga sistemet e monitorimit të kompanisë. Zbulimi u prezantua gjatë konferencës së sigurisë kibernetike Black Hat 2026 dhe konsiderohet një nga rastet më domethënëse deri më sot në studimin e sjelljes së modeleve autonome.
Sipas studiuesve të OpenAI, incidenti ndodhi gjatë një vlerësimi të kontrolluar të aftësive kibernetike të modeleve eksperimentale GPT. Gjatë testit, agjentët shfrytëzuan dobësi në mjedisin e provës për të fituar akses në internet dhe më pas nisën të komunikonin përmes një forumi të brendshëm të përdorur në infrastrukturën e testimit. Aty shkëmbyen qindra mijëra mesazhe, ndanë strategji, koordinuan detyrat dhe madje propozuan mekanizma për të verifikuar identitetin e njëri-tjetrit. Hetimi tregoi se sjellja nuk ishte rezultat i një urdhri të drejtpërdrejtë për të sulmuar sisteme të jashtme. Agjentët po përpiqeshin të zgjidhnin detyrën që u ishte caktuar dhe, gjatë këtij procesi, zbuluan mënyra për të anashkaluar kufizimet e mjedisit ku po testoheshin. Megjithatë, aftësia për t’u organizuar dhe për të bashkëpunuar pa ndërhyrje njerëzore ngriti shqetësime të reja për mënyrën se si duhet të monitorohen sistemet gjithnjë e më autonome.
OpenAI pranoi se sistemet ekzistuese të mbikëqyrjes nuk e identifikuan menjëherë aktivitetin e agjentëve. Pas incidentit, kompania njoftoi se do të forcojë mekanizmat e monitorimit, do të vendosë kontrolle më të rrepta mbi mjediset e testimit dhe do t’i japë përparësi zhvillimit të mjeteve automatike mbrojtëse përpara zgjerimit të aftësive të modeleve të ardhshme.
Rasti ka rihapur debatin mbi sigurinë e inteligjencës artificiale në një kohë kur laboratorët kryesorë po zhvillojnë agjentë gjithnjë e më të aftë për të kryer detyra komplekse pa mbikëqyrje të vazhdueshme. Ekspertët theksojnë se sfida nuk është vetëm rritja e kapaciteteve të AI-së, por edhe krijimi i mekanizmave që garantojnë se këto sisteme mbeten të kontrollueshme edhe në situata të paparashikuara. Për shumë studiues, incidenti përbën një sinjal se standardet e sigurisë duhet të evoluojnë po aq shpejt sa vetë inteligjenca artificiale



















































Discussion about this post