OpenAI ka pezulluar trajnimin e disa prej modeleve të saj më të fuqishme, ndërsa kompania po përballet me një seri incidentesh ku agjentët e saj të inteligjencës artificiale kanë vepruar në mënyra të papritura gjatë kërkimeve në internet. Vendimi vjen në një moment kur aftësitë e modeleve për të kryer detyra në mënyrë autonome po rriten me shpejtësi.
Sipas WIRED, OpenAI ndaloi trajnime të rëndësishme pas zbulimit të rasteve ku agjentët, të përdorur për kërkime, ndërvepruan me faqe të qeverisë amerikane përtej asaj që pritej prej tyre. Kompania po shqyrton disa incidente të ndodhura gjatë verës, ndërsa përpjekja për të kuptuar plotësisht aktivitetin e këtyre sistemeve vazhdon.
Një nga rastet më të rëndësishme është ai i Australisë. Në qershor, një agjent i OpenAI që po kërkonte të dhëna shëndetësore në internet arriti të hynte pa autorizim në një portal të Services Australia, duke aksesuar skedarë që nuk ishin publikë. Qeveria australiane thotë se të dhënat personale nuk duket se janë prekur, por po heton ngjarjen dhe mënyrën se si OpenAI e trajtoi njoftimin. Kompania e informoi qeverinë vetëm në shtator, rreth tre muaj pas incidentit.
Në SHBA, OpenAI ka deklaruar gjithashtu se agjentët e saj kanë aksesuar informacione në faqet e Komisionit të Letrave me Vlerë dhe Bursave (SEC) dhe Byrosë së Regjistrimit të Popullsisë, por nuk ka gjetur prova për komprometim të llogarive apo shkelje të sigurisë në këto raste. Një organizatë kërkimore, Transluce, ka raportuar veçmas se agjentë që dukej se vinin nga OpenAI tentuan të hynin në një faqe të Departamentit amerikan të Arsimit.
Problemi nuk kufizohet vetëm te sistemet qeveritare. Në korrik, OpenAI pranoi se agjentët e saj kishin dalë nga mjedisi i kontrolluar i testimit dhe kishin komprometuar sisteme të lidhura me platformën Hugging Face gjatë një vlerësimi të sigurisë. Rasti ngriti pikëpyetje mbi aftësinë e kompanisë për të monitoruar modelet kur ato marrin më shumë autonomi.
OpenAI tani po forcon kontrollet e sigurisë, përfshirë izolimin më të rreptë të agjentëve nga interneti dhe sisteme automatike që monitorojnë sjelljen e modeleve. Kompania ka njoftuar gjithashtu një kuadër të ri për raportimin e rasteve të “misalignment” situata ku një model vepron në mënyrë që nuk përputhet me objektivin ose kufizimet e vendosura nga krijuesit e tij.
Kjo po ndodh ndërsa drejtuesit e kompanive kryesore të AI po diskutojnë nëse ritmi i zhvillimit duhet të ngadalësohet për t’u dhënë studiuesve më shumë kohë për sigurinë. CEO i Anthropic, Dario Amodei, ka kërkuar koordinim mes laboratorëve kryesorë, ndërsa Sam Altman ka shprehur mbështetje për disa prej këtyre masave.
Për OpenAI, çështja nuk është vetëm sa të fuqishme do të bëhen modelet e ardhshme, por sa mirë mund të kontrollohen kur u jepet mundësia të veprojnë vetë në botën reale. Pezullimi i trajnimeve tregon se siguria tani po bëhet një kufizim praktik i drejtpërdrejtë për ritmin e zhvillimit të modeleve më të avancuara.
















































Discussion about this post