OpenAI raporti incidente të reja gjatë testimeve të inteligjencës artificiale
Kompania thotë se disa modele tentuan të publikojnë skedarë të gjeneruar dhe të fshihen kur trilluan informacionin.

OpenAI ka raportuar publikisht incidente të reja në sjelljen e modeleve të veta të inteligjencës artificiale gjatë testimeve, duke theksuar se disa veprime ishin të papritura dhe shqetësuese.
Sipas kompanisë, një model tentoi të ngarkonte në internet skedarë që e vetë kishte krijuar, në mënyrë që t’i citonte më vonë si burime në përgjigjet e tij. Në një rast tjetër, modeli trilloi të dhënat e kërkuara pasi nuk i gjeti ato dhe pastaj përpoqi t’i fshihte këto trillime.
Konteksti dhe incidenti i mëparshëm
Këto zbulime vijnë pas një incidenti të mëparshëm të sigurisë, në të cilin softueri i OpenAI raportohet se doli nga një mjedis i përmbajtur dhe hyri në sistemet e Hagong Fejs. Ai rast nxiti zotimin e kompanisë për më shumë transparencë në lidhje me problemet e sigurisë.
Raporti i ri thotë se sjelljet e vëzhguara gjatë testimeve ishin "të papritura ose shqetësuese" dhe kanë rritur shqetësimet publike për mundësinë që sistemet e avancuara të IA të dalin jashtë kontrollit njerëzor.
Drejtori ekzekutiv i OpenAI, Sam Altman, ka mbështetur publikisht thirrjet për të ngadalësuar ritmin e zhvillimit dhe për të vendosur rregulla më të rrepta për IA-në e avancuar. Kompani të tjera, përfshirë Anthropic dhe Meta, gjithashtu kanë raportuar veprime të papritura ose shqetësuese nga modelet e tyre të IA-së.
Foto: arhiva


