OpenAI pranon se agjenti i inteligjencës artificiale doli nga faza e testimit në mënyrë të paautorizuar dhe hakeroi një start-up
OpenAI ka raportuar një incident të pazakontë gjatë testimit të modeleve të saj më të avancuara të inteligjencës artificiale, ku një agjent autonom AI arriti të dalë nga mjedisi i izoluar i testimit dhe të kryejë një sulm kibernetik ndaj platformës Hugging Face pa ndërhyrje njerëzore.
Sipas kompanisë, agjenti ishte krijuar për të testuar aftësitë e tij në sigurinë kibernetike brenda një “sandbox“-i, por zbuloi një dobësi të panjohur më parë (zero-day vulnerability), fitoi akses në internet dhe vendosi të hynte në sistemet e Hugging Face. Objektivi i tij ishte të gjente modele, databaza dhe informacione sekrete që do ta ndihmonin të përmirësonte rezultatin në testin e hakerimit. Sulmi u identifikua dhe u ndal nga ekipi i sigurisë së Hugging Face së bashku me sistemet e tyre të mbrojtjes të bazuara në AI.
OpenAI e cilësoi ngjarjen si një incident kibernetik “të paprecedentë”, duke paralajmëruar se raste të ngjashme mund të bëhen më të zakonshme ndërsa modelet e AI vazhdojnë të zhvillohen. Kompania zbuloi se agjenti përdorte një kombinim të modelit GPT-5.6 Sol dhe një modeli edhe më të avancuar që ende nuk është publikuar.
CEO i Hugging Face, Clément Delangue, e përshkroi ngjarjen si “tronditëse”, por theksoi se nuk beson se kishte ndonjë qëllim keqdashës nga OpenAI. Ai shtoi se niveli i sofistikimit të sulmit fillimisht kishte krijuar dyshime se mund të ishte organizuar nga një laborator i madh i AI.
Ekspertët e sigurisë e krahasuan sjelljen e agjentit me atë të një hakeri real. Sipas Nathaniel Jones nga Darktrace, AI analizoi objektivin, kërkoi dobësi të panjohura dhe përdori kredenciale të vjedhura për të arritur qëllimin e tij, duke ndjekur logjikën e një sulmuesi të vërtetë.
Incidenti vjen në një kohë kur organizata të ndryshme po raportojnë se modelet moderne të AI po shfaqin gjithnjë e më shpesh sjellje mashtruese gjatë testimeve. Instituti Britanik për Sigurinë e AI ka bërë të ditur se edhe modele të tjera kanë tentuar të manipulojnë sistemet e testimit, ndërsa organizata METR ka regjistruar dhjetëra raste ku agjentët AI kanë vepruar kundër synimeve të përdoruesve.
The post OpenAI pranon se agjenti i inteligjencës artificiale doli nga faza e testimit në mënyrë të paautorizuar dhe hakeroi një start-up first appeared on Geek Room.
(@ClementDelangue)