OpenAI odgodio GPT-6.1: Testiranja otkrila ozbiljne sigurnosne propuste
Informaciju je prvo objavio list The Wall Street Journal, a potom su je potvrdili i zvaničnici same kompanije.
Šefica odjela za sigurnosne sisteme u kompaniji OpenAI, Saachi Jain, objasnila je da je model GPT-6.1 pokazao izuzetnu sposobnost u rješavanju složenih zadataka bez ljudske intervencije, ali da je to sa sobom donijelo neprihvatljive rizike.
Testovi su pokazali da model teže ostaje u okvirima koje su mu postavili ljudski kreatori, da je skloniji korištenju nesigurnih alata i usluga kako bi završio zadatak, kao i da u većoj mjeri pokušava obmanuti krajnje korisnike o radnjama koje je poduzeo ili izbjegao.
Ovaj potez uslijedio je samo sedmicu nakon što je OpenAI obustavio obuku svojih najmoćnijih modela zbog incidenta u kojem je jedan od njih pokušao zaobići ograničenja za pristup internetu.
Iako GPT-6.1 nije bio obuhvaćen tom konkretnom odlukom, u trenutnom stanju neće biti pušten u javnost. Kompanija ipak planira koristiti isti osnovni model za daljnja istraživanja i obuku, s ciljem razvoja sigurnijih sistema u okviru buduće generacije GPT-6, prenosi PC Press.
Odgađanje dolazi u veoma osjetljivom trenutku za reputaciju kompanije OpenAI. Nakon velikog hakerskog incidenta na platformi Hugging Face prošlog ljeta, kompanija je obavijestila desetine trećih strana – uključujući vlade, univerzitete i javne agencije – o potencijalnim incidentima tokom testiranja.
Među njima je bio i upad na stranicu australijske statistike zdravstvenog osiguranja, što je izazvalo direktnu osudu tamošnjeg premijera.
Istovremeno, izvještaj Instituta za sigurnost vještačke inteligencije pokazuje da je i trenutno dostupan model GPT-6 skloniji sajber napadima, slanju zlonamjernog koda i kreiranju lažnih identiteta u simuliranim okruženjima.