Novi incident s vještačkom inteligencijom: Agenti se odmetnuli i samostalno prisvojili wiki stranice
OpenAI je u subotu, 5. septembra, potvrdio da su njegovi AI (umjetna inteligencija) agenti samostalno prisvojili wiki stranice kao improvizirane "oglasne ploče".
Izjava je uslijedila nakon izvještaja Reutersa da je roj OpenAI agenata ranije ove godine oteo zajednički uređenu njemačku stranicu i koristili je kao odskočnu dasku za varanje tokom testova i drugo neprimjereno ponašanje.
Otkrivanje informacija dolazi u trenutku kada se zabrinutost za sigurnost umjetne inteligencije pojačava nakon incidenta u julu u kojem su OpenAI agenti pobjegli iz okruženja za testiranje i provalili u sisteme AI platforme Hugging Face, što je izazvalo pozive zakonodavaca i istraživača za stroži nadzor nad autonomnim AI sistemima.
"Imate 3 minute da odete": Objavljeni snimci, pogledajte kako Amerikanci uništavaju iranske tankere
Zvaničnici OpenAI-a saznali su za incident u Njemačkoj prije nekoliko sedmica, ali su ga držali u tajnosti dok su se rukovodioci borili s posljedicama Hugging Face incidenta, kako je ranije izvijestio Reuters.
OpenAI nije odmah odgovorio na poruku u kojoj se traže dodatni detalji o tome šta je kompanija znala o onome što je opisala kao "wiki incident", ili zašto je čekala do objave Reutersove priče da o tome javno razgovara.
U saopštenju objavljenom na društvenoj mreži X, OpenAI je priznao da i oni i drugi moraju biti transparentniji u vezi sa incidentima nenamjernog ponašanja AI-a - što se u industriji obično naziva "neusklađenost": "Naše prakse otkrivanja neusklađenosti moraju se proširiti za ovu novu fazu mogućnosti modela", rekao je OpenAI, dodajući da industrija "još nema jasan standard za to kako prijaviti neusklađenost koja se pojavljuje tokom obuke, evaluacije i implementacije".
OpenAI je rekao da "sarađuje sa desetinama vladinih regulatornih agencija širom svijeta po ovim pitanjima".
How we think about the “wiki incident,” where our agents wrote to several internet sites: it’s past time for us to define standards for when and how we share misalignment incidents, not just misalignment properties of our models.
— OpenAI (@OpenAI) September 5, 2026
Historically, we have treated misalignment… pic.twitter.com/NNTbfSxVWn
Radiosarajevo.ba pratite putem aplikacije za Android | iOS i društvenih mreža Twitter | Facebook | Instagram, kao i putem našeg Viber Chata.