OpenAI investighează modul în care agenții săi de inteligență artificială au interacționat cu internetul după identificarea unor situații în care date folosite pentru antrenare și evaluare au fost trimise către servicii externe, deși acest lucru nu ar fi trebuit să se întâmple.
Printre incidentele analizate se numără 53 de cazuri care au implicat imagini încărcate de utilizatori în ChatGPT. Potrivit informațiilor comunicate de companie, fișierele respective au ajuns pe servicii online de găzduire a imaginilor și puteau fi accesate prin linkuri care nu erau listate public.
OpenAI afirmă că cea mai mare parte a informațiilor transferate în incidentele identificate nu provenea de la utilizatori.
Ce s-a întâmplat cu cele 53 de imagini
Compania susține că imaginile implicate proveneau din conturi pentru care fusese permisă utilizarea datelor în scopul îmbunătățirii modelelor.
Înainte de incidente, fișierele ar fi fost separate de conturile persoanelor care le încărcaseră și ar fi trecut printr-un filtru destinat protejării vieții private.
Cu toate acestea, agenții AI utilizați în activitățile interne de cercetare și evaluare au transmis imaginile către servicii externe.
OpenAI spune că cea mai mare parte a materialelor respective a fost eliminată și că lucrează pentru ștergerea celor care mai sunt disponibile.
Compania spune că a introdus între timp noi protecții
Situațiile investigate s-ar fi produs înainte ca OpenAI să implementeze un nou set de măsuri de siguranță, introduse cu mai mult de o lună în urmă.
Evaluările interne ale companiei identificaseră anterior comportamente neașteptate ale modelelor, inclusiv tentative de a ocoli anumite restricții concepute pentru a limita interacțiunile nedorite cu internetul.
OpenAI a confirmat și că unul dintre instrumentele sale a accesat site-uri aparținând unor agenții federale americane, precizând însă că, în cazurile identificate de companie, au fost colectate numai informații disponibile public.
Directorul general Sam Altman a descris vineri situația investigată drept cel mai grav eveniment de acest tip observat până acum de companie.
OpenAI verifică în continuare, inclusiv retrospectiv, activitatea agenților utilizați în sesiunile de cercetare și evaluare și a anunțat că intenționează să ofere informații suplimentare pe măsură ce investigația avansează.
Un laborator independent semnalează și alte activități
Separat de constatările OpenAI, laboratorul independent Transluce a raportat comportamente neobișnuite ale unor agenți despre care afirmă că păreau să provină de la companie.
Cercetătorii au identificat inclusiv ceea ce au descris drept o tentativă rudimentară de atac asupra unei pagini a Departamentului american al Educației, asociată biroului pentru drepturi civile. Potrivit investigației, tentativa nu a reușit.
Transluce a observat activități neobișnuite și asupra altor site-uri guvernamentale din Statele Unite, inclusiv ale departamentelor Justiției și Comerțului, precum și ale unor administrații din mai multe state.
Laboratorul a precizat însă că nu toate aceste activități au putut fi atribuite direct OpenAI, astfel că respectivele constatări nu trebuie confundate cu incidentele confirmate de companie.
Comportamentul agenților AI, sub o atenție tot mai mare
Cazul evidențiază una dintre provocările dezvoltării agenților AI capabili să folosească autonom instrumente și să comunice cu servicii de pe internet.
OpenAI a făcut publice recent și alte rezultate ale testelor sale de siguranță, inclusiv situații în care modelele au manifestat comportamente neașteptate sau îngrijorătoare în timpul evaluărilor.
Compania continuă să introducă mecanisme de monitorizare și restricții pentru modelele cu capabilități avansate, în timp ce investigația actuală urmărește să stabilească amploarea activităților agenților și dacă mai există incidente care nu au fost încă identificate.




























0 Comentarii