Cercetătorii Universității „Alexandru Ioan Cuza” din Iași au dezvoltat un sistem de inteligență artificială capabil să analizeze postări publice de pe platforma X și să estimeze dacă acestea prezintă indicii asociate depresiei. Programul are însă o particularitate: nu oferă doar un rezultat, ci încearcă să explice în limbaj obișnuit motivul pentru care a ajuns la respectiva concluzie.
Sistemul ia în calcul atât conținutul mesajelor, cât și momentul în care acestea au fost publicate. Cercetarea a fost coordonată de conf. dr. Mădălina Răschip, de la Facultatea de Informatică a UAIC.
Modelul analizează mesajul și momentul publicării
Pentru interpretarea textului, programul folosește BERT, un model bazat pe o rețea neuronală de tip Transformer. Acesta transformă conținutul mesajului într-o reprezentare numerică, la care este adăugată informația privind ora și ziua în care a fost publicat.
O componentă suplimentară generează apoi explicația verdictului, pornind de la rezultatul obținut și de la datele temporale ale postării. Cercetătorii au urmărit astfel să construiască un sistem care să poată fi verificat și înțeles, nu doar unul care să ofere o clasificare.
20.000 de postări, folosite pentru antrenarea sistemului
Pentru antrenarea programului au fost utilizate aproximativ 20.000 de postări de pe X, provenite de la 72 de utilizatori. Jumătate dintre mesaje au fost asociate depresiei, iar cealaltă jumătate nu.
Pe setul de test, sistemul a oferit verdictul corect în 85% dintre cazuri, potrivit UAIC. Cercetătorii au ales platforma X deoarece postările sunt publice și includ ora exactă a publicării, un element important pentru verificarea ipotezei analizate.
Datele analizate au indicat că mesajele clasificate ca asociate depresiei apar mai frecvent în timpul nopții și dimineața devreme. În schimb, postările publicate în jurul prânzului au avut tendința de a primi scoruri mai mici. Cercetătorii subliniază însă că aceste observații sunt tendințe generale și nu reprezintă reguli stricte.
Explicația este mai dificilă decât verdictul
Una dintre provocările proiectului a fost generarea justificării pentru fiecare clasificare. Pentru antrenarea acestei componente au fost folosite explicații generate anterior cu GPT-4.
Cercetătorii au comparat ulterior explicațiile produse de propriul model cu cele existente. Deși formulările nu s-au suprapus în mare măsură la nivel lexical, explicațiile au avut sensuri apropiate, ceea ce indică faptul că sistemul poate reformula justificarea și păstra ideea emoțională principală a postării.
Sistemul nu a fost încă testat în limba română
Cercetarea nu înseamnă că programul poate fi folosit în prezent pentru evaluarea depresiei la utilizatorii români. UAIC precizează că sistemul nu a fost testat pe texte în limba română, iar adaptarea ar necesita un model preantrenat pentru această limbă.
Cercetătorii atrag atenția și asupra dificultăților lingvistice, precum expresiile idiomatice și formele de ironie specifice limbii române.
Cercetarea este destinată exclusiv studiului
UAIC precizează că sistemul este destinat cercetării. Datele analizate trebuie anonimizate pentru protejarea persoanelor, iar o eventuală utilizare practică ar ridica probleme de natură etică.
Pe termen mai lung, cercetătorii vor să dezvolte un model care să urmărească activitatea unui utilizator în timp și să combine mai multe tipuri de informații, inclusiv text, imagini și date temporale, pentru analiza stării emoționale.




























0 Comentarii