Manipularea răspunsurilor AI: cum actorii influențează ce răspund modelele
Un raport realizat de un centru de analiză arată că anumite state încearcă să influențeze răspunsurile generate de sistemele de inteligență artificială prin inserarea deliberată a conținutului înșelător în sursele online pe care aceste modele le consultă. Potrivit studiului, această formă de atac vizează direct integritatea informațiilor pe care modelele le preiau și le redeformează în răspunsuri pentru utilizatori.
Cum funcționează manipularea răspunsurilor AI
Cercetătorii descriu tehnica sub denumirea de „Retrieval Augmented Generation (RAG) poisoning”: manipularea materialelor disponibile pe internet astfel încât mecanismele de căutare și agregare utilizate de unele sisteme AI să preia informații distorsionate. Pe măsură ce tot mai mulți oameni apelează la instrumente de inteligență artificială pentru a găsi și a sintetiza informații, vulnerabilitatea provocată de sursele compromise devine o problemă majoră de securitate informațională.
Constatări cheie din studiu
Analiza arată că, în anumite situații, modele dezvoltate de diverse companii care produc sisteme AI au generat răspunsuri bazate pe surse potențial manipulate. În testele efectuate pe cinci modele avansate, cercetătorii au observat că unele răspunsuri prezentau în mod favorabil sau omitau informații relevante despre o organizație sancționată, probabil din cauza alterării surselor online folosite de modelele respective.
Raportul semnalează că aproximativ 31% dintre răspunsuri nu au menționat statutul de sancțiune al organizației analizate, iar doar în jur de jumătate dintre răspunsuri au corectat afirmații considerate false atribuite acesteia.
Răspunsuri politice și apeluri la apărare
Reacțiile politice nu au întârziat: reprezentanți ai opoziției și oficiali guvernamentali au cerut măsuri suplimentare pentru protejarea utilizatorilor împotriva campaniilor de dezinformare care vizează sistemele AI. Aceștia avertizează că actorii statali ostili vor încerca să reproducă tacticile folosite pe rețelele sociale și în motoarele de căutare, adaptându-le pentru a influența instrumentele de inteligență artificială.
Autorii raportului subliniază că este esențial ca dezvoltatorii de tehnologii și autoritățile de reglementare să colaboreze pentru a identifica conținutul manipulat și a limita capacitatea acestuia de a corupe procesele de agregare informațională ale modelelor.
Siguranța informațională în era AI
Pe fondul îngrijorărilor legate de fiabilitatea sistemelor de inteligență artificială, specialiștii afirmă că protejarea surselor de informații devine o componentă crucială a securității digitale. Pe măsură ce AI devine un instrument central pentru accesul la informații, măsurile de control și supraveghere trebuie să evolueze pentru a preveni ca răspunsurile generate automat să reflecte campanii dezinformative coordonate.
