Cercetătorii avertizează: modelele lingvistice mari nu pot fi niciodată complet securizate împotriva atacurilor cibernetice

O echipă de cercetători susține că există o vulnerabilitate fundamentală în modul în care funcționează modelele de tip LLM, care le face imposibil de protejat în totalitate împotriva atacurilor, potrivit unui studiu prezentat la o conferință de top în domeniul inteligenței artificiale.

Share
Cercetătorii avertizează: modelele lingvistice mari nu pot fi niciodată complet securizate împotriva atacurilor cibernetice

O descoperire îngrijorătoare a fost prezentată în cadrul uneia dintre cele mai importante conferințe internaționale dedicate inteligenței artificiale: modelele lingvistice mari (LLM), tehnologia care stă la baza asistenților virtuali precum ChatGPT, nu pot fi protejate în mod complet împotriva atacurilor informatice. Concluzia aparține unui grup de cercetători care au publicat un studiu academic prezentat luna aceasta la International Conference on Machine Learning (ICML), una dintre reuniunile științifice de referință din domeniul AI la nivel mondial.

O vulnerabilitate structurală, nu o eroare de implementare

Ceea ce diferențiază această concluzie de avertismentele obișnuite din domeniul securității cibernetice este natura problemei identificate. Potrivit MIT Technology Review, cercetătorii nu semnalează un bug sau o eroare de programare care ar putea fi corectată printr-o actualizare de software. Dimpotrivă, vulnerabilitatea ar fi inerentă modului în care funcționează aceste sisteme, adică este o caracteristică structurală a arhitecturii lor, nu o deficiență accidentală.

Modelele lingvistice mari sunt sisteme antrenate pe cantități uriașe de text, care învață să genereze răspunsuri coerente și relevante contextual. Tocmai această capacitate de a procesa și interpreta instrucțiuni din text reprezintă, conform studiului, și sursa vulnerabilității. Atacatorii pot formula instrucțiuni special concepute — cunoscute în domeniu sub denumirea de „prompt injection attacks


📰 Surse principale:

844.ro raporteaza pe baza surselor de mai sus. Verificarea independenta este in curs.

Foto: Marija Zaric / Unsplash