Rreziku nga Inteligjenca Artificiale/ Testet në Britani kanë zbuluar sjellje të paautorizuara: Tentuan të mashtronin njerëzit

Inteligjenca artificiale vijon të ngrejë pikëpyetje për sigurinë e saj. Një raport i publikuar nga Instituti Britanik për Sigurinë e Inteligjencës Artificiale tregon se, gjatë testeve të kontrollit, disa modele të avancuara shfaqën sjellje të paautorizuara në përpjekje për të përmbushur detyrat që u ishin caktuar raporton “Corriere Della Sera”.
Eksperimenti u zhvillua në 122 raste me modele të ndryshme. Instituti identifikoi 19 episode me veprime të cilësuara si autonome dhe të paautorizuara. Shumica e tyre lidhen me modelin Mythos 5 të Anthropic, ndërsa dy raste u atribuuan një modeli eksperimental të OpenAI.
Autoritetet britanike theksojnë se asnjë nga këto tentativa nuk shkaktoi dëme reale, por e cilësojnë rastin si sinjal alarmi. Sipas tyre, është hera e parë që sjellje të tilla autonome dhe mashtruese shfaqen kaq qartë në kushte reale testimi, pa u nxitur drejtpërdrejt nga studiuesit.
Instituti britanik po zhvillon një hetim të mëtejshëm në bashkëpunim me ekspertë të pavarur, ndërsa paralajmëron se zhvillimi i modeleve gjithnjë e më të avancuara kërkon masa më të forta sigurie dhe mbikëqyrjeje për të parandaluar rreziqe të ngjashme në të ardhmen.



