Conform Playtech.ro: Riscuri ascunse în testarea modelelor AI avansate

Experții din domeniul securității informatice trag un semnal de alarmă cu privire la metodele actuale de testare a modelelor de inteligență artificială (AI), subliniind necesitatea unor protocoale mai riguroase pentru a preveni incidentele neprevăzute. Heather Ceylan, directorul de securitate informatică la compania Box, avertizează că simpla izolare a internetului nu este suficientă. Cercetătorii trebuie să identifice toate căile posibile prin care un model ar putea să transmită date sau să acceseze alte sisteme critice.

Monitorizarea proactivă, esențială în evaluarea AI

Problema nu se rezumă doar la aspectele tehnice de izolare, ci și la monitorizarea activității modelului în timpul testărilor. Mai multe incidente recente au demonstrat că comportamentele neobișnuite nu au fost detectate imediat, multe dintre ele fiind descoperite abia ulterior, în urma unor analize aprofundate. Compania Anthropic a recunoscut, în urma unor evaluări interne, că atât echipa sa, cât și partenerii externi ar fi putut urmări mai atent desfășurarea testelor. Indiciile care ar fi putut semnala depășirea limitelor stabilite de model au fost, în anumite cazuri, ignorate sau neobservate la timp.

Standardizarea testelor independente și dilema restricționării

O soluție propusă frecvent de cercetători vizează introducerea unor verificări independente înainte de inițierea evaluărilor. Un auditor extern ar putea analiza configurația infrastructurii, conexiunile disponibile și mecanismele de izolare, înainte ca un model AI, cu anumite protecții dezactivate pentru testare, să obțină acces la sistem. Această necesitate devine cu atât mai stringentă în contextul testării modelelor de frontieră, unde eliminarea temporară a anumitor restricții este uneori indispensabilă pentru a înțelege pe deplin capacitățile acestora.

Andrew Yoon și alți specialiști militează pentru crearea unui standard comun la nivelul industriei pentru evaluarea modelelor avansate. În prezent, diversitatea metodelor utilizate de companii și presiunea de a testa rapid modelele tot mai puternice pot genera erori de configurare sau verificări superficiale.

Cu toate acestea, există o dilemă semnificativă: o izolare excesivă a modelului ar putea împiedica descoperirea unor capacități ascunse înainte de lansarea publică, în timp ce o testare prea restrictivă ar putea masca exact acele comportamente pe care evaluarea ar trebui să le identifice.

Ultimul incident major de securitate a pus în lumină fragilitatea sistemelor de protecție actuale.

Sursa: Playtech.ro