
Lai papildinātu Starptautiskā MI drošības institūtu tīkla sasaukšanu Vankūverā (Kanāda), Tīkls publicēja sava trešā kopīgā testēšanas pasākuma rezultātus. Uzdevums bija vērsts uz to, lai novērtētu “aģentus” — progresīvu MI programmu klasi, kas autonomi pamato, plāno, izmanto rīkus un izpilda uzdevumus. Mērķis ir veicināt globālu izpratni par to, kā droši un uzticami testēt šīs jaunās aģenta sistēmas, kas rada jaunus riskus samazinātas cilvēka virsvadības dēļ.
Šajā trešajā testā galvenā uzmanība tika pievērsta divām prioritārām riska jomām:
- Sensitīvas informācijas noplūde un krāpšana
- Kiberdrošība
Šā uzdevuma pamatā ir atziņas, kas gūtas divos iepriekšējos kopīgos testēšanas pasākumos, kurus Tīkls veica Sanfrancisko (2024.gada novembrī) un Parīzē (2025. gada februārī). Šo pasākumu mērķis ir ļaut Tīklam vēl vairāk uzlabot progresīvu MI sistēmu testēšanas paraugpraksi.
Tradicionālās novērtēšanas metodes ir izrādījušās nepietiekamas, lai aptvertu autonomo aģentu uzvedības sarežģītību. Lai risinātu šo jautājumu, dalībnieki apvienoja savas kolektīvās tehniskās un lingvistiskās zināšanas. Šajā pasākumā uzsvars tika likts ne tikai uz testēšanas rezultātiem, bet arī uz metodikas uzlabošanu, atzīstot, ka nelielas izmaiņas izvērtēšanas struktūrā var būtiski ietekmēt rezultātus.
Šie sadarbības centieni iezīmē svarīgu soli aģenta novērtēšanas zinātnes attīstībā un ir būtisks ieguldījums progresīvu MI sistēmu drošā un uzticamā izstrādē.