
За да подпомогне свикването на Международната мрежа на институтите за безопасност на ИИ във Ванкувър, Канада, мрежата публикува резултатите от третото си съвместно изпитване. Упражнението беше съсредоточено върху оценката на „агентите“ — клас авангардни програми с ИИ, които самостоятелно разсъждават, планират, използват инструменти и изпълняват задачи. Целта е да се постигне напредък в глобалното разбиране за това как безопасно и надеждно да се тестват тези нововъзникващи агентни системи, които пораждат нови рискове поради намаления човешки надзор.
Третата проверка беше съсредоточена върху две приоритетни рискови области:
- Изтичане на чувствителна информация и измами
- Киберсигурност
Това учение се основава на изводите от две предишни съвместни изпитвания, проведени от мрежата в Сан Франциско (ноември2024 г.) и в Париж (февруари 2025 г.). Целта на тези учения е да се даде възможност на мрежата да усъвършенства допълнително най-добрите практики за изпитване на усъвършенствани системи с ИИ.
Традиционните методи за оценка се оказаха недостатъчни, за да обхванат сложността на поведението на автономните агенти. За да се справят с това, участващите членове обединиха своите колективни технически и езикови познания. Акцентът на тази дейност беше не само върху резултатите от изпитванията, но и върху подобряването на методологиите — като се признава, че малките промени в модела на оценката могат да окажат значително въздействие върху резултатите.
Тези съвместни усилия бележат важна стъпка в напредъка на науката за оценка на агентите и представляват критична инвестиция в безопасното и надеждно разработване на усъвършенствани системи с ИИ.