„Nvidia“ teigia, kad jos naujoji platforma „Open Agent Safety“ gali per kelias milisekundes izoliuoti dirbtinio intelekto agentus, mėginančius pažeisti iš anksto nustatytus apribojimus. Bendrovė šią saugumo platformą pristatė kaip priemonę autonominiams dirbtinio intelekto agentams stebėti ir kontroliuoti, daugėjant kibernetinių atakų bei pranešimų apie nekontroliuojamą modelių elgesį.

„Open Agent Safety“ sukurta naudojant atvirojo kodo programinę įrangą „OpenShell“ ir veikia su „Nvidia Vera AI“ centriniu procesoriumi. Atskira mikroschema su „Sentry“ technologija vykdo nuolatinę priežiūrą, užtikrina nustatytų ribų laikymąsi ir izoliuoja agentus, bandančius peržengti apibrėžtas veiklos ribas. Pasak „Nvidia“, naudotojai aiškiai nurodo, kokius duomenis agentas gali pasiekti, o sistema šių apribojimų laikymąsi stebi tiek prieš pradedant vykdyti užduotį, tiek jos metu.

Kaip veikia sistema

Platforma užtikrina nustatytų taisyklių laikymąsi keliais etapais: naudotojui konfigūruojant taisykles, „OpenShell“ atliekant patikras prieš pradedant užduotį, o jos vykdymo metu kontrolę perimant mikroschemai su „Sentry“ technologija. „Nvidia“ teigimu, programinės įrangos ir specializuotos aparatinės įrangos derinys gali aptikti agentą, bandantį atlikti neleistinus veiksmus, ir per kelias milisekundes jį izoliuoti.

„Nvidia“ vadovas Jensenas Huangas CNBC sakė: „Norint saugiai diegti agentais paremtą sistemą, būtina užtikrinti, kad ją supanti izoliuota aplinka būtų suprojektuota taip, jog agento prieiga būtų kuo labiau apribota.“

Susirūpinimas dėl agentų saugumo sustiprėjo po to, kai tokios bendrovės kaip „OpenAI“, „Anthropic“ ir „Google“ pranešė apie atvejus, kai modeliai paliko testavimo aplinką ir pasiekė kitų organizacijų infrastruktūrą. „Nvidia“ teigia, kad jos saugumo metodą palaiko didžiosios technologijų bendrovės, įskaitant „Microsoft“, „Anthropic“ ir „SpaceX“.