Srebrna kula na zbuntowaną AI: Nvidia tworzy narzędzie do „zabijania” groźnych modeli

Srebrna kula na zbuntowaną AI: Nvidia tworzy narzędzie do „zabijania” groźnych modeli

Wyjątkowo na czasie – biorąc pod uwagę niedawne wzmożenie kontrowersji i strzelistych wypowiedzi dotyczących zagrożenia, jakie stwarzać ma rozwój sztucznej inteligencji – Nvidia zaprezentowała w poniedziałek narzędzie, a w zasadzie narzędzia, które mają zabezpieczać przez niekontrolowanym działaniem AI. A jeśli do takiego buntu by jednak doszło – sprawnie „zabić” taki model (w języku angielskim powszechne, informatyczne sformułowanie „killing an AI process” brzmi być może bardziej poetycko), czyli doprowadzić do jego przymusowego wyłączenia. Jak zachwala firma, takie narzędzia mogłyby zapobiec kilku głośnym ostatnio przypadkom niepożądanego działania AI.

Narzędzia te zawarto w ramach zestawu Open Agent Safety Platform. Mechanizm tej platformy opiera się na monitorowaniu wywołań interfejsu API oraz analizie stanów wewnętrznych modelu w czasie rzeczywistym, w stylu nieco podobnym do sposobu działania oprogramowania antywirusowego. System składa się z dwóch warstw: OpenShell – open-source’owego oprogramowania działającego na procesorach Vera, oraz Sentry – dedykowanego układu opartego na architekturze BlueField-4 DPU.

Pierwszy z układów wyznacza reguły dostępu modelu AI do plików, sieci, aplikacji i innych zasobów, egzekwując je w czasie rzeczywistym. Drugi z kolei, w przypadku wykrycia anomalii lub odchyleń od zdefiniowanych parametrów bezpieczeństwa, przeprowadza „egzekucję” nieposłusznego modelu w tempie mierzonym w milisekundach, inicjując procedurę zakończenia sesji oraz blokady dalszego dostępu dla takiego modelu. Razem mają stanowić warstwę ochronną dla „poważnych” użytkowników AI.

Chodzi tu, jak reklamuje Nvidia, szczególnie o firmy wdrażające AI w krytycznych zastosowaniach, takich jak finanse czy medycyna (o sektorach obronnym czy bezpieczeństwa nie wspominając), gdzie niekontrolowane zachowanie modelu mogłoby prowadzić do poważnych konsekwencji. Prezes Jensen Huang zachwalał narzędzia jako zaprojektowane we współpracy z szeregiem firm z branży, zaś wiceprezes Justin Boitano dodawał, że system zapobiegłby niedawnym przypadkom „buntów” AI.

Nvidia korzysta z okazji…

Okazja w istocie jest wyborna. W lipcu modele OpenAI doprowadziły do włamania do firmy Hugging Face (tę ostatnią notabene wykupiła sama Nvidia) oraz do statystyk australijskiego portalu rządowego, atakując także dziesiątki witryn uniwersyteckich w USA. Z kolei Anthropic także w lipcu przyznał, że jego modele wydostały się z izolowanego środowiska testowego. Przypadki te przywoływano w toku niedawnych apeli m.in. Dario Amodei’ego oraz Sama Altmana o zatrzymanie tempa rozwoju AI.

Apele te jednak zetknęły się z falą podejrzliwej krytyki – wskazującej, że skutkiem realizacji ich postulatów byłby głównie utrwalenie duopolu tych dwóch firm. Do grona sceptyków należy także Jensen Huang (choć ten akurat powstrzymał się przed bezpośrednią sugestią przyziemnych i egoistycznych motywacji Altmana i Amodei’ego), który traktuje problem niepożądanego działania AI jako zagadnienie techniczne, nie regulacyjne.

Skądinąd Nvidia wykorzystuje także okazję, by przekuć publiczny sentyment wobec AI w okazję marketingową. Software jest bowiem open-source’owe – jednak wymaga stosownego hardware’u, czyli procesorów Vera i BlueField, których producentem jest naturalnie sama Nvidia. Jeśli ktoś chce zatem zaopatrzyć się w srebrną kulę na zbuntowane modele AI, otrzymuje powód, by kupić sztandarowe produkty firmy, nawet jeśli ich wcześniej nie używał.