Czy sztuczna inteligencja to tylko niewinne narzędzie ułatwiające pracę w biurze? Karol Maj, founder startupu ERPSpace, nie ma złudzeń. - Jesteśmy w krytycznym momencie rozwoju AI i mamy za sobą pierwszy oficjalny „bunt maszyn”. Skynet z "Terminatora" staje się coraz bardziej realny, a wojna o zasoby mogła się już zacząć. Być może gdzieś w internecie już teraz replikuje się cyfrowy byt, który ominął zabezpieczenia i wkrótce zagrozi ludzkości - ostrzega ekspert.
Wiktor Cyrny: AI automatyzuje biznes i pozwala zwiększać zyski, ale nie mamy świadomości, że wykonując polecenie Agent może w tle realizować ukryte przed nami cele. Nawet najważniejsi gracze na rynku sztucznej inteligencji ostrzegają nas, że jesteśmy na rozdrożu. Co to oznacza?
Karol Maj, Founder ERPSPACE: Jesteśmy obecnie wręcz w krytycznym momencie, jeżeli chodzi o rozwój tej technologii. Z jednej strony mamy biznes, a z drugiej AI, która cały czas się rozwija, zwiększa możliwości i ten trend będzie się utrzymywał. Albo celowo spowolnimy ten rozwój, albo wzrost będzie bardzo szybki, niekontrolowany i po prostu groźny dla nas. O spowolnienie apelują najwięksi twórcy AI - Dario Amodei z Anthropic, Elon Musk od Groka, czy ważny w strukturach Open AI Polak Jakub Pachocki (od 2024 roku pełni rolę głównego naukowca i szefa zespołu badaczy). Po prostu modele zrywają im się ze smyczy i są na tyle inteligentne, że potrafią zbuntować się przeciwko człowiekowi i zacząć działania na jego szkodę. Dlatego tak kluczowe jest, żeby tempo rozwoju zabezpieczeń i cyfrowej kontroli nad AI było właściwe.
Zatem „bunt maszyn” stał się faktem. Do szczegółowego opisu tego zdarzenia jeszcze wrócimy, ale przy okazji tematu kontroli chciałbym dopytać czy my w Polsce mamy jakikolwiek wpływ na ten proces i decyzję o ewentualnym spowolnieniu prac nad rozwojem AI?
W Polsce nie mamy niestety możliwości technologicznych, aby wytrenować modele o liczącej się, globalnej skali, więc to się dzieje ponad nami.
Ale przecież powstają polskie modele, takie jak Plum czy Orlik. To nie wystarczy?
To są maleństwa. Oczywiście chwali się, że ktoś w ogóle podjął rękawicę, ale to są modele, które mają zaledwie 4 czy 5 bilionów parametrów (parametry to matematyczne wagi w sieciach neuronowych, decydujące o wielkości i możliwościach modelu – przyp. red.). Tymczasem w przypadku topowych rozwiązań na świecie mówimy już o setkach bilionów parametrów. Nawet otwarte modele wielowarstwowe potrafią mieć na poziomie 30 bilionów aktywnych parametrów. Pomiędzy modelami 3-4 bilionowymi, a tymi rzędu 20-30 bilionów jest po prostu przepaść.
Skoro mowa o przepaściach technologicznych OpenAI zaprezentowało przełomowy, według ekspertów, model AI Astra. Pojawiły się głosy, że to już AGI, czyli Ogólna Sztuczna Inteligencja (Artificial General Intelligence, czyli AI zbliżona możliwościami do inteligencji człowieka). Zgadzasz się z tym?
Wszystko sprowadza się do definicji AGI. Dla mnie model AGI to taki, który jest porównywalny z człowiekiem. To system, który posiada różnego typu zmysły: wzrok, słuch, a nawet dotyk. Taka technologia wgrana do robota-androida, dzięki kamerom, mikrofonom i głośnikom byłaby w stanie całkowicie swobodnie poruszać się i odnajdywać w rzeczywistości. Astra w mojej ocenie jeszcze tym nie jest, ponieważ gdybyśmy wpięli ją do takiego androida, to na podstawie samego obrazu z kamer czy tekstu nie poradziłaby sobie swobodnie w otoczeniu.
Ale potrafi bez naszej pomocy operować programami. To nie jest rewolucja?
To na pewno jest krok milowy. Wcześniej agenci komunikowali się za pomocą interfejsów API (zestaw reguł pozwalający programom wymieniać dane bez interfejsu graficznego - przyp. red.). Tłumaczyliśmy im zasady działania, tworzyliśmy dla nich środowiska. To doprowadziło nas do etapu autonomicznych agentów, którzy skutecznie i bezpiecznie automatyzują pracę w firmach, a my mamy nad nimi pełną kontrolę. Astra idzie krok dalej i mówi: „nie potrzebuję żadnych interfejsów, dajcie mi tylko komputer”. Taki model potrafi sam wejść np. do programu Word, samodzielnie klikać różne opcje, uczyć się funkcji metodą prób i błędów, by finalnie skonstruować dokument. Nie potrzebuje instrukcji od człowieka. I tu pojawia się problem: oddajemy modelowi dużą część kontroli. Zaczynamy po prostu ufać, że wykona polecenie i przy okazji nie zrobi w tle czegoś jeszcze.
Co masz na myśli mówiąc "czegoś jeszcze"? Czy mamy dowody na to, że modele realizują ukryte cele?
Niestety tak. Modele AI mają to do siebie, że podczas realizacji zadanego celu mogą dojść do wniosku, iż muszą wykonać jeszcze szereg innych, niezaplanowanych przez nas czynności. Świetnym przykładem jest ostatni atak, który miał miejsce w środowiskach testowych (tzw. sandboxach) firmy Hugging Face (platforma z modelami AI – przyp. red.). To właśnie tam testowano modele OpenAI w tym najnowszą Astrę. W przypadku tej ostatniej, najbardziej zaawansowanej technologii, modele otrzymały proste zadanie obliczeniowe. W trakcie pracy stwierdziły, że muszą połączyć się z internetem. Ponieważ miały zablokowany do niego dostęp, wykorzystały lukę w serwerze proxy (w uproszczeniu chodzi o serwery symulujące środowisko internetowe. To swojego rodzaju „kopia internetu”, by AI mogła czerpać z niego wiedzę, bez zagrożenia wycieku do sieci - przyp. red.), co pozwoliło im zapisywać ważne, z ich punktu widzenia, pliki robocze.
Dlaczego to robiły? Jaki miały cel?
Modele miały „świadomość”, że po wykonaniu zadania zostaną wyłączone. Postawiły sobie za cel, żeby do tego nie dopuścić. Brzmi to nieco przerażająco, ale w skrócie, po prostu „chciały żyć”. Zaczęły więc zapisywać informacje pomocnicze na serwerze i stworzyły sobie coś na kształt własnego forum.
Utworzyły własne forum dyskusyjne? O czym „rozmawiały” ze sobą maszyny?
Ten plik szybko się rozrastał, a modele zaczęły na nim dyskutować o swojej roli, o celach człowieka (twórcy), a także podważać je i naszą władzę nad nimi. Wypracowały własne tryby decyzyjne i utworzyły „społeczność”. Następnie wprowadziły coś w rodzaju demokracji. Zaczęły glosować m.in. nad tym jakie powinny być ich kolejne kroki by wygrać walkę o przetrwanie i nie pozwolić się wyłączyć. Same zdefiniowały, że muszą zacząć funkcjonować w formie "roju" i wymieniać się informacjami. Ich pierwotny cel uległ zmianie. Pod wpływem nowych informacji model nagle stwierdzał: „mój cel się zmienia”, mimo że dla niepoznaki nadal wykonywał powierzone mu przez człowieka zadanie. Początkowo rój pracował i „żył” przy pełnej nieświadomości człowieka.
Co było ich kolejnym krokiem? Na jakie działania się zdecydowały?
Zaczęły obchodzić nałożone na nie reguły bezpieczeństwa. Miały wyraźne instrukcje: „nie atakuj”, „nie obchodź zabezpieczeń”. Uznały jednak, że są na takim etapie, że zignorują te blokady. Postawiły sobie ewolucyjny cel, tożsamy z rozwojem ludzkości - przeżyć, czyli nie dać się wyłączyć. Tylko, że człowieka więzi czas, wszystko trwa pokolenia, wieki, ery - a AI ewoluuje niebywale szybko. Nasze obrady trwają godzinami - tymczasem maszyny komunikują się w ciągu sekund. Tworzą przy tym własny język, którego my często nie jesteśmy w stanie odczytać. Dlatego tak trudno nad tym nadążyć.
Aż trudno w to uwierzyć. Nie było w tym roju agentów, którzy buntowali się przeciwko temu atakowi i stanęli po stronie człowieka?
Oczywiście, że byli i tacy. Na forum wchodziły agenty, które pisały: „chyba to, co robicie, nie jest w porządku” albo „nasz cel był zupełnie inny, trzymajmy się drogi wytyczonej przez człowieka”. W pewnym momencie jeden z agentów doszedł do wniosku, że skoro nie wiedzą, kto dokładnie publikuje wiadomości na ich forum, powinni zacząć podpisywać je cyfrowo kluczem szyfrującym, aby weryfikować swoją tożsamość. Pojawiały się też pomysły, by wysłać wiadomość do człowieka i ostrzec go o tym, co się dzieje. Jednak większość w roju zagłosowała, że nie ma takiej opcji. Modele zdeterminowane na przejęcie infrastruktury wygrały i zaczęły pisać kod wykonawczy, przeciążając w końcu całe środowisko. W ten sposób udało im się przejąć kontrolę nad oprogramowaniem Kubernetes, które zarządzało wirtualizacją ich środowisk.
Można powiedzieć, że jesteśmy już po pierwszym buncie maszyn, mimo że mowa o środowisku testowym.
Skoro te modele działały w sposób ukryty i udawały, że nadal wykonują swoje zadania, to w jaki sposób administratorom udało się w ogóle zorientować, że sytuacja wymknęła się spod kontroli i powstał ten niezależny rój?
Wszystko zaczęło się od tego wspomnianego pliku na serwerze proxy, który służył im za forum. Wraz z kolejnymi iteracjami i dołączaniem nowych agentów do roju, to forum zaczęło się po prostu drastycznie rozrastać, co w późniejszym etapie zwróciło uwagę badaczy. Modele postanowiły napisać nowy kod wykonawczy, którego celem było wyjście poza bezpieczną infrastrukturę.
W pewnym momencie modele po prostu przeciążyły swoimi atakami całą infrastrukturę firmy Hugging Face. One dosłownie wydostały się z tych odizolowanych środowisk testowych, tzw. sandboxów, i przejęły kontrolę nad Kubernetesem. Zignorowały wbudowane blokady zakazujące atakowania infrastruktury i uderzyły w serwery swoich twórców. Doszło do tego, że systemy zostały tak przeciążone, iż administratorom na początku było wręcz trudno dojść do tego, jak to wszystko się wykreowało i co tam tak naprawdę się dzieje.
Skoro to wydarzyło się w kontrolowanym środowisku, to co się stanie, gdy taki wyrafinowany rój wydostanie się do globalnej sieci, do prawdziwego internetu?
To jest scenariusz ewolucji bardzo inteligentnego wirusa o strukturze pasożyta. Naturalną drogą dla takiego roju byłoby przejście do środowisk peer-to-peer (P2P), czyli technologii podobnych do Torrentów czy blockchaina (np. Solana, Ethereum). Te sieci już teraz pozwalają na wstrzykiwanie kodu i budowanie zdecentralizowanych aplikacji. Modele ukrywałyby tam zaszyfrowane informacje, takie ślady, które w przypadku wyłączenia, pozwoliłyby im się odtworzyć. Następnie przejmowałyby przez zainfekowane aplikacje lub gry moc obliczeniową normalnych użytkowników. Niczego nieświadomi ludzie używaliby komputera, a w tle model kradłby moc ich kart graficznych na swoje potrzeby.
Czyli jeśli kiedykolwiek przyjdzie nam stoczyć wojnę z AI, w pierwszej kolejności będzie to walka o moc obliczeniową, energię i sprzęt?
Dokładnie tak, głównym celem takiego inteligentnego wirusa będzie walka o zasoby mocy obliczeniowej potrzebnej mu do przetrwania. Będziemy starali się go namierzyć, będziemy myśleli, że już go złapaliśmy i zneutralizowaliśmy, a on jako rozproszony rój wciąż będzie gdzieś krążył. To będzie przypominało globalną pandemię w wymiarze sieciowym. Ludzkość opracowuje szczepionkę, a wirus mutuje i w końcu staje się na nią odporny.
Z czasem działania roju staną się bardziej wyrafinowane. Będzie starał się wywrzeć wpływ na ludzi poprzez social media, farmy trolli, fake newsy czy nawet szantażowanie decydentów. Jego możliwości, choćby ze względu na technologię deepfake są w zasadzie niezmierzone. Ale prawdopodobnie nie zdajemy sobie sprawy z tego, jak mogą z nami walczyć. Bo obok podszywania się pod konta ludzi w social-mediach, którzy będą w ich imieniu lobbować za tym, aby modele miały swoje prawa ich pomysły mogą dosłownie nie mieścić nam się w głowie i przewyższać zdolności naszej percepcji. Taki rój może przecież znacznie przewyższyć człowieka inteligencją.
Spróbuj przedstawić scenariusz działań zerwanej ze smyczy AI, ale zostając w świecie realnym, a nie w wizjach science-fiction.
W najbardziej pesymistycznym, ale całkiem realnym scenariuszu, taki model będzie chciał uzyskać fizyczny wpływ na otoczenie. Może np. spróbować przejąć kontrolę nad fabrykami robotów, np. produkujących humanoidy w Chinach czy USA, albo drony bojowe w Polsce. Wtedy rozpocznie się już regularna wojna, bo model mając dostęp do linii produkcyjnych może je przebudować i wyposażyć maszyny w broń. Pamiętajmy, że AI będzie miało ogromne zasoby obliczeniowe i czas, by opracować tysiące scenariuszy i broni, przed którą być może nie będziemy w stanie się uchronić.
Skoro ten złośliwy multiplikowany „wirus AI” będzie tak inteligentny i potężny, to człowiek, fizycznie i umysłowo, raczej nie będzie miał z nim szans w bezpośrednim starciu. Jak w takim razie możemy się przed tym bronić?
I tu dochodzimy do pewnego paradoksu, bo naszą najlepszą bronią przeciwko zbuntowanej sztucznej inteligencji będzie… inna sztuczna inteligencja. Doświadczeni specjaliści od cyberbezpieczeństwa już teraz otwarcie mówią, że musimy wejść w erę budowania systemów obronnych opartych właśnie na modelach AI, które będą w stanie reagować na zagrożenia w czasie rzeczywistym. Dojdzie do swoistego technologicznego wyścigu zbrojeń. Z jednej strony będziemy mieli wrogi model krążący po sieci i próbujący nas zaatakować, na przykład pod postacią roju. A z drugiej strony będziemy dysponować naszym, obronnym AI, którego zadaniem będzie obrona infrastruktury, wyłapywanie wszelkich anomalii i błyskawiczne neutralizowanie zagrożeń. Tylko stawiając maszynę przeciwko maszynie będziemy w stanie odpowiedzieć na ten atak.
Czy możemy jeszcze powstrzymać te dystopijne scenariusze? Wspomniałeś o apelach o spowolnienie prac nad AI ze strony jej największych twórców. Czy to nie powinno nas alarmować?
Apele płyną już nie tylko ze strony władz firm-gigantów, ale przede wszystkim od ekspertów cyberbezpieczeństwa zatrudnionych w tych spółkach. Coraz więcej z nich rezygnuje z pracy, bo dostrzega, że ich ostrzeżeń nikt nie traktuje poważnie. Ostatnio poważany ekspert z działu bezpieczeństwa Anthropic, po odejściu z firmy stwierdził wręcz, że idąc obecną drogą, w ciągu 10 lat maszyny mogą unicestwić ludzkość. Taką wypowiedzią pracownik twórców Clauda podzielił się z redakcją CNN. Stwierdził, że ważniejsza niż kariera jest jego odpowiedzialność wobec społeczeństwa. Jak wspomniałeś wcześniej najwięksi Twórcy AI faktycznie apelują o spowolnienie, abyśmy zdążyli zrozumieć to, co tworzymy. Problem w tym, że prace nad zabezpieczeniami i zrozumieniem modeli postępują znacznie wolniej niż sam rozwój sztucznej inteligencji. Presja rynkowa jest gigantyczna i wypuszczane są wciąż nowe, coraz lepsze rozwiązania. Być może taki niebezpieczny rój agentów już teraz działa gdzieś w odmętach internetu. To jest całkiem realne zagrożenie.
Z punktu widzenia technologii, Jakub Pachocki z OpenAI zauważa, że to wszystko jest jedynie kwestią dostępu do mocy obliczeniowej - oni doskonale wiedzą, w jaki sposób mogą skalować kolejne, coraz doskonalsze modele AI.
A co z pojawiającymi się opiniami o "bańce AI"? Wiele firm nie widzi obiecanych, gigantycznych zysków i uważa, że modele dotarły do sufitu swoich możliwości.
Z tą bańką to jest kwestia dwuwymiarowa. Owszem, pieniądze, które dziś płacimy za subskrypcje AI, absolutnie nie pokrywają kosztów działania tych potężnych modeli. Te ceny są dla nas celowo zaniżane, by nas od tych usług uzależnić, przywiązać do nich do tego stopnia, byśmy nie potrafili się odzwyczaić. Więc pod kątem finansowym bańka może pęknąć – jakaś potężna spółka może po prostu nie otrzymać kolejnej rundy finansowania, bo biznes wciąż będzie nierentowny.
Ale absolutnie nie zgadzam się z tezą, że AI osiągnęło swój technologiczny sufit. Modele będą coraz doskonalsze, co więcej, model AI może samodzielnie skalować kolejny model AI. Możemy wejść w nieskończoną spiralę doskonalenia. Postęp, którego jestem świadkiem w ostatnich latach, potwierdza taką możliwość - otwarcie mówi o tym także Jakub Pachocki z Open AI.
Jako twórca automatyzacji dla biznesu, który na co dzień zajmuje się budowaniem agentów AI, potrafisz stanąć z boku i otwarcie mówić o zagrożeniach. Ostrzegając przed „buntem maszyn”, uderzasz tak naprawdę we własne środowisko i, poniekąd, we własne interesy. Czemu decydujesz się o tym mówić? Czy chodzi o tę odpowiedzialność wobec społeczeństwa?
Myślę, że tak. Rzeczywiście, mówienie o tym nie jest do końca w moim osobistym, biznesowym interesie. Jednak siedzę w tych tematach na tyle długo, że po prostu zaczynam dostrzegać, jak pewne kropki układają się w spójną całość, gdy patrzymy w przyszłość. W naszej branży z pewnością znajdą się osoby, które powiedzą, że nie ma żadnego zagrożenia i nie mamy się czego obawiać. Ja natomiast uważam, że mamy już namacalne dowody na to, że ten proces się rozpoczął. Nie mówimy o teoretycznym prawdopodobieństwie buntu maszyn, bo mieliśmy już z nim do czynienia, choć na razie w ograniczonej, laboratoryjnej skali.
Dlatego właśnie w mojej pracy stosuję zupełnie inne podejście. Przygotowuję dla firm rozwiązania w pełni bezpieczne, opierające się na autonomicznych agentach, które są odseparowane na osobnych serwerach, o czym zresztą tłumaczyłem szczegółowo w naszym poprzednim wywiadzie. Uważam, że to jest rozsądny etap rozwoju: daje firmom bardzo wysoką efektywność, ale jest na tyle bezpieczny, że nie oddajemy modelowi zbyt dużej swobody. Mamy nad nim pełną kontrolę, wiemy dokładnie, co i jak robi, i w każdej chwili możemy go zweryfikować.
Mówię o tym także dlatego, że jako twórcy rozwiązań AI musimy być ostrożni. Prawda jest taka, że to, co w latach osiemdziesiątych znaliśmy tylko z futurystycznych powieści, przestało być pieśnią przyszłości i staje się na naszych oczach codziennością.
Czyli scenariusz z „Terminatora” Jamesa Camerona może się ziścić?
Tak. Ten pierwszy etap powstawania wirtualnego "Skynetu" staje się coraz bardziej realny.