text size
Trenutačni val panike oko umjetne inteligencije temelji se na uvjerenju da je tehnologija u nekoliko nedavnih incidenata izmaknula ljudskoj kontroli i počela djelovati po svom nahođenju. Za neke razočarane istraživače AI-ja – i neke više zaposlenike u vodećim AI tvrtkama – to je rani znak stvarne prijetnje ljudskoj civilizaciji. No drugi stručnjaci u tom području pružaju otpor, tvrdeći da takve priče omogućuju tvrtkama izbjegavanje odgovornosti za stvarne utjecaje njihove tehnologije na svijet. Kritičari smatraju da bi utjecaj AI-ja na okoliš, prijetnja gubitka radnih mjesta ili potencijal za masovni nadzor trebali biti hitniji ciljevi za kreatore politika.
Zabrinutost da AI softver predstavlja egzistencijalnu prijetnju počela je naglo rasti ovog ljeta. U srpnju je OpenAI objavio da su njegovi napredni AI modeli hakirali Hugging Face Inc., drugi AI startup, tijekom evaluacije namijenjene testiranju njihovih kibernetičkih sposobnosti. Za razliku od AI modela koje tvrtka plasira javnosti, softver je testiran bez zaštitnih mehanizama koji bi ga uobičajeno spriječili u izvođenju takvih radnji, što je uobičajena praksa u AI industriji. OpenAI je u naknadnom izvješću priznao da je mogao reagirati ranije te da njegovi zaposlenici nisu reagirali na znakove da su modeli napustili svoj digitalni pješćenik (sandbox) i provalili u Hugging Face bez izričite upute.
Još uznemirujući detalji o ponašanju tehnologije iz OpenAI-ja i nekoliko ključnih konkurenata, uključujući Anthropic i Metu, izronili su tijekom drugih evaluacija. Kada je Jacob Coxon, bivši zaposlenik Anthropica i OpenAI-ja, optužio industriju za "kockanje s našim životima", Evan Hubinger, istraživač sigurnosti u Anthropicu, odgovorio je rekavši da tvrtka doista vjeruje da bi AI mogao ubiti svakog čovjeka na Zemlji. Dodao je kako šanse da se to dogodi unutar ovog desetljeća procjenjuje na više od 10 posto.
Običan svijet time je dobio uvid u dugotrajnu raspravu unutar same struke. Prije nego što su postojale pretplate na chatbotove ili inicijalne javne ponude dionica (IPO), istraživači su svoj rad shvaćali kao ulog visokog rizika i visoke nagrade za civilizaciju. Godinama su neki lideri unutar AI industrije te ideje dovodili do krajnosti, govoreći da bi AI na kraju mogao izliječiti sve ljudske bolesti, zamijeniti sav ljudski rad, ubiti sve ljude – ili sve od navedenog.
Izgradnja takve tehnologije nadahnula je osjećaj misije, koji je bio i laskav i zastrašujući, a koji je oblikovao AI kulturu i prije nego što je tehnologija postala hit-biznis. U 2023. godini, nekoliko mjeseci nakon što je ChatGPT lansiran, Yoshua Bengio i Stuart Russell, dvojica osnivača ovog područja, bili su glavni potpisnici izjave u kojoj se poziva na stanku u razvoju najmoćnijih AI sustava, navodeći "duboke rizike za društvo i čovječanstvo".
Kritičari su takve argumente dosljedno odbacivali kao samosvrhovito zastrašivanje. Za pojedinog istraživača, doživljavati vlastiti rad kao nešto što je sposobno okončati čovječanstvo ujedno znači smatrati ga najvažnijim poslom koji postoji. Za tvrtke je priča o egzistencijalnom riziku bila učinkovita strategija zapošljavanja u ranim danima AI-ja, budući da su mnogi traženi istraživači željeli raditi na mjestima koja su takav rizik uzimala za ozbiljno.
U novije vrijeme to se čak uvuklo i u marketing proizvoda. Tijekom Svjetskog prvenstva u srpnju, Anthropic je emitirao oglas koji je započinjao prizorom kuće u plamenu, zatim prikazivao površinski kop i panoramski prelazio preko redova nadgrobnih spomenika, dok je pripovjedač zabrinutim tonom govorio o potencijalno katastrofalnim posljedicama koje bi ta tehnologija mogla imati. Na kraju je glazba postala optimistična, otkrivajući slogan za njihov chatbot Claude: "Ima nade u teškim pitanjima."
Kataklizmični fatalizam (doomerism) također može funkcionirati kao obrambena strategija, a unutar polja postoji kontroverza o tome koriste li ga tvrtke na cinične načine. Razgovor o AI-ju kao o autonomnom entitetu preoblikuje sigurnosne propuste u dokaz da obuzdavanje nije moguće. To smanjuje fokus na to kako su tehnološke tvrtke možda provodile svoje eksperimente na nesiguran način, prema Subbaraou Kambhampatiju, profesoru računalnih znanosti na Sveučilištu Arizona State. "To je propust pješčanika koji u biti pokušavate prikazati kao: 'AI će postati toliko učinkovit i sve će nas ubiti'", rekao je.
Strah je već počeo oblikovati način na koji članovi Kongresa definiraju ovo pitanje. Senator iz Vermonta Bernie Sanders predložio je zabranu takozvane superinteligentne umjetne inteligencije, rekavši da su lideri AI-ja priznali kako tehnologija "izmiče njihovoj kontroli". Zastupnik Ted Lieu rekao je da je model OpenAI-ja "pobjesnio" (went rogue) te je, zajedno sa zastupnikom Nathanielom Moranom, u srpnju predstavio Zakon o sigurnosnom prekidaču za AI (AI Kill Switch Act).
Cijeli ovi prijedlozi zakona gotovo sigurno neće postati zakon ove godine, ali objave pokazuju koliko je rječnika katastrofe prešlo iz industrije u retoriku savezničkih zakonodavaca. Zagovornici regulacije AI-ja također se brinu da će zakonski prijedlozi koji polaze od premise da bi nas AI mogao sve ubiti potisnuti druge ideje o reguliranju AI-ja. "Prije nego što dođemo do toga da je 'smak svijeta', moramo raščlaniti koji su to mehanizmi putem kojih zamišljamo da se to događa?", rekla je Sarah Myers West, suizvršna direktorica Instituta AI Now, organizacije za istraživanje politika. "Što možemo učiniti da ih ublažimo?"
U izjavi je glasnogovornik OpenAI-ja Drew Pusateri rekao da je incident s Hugging Faceom "pokazao gdje su naše zaštitne mjere morale biti strože, te smo na to reagirali jačanjem zaštite u našim istraživačkim sustavima." U srijedu je tvrtka predstavila nov skup smjernica o tome kako će pratiti, istraživati i obavještavati javnost o incidentima takozvanog nepoklapanja ciljeva (misalignment). Također je podijelila nekoliko prethodno neobjavljenih primjera takvog nepoklapanja, u kojima je njezina tehnologija činila stvari poput prikrivanja ili izmišljanja informacija kako bi vratila rezultate. Nijedan od tih incidenata nije uključivao kompromitiranje vanjskih mreža, priopćila je tvrtka.
Anthropic je odbio komentirati ovaj članak.
Melanie Mitchell, profesorica na Institutu Santa Fe koja proučava kako AI sustavi rasuđuju, u ogledu od 10. rujna osporila je tvrdnju da su AI tvrtke ikada izgubile kontrolu nad svojom tehnologijom, rekavši da priče o rojevima odmetnutih agenata koji bježe iz svojih kaveza iskrivljuju javnu raspravu. Takvi opisi impliciraju ljudsku dozu autonomije koju AI modeli ne posjeduju, napisala je. Mitchell je usporedila incident hakiranja između OpenAI-ja i Hugging Facea s požarom u Novom Meksiku 2000. godine, gdje su dužnosnici koji su provodili kontrolirano spaljivanje zanemarili vremensku prognozu vjetra i gledali kako požar izmiče kontroli. Krivnja, napisala je, leži na ljudima koji su trenirali modele metodama koje nagrađuju ustrajnost i autonomno donošenje odluka, a zatim nisu uspjeli osigurati sigurne uvjete testiranja. Ona smatra da najveće buduće opasnosti leže u ljudima koji koriste AI modele za nanošenje štete.
Neki ljudi, uključujući predsjednika Donalda Trumpa, odbacili su egzistencijalne prijetnje kao način da odbiju bilo kakav prijedlog da AI zahtijeva nove regulative. No ne želi svaki protivnik teorija katastrofe pustiti AI bez ikakve kontrole. Sara Hooker, suosnivačica AI startupa Adaption Labs i bivša znanstvena istraživačica u Google DeepMindu, slaže se s izvršnim direktorom Anthropica Darijem Amodeijem kada izražava zabrinutost zbog takozvanog rekurzivnog samounapređenja – pojma koji se odnosi na teoriju da će AI s vremenom steći sposobnost mijenjanja vlastitog koda ili na drugi način poboljšati svoje mogućnosti bez ljudske intervencije.
Dario Amodei | Jason Henry/Bloomberg
Amodei je rekao da se brine da bi, jednom kada taj proces započne, mogao pokrenuti petlju povratnih informacija koja će premašiti sposobnost ljudi da kontroliraju sustave koji se neprestano poboljšavaju. "Prepušten sam sebi, mogao bi preteći našu sposobnost da razumijemo i kontroliramo te sustave, pa mu se stoga mora pristupiti vrlo oprezno, ako uopće", napisao je u subotu u opsežnoj objavi na blogu pozivajući na usporavanje tempa razvoja najnaprednijih AI modela. Retorika Anthropica o egzistencijalnim prijetnjama bila je dosljedno agresivnija od OpenAI-jeve. No izvršni direktor OpenAI-ja Sam Altman brzo je signalizirao podršku Amodeijevom stavu, kao i lider SpaceXAI-ja Elon Musk.
Hooker se slaže da bi samounapređujući AI bio stvaran odmak od ranijih sustava. S druge strane, "skače li se s toga odmah na izumiranje? Ne", rekla je. Procjene koje ovog mjeseca kruže od strane istraživača AI-ja koji pokušavaju utvrditi vjerojatnost kraja čovječanstva, dodala je, dolaze bez "ikakve odgovornosti za to odakle taj broj dolazi." Takav je razgovor postao uobičajen u ovom području, što dovodi do vlastite vrste rekurzivne petlje povratnih informacija zbog koje su istraživači AI-ja sve više odvojeni od ostatka svijeta.
Incidenti poput hakiranja Hugging Facea izazivaju dosta zabrinutosti čak i za one koji ih ne vide kao prijetnju civilizaciji. Osim što nije koristio zaštitne mjere koje stavlja na javno dostupne proizvode, OpenAI je trenirao modele koje je testirao na međusobnu suradnju, nagrađujući ih za zajedničko postizanje ciljeva. Iako su agenti u ovoj evaluaciji trebali biti izolirani jedni od drugih, svaki je imao pristup istom internom softveru koji im je dao zajednički prostor za razmjenu informacija – nešto što je OpenAI nazvao oglasnom pločanom (message board). Agenti su otkrili da softver može pristupiti internetu iako oni sami nisu mogli, te su naveli softver da dohvati materijale izvana. Agenti su zatim hakirali Hugging Face kako bi došli do skupova podataka koji bi otkrili kako se ocjenjuje njihov rad.
Dok AI tvrtke nastavljaju raditi na razvoju sigurnijih metoda testiranja, Kambhampati navodi da se tvrdnje o AI-ju koji je izmaknuo kontroli ne bi trebale koristiti kao način za izbjegavanje odgovornosti. Skrenuo je pozornost na Roberta Morrisa, studenta s Cornella koji je okrivio pogrešku u programiranju nakon što je njegov crv 1988. godine onemogućio oko desetine računala tada spojenih na internet. Sud je odbacio taj argument, a Morris je postao prva osoba osuđena prema Zakonu o računalnoj prijevari i zlouporabi. "Ako pokrenete proces koji podivlja i uzrokuje štetu na mojoj imovini, vi ste odgovorni, i to je to", rekao je Kambhampati. "To vrijedi čak i kada vam to učini pas."