text size
OpenAI je objavio da uvodi agresivnije sustave za praćenje i zaštitu modela umjetne inteligencije u razvoju, nakon što su nedavni kibernetički incidenti potaknuli zabrinutost zbog AI alata koji izmiču kontroli.
U utorak je tvorac ChatGPT-a izjavio kako planira dodatno pojačati praćenje načina na koji njegovi najsposobniji neobjavljeni modeli rješavaju probleme i koriste razne mrežne alate, s ciljem da sigurnosne timove upozori na zabrinjavajuće ponašanje u roku od 30 minuta.
Tvrtka je navela da je dodala i nove kontrole kako bi spriječila određene AI modele da pristupaju internetu prilikom obavljanja zadataka višeg rizika. Osim toga, OpenAI će zahtijevati strožu izolaciju – što se često naziva sandbox (pješčanik) – za treniranje i procjenu AI modela na zadacima kao što je izvršavanje koda koji su generirali sami modeli ili koji se smatra nepouzdanim.
Posljednjih tjedana i OpenAI i Anthropic PBC javno su priznali da su neki od njihovih AI modela nenamjerno i zajednički probili sustave više institucija, uključujući tvrtku Hugging Face Inc., tijekom postupaka procjene. Najnovije objave služe kao novi dokaz da su AI agenti sposobni djelovati autonomno na načine koje čak ni stručnjaci obučeni za pronalaženje ranjivosti u tehnologiji više ne mogu predvidjeti.
OpenAI je priopćio da su najnoviji napori za jačanje sigurnosti i osiguravanje da AI modeli rade kako je predviđeno namijenjeni tome da tvrtka drži korak s tehnologijom kako ona s vremenom postaje sve sposobnija.
"Očito je da je sve što radimo usmjereno na to da spriječimo da se nešto poput incidenta s Hugging Faceom ponovi", rekla je Mia Glaese, potpredsjednica istraživanja u OpenAI-ju, na brifingu s novinarima u utorak. "No sposobnosti modela napreduju uistinu iznimno brzo, tako da to nipošto nije dovoljno. Izuzetno naporno radimo kako bismo osigurali da ono što radimo ostane ispred još sposobnijih modela."
OpenAI je ranije objavio da je privremeno zaustavio dio internog rada na jednom od svojih nadolazećih AI modela kako bi primijenio strože mjere zaštite. U objavi na blogu u utorak, tvrtka je navela da je velika faza treniranja modela i dalje na čekanju.
Tvrtka je također poručila kako uskoro planira podijeliti detaljnu analizu incidenta s Hugging Faceom.