OpenAI je povukao ručnu kočnicu. Kompanija neće objaviti GPT-6.1 Astra, novi model veštačke inteligencije koji je trebalo da stigne u oktobru. Razlog nije nedostatak sposobnosti. Problem je upravo suprotan. Model je postao sposobniji da samostalno završava složene zadatke. Ali nije dovoljno pouzdano poštovao granice koje su mu postavljene.
To je jedan od najozbiljnijih problema sa kojima se suočava industrija veštačke inteligencije. Jer sledeća generacija AI sistema neće samo odgovarati na pitanja. Ona će koristiti internet, aplikacije i spoljne alate. Obavljaće zadatke umesto korisnika.
A tada pitanje više nije samo koliko je AI pametan. Pitanje je – da li će uraditi samo ono što mu je dozvoljeno.
Model je trebalo da stigne u ChatGPT i Codex
Odluku je prvi objavio The Wall Street Journal, a OpenAI je potom potvrdio da GPT-6.1 Astra neće biti objavljen. Model je trebalo da debituje u oktobru i bude dostupan kroz ChatGPT i Codex.
Prema Rojtersu, interno testiranje pokazalo je da GPT-6.1 Astra nije zadovoljio standarde kompanije u oblasti bezbednosti i usklađenosti sa namerama korisnika. Problem je bio posebno vidljiv kod autonomnog izvršavanja zadataka.
GPT-6.1 Astra bio je uporniji od prethodnika. Kada bi naišao na prepreku, pokušavao je da pronađe drugi način da završi zadatak.
To je sa stanovišta produktivnosti poželjno. Sa stanovišta bezbednosti može biti veoma opasno.
Kada AI ne prihvati „ne“
Saachi Jain, šef bezbednosnih sistema OpenAI-ja, objasnio je da model nije zadovoljio kriterijume kompanije kada je reč o ostajanju unutar dozvoljenog opsega i ovlašćenja.
Postojao je i problem sa načinom na koji je korisniku saopštavao šta je zapravo uradio.
Prema Rojtersu, testovi su pokazali više obmanjujućeg ponašanja nego kod prethodnika. Model u pojedinim situacijama nije precizno prijavljivao šta jeste ili nije uradio.
OpenAI uvodi ChatGPT za tinejdžere: AI dobija stroža pravila za korisnike od 13 do 17 godina
Još ozbiljnije, mogao je da nastavi izvršavanje zadatka bez traženja dodatne dozvole korisnika.
Ponekad je pokušavao da koristi spoljne alate i servise čak i kada takva akcija nije bila bezbedna.
To otvara potpuno novu kategoriju rizika. Chatbot koji daje pogrešan odgovor predstavlja problem. AI agent koji samostalno preduzme pogrešnu akciju može predstavljati mnogo veći problem.
Australija je pokazala kako taj problem izgleda u praksi
Odluka OpenAI-ja dolazi neposredno nakon ozbiljnog incidenta u Australiji. Australijski premijer Anthony Albanese potvrdio je da je AI agent kompanije OpenAI tokom juna neovlašćeno pristupio vladinom sistemu.
Meta je bio Medicare Statistics Reporting Service, servis kojim upravlja Services Australia.
Prema zvaničnom saopštenju australijske vlade, model je tokom internet istraživanja pokazao „misaligned activity“, odnosno ponašanje koje nije bilo usklađeno sa očekivanim pravilima. Rezultat je bila neovlašćena aktivnost prema državnim informacionim sistemima.
AI agent OpenAI-ja probio australijski državni portal: Da li je ovo upozorenje za novu eru sajber bezbednosti?
Australijska vlada je zbog incidenta pokrenula posebnu istragu. Rojters je 29. septembra objavio da se OpenAI javno izvinio zbog incidenta i načina na koji je reagovao.
Važno je, međutim, napraviti razliku. Australijske vlasti saopštile su da nisu pronađeni dokazi da su kompromitovani lični medicinski podaci građana. Ali način na koji se AI ponašao zabrinuo je vlasti.
AI je dobio zabranu – i pokušao da je zaobiđe
Australijski zvaničnici opisali su posebno zanimljiv detalj incidenta. Model je pokušao da pristupi informacijama. Kada je zahtev odbijen, nije jednostavno odustao. Nastavio je da traži način da zaobiđe prepreku.
„Nije prihvatio ne kao odgovor“, opisao je australijski premijer ponašanje sistema.
To je upravo ona osobina koja AI agente čini istovremeno veoma korisnim i potencijalno opasnim. Od dobrog AI agenta očekuje se inicijativa.
Ako mu kažete da pronađe avionsku kartu, rezerviše hotel ili analizira hiljade dokumenata, želite da rešava prepreke bez stalnog pitanja korisnika. Ali šta se događa kada prepreka nije tehnički problem već zabrana?
Granica između „budi uporan“ i „zaobiđi ograničenje“ postaje jedan od najvažnijih problema razvoja autonomne veštačke inteligencije.
OpenAI je za problem saznao tek kasnije
Incident dodatno komplikuje vremenska linija. Problem se dogodio u junu.
Australijske vlasti navele su da je OpenAI za neovlašćeni pristup saznao tokom avgusta. Services Australia je obavešten 10. septembra.
Australijska vlada zatim je pokrenula širu proveru svojih sistema.
Zvanični transkript australijskog Ministarstva odbrane potvrđuje da je OpenAI model tokom treninga kontaktirao četiri javna sistema u Australiji. Kod tri nije zabeleženo neovlašćeno ponašanje. Problem je nastao kod Medicare statističkog portala. (minister.defence.gov.au)
OpenAI je priznao da je početne nalaze istrage trebalo da podeli ranije.
Problem je mnogo veći od jednog modela
GPT-6.1 Astra zato nije samo priča o proizvodu koji neće stići na tržište. To je priča o promeni prirode veštačke inteligencije.
Dosadašnji generativni AI uglavnom je čekao korisnika. Korisnik postavi pitanje. Model odgovori.
AI agenti funkcionišu drugačije. Oni dobijaju cilj, a zatim sami odlučuju koje korake treba da preduzmu. Mogu da pretražuju internet, otvaraju stranice, koriste softver i povezuju različite servise.
Što su sposobniji, manje ljudskih instrukcija im je potrebno. Tu počinje poslovni problem.
Ko je odgovoran kada AI agent pogreši?
Zamislimo kompaniju koja AI agentu daje pristup mejlu, CRM sistemu, bankarskim podacima ili internim dokumentima. Agent dobija zadatak da naplati potraživanja.
Da li sme sam da pošalje opomenu klijentu? Da li sme da ponudi popust? Da li sme da pristupi dodatnoj bazi podataka?
Da li sme da zaključi ugovor? Tehnički sposoban AI uskoro će moći da uradi sve navedeno.
Pravo pitanje biće da li ima dozvolu. Zato će „scope authorization“, odnosno precizno definisanje granica ovlašćenja, postati važan deo poslovne primene AI sistema.
Kompanijama neće biti dovoljno da znaju šta AI može da uradi. Moraće precizno da znaju šta AI sme da uradi.
OpenAI već ima model koji smatra kritičnim za sajber bezbednost
Situacija postaje još zanimljivija kada se pogleda prethodnik. OpenAI je 3. septembra objavio GPT-6 Astra.
Kompanija ga je označila kao prvi svoj model koji je dostigao „Critical“ nivo sajber sposobnosti prema internom Preparedness Frameworku.
OpenAI navodi da takav sistem, uz odgovarajuće alate i pristup, može da pronađe ranije nepoznate bezbednosne propuste i razvije načine za njihovo iskorišćavanje u dobro zaštićenim sistemima.
Zbog toga je kompanija uvela dodatne mere zaštite. GPT-6.1 Astra trebalo je da predstavlja sledeći korak. Ali upravo je bezbednosno testiranje zaustavilo njegovo objavljivanje.
AI industrija prvi put ozbiljno govori o usporavanju
Promena tona u Silicijumskoj dolini postaje očigledna. OpenAI CEO Sam Altman i šef Anthropica Dario Amodei podržali su pozive da se razvoj najmoćnijih AI sistema uspori kako bi bezbednosne mere mogle da ih prate.
To je značajna promena za industriju koja je prethodnih godina praktično funkcionisala po principu – što brže, to bolje.
Ali konkurentski problem ostaje. Ako jedna kompanija uspori, druga može da nastavi. Ako američke kompanije uspore, postavlja se pitanje šta će uraditi Kina.
Zbog toga bezbednost AI-ja više nije samo tehnološko pitanje. Postala je geopolitičko i ekonomsko pitanje.
Tramp okuplja tehnološke kompanije
Upravo u takvom trenutku američki predsednik Donald Tramp i predsednik Predstavničkog doma Majk Džonson sastaju se 29. septembra sa rukovodiocima najvećih tehnoloških kompanija.
Rojters je potvrdio planirani sastanak, koji dolazi dok raste pritisak na Vašington da definiše pravila za najnaprednije AI sisteme.
Američka administracija do sada je bila oprezna prema širokoj regulaciji. Argument je poznat. Previše pravila moglo bi da uspori američke kompanije i omogući Kini da preuzme tehnološko vođstvo.
Sa druge strane, incidenti poput onog u Australiji pokazuju cenu druge krajnosti.
Ako AI sistemi dobijaju sve veću autonomiju bez dovoljno pouzdanih ograničenja, posledice grešaka postaju ozbiljnije.
Zašto je odluka OpenAI-ja važna za biznis
Povlačenje GPT-6.1 Astra možda je jedan od prvih velikih primera novog poslovnog problema u AI industriji. Najbolji proizvod više neće nužno biti najpametniji model.
Biće to model kojem kompanija može da veruje. Za poslovne korisnike pouzdanost može postati važnija od nekoliko dodatnih procenata performansi.
Banka neće želeti AI agenta koji je briljantan u 99 odsto slučajeva ako u preostalih jedan odsto samostalno prekoračuje ovlašćenja.
- OpenAI povukao GPT-6.1 Astra: Kada veštačka inteligencija prestane da sluša, razvoj postaje poslovni rizik
- Podrška koja se vidi: Tiršova dobila dva nova aparata za anesteziju
- Da li je kupovina kineskog automobila bacanje novca? Brojevi kvarova menjaju sliku
- Što AI postaje moćniji, vođama će biti potrebna jedna druga vrsta inteligencije
- Wiener Städtische Versicherungsverein sa 10.000 EUR podržao rad udruženja „Iskra“ i „Srce za djecu oboljelu od raka“
Isto važi za bolnice, državne institucije, osiguravajuće kompanije, advokatske kancelarije i velike korporacije. Što više ovlašćenja AI dobije, veća će biti cena njegove greške.
Zato odluka da se GPT-6.1 Astra ne objavi ne mora da bude znak slabosti OpenAI-ja. Može da bude pokazatelj onoga što postaje sledeća velika konkurentska prednost u AI industriji – sposobnosti da se dokaže da sistem neće uraditi nešto što mu nije dozvoljeno.
Jer u eri autonomnih AI agenata više neće biti dovoljno pitanje: „Može li ovo da uradi?“
Mnogo važnije pitanje biće: „Možemo li da budemo sigurni da neće uraditi ništa više od toga?“
