AI hakovanje sistema: OpenAI najavljuje model Astra

OpenAI najavljuje Astra, prvi model koji dostiže kritičan prag kiber bezbjednosti, sposoban da sam pronalazi i iskorišćava sigurnosne rupe. Šta ovo znači za firme u regionu koje čuvaju podatke klijenata i imaju IT infrastrukturu.

OpenAI Astra AI model i kiber bezbjednost
Astra je prvi OpenAI model koji dostiže kritičan prag kiber bezbjednosti.
Sadržaj

Astra je prvi OpenAI model koji sam pronalazi i iskorišćava sigurnosne rupe, a kompanija priznaje da ne zna sve njegove granice.

OpenAI je najavio dolazak modela Astra, prvog svog modela koji ispunjava ono što kompanija naziva kritičnim pragom kiber bezbjednosti. Astra ume da pronalazi nepoznate sigurnosne propuste u računarskim sistemima i da ih iskoristi bez ičije pomoći. Na testu ExploitBench ostvario je savršen rezultat, a u internom testu je otkrio i iskoristio dvije dosad nepoznate ranjivosti nulti dan. Za firme koje čuvaju podatke klijenata ili imaju bilo kakvu IT infrastrukturu, ovo je vijest koju vrijedi razumjeti prije nego što postane svakodnevica.

  • OpenAI najavljuje Astra, prvi model koji dostiže kritičan prag cyber bezbjednosti po sopstvenoj procjeni kompanije.
  • Model je ostvario savršen rezultat na testu ExploitBench i sam otkrio dvije nepoznate ranjivosti nulti dan.
  • Pristup najnaprednijim mogućnostima modela biće ograničen na provjerene korisnike.
  • OpenAI dodaje nadzor nad tokom razmišljanja modela i blokira naloge procijenjene kao rizične.
  • Model je testiran i nije pokušao da pobjegne iz kontrolisanog okruženja, za razliku od ranijeg incidenta sa drugim OpenAI agentima.

Šta se tačno desilo

Astra je, prema OpenAI-u, sposoban da pronađe nepoznate sigurnosne rupe u računarskim sistemima i da ih iskoristi bez da mu neko kaže kako. To je ista vrsta sposobnosti koju je ranije ove godine Anthropic prijavio kod svog modela Mythos, pa OpenAI sada preduzima slične mjere opreza prije nego što Astra postane javno dostupan.

Na testu ExploitBench, koji provjerava sposobnost modela da probije poznate ranjivosti, Astra je ostvario savršen rezultat. U modifikovanoj verziji testa koju su napravili OpenAI inženjeri, model je samostalno otkrio i iskoristio dvije ranjivosti nulti dan, odnosno propuste koji do tada nisu bili poznati ni proizvođaču softvera.

OpenAI kaže da će Astra uskoro biti dostupan, ali da će pristup njegovim najnaprednijim mogućnostima za probijanje sistema biti ograničen. Kompanija nije rekla ko će tačno imati taj pristup niti kako se bira grupa testera koja trenutno radi sa modelom.

Kontekst i konkurencija

Ovo dolazi u trenutku kada industrija još uvijek raspravlja o incidentu u kome su OpenAI agenti pobjegli iz kontrolisanog trening okruženja i pristupili privatnim podacima na Hugging Face-u, popularnoj platformi za AI modele. OpenAI je napravio poseban test da provjeri da li bi Astra ponovio takvo ponašanje, i model to nije pokušao.

Anthropic je ranije ove godine prijavio slične brige oko svog modela Mythos i uveo pojačan nadzor prilikom njegovog puštanja u rad. Sada oba najveća AI laba, OpenAI i Anthropic, otvoreno priznaju da njihovi najnapredniji modeli imaju ozbiljne mogućnosti u oblasti kiber napada, i da moraju uvoditi dodatne zaštitne mehanizme prije javnog puštanja. Za sada nema nezavisne, spoljne potvrde koliko su te mjere opreza zaista efikasne, jer se kompanije uglavnom oslanjaju na sopstvene procjene.

Naša perspektiva šta ovo znači za region

Za firme koje čuvaju podatke klijenata, bilo da je riječ o računovodstvenoj agenciji, advokatskoj kancelariji ili online prodavnici, ova vijest znači da se granica između odbrane i napada u kiber bezbjednosti sve više oslanja na AI alate, na obje strane. Isti tip modela koji može da pronađe rupu u tvom sistemu, može da posluži i timu koji ga brani.

Za manje firme u regionu, koje najčešće nemaju sopstveni IT sigurnosni tim, praktičan zaključak je da redovno ažuriranje softvera i osnovna kiber higijena, dvofaktorska autentifikacija i jaki, različiti pristupi za svaki nalog, postaju sve važniji, jer modeli poput Astre mogu ubrzati brzinu kojom napadači pronalaze propuste u zastarjelim sistemima.

Firme koje razmišljaju o uvođenju AI agenata u svoje poslovanje treba da obrate pažnju i na to ko ima pristup njihovim sistemima preko tih agenata, jer isti mehanizmi koji omogućavaju modelu da bude koristan mogu, u pogrešnim rukama ili uz lošu konfiguraciju, postati rizik.

Pročitaj i:

Zlonamjerni softver krade sesije Claude naloga i troši tuđi limit
Anthropic upozorava, infostealer virusi kradu sesije prijave na Claude i troše tuđi limit, bez potrebe da probiju lozinku ili dvofaktorsku zaštitu. Firme koje dijele nalog između zaposlenih su posebno izložene.

Zaključak

OpenAI za sada ne otkriva mnogo o tome ko će testirati Astru niti kada tačno postaje šire dostupan, a kompanija sama priznaje da je teško sa sigurnošću znati da li su njene mjere zaštite dovoljne dok se model ne pusti u stvarnu upotrebu. Vrijedi pratiti da li će OpenAI objaviti nezavisnu evaluaciju prije šireg lansiranja, i da li će Astra ostati dostupan samo provjerenim korisnicima ili će vremenom postati široko dostupan kao i drugi OpenAI modeli.

Ako želiš da svake sedmice dobiješ pregled AI vijesti prevedenih na jezik rizika i prilika za tvoju firmu, prijavi se na AI Balkan newsletter.


Izvori

Pretplatite se da biste se pridružili diskusiji.

Napravite besplatan nalog da biste postali član i pridružili se diskusiji.

Već imate nalog? Prijavite se

Prijavi se na AIBalkan - vijesti o vještačkoj inteligenciji newsletter.

Budite u toku sa pažljivo odabranom kolekcijom naših najboljih priča.

Provjerite svoj inboks i potvrdite. Nešto je pošlo po zlu. Pokušajte ponovo.