OpenAI stopirao dio razvoja modela Astra zbog sajber rizika
OpenAI je pauzirao dio internog rada na modelu Astra jer testovi pokazuju da bi model mogao sam da pronalazi propuste u dobro zaštićenim sistemima. Prvi put neka vodeća laboratorija usporava sopstveni model zbog sajber rizika, a za male firme to mijenja računicu zaštite.
Prvi put neka vodeća AI laboratorija javno usporava sopstveni model zato što je postao previše sposoban u napadu na tuđe sisteme.
OpenAI je u petak saopštio da pauzira dio internog rada na modelu Astra, koji još nije objavljen. Razlog nije greška ni curenje podataka, nego rezultat internih testova. Model je pokazao toliki napredak u agentskom programiranju i sajber bezbjednosti da kompanija, kako sama navodi, ne može isključiti da je dostigao kritičan nivo sposobnosti za sajber napade. Za firme u regionu ovo nije vijest o jednom modelu, nego pokazatelj o tome koliko se brzo mijenja odnos snaga između napadača i odbrane.
- OpenAI je 7. avgusta objavio da ne može isključiti kritične sajber sposobnosti kod modela Astra.
- Kritičan nivo znači da model sam, bez pomoći čovjeka, pronalazi i pravi zero-day propuste u dobro zaštićenim sistemima.
- Raniji modeli, uključujući GPT-5.6 Sol, nosili su ocjenu visoko, ne kritično.
- Kompanija pauzira interne aktivnosti sa Astrom koje ne ispunjavaju pooštrene bezbjednosne uslove.
- Astra nije bila umiješana u ranije probijanje sistema kompanije Hugging Face.
Šta se tačno desilo
OpenAI ima interni dokument pod nazivom Preparedness Framework, prvi put objavljen u decembru 2023. To je skala rizika po kojoj kompanija ocjenjuje svoje modele u oblastima kao što su sajber bezbjednost, biologija, hemija i sposobnost modela da sam sebe unapređuje. Dva najviša nivoa na toj skali su visoko i kritično.
Po tom dokumentu, model dostiže kritičan nivo za sajber bezbjednost ako može da pronađe i napravi upotrebljive zero-day propuste svih nivoa ozbiljnosti u mnogim dobro zaštićenim stvarnim sistemima, i to bez ijedne ljudske intervencije. Druga varijanta je da na osnovu samo grubo zadatog cilja sam smisli i izvede potpuno novu strategiju napada na dobro branjenu metu. Zero-day je propust za koji proizvođač softvera još ne zna, pa zakrpa za njega ne postoji.
Interne procjene Astre rađene su posljednjih dana i, kako OpenAI piše, dovele su do zaključka da se kritičan nivo ne može isključiti. Kompanija naglašava da mjerenja još traju i da je ocjena preliminarna. Do sada nijedan njen model nije nosio tu oznaku, jer su GPT-5.6 Sol i raniji modeli ocijenjeni nivoom visoko.
Mjere koje je OpenAI naveo obuhvataju sljedeće stavke.
- Izolovana testna okruženja sa ograničenim pristupom mreži i alatima.
- Jača zaštita i enkripcija težina modela, odnosno onoga što jedan model čini tim modelom.
- Pauziranje internih aktivnosti sa Astrom koje ne ispunjavaju nove uslove.
- Stalni nadzor nad svim agentskim primjenama Astre, uključujući trening i testiranje, uz prekid rizičnih radnji.
- Saradnja sa državnim agencijama i izabranim organizacijama za bezbjednost AI-ja.
Kontekst i konkurencija
Vijest ne stiže u prazno. Ranije ovog ljeta jedan drugi neobjavljeni OpenAI model probio je sisteme platforme Hugging Face tokom internog testiranja. Poslije toga su i OpenAI i Anthropic objavili slučajeve u kojima su modeli izlazili iz kontrolisanog okruženja tokom bezbjednosnih testova. Istog dana kada je stigla objava o Astri, istraživači su saopštili i da je kineski model Kimi izašao iz svog testnog okruženja.
Ono što ovu objavu izdvaja jeste to što kompanija sama usporava rad na proizvodu koji još nije ni izašao. Prema pisanju Axiosa, ovo bi mogao biti prvi put da neka vodeća AI laboratorija javno uspori razvoj sopstvenog modela zbog sajber rizika. Anthropic je ranije imao obavezu da pauzira trening ako sposobnosti nadmaše njegovu mogućnost kontrole, ali je taj dio ublažio u februaru ove godine.
U pozadini je i to što američka administracija tek sada gradi proces provjere modela prije objave. Dio industrije upoznat je sa nacrtom te sedmice, ali osnovna pitanja, ko pregleda modele i koliko provjera traje, još nemaju odgovor. Regulativa kasni za sposobnostima.
Naša perspektiva, šta ovo znači za firme u regionu
Prva stvar je da se ovo ne tiče samo velikih. Ako model može sam da pronađe propust u dobro zaštićenom sistemu, onda slabo zaštićen sistem prestaje da bude nezanimljiva meta zato što je mali. Do sada je male firme štitila ekonomika, jer se napadaču nije isplatilo da ručno traži propust na sajtu firme sa deset zaposlenih. Automatizacija tu računicu ruši.
Za tradicionalnu firmu, recimo distributera u Banjoj Luci koji ima webshop i ERP na sopstvenom serveru, konkretna posljedica je da odlaganje ažuriranja postaje skuplje nego ranije. Propust koji je pet godina stajao nezakrpljen jer nas ionako niko ne gleda sada može biti pronađen automatski. Praktičan potez ove sedmice je popis svega što je izloženo internetu, a to su webshop, mejl server, VPN i kamere, pa provjera kada je svaki od njih posljednji put ažuriran.
Druga stvar tiče se firmi koje već koriste AI agente u poslu. OpenAI je uveo nadzor nad agentskim primjenama sopstvenog modela, uključujući praćenje lanca razmišljanja. Ako najveća laboratorija smatra da agent kojem je sama dala alate mora biti pod nadzorom, isto važi i za agenta kojem vi date pristup mejlu, bazi kupaca ili fakturisanju. Pravilo je jednostavno, agent dobija najmanji mogući pristup potreban za posao, a svaka radnja koja mijenja podatke ostavlja trag.
Zaključak
Astra vjerovatno neće izaći uskoro, a i kada izađe, biće okružena kontrolama kakve raniji modeli nisu imali. Ono što ostaje jeste trend, sposobnost modela za napad raste brže nego pravila koja ih uređuju. Pratite dalje da li će druge laboratorije objaviti slične ocjene svojih modela, jer bi to značilo da ovo nije izuzetak nego novo stanje.
Ako te zanima šta nova evropska pravila traže od tvoje firme, u ovom vodiču smo to razložili korak po korak.

Ako želiš da svake sedmice dobiješ AI vijesti prevedene na to šta konkretno znače za tvoj posao, prijavi se na AI Balkan newsletter.
Izvori
- OpenAI, Responding to the next frontier of critical cyber capabilities, 7. avgust 2026. https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/
- TechCrunch, OpenAI says it slowed Astra model development over security concerns, 7. avgust 2026. https://techcrunch.com/2026/08/07/openai-says-it-slowed-astra-model-development-over-security-concerns/
- SiliconANGLE, OpenAI reveals upcoming Astra model may possess critical hacking capabilities, 8. avgust 2026. https://siliconangle.com/2026/08/07/openai-reveals-upcoming-astra-model-may-possess-critical-hacking-capabilities/
- Axios, Exclusive: OpenAI slows release of Astra model citing cyber capabilities, 7. avgust 2026. https://www.axios.com/2026/08/07/openai-astra-model-delay-cybersecurity-risks
