Nova OpenAI tehnika otežava nadzor nad AI modelima

Novi OpenAI model Astra koristi tehniku zvanu opaque recurrence, koja otežava praćenje kako AI model dolazi do odgovora. Stručnjaci upozoravaju da bi ovo moglo postati standard i kod Claude i Gemini modela.

Ilustracija neprozirnog AI razmišljanja koje otežava nadzor nad modelima kao što je OpenAI Astra
Nova tehnika u OpenAI modelu Astra otežava praćenje kako AI dolazi do odgovora
Sadržaj

AI stručnjaci upozoravaju da bi tehnika "opaque recurrence" u novom OpenAI modelu Astra mogla postati standard i kod drugih velikih AI modela.

OpenAI je najavio da će njegov novi model Astra koristiti tehniku zvanu "recurrent depth", poznatu i kao "opaque recurrence" (neprozirna rekurzija). Tehnika modelu omogućava da obrađuje isti upit u petlji, van uobičajenog koraka po korak razmišljanja koje karakteriše većinu današnjih AI modela. Problem je što ta ista tehnika otežava praćenje kako je model došao do odgovora, a AI bezbjednosni stručnjaci kažu da bi to moglo ozbiljno da oteža nadzor nad ponašanjem AI sistema, uključujući i alate koje firme sve više koriste za automatizaciju poslovanja.

  • OpenAI-jev novi model Astra koristi tehniku "opaque recurrence", koja obrađuje isti upit u petlji umjesto u linearnim koracima.
  • Tehnika otežava praćenje lanca razmišljanja (chain of thought), alata koji istraživači koriste da provjere zašto je AI model uradio nešto pogrešno.
  • Direktor bezbjednosne firme Redwood Research Buck Shlegeris javno je izrazio zabrinutost, upozoravajući da bi dalje širenje tehnike moglo potpuno uništiti mogućnost nadzora.
  • OpenAI-jev glavni naučnik Jakub Pachocki tvrdi da kompanija i dalje radi na tome da lanac razmišljanja ostane čitljiv.
  • Izvještaji navode da i Anthropic i Google DeepMind već razmatraju sličnu tehniku, što otvara pitanje da li će postati standard u industriji.

Šta se tačno desilo

Većina današnjih AI modela koji "razmišljaju" prije odgovora rade to sekvencijalno, korak po korak, i taj proces ostavlja trag poznat kao lanac razmišljanja (chain of thought). Taj trag nije savršen prikaz onoga što se stvarno dešava unutar modela, ali istraživačima daje uvid u to zašto je model donio određenu odluku, posebno kada nešto pođe po zlu.

Astra, novi OpenAI model, umjesto toga koristi tehniku koja isti upit obrađuje više puta u petlji, manje linearno. Rezultat ostavlja mnogo manje čitljivih tragova, što u praksi znači da je teže rekonstruisati zašto je model uradio ono što je uradio. OpenAI tvrdi da je upotreba tehnike kod Astre za sada ograničena i da lanac razmišljanja ostaje u velikoj mjeri čitljiv, a kompanija je odbacila sugestije da prelazi na potpuno neprozirno razmišljanje (takozvani "neuralese").

Ipak, reakcije u AI bezbjednosnoj zajednici bile su brze. Direktor firme Redwood Research Buck Shlegeris napisao je da ga izuzetno brine ova informacija, i upozorio da bi OpenAI, ako nastavi da razvija tehniku, mogao dobiti mogućnost da drastično poveća rekurziju i time potpuno uništi mogućnost nadzora nad lancem razmišljanja. Dugogodišnji zagovornik AI bezbjednosti Zvi Mowshowitz otišao je korak dalje, napisavši da bi mogli biti potrebni zakoni koji bi spriječili "trku ka dnu" među AI kompanijama.

Kontekst i konkurencija

Lanac razmišljanja je do sada bio jedan od rijetkih alata koje istraživači imaju za praćenje ponašanja AI modela, uključujući i slučajeve kada agenti postupe suprotno očekivanom. Prema izvještajima, i Anthropic i Google DeepMind već razmatraju sličnu tehniku rekurzije, što znači da ovo vjerovatno neće ostati izolovan slučaj kod jednog modela.

Glavni naučnik OpenAI-ja Jakub Pachocki javno je odgovorio na kritike, naglašavajući da je očuvanje čitljivog lanca razmišljanja bio prioritet kompanije još od prvih modela za rezonovanje i da ostaje ključni cilj njihovog istraživačkog programa. Istovremeno, glavni istraživač Redwood Research Ryan Greenblatt upozorio je da bi prirodan sljedeći korak bio dalje skaliranje neprozirnog razmišljanja, sve dok model ne počne da razmišlja gotovo isključivo van vidljivih kanala.

Važno je reći da nijedan AI model danas nema potpuno providan proces razmišljanja, i malo istraživača lanac razmišljanja tretira kao doslovan prikaz onoga što se dešava unutar modela. Ali upravo zato što je to jedan od rijetkih dostupnih alata za nadzor, njegovo dalje slabljenje zabrinjava stručnjake, posebno kako tehnika bude korištena u sve više modela.

Naša perspektiva: šta ovo znači za region

Za firme u regionu ovo zvuči kao daleka tehnička rasprava, ali direktno se tiče svakoga ko planira da AI agentima povjeri zadatke bez stalnog ljudskog nadzora.

Kada firma uvede AI agenta koji, recimo, samostalno odgovara klijentima, obrađuje fakture ili pretražuje interne dokumente, jedini način da se provjeri zašto je agent nešto uradio (ili pogriješio) često je upravo taj zapis njegovog "razmišljanja". Ako budući modeli sve više koriste tehnike poput opaque recurrence, ta mogućnost provjere postaje slabija, čak i kad kompanije koje grade te modele imaju najbolje namjere.

Praktičan zaključak za firme koje uvode AI agente: prije nego što agentu date pristup sistemu koji šalje mejlove, izvršava plaćanja ili mijenja podatke, treba tražiti od dobavljača konkretan odgovor na pitanje da li i kako mogu naknadno da provjere zašto je agent donio određenu odluku. Ako odgovor nije jasan, to je razlog da se agent zadrži na zadacima gdje ljudska potvrda ostaje obavezna, bar dok industrija ne razriješi ovo pitanje.

Zaključak

Ova rasprava tek počinje, a s obzirom da i Anthropic i Google DeepMind razmatraju sličnu tehniku, vjerovatno se neće ograničiti na jedan model. Vrijedi pratiti da li će OpenAI objaviti detaljnije tehničke podatke o tome koliko je Astrina upotreba rekurzije zaista ograničena, i da li će se pojaviti industrijski standard za nadzor agenata koji koriste ovakve tehnike.

Napravili smo kratku checklistu od pet pitanja koja treba postaviti svakom AI dobavljaču prije nego što agentu date pristup osjetljivim sistemima u firmi. Preuzmi je besplatno kad se prijaviš na AI Balkan newsletter.

Ako želiš da svake sedmice dobiješ ovakve AI vijesti prevedene na "šta to znači za tvoj posao", prijavi se na AI Balkan newsletter.


Izvori:
TechCrunch, 2. septembar 2026

Pretplatite se da biste se pridružili diskusiji.

Napravite besplatan nalog da biste postali član i pridružili se diskusiji.

Već imate nalog? Prijavite se

Prijavi se na AIBalkan - vijesti o vještačkoj inteligenciji newsletter.

Budite u toku sa pažljivo odabranom kolekcijom naših najboljih priča.

Provjerite svoj inboks i potvrdite. Nešto je pošlo po zlu. Pokušajte ponovo.