Grok 4.7 ima nižu cijenu po tokenu, ali troši ih više

Grok 4.7 na papiru izgleda jeftino, cijena po tokenu je ostala ista kao kod prethodnika. Nezavisni testovi pokazuju da za isti zadatak troši i do dvostruko više tokena, pa firma na kraju plati više, ne manje.

Jeftini AI tokeni preplavljuju mjerač ukupnog troška i podižu račun.
AI Balkan / AI-generisana urednička ilustracija.
Sadržaj

Ista cijena po tokenu kao kod prethodnika zvuči kao dobra vijest, dok se ne izračuna koliko tokena novi model zapravo potroši za isti zadatak.

xAI je 21. septembra predstavio Grok 4.7, novu verziju svog modela za programiranje i poslovnu upotrebu. Kompanija ističe da je cijena po tokenu ostala ista kao kod Grok-a 4.6, dva dolara za milion ulaznih i šest dolara za milion izlaznih tokena. Nezavisno testiranje pokazuje drugu stranu priče: za isti zadatak, model troši i do 125 odsto više tokena od prethodnika, pa firma na kraju plaća više, ne manje. Za svakoga ko bira AI alat za programiranje po cijeni iz cjenovnika, ovo je razlog da prvo pogleda i potrošnju, ne samo cijenu po tokenu.

  • Grok 4.7 zadržava cijenu Grok-a 4.6, dva dolara za milion ulaznih i šest dolara za milion izlaznih tokena, uz duplu cijenu za brži odgovor
  • Nezavisna platforma Artificial Analysis izmjerila je da najsposobnija varijanta modela troši oko 81.000 izlaznih tokena po zadatku, 125 odsto više od Grok-a 4.6 i 196 odsto više od GPT-6 Astra Max-a
  • Realni trošak po zadatku iznosi oko 3,74 dolara, dok konkurentski model GPT-5.6 Sol Max, uz veću cijenu po tokenu, izlazi na oko 1,99 dolara po zadatku
  • Na velikom obimu (50 milijardi ulaznih i 10 milijardi izlaznih tokena mjesečno) razlika u pristupu znači i do 1,92 miliona dolara godišnje
  • Model je ipak napredovao na testovima kodiranja, sa vidnim poboljšanjem na Terminal-Bench i CursorBench mjerenjima u odnosu na prethodnu verziju

Šta se tačno desilo

xAI, kompanija iza Grok modela, redovno objavljuje nove verzije po nižim cijenama ili sa boljim rezultatima, i Grok 4.7 na prvi pogled nastavlja taj obrazac. Cjenovnik je identičan kao za Grok 4.6, sa dvostrukom cijenom kad korisnik traži bržu, takozvanu Fast varijantu. Model je ojačan dodatnim treningom kroz pojačano učenje (reinforcement learning, tehnika u kojoj model uči kroz probu i nagradu za tačan odgovor) na težim zadacima, pa je poboljšan na više specijalizovanih testova, uključujući programiranje, elektrotehniku i pravne zadatke.

Problem se pojavljuje kad se cijena po tokenu poredi sa brojem tokena koji je modelu potreban da završi zadatak. Platforma Artificial Analysis, koja nezavisno testira AI modele, izmjerila je da Grok 4.7 u svom najzahtjevnijem režimu (xHigh) troši prosječno 81.000 izlaznih tokena po zadatku. To je 125 odsto više od Grok-a 4.6 i skoro tri puta više od konkurentskog GPT-6 Astra Max-a. Kad se ta potrošnja pomnoži sa cijenom po tokenu, stvarni trošak po zadatku iznosi oko 3,74 dolara, iako je nominalna cijena po tokenu ostala niska.

Na velikom obimu razlika postaje ozbiljan novac. Za firmu koja mjesečno potroši 50 milijardi ulaznih i 10 milijardi izlaznih tokena, ova razlika u efikasnosti znači razliku od stotinu i šezdeset hiljada dolara mjesečno, odnosno skoro dva miliona dolara godišnje, u odnosu na model koji troši manje tokena po istom zadatku.

Kontekst i konkurencija

Ista sedmica donijela je i primjer suprotnog trenda: kineska Xiaomi predstavila je model MiMo-V2.6-Pro koji je, prema istom nezavisnom mjerenju Artificial Analysis-a, izjednačen sa Grok-om 4.7 po ukupnoj sposobnosti, ali sa mnogo nižom cijenom po tokenu i otvorenim, besplatnim licenciranjem. Poređenje ova dva modela pokazuje da trka za nižom cijenom po tokenu i trka za nižim stvarnim troškom po zadatku više nisu ista trka. GPT-6 Astra Max, iako naplaćuje više po tokenu, u više slučajeva izlazi jeftiniji po završenom zadatku, upravo zato što mu treba manje tokena da dođe do rješenja.

Ovakvi obrasci su sve češći u industriji: kompanije objavljuju upečatljive brojeve u cjenovniku, dok stvarna ekonomija zavisi od toga koliko model "razmišlja" prije nego da odgovor. Firme koje biraju AI alat isključivo po cijeni po tokenu, bez testa na sopstvenim zadacima, rizikuju da potpišu ugovor koji izgleda jeftino, a na kraju mjeseca ispadne skuplji od alternative.

Naša perspektiva, šta ovo znači za region

Za firme koje koriste AI alate za programiranje, kao što su razvojni timovi u IT kompanijama u regionu, ovo je konkretan podsjetnik da se odluka o alatu ne donosi na osnovu marketinškog cjenovnika. Primjer: softverska firma koja razmatra prelazak sa jednog AI asistenta za kod na drugi treba prvo da pokrene isti set od desetak realnih zadataka na oba modela i uporedi ukupan broj potrošenih tokena, ne samo cijenu po tokenu iz reklame. Razlika od nekoliko hiljada eura godišnje lako se sakrije iza brojke koja na prvi pogled izgleda povoljno.

Za vlasnike malih i srednjih firmi koji plaćaju AI pretplate za tim od par ljudi, poruka je slična u manjem obimu: prije potpisivanja ugovora vrijedi tražiti od dobavljača konkretan izvještaj o prosječnoj potrošnji tokena po zadatku, ne samo cijenu po tokenu. Razlika između "jeftino" i "jeftino po tokenu, a skupo u praksi" može biti nekoliko stotina eura mjesečno već kod tima od pet ljudi.

Zaključak

Trend je jasan: dobavljači AI modela sve više takmiče cijenu po tokenu, dok se stvarna razlika u trošku seli u to koliko tokena model troši da dođe do rješenja. Firme koje prate samo cjenovnik će sve češće birati "jeftinije" modele koji ih na kraju mjeseca koštaju više. Vrijedi pratiti hoće li xAI i konkurenti početi da objavljuju i podatke o prosječnoj potrošnji tokena, ne samo cijenu, jer bi to postao novi standard poređenja.

Ako želiš da svake sedmice dobiješ ovakve analize troškova AI alata prevedene na konkretne brojke za tvoju firmu, prijavi se na AI Balkan newsletter.


Izvori:

Pretplatite se da biste se pridružili diskusiji.

Napravite besplatan nalog da biste postali član i pridružili se diskusiji.

Već imate nalog? Prijavite se

Prijavi se na AIBalkan - vijesti o vještačkoj inteligenciji newsletter.

Budite u toku sa pažljivo odabranom kolekcijom naših najboljih priča.

Provjerite svoj inboks i potvrdite. Nešto je pošlo po zlu. Pokušajte ponovo.