DeepSeek pustio model koji je jeftiniji od GPT i Claude
Novi DeepSeek model na testu programiranja blago pretiče Claude Opus 5 i GPT-5.6 Sol, uz cijenu koja je za isti posao i do 100 puta niža. Objašnjavamo šta brojevi znače za firme u regionu koje biraju AI dobavljača za svakodnevne zadatke.
Kineska firma nastavlja rat cijenama u vještačkoj inteligenciji, novi model na nekim testovima stiže i pretiče Claude Opus 5 i GPT-5.6 Sol, uz cijenu koja je i do 100 puta niža.
Kineska AI kompanija DeepSeek je 10. septembra predstavila model V4.1-Flash, sa milion tokena konteksta (koliko teksta model odjednom "pamti" tokom razgovora) i cijenom koja u vanvršnim satima ide i do 0,003 dolara za milion obrađenih tokena iz keša (privremene memorije za ponovljene upite). Za konkretan primjer, agent koji kroz 100 upita ponovljeno koristi keširan tekst od 500.000 tokena, taj posao na V4.1-Flash košta 0,15 dolara, a isti posao na Claude Opus 5 oko 25 dolara. Za firme u regionu koje razmišljaju o automatizaciji putem AI agenata, ovo je nastavak trenda koji DeepSeek vodi još od početka 2025, cijena AI alata pada brže nego što većina firmi stiže da promijeni dobavljača.
- DeepSeek je 10. septembra pustio model V4.1-Flash, sa milion tokena konteksta i arhitekturom optimizovanom za jeftinije duge razgovore.
- Cijena u vanvršnim satima ide do 0,003 dolara za milion tokena iz keša, zbog čega isti konkretan zadatak koji na Claude Opus 5 košta 25 dolara, na novom modelu košta 0,15 dolara.
- Na nekim testovima programerskih zadataka, novi model blago pretiče i Claude Opus 5 i GPT-5.6 Sol.
- Na drugim testovima, poput izvršavanja komandi u terminalu, Claude Opus 5 i dalje jasno vodi.
- DeepSeek nastavlja politiku niskih cijena koju vodi još od početka 2025, kad je prvi put uzdrmao tržište.
Šta se tačno desilo
V4.1-Flash je model sa 552 milijarde parametara (brojčanih vrijednosti koje model uči tokom treniranja), ali zahvaljujući arhitekturi tipa "mešavina eksperata" (mixture of experts, gdje se za svaki upit koristi samo dio modela) u praksi aktivira samo 8 do 16 milijardi parametara po upitu. To je razlog zašto model može biti i brz i jeftin, a opet konkurentan po kvalitetu. Cijena zavisi i od doba dana, radnim danima od jedan do četiri i od šest do deset ujutru po evropskom vremenu, cijena je duplo niža nego u ostatku dana.
Na testu DeepSWE, koji mjeri sposobnost rješavanja programerskih zadataka, V4.1-Flash je osvojio 74,2 boda, neznatno više od Claude Opus 5 (74,0) i GPT-5.6 Sol (73,0). Na testu Terminal-Bench 3.0, koji provjerava rad sa komandnom linijom, slika je drugačija, Claude Opus 5 vodi sa 43,3 boda naspram 30,0 za DeepSeek.
| Test | DeepSeek V4.1-Flash | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|
| DeepSWE v1.1 (programiranje) | 74,2 | 74,0 | 73,0 |
| Terminal-Bench 3.0 (komandna linija) | 30,0 | 43,3 | nije navedeno |
Rezultate je mjerio VentureBeat na osnovu javno dostupnih testova, ne sama kompanija DeepSeek, što ih čini uporedivim sa rezultatima drugih modela na istim testovima.
Kontekst i konkurencija
Niska cijena nije novost za DeepSeek, kompanija je tržište prvi put uzdrmala početkom 2025. sa modelima V3 i R1, kad je pokazala da se blizu vrhunskih rezultata može doći uz mnogo manji trošak treniranja i rada. Ono što je novo u ovom izdanju jeste da model na pojedinim testovima ne samo da je jeftiniji, nego i blago bolji od najskupljih modela iz Amerike, dok na drugim testovima (poput rada u komandnoj liniji) i dalje zaostaje. Poruka za firme, jeftiniji ne znači automatski i lošiji, ali ni automatski bolji, zavisi od konkretnog zadatka.
Naša perspektiva, šta ovo znači za region
Za firme koje AI koriste za zadatke velikog obima, na primjer automatsko sortiranje i odgovaranje na upite korisničke podrške, ili obradu velikog broja dokumenata, razlika u cijeni od 25 dolara naspram 0,15 dolara po istom poslu, pomnožena sa hiljadama upita sedmično, nije zanemarljiva stavka u budžetu. Firma koja mjesečno troši nekoliko stotina evra na API pozive ka skupljem modelu za takve zadatke, uz testiranje istog posla na jeftinijem modelu može taj trošak svesti na desetinu, ako kvalitet ostane dovoljno dobar za tu konkretnu upotrebu.
Prije prelaska, vrijedi provjeriti i gdje se podaci obrađuju, DeepSeek je kineska kompanija, pa firme koje rade sa osjetljivim podacima klijenata treba da provjere uslove korišćenja i lokaciju servera prije nego prebace stvaran posao na jeftiniji model, isto kao što bi provjerile bilo kog novog dobavljača usluga.
Zaključak
Rat cijenama u AI industriji nastavlja se brže nego što firme stižu da testiraju dobavljače, a razlika između najjeftinijeg i najskupljeg ozbiljnog modela sad se mjeri i u desetinama puta, ne samo procentima. Za firme u regionu, praktičan sljedeći korak nije da automatski pređu na najjeftiniju opciju, nego da isti konkretan zadatak testiraju na dva ili tri modela prije nego odluče gdje ide taj mjesečni trošak.
Ako želiš da svake sedmice dobiješ pregled AI vijesti prevedenih na to šta konkretno znače za tvoj posao u regionu, prijavi se na AI Balkan newsletter.