
AI modeli naplaćuju po tokenu, a engleski je najjeftiniji jezik koji postoji. Isti posao na srpskom košta 50 do 129% više. Evo zašto, i kako da izmerite svoj.
Svaka firma koja određuje cenu neke AI funkcije radi isto: pročita cenu po milionu tokena, napravi brzi demo na engleskom i pomnoži. Demo je na engleskom jer se ti alati tako i predstavljaju. Račun nije na engleskom. On je na vašem jeziku, a vaš jezik skoro sigurno košta više.
Modeli naplaćuju po tokenu, a engleski je dno cene
Veliki jezički model ne naplaćuje po reči, nego po tokenu: komadu teksta iz svog fiksnog rečnika, nekad cela reč, nekad slog, nekad jedno slovo. Što se tekst iseče na više komada, veći je račun, sporiji je odgovor i manje teksta model može da drži u memoriji odjednom.
Taj rečnik je napravljen na tekstovima na kojima je model treniran, a to je ogromnom većinom engleski. Engleske reči češće prežive kao jedan token. Ređi jezici se seku na više manjih komada. Zato isto značenje, na drugom jeziku, tiho košta više na svakom pozivu.
Izmerili smo, i razlika je velika
Propustili smo isti tekst kroz tokenizatore osam aktuelnih modela, među njima GPT-5, Gemini, Llama 4, Mistral, DeepSeek, Qwen, Kimi i GLM. Ceo metod i brojevi su u našoj studiji Veštačka inteligencija naplaćuje porez na srpski, a ćirilica plaća više. Ukratko:
- Isti sadržaj koji na engleskom zauzme 100 tokena, na srpskoj latinici zauzme oko 153, a na srpskoj ćirilici 180 tokena na GPT-5.
- Na svih osam modela latinica košta 50 do 84% više od engleskog, a ćirilica 65 do 129% više.
- Nelatinična pisma plaćaju najviše, i ta razlika se pojavljuje u svakom modelu, ne samo u jednom.
Srpski je jedan jezik. Mehanizam je univerzalan: svaki jezik koji je bio redak u podacima za treniranje seče se na više tokena, a nelatinična pisma — ćirilica, arapsko, CJK — obično plaćaju najstrmiju verziju poreza.
Zašto je važno i mimo računa
Porez na tokene nije samo stavka na računu. Više tokena znači sporije odgovore, jer model stvara token po token. Znači manje mesta u kontekstnom prozoru, pa dugi dokumenti na vašem jeziku budu odsečeni pre nego isti dokumenti na engleskom. I znači da najjeftiniji model na engleskom često nije najjeftiniji na vašem jeziku: razlika između modela stiže do 36% na srpskom, a samo 4% na engleskom. Redosled se menja čim izađete iz engleskog.
Kako da izmerite svoj pre nego što se obavežete
- Merite na sopstvenom tekstu. Uzmite pravi sadržaj na svom jeziku — oglase, mejlove, dokumente — i prebrojte tokene na tačno onim modelima koje razmatrate. Engleski benčmark provajdera neće se poklopiti.
- Poredite modele, ne samo cene. Pošto se razlika između modela širi na drugim jezicima, pravi model za engleski proizvod često je pogrešan za vaš.
- Projektujte oko troška. Držite sistemske upite i interno rezonovanje na engleskom tamo gde ih korisnik ne vidi, čistite mešana pisma, a za neke jezike generišite na latinici i preslovljavajte nazad.
To je upravo ono što ugrađujemo u AI automatizaciju po meri: automatizacija je projektovana oko toga koliko stvarno košta da radi na vašem jeziku, a ne oko engleskog demoa. Ako planirate AI funkciju i želite da znate koliko će zaista koštati na vašem tržištu, zakažite tehnički strateški poziv i izmerićemo to zajedno.
Česta pitanja
Zašto AI košta više na srpskom nego na engleskom?
Modeli naplaćuju po tokenu, komadu teksta iz rečnika modela. Taj rečnik je napravljen na tekstovima kojih ima najviše, a to je ogromnom većinom engleski. Ređi jezici se seku na više manjih komada, pa isti sadržaj troši više tokena i košta više. Izmerili smo srpski na 50 do 84% više od engleskog na latinici i do 129% više na ćirilici.
Da li ovo utiče baš na naše tržište?
Utiče na svaki jezik koji je slabo zastupljen u podacima za treniranje, a to je skoro svaki jezik osim engleskog. Koliko tačno, zavisi od jezika i pisma: nelatinična pisma kao ćirilica, arapsko i CJK pisma obično plaćaju najviše. Jedini pouzdan broj je onaj izmeren na vašim tekstovima i na modelu koji zaista koristite.
Kako da smanjim trošak AI na srpskom?
Izmerite kandidate na sopstvenom sadržaju pre izbora, jer je razlika između modela mnogo veća na srpskom nego na engleskom. Držite sistemske i interne tekstove na engleskom tamo gde ih korisnik ne vidi, čistite mešana pisma, a za neke slučajeve tražite odgovor na latinici i preslovljavajte ga. Studio koji automatizaciju gradi oko cene tokena, a ne oko engleskog demoa, štedi vam razliku na svakom pozivu.

