Juče smo pisali o Jevu, modelu koji ne piše tekst nego vraća odluku i broj koji kaže koliko je u nju siguran. Za jedan dan ljudi su ga stavili u svoj kod i počeli da objavljuju rezultate.
Iz tih objava se vidi da je reč o novom primitivu za AI softver — prvom posle dužeg vremena, elementu od kog se gradi, a ne još jednom modelu koji priča.
Here's a 45-second TL;DR on Jev.
I find the core idea beautifully simple, but the video made it really hard to understand.
Hope you find it helpful. https://t.co/xIz3XIeXiE pic.twitter.com/KtSKlEMVL3
— Matija Sosic (@MatijaSosic) September 16, 2026
Kako Jev radi
Dosadašnji modeli vraćaju tekst pa ga kod tumači. Jev dobija stanje i unapred određena pitanja sa ponuđenim odgovorima, a vraća izbor i verovatnoću uz njega.
To je uslov u kodu koji razume kontekst, dovoljno jeftin da se poziva hiljadama puta dnevno.
"jev can't generate text"
But jev has a lot to say!
I gave him a couple hundred common english words to choose from + punctuation pic.twitter.com/WmDkTyiG9u
— Isaac Tai 🧇 (@hi_im_isaac_) September 17, 2026
Šta ljudi već rade s njim
Inženjer bezbednosti ga uvodi u istragu upada: rangiranje rezultata pretrage, ocenjivanje korisnika i procesa po sumnjivosti, razvrstavanje hiljada izvršavanja jednog procesa.
This made me rethink where AI actually fits into security engineering.
For purely engineering work, forget about ChatGPT or Claude.
TypeSafe AI just released Jev, and I think it’s going to change how we build AI into security workflows.
Instead of asking an LLM to “investigate… https://t.co/wSfa9Uj6Wz
— Kostas (@Kostastsale) September 16, 2026
Jedan programer ga je pustio da mu pregleda izmene koda: jedan poziv vraća 14 tipiziranih provera kao verovatnoće, po ceni od sedam centi na hiljadu pregleda.
got Jev to review my PRs. ~200x cheaper than Claude and it answers in half a second
6 real PRs in the video. $0.00007 each. 1,000 PRs = 7 cents vs ~$14.50 on Opus 5
paste a diff → ONE call to @typesafeai → 14 typed checks come back as probabilities:
hardcoded secret, sql… pic.twitter.com/ChZ4HG54GF— Paolo Rosson (@redp314) September 17, 2026
Drugi ga puštaju na redove tiketa: hitnost, usmeravanje na tim, odluka da li uopšte treba čovek. U agentima bira kom alatu ide zadatak, umesto da veliki model troši tokene na svaku sitnicu.
Koliko je dobar i koliko košta
Na testu sa ljudski označenim podacima poklapanje sa ljudskim ocenama košta 0.79, ispred tri modela koja se za taj posao inače koriste — uz cenu od dva centa naspram njihovih 14 do 29.
Our human-labeled benchmark measures correlation (Spearman) between human labels and AI:
* Gemini 3.1-Flash-lite | Spearman 0.72 | $0.29
* DeepSeek V4 Flash 0731-low | Spearman 0.73 | $0.27
* DeepSeek V4 Flash 0731-high | Spearman 0.77 | $0.14
* Jev | Spearman 0.79 | $0.02— Hamed Nilforoshan (@h_nilforoshan) September 17, 2026
Iz Vercela, firme koja hostuje veliki deo modernog weba, kažu da im na bezbednosnoj proveri svake komande radi do 18 puta brže i tačnije od modela koji taj posao sada obavlja, pa ga uvode u svoj gateway.
We're seeing extraordinary results from @typesafeai. Default mode in 𝚏𝚡 is auto, with a safety reviewer analyzing every command.
That reviewer runs on GPT Luna today. Jev is up to 18x faster (p95) *and* more accurate. It's coming to @vercel AI Gateway and likely new default. https://t.co/y5tFnlFN2l
— Guillermo Rauch (@rauchg) September 16, 2026
Gde staje
Ne piše tekst i ne objašnjava izbor, a listu mogućih odgovora moraš sam da napraviš u kodu. Ono "bez halucinacija" znači samo da izlaz ne može da pobegne iz zadatog oblika, ne i da je izbor tačan.
Dokumentacija navodi gde je slab: matematika, poređenje datuma, previše nebitnog konteksta i zlonameran ulaz. Kad su ga pustili da igra šah protiv velikih modela, videlo se dokle ide odluka doneta bez razmišljanja u koracima.
Jev VS Fable 5.1 VS GPT-6 Astra: chess
typesafe's new Jev V13 isn't an LLM. it doesn't chat, doesn't explain, doesn't write code — it only makes decisions. so we made it play blitz against frontier LLMs.
the test: 5+0 blitz. every move is one API call.
Jev V13 vs Fable 5.1:… https://t.co/cItkOtyx78 pic.twitter.com/lvtZPjmpC6
— AI/ML API (@aimlapi) September 16, 2026
Sličnu ocenu daju i ljudi koji vode velike softverske firme: osnivač Boxa piše da postoje čitavi svetovi AI inovacija koji nisu bili ni na čijem radaru, i da je obrada podataka ovom brzinom i po ovoj ceni velika stvar za poslovne zadatke.
Incredibly exciting that there are entire universes of AI innovation that still exist that weren’t even on most of our radars.
Being able to process information insanely quickly, at crazy low costs, with high levels of capability is huge for a wide number of enterprise tasks.… https://t.co/IO5LDA13ff
— Aaron Levie (@levie) September 17, 2026
Kako to izgleda kad se sve to spoji u jednu odluku, pokazuje i kratko video objašnjenje modela:
Za nekoga ko gradi agente ovde, vrednost nije samo u brzini i ceni nego u tome što je stigao nov primitiv, element od kog se gradi: veliki model piše i rezonuje, a ovaj nosi hiljade sitnih odluka koje su do sada plaćane po ceni pisanja.
Ako je Jev stvarno ono što deluje da jeste, vreme je da se promisli svaki agent kog smo pravili prethodnih meseci i godina.
