AI Pregled · 31. srpnja 2026.

AI Pregled — 31. srpnja 2026.: OpenAI O4 Pro, prva kazna EU AI Akta i Perplexity na 18 mlrd. $

OpenAI O4 Pro resetira ljestvice s kontekstom od 10 milijuna tokena. EU AI Akt izriče prvu kaznu od 35 mil. €. Perplexity prikuplja 500 mil. $. Anthropic objavljuje Sonnet 4.7. Tenderly iz Zagreba premašuje 40 mil. $ ARR-a.

Boris Agatić  ·  31. srpnja 2026.  ·  13 min čitanja

Čitajte na: English  |  Deutsch

Posljednji tjedan srpnja 2026. donio je najgušću koncentraciju frontier model izdanja od siječanjskog vala. OpenAI je u utorak objavio O4 Pro — model koji stavlja naglasak na zaključivanje, s kontekstnim prozorom od 10 milijuna tokena koji je nadmašio sve javne ljestvice unutar 24 sata od izdavanja. EU je iskoristio isti tjedan za prvu formalnu akciju prema EU AI Aktu, izričući kaznu od 35 milijuna eura velikom HR-tech vendoru zbog nerazotkrivenih automatiziranih bodova za zapošljavanje. Perplexity je zatvorio rundu od 500 milijuna dolara po vrijednosti od 18 milijardi i najavio zaokret prema enterprise pretraživanju. Anthropic je objavio Claude Sonnet 4.7, a Mistral je izdao Large 3 kao potpuno open-weights model pod Apache 2.0 licencom. U Hrvatskoj, Tenderly — zagrebačka platforma za Web3 razvoj — premašila je 40 milijuna dolara ARR-a zahvaljujući novom AI sloju simulacije.

Ukratko: OpenAI O4 Pro lansiran 29. srpnja (10M tokena, Hijerarhijski Lanci Zaključivanja, 94,3% GPQA Diamond). Prva kazna EU AI Akta: 35 mil. € HR-tech vendoru za nedozvoljena automatizirana odlučivanja o zapošljavanju. Perplexity prikuplja 500 mil. $ na 18 mlrd. $, zaokret prema enterprise pretraživanju. Claude Sonnet 4.7 — 40% brži od 4.6, iste cijene. Mistral Large 3 pod Apache 2.0. Cohere Command R+ 2.1 s poboljšanim agentskim alatima. Google Cloud objavljuje GA cijene za Gemini 3.5 Pro. Tenderly iz Zagreba premašuje 40 mil. $ ARR-a.

Glavna priča: OpenAI O4 Pro — zaključivanje s 10 milijuna tokena

OpenAI-jev O4 Pro, objavljen 29. srpnja, nije samo inkrementalno ažuriranje O-serije — to je temeljito promišljanje kako frontier model za zaključivanje rukuje zadacima s dugim kontekstom. Kontekstni prozor od 10 milijuna tokena (otprilike 7,5 milijuna riječi) omogućuje učitavanje cijele srednje velike korporativne baze koda, godišnjih financijskih izvještaja ili cjelovitog skupa podataka kliničkog ispitivanja u jedan upit bez segmentiranja ili pretraživanja.

Arhitektura se oslanja na ono što OpenAI naziva Hijerarhijskim Lancima Zaključivanja — interni mehanizam koji segmentira duge probleme zaključivanja u ugniježđene potproblemе, rješava ih neovisno i sastavlja rezultat, umjesto da održava ravni lanac misli kroz cijeli tokenski budžet. Prema OpenAI-jevom tehničkom sažetku, to modelu omogućuje održavanje koherentnosti pri znatno dužim kontekstnim prozorima bez pada točnosti koji se tipično vidi iznad granice od 1M tokena.

10M
tokena kontekstnog prozora
94,3%
GPQA Diamond rezultat
88,1%
FrontierMath rezultat
$15/$60
po 1M tokena ulaz/izlaz

Rezultati na ljestvicama i što znače

O4 Pro je postigao 94,3% na GPQA Diamond (pitanja na razini doktorata iz prirodnih znanosti) — novi javni rekord — i 88,1% na FrontierMath, znatno smanjujući jaz do performansi ljudskih stručnjaka. Na SWE-Bench Verified (zadaci softverskog inženjerstva) dostigao je 71,4% — gotovo 5 postotnih bodova iznad prethodnog rekorda. Na ljestvicama dugog kontekstnog prisjećanja (NIAH varijante iznad 1M tokena), O4 Pro je prvi model koji održava iznad 95% točnosti bez pada.

Cijene i dostupnost

O4 Pro je odmah dostupan u ChatGPT Pro tieru za razgovor i putem API-ja po cijeni od $15 po milijunu ulaznih tokena, $60 po milijunu izlaznih tokena. Stopa "cached" ulaza od $3,75 po milijunu primjenjuje se na upite gdje se prefiks ne mijenja između zahtjeva — važno za enterprise radna opterećenja koja višekratno učitavaju isti veliki sistemski prompt. O4 Pro Mini, jeftinija destilacija, očekuje se za četiri do šest tjedana.

Što to znači za enterprise kupce: Kontekst od 10M tokena eliminira sloj pretraživanja za mnoge radne tokove s puno dokumenata — pregled ugovora, revizija usklađenosti i tehnička dubinska analiza. Kompromis je latencija: O4 Pro nije model u realnom vremenu. Latencija prvog tokena na maksimalnom kontekstu mjeri se u desetinama sekundi. Za batch obradu to je irelevantno; za interaktivni chat to je materijalno ograničenje.

EU AI Akt: Prva kazna je pala

Najvažniji regulatorni događaj tjedna — i vjerojatno kvartala — nije bio lansiranje proizvoda nego odluka Europskog odbora za zaštitu podataka. U ponedjeljak, 28. srpnja, EDPB je izrekao kaznu od 35 milijuna eura velikom HR-tehnološkom vendoru (nije imenovan do okončanja žalbenog postupka, ali je naširoko izvijestio europski tisak kao platformu koju koristi više od 400 velikih poslodavaca diljem EU) zbog kršenja Članka 26. EU AI Akta.

Kršenje: korištenje AI sustava koji je automatski bodovao kandidate za posao bez otkrivanja kandidatima da takav sustav postoji, bez osiguranja smislene ljudske provjere negativnih odluka i bez registracije sustava u EU bazi podataka za AI visokog rizika, kako zahtijeva Prilog III. Akta.

Zašto ova kazna ima veći značaj od iznosa

Iznos od 35 milijuna eura predstavlja 3,1% globalnog godišnjeg prometa tvrtke — dobro ispod maksimuma od 6% prema Članku 99(3) za kršenja zabranjene AI prakse, ali dobro iznad praga od 3% za neusklađenost s ostalim obvezama. Važniji od iznosa je signal koji šalje o prioritetima provedbe: EDPB je izabrao sustavni, visoko-volumni, neotkriven sustav automatiziranog odlučivanja kao prvu metu, a ne model opće namjene. To tržištu točno govori gdje leži rizik od provedbe u 2026. i 2027. godini.

Regulacija

Što bi tvrtke u EU trebale odmah revidirati

EDPB kazna stavlja četiri kategorije korištenja AI-a izravno u fokus: (1) automatizirana obrada životopisa ili bodovanje koje utječe na odluke o zapošljavanju, (2) sustavi praćenja učinka koji generiraju automatske ocjene rizika za zaposlenike, (3) kreditno ili anti-fraud bodovanje kupaca bez objavljene logike, i (4) bilo koji sustav iz kategorija Priloga III. koji još nije upisan u EU AI Akt bazu podataka. Ako vaša tvrtka koristi SaaS treće strane koji obavlja te funkcije, provjerite status usklađenosti tog dobavljača prije rujna 2026. — EDPB je ovog tjedna naznačio da istovremeno provodi sektorske preglede HR teha, financijskog AI-a i dijagnostičkog AI-a u zdravstvu.

Novi modeli ovog tjedna

O4 Pro
OpenAI · 29. srpnja

10M-tokenski kontekst, Hijerarhijski Lanci Zaključivanja, 94,3% GPQA Diamond. Dostupan u ChatGPT Pro i API-ju. $15/$60 po 1M tokena. Optimiziran za zaključivanje dugog konteksta, ne za interakciju u realnom vremenu.

Claude Sonnet 4.7
Anthropic · 28. srpnja

40% brže vrijeme do prvog tokena nego Sonnet 4.6, isti nivo sposobnosti, iste cijene ($3/$15 po 1M tokena). Prošireno razmišljanje sada uključeno po zadanom za složene zadatke. Poboljšana pouzdanost korištenja alata u agentskim radnim tokovima.

Mistral Large 3
Mistral AI · 25. srpnja

Open-weights pod Apache 2.0 licencom. 128K kontekst. Vodi među otvorenim modelima na većini europskih jezičnih ljestvica, uključujući hrvatski, mađarski, češki, slovački i rumunjski. Dostupan na Hugging Face.

Command R+ 2.1
Cohere · 27. srpnja

Poboljšano agentsko korištenje alata s višekoračnim planiranjem, smanjeno haluciniranje na zadacima utemeljenog pretraživanja. Cohere tvrdi 60% smanjenje grešaka u pozivima alata u usporedbi s R+ 2.0.

Claude Sonnet 4.7: što se mijenja u praksi

Anthropicovo ažuriranje na Sonnet 4.7 manje je o gornjoj granici sposobnosti, a više o operativnoj pouzdanosti. Smanjenje vremena do prvog tokena za 40% značajno je za aplikacije usmjerene prema korisniku gdje je percipirana brzina važna. Veća promjena za enterprise korisnike je da je prošireno razmišljanje sada uključeno po zadanom za upite koji aktiviraju složeno zaključivanje — prethodno je prošireno razmišljanje zahtijevalo eksplicitan API parametar. To znači da radna opterećenja koja su tiho slabije funkcionirala na višekoračnim zadacima zaključivanja mogu proizvesti znatno bolje rezultate bez ikakvih promjena upita.

Mistral Large 3: otvoreni frontier postaje ozbiljan

Mistralova odluka da objavi Large 3 pod Apache 2.0 — potpuno otvoreno, komercijalno upotrebljivo bez ograničenja — najjasniji je signal dosad da open-source frontier sustize zatvorene API-je na zadacima europskih jezika. Na višejezičnim ljestvicama koje pokrivaju hrvatski, mađarski, češki, slovački i rumunjski, Mistral Large 3 nadmašuje svaki drugi otvoreni model. Za tvrtke u Središnjoj i Istočnoj Europi koje razmatraju on-premise AI implementaciju radi zahtjeva rezidencije podataka, ovo je najuvjerljivija opcija koja je ikad bila dostupna.

Perplexity prikuplja 500 mil. $ — i zakreće prema enterprise-u

Perplexity AI zatvorio je Series E rundu od 500 milijuna dolara po vrijednosti od 18 milijardi dolara 26. srpnja, predvođenu SoftBank Vision Fund 3 uz sudjelovanje Nvidije, Databricksa i nekoliko suverenih fondova bogatstva. Runda podiže ukupno prikupljene investicije Perplexityja na nešto više od 1,2 milijarde dolara od osnivanja 2022. godine.

Važniji od financiranja je objavljeni smjer proizvoda: Perplexity zakreće primarni fokus rasta s potrošačkog pretraživanja na enterprise pretraživanje znanja. Novi Perplexity Enterprise tier, koji se lansira u rujnu 2026., omogućit će organizacijama povezivanje internih baza znanja, Confluence wikija, SharePoint repozitorija i Salesforce instanci s Perplexityjevim pretraživačkim motorom — uz citirane odgovore, ograničene na podatke tvrtke i revizibilne.

18 mlrd. $
vrijednost Perplexityja
500 mil. $
prikupljeno u Series E
110 mil.
mjesečnih aktivnih korisnika
ruj. 2026.
lansiranje Enterprise tiera

Ostale važne vijesti

Enterprise

Microsoft dodaje O4 Pro u Copilot Studio s Document Mode od 10M tokena

Microsoft je potvrdio da će O4 Pro biti dostupan u Copilot Studiu do sredine kolovoza 2026., s namjenskim "Document Modeom" koji učitava do 10M tokena enterprise dokumenata — ugovora, politika, tehničkih specifikacija — za analitičke radne tokove. Cijene će biti temeljene na potrošnji unutar postojećih Microsoft 365 E5 AI kredita.

Open Source

Meta objavljuje toolkit za fine-tuning Llama 4 Scout

Meta je objavila sveobuhvatni toolkit za fine-tuning Llama 4 Scouta na Hugging Faceu, uključujući QLoRA i recepte za potpuni fine-tuning, okvire za evaluaciju i skup domenski specifičnih adaptera (pravo, medicina, kod) koji služe kao polazišne točke. Toolkit dramatično snižava prepreku za domenski specifičnu implementaciju otvorenih modela.

Infrastruktura

Nvidia potvrđuje isporuke Blackwell Ultra hiperskalabilicima ranije od rasporeda

Nvidiina konferencija o zaradama za Q2 2026. potvrdila je da su isporuke Blackwell Ultra GPU-ova Microsoftu, Googleu, Amazonu i Oracleu oko šest tjedana ispred rasporeda, zahvaljujući poboljšanim prinosima na TSMC-ovom N3B procesu. Ubrzanje opskrbe očekuje se da će sniziti troškove GPU računalstva u cloud API-jima kroz Q4 2026.

Hrvatska: Tenderly premašuje 40 mil. $ ARR-a s AI slojem simulacije

Zagrebački Tenderly, poznat kao platforma za simulaciju i debugiranje pametnih ugovora za Web3 programere, ovog tjedna je objavio da je premašio 40 milijuna dolara godišnjeg ponavljajućeg prihoda — dostignut velikim dijelom zahvaljujući AI Sloju Simulacije, lansiranom u Q1 2026. Funkcionalnost koristi fino podešeni model koda za predviđanje ishoda transakcija, otkrivanje neučinkovitosti gasa i identificiranje potencijalnih eksploata u pametnim ugovorima prije implementacije, dramatično smanjujući teret ručnog pregleda za blockchain sigurnosne inženjere.

Trenderly Tenderlyjeva trajektorija rasta je izuzetna iz dva razloga. Kao prvo, demonstrira da hrvatska duboke-tech tvrtke mogu graditi globalne infrastrukturne proizvode za razvojne programere iz Zagreba — Tenderly sada broji više od 140.000 timova razvojnih programera iz 85 zemalja kao korisnike. Kao drugo, AI Sloj Simulacije predstavlja jasan arhetip za usvajanje AI-a u specijaliziranim tehničkim domenama: umjesto zamjene inženjera, pojačava njihovu sposobnost ranog otkrivanja problema.

Izvršni direktor Tenderlya Pero Novak potvrdio je da tvrtka trenutno ne prikuplja sredstva i planira dostići profitabilnost prije bilo koje buduće runde. Tvrtka zapošljava oko 130 ljudi, pretežno u Zagrebu, s malim timom u San Franciscu.

Za hrvatske tvrtke: Tenderlyjevo dostignuće podsjetnik je da su najdugotrajnija AI-nativna poduzeća često vertikalne platforme — duboko domensko znanje, specifičan radni tok i AI ugrađen u srž proizvoda, a ne dodan izvana. Ako gradite AI strategiju za 2027., Tenderlyjev model (posjedujte radni tok, automatizirajte dosadne dijelove, pojačajte stručnjake) je branivija arhitektura od horizontalnog AI asistenta slojevi na vrhu postojećih alata.

Tjedan u brojevima

35 mil. €
prva kazna EU AI Akta
1,4 mlrd. $
AI financiranje ovog tjedna
71,4%
O4 Pro na SWE-Bench Verified
3,1×
ubrzanje zaključivanja distribuiranim spekulativnim dekodiranjem

Što pratiti u kolovozu 2026.

Spremni primijeniti modele ovog tjedna?

Naš tim pomaže hrvatskim i europskim tvrtkama evaluirati, implementirati i upravljati frontier AI-em — od odabira modela do usklađenosti s EU AI Aktom. Certificirani Claude partner, bez vendor lock-ina.

Razgovarajmo