OpenAI pokreće GPT-5.6 Sol na 750 tokena u sekundi. Google Gemini doseže milijardu korisnika. Anthropic cilja $2 bilijuna na IPO-u u listopadu. Bijela kuća saziva AI kompanije o sigurnosti. Palantir Q2 prihod raste 93%.
Drugi tjedan kolovoza 2026. potvrdio je da je AI industrija ušla u fazu u kojoj brzina i opseg — ne samo sposobnost — definiraju konkurentsku poziciju. OpenAI je 13. kolovoza predstavio GPT-5.6 Sol Ultrafast, pokrenuvši frontier model na 750 izlaznih tokena u sekundi (14× brže od standardne brzine) koristeći Cerebras hardver. Dan ranije, CEO Googlea Sundar Pichai objavio je da je Gemini prešao milijardu mjesečnih korisnika — najbrži rast u povijesti kompanije. Istovremeno je objavljen Gemini 3.7 Flash. U financijskom smislu, Anthropic potvrđuje da cilja IPO valuaciju od $2 bilijuna u listopadu, potpomognut prihodima koji su prešli $30 milijardi run-rate. A u Washingtonu, Trumpova administracija pozvala je OpenAI, Anthropic i Google na prve formalne razgovore o AI sigurnosti ove godine.
Sažetak: OpenAI predstavlja GPT-5.6 Sol Ultrafast (750 tokena/s, 14× brži, Cerebras hardver, ograničen pristup od 13. kolovoza). Gemini prešao milijardu mjesečnih korisnika; ChatGPT na milijardi tjednih. Google objavljuje Gemini 3.7 Flash. Anthropic cilja IPO od $2T u listopadu; prihodi projektiraju $100-120B do kraja godine. Bijela kuća saziva AI kompanije za dobrovoljni okvir sigurnosnog testiranja. Palantir Q2 prihod $1,94B (+93% godišnje). Meta objavljuje Muse Glimmer (30B, Apache 2.0, multimodalni). Anthropic imenuje prvog Chief Global Affairs Officera.
OpenAI je 13. kolovoza otvorio ograničeni pristup GPT-5.6 Sol Ultrafast — novom načinu zaključivanja koji pokreće GPT-5.6 Sol model na do 750 izlaznih tokena u sekundi. Ključna razlika od prethodnih brzih izdanja: Ultrafast ne prebacuje na manji ili manje sposoban model. Isporučuje puni frontier model brže, pokrenut Cerebras hardverom — wafer-scale silikonom koji Cerebras Systems razvija specifično za visoko-propusno zaključivanje.
Praktična implikacija je značajna. Zadaci koji su prethodno zahtijevali odabir između brzine (manji, brži model) i inteligencije (frontier model s većom latencijom) sada mogu raditi na frontier razini s gotovo realnim vremenom odziva. Ciljane primjene uključuju odgovor na incidente, korisničku podršku, analizu financijskih tržišta i e-trgovinu — sve tokove rada gdje latencija odziva izravno utječe na kvalitetu suradnje čovjeka i AI-a.
Najava Ultrafasta ima izravnu posljedicu za arhitekte poslovnih AI sustava: latencija više nije prihvatljiv razlog za smanjenje kvalitete modela. Timovi koji su odabrali GPT-4o-mini ili GPT-5.5 Flash za interaktivne aplikacije isključivo zbog toga što su frontier modeli bili prespori, sada imaju put do frontier kvalitete bez kazne za brzinu. Model ograničenog pristupa signalizira da OpenAI pažljivo upravlja kapacitetima — organizacije s latencijsko-osjetljivim tokovima rada trebale bi se odmah registrirati za pristup.
Cerebras kao infrastruktura: OpenAI-ev odabir Cerebras hardvera za Ultrafast — umjesto Nvidia GPU-a — je značajan. Cerebras wafer-scale silikon optimiziran je za memorijsku propusnost, koja je primarno usko grlo za propusnost zaključivanja velikih modela. Ovo sugerira da trenutna generacija Nvidia-centrične inference infrastrukture ima stvarne limite na brzinu generiranja tokena koje alternativni silikon može značajno premašiti.
CEO Googlea Sundar Pichai objavio je 11. kolovoza da je Gemini app prešao milijardu mjesečnih aktivnih korisnika, postajući najbrže rastuć Googleov proizvod u povijesti. Milestone stavlja Gemini na otprilike istu razinu kao ChatGPT — koji je prešao milijardu tjednih korisnika u srpnju — signalizirajući da se tržište AI asistenata konsolidiralo oko dvije dominantne platforme s istinski masovnim dosegom.
Uz korisnički milestone, Google je objavio Gemini 3.7 Flash — model visoke propusnosti dizajniran za agentne radne tokove. Flash prioritizira propusnost i nisku latenciju za API-je usmjerene na programere, izravno se natječući s OpenAI-evim GPT-5.6 Sol Ultrafast u segmentu visokobrze inferencije. Istovremeno objavljivanje modela brzog sloja od OpenAI-a i Googlea u istom tjednu nije slučajno — obje kompanije konvergiraju prema zaključku da je usvajanje agentnog AI-a u poduzećima ograničeno jednako brzinom inferencije kao i inteligencijom modela.
Za poslovne donositelje odluka: Tržište AI asistenata podijelilo se na dvije masovne platforme (Gemini i ChatGPT) s više od milijardu korisnika svaka, i razvojni/poslovni API sloj gdje isti modeli konkuriraju na cijeni, brzini i specijalizaciji. Odabir poslovne AI platforme sada zahtijeva jasnu procjenu u kojem sloju živi vaš slučaj upotrebe — i je li sigurnost podataka na razini korisničke potrošnje prihvatljiva za vaše tokove rada.
Anthropicovi investitori ciljaju valuaciju od $2 bilijuna ili više za planirani IPO u listopadu — iznos koji bi Anthropic svrstao među najvrednije tehnološke kompanije koje su ikad izašle na burzu. Cilj je usidren u trajektoriji prihoda koja je ubrzala iznad gotovo svih prognoza: od run-rate od $9 milijardi krajem 2025. do otprilike $30 milijardi u travnju 2026., s analitičarima koji projiciraju $100-120 milijardi u godišnjim prihodima do kraja 2026.
Rast prihoda pogonjen je trima komponirajućim silama: usvajanjem poslovnih API-ja (ubrzanim pokretanjem Claude Opus 5 i JV-om Ode With Anthropic), pretplatama na Max plan za potrošače, i partnerskim ekosustavom koji je dramatično proširio Anthropicov komercijalni doseg bez proporcionalnog rasta broja zaposlenika. Značajno, Anthropic je navodno prešao OpenAI u prihodima na run-rate osnovi.
Pred IPO, Anthropic je imenovao Tina Cuéllara — bivšeg suca Vrhovnog suda Kalifornije i predsjednika Carnegie Endowment for International Peace — prvim Chief Global Affairs Officerom. Zapošljavanje signalizira Anthropicovu namjeru da se proaktivno angažira s vladama i regulatorima na najvišim razinama dok njegova tehnologija postaje ekonomski kritična infrastruktura u više jurisdikcija.
Trumpova administracija ovog je mjeseca pozvala predstavnike OpenAI-a, Anthropica i Googlea u Bijelu kuću kako bi razgovarali o novom SAD-ovom okviru za dobrovoljno testiranje AI sigurnosti. Okvir proizlazi iz lipanjske izvršne naredbe o AI kibernetičkoj sigurnosti i opisuje pristup opt-in sigurnosnim pregledima frontier modela — pristup koji se strukturalno razlikuje od obveznih zahtjeva za otkrivanjem koji se razmatraju u provedbi EU AI akta.
OpenAI je ovog tjedna proširio program Daybreak za kibernetičku sigurnost, uvodeći GPT-5.6-Cyber — specijalizirani model za ovlašteni sigurnosni rad — zajedno s Daybreak Blue (za obranu) i Daybreak Red (za ofenzivno sigurnosno istraživanje u kontroliranim uvjetima). Inicijativa odobrenim sigurnosnim profesionalcima daje pristup frontier modelima za istraživanje ranjivosti, pregled koda, odgovor na incidente i sigurnosno testiranje.
Palantir Technologies objavio je Q2 2026. prihod od $1,94 milijardi, rast 93% godišnje — razbijajući analitičarska očekivanja i pružajući najkonkretnije javno dostupne dokaze da je usvajanje poslovnog AI-a prešlo s pilota na produkciju u velikom razmjeru. Američki komercijalni prihod porastao je 149% godišnje. Prilagođeni EPS bio je $0,41 nasuprot očekivanog $0,34, a Palantir je podigao godišnju prognozu za 2026. na $8,15 milijardi.
Palantirovi rezultati su koristan vodeći pokazatelj za šire tržište poslovnog AI-a jer su gotovo u cijelosti derivirani iz implementacije AI-a u produkciji — ne od prodaje SaaS-a ili savjetodavnih usluga. Ubrzanje u američkim komercijalnim prihodima (+149%) posebno je značajno, sugerirajući da su najveća američka poduzeća odlučno prešla fazu evaluacije.
Što Palantirovi brojevi znače za ostatak tržišta: Ako Palantir — koji radi primarno s analitički najsofisticiranijim organizacijama u obrani, obavještajnim službama, zdravstvenoj skrbi i financijskim uslugama — raste 93% na produkcijskom AI-u, implikacija je da je AI implementacija u mainstream poduzećima (koja obično zaostaju za ovim sektorima 12-18 mjeseci) tek u ranoj fazi. Krivulja usvajanja za većinu poduzeća ne usporava; sprema se strmo porasti.
750 izlaznih tokena/s (14× standardna brzina) koristeći Cerebras čipove. Frontier-kvalitetni model s gotovo realnim vremenom odziva. Ograničeni pristup, samo za pozvane. Ista cijena kao standardni Sol.
Model visoke propusnosti za agentne radne tokove. Dizajniran za brzinski osjetljive razvojne i poslovne API-je. Nadopunjuje Gemini 3.7 Pro. Dostupan putem Vertex AI i AI Studio.
30B parametarski gust multimodalni model, Apache 2.0. Podešen za lokalno agentno korištenje alata, kodiranje i LLM-as-judge zadatke. 131K kontekst, podržava 100+ jezika. Izvrsna opcija za lokalnu implementaciju.
Model optimiziran za brzinu iz ByteDanceove Seed obitelji. Ciljanje razvojnih i poslovnih API tržišta s konkurentnim cijenama. Jaka izvedba na kineskim i višejezičnim benchmarkovima.
Metaov Muse Glimmer zaslužuje posebnu pozornost među open-weights izdanjima ovog tjedna. S 30 milijardi parametara pod Apache 2.0 licencom, u potpunosti je implementabilan lokalno — uključujući na serverima potrošačke razine s dovoljno RAM-a — i specifično je podešen za lokalno agentno korištenje alata i LLM-as-judge zadatke. Za organizacije koje ne mogu slati podatke na cloud inference API-je zbog zahtjeva za suverenošću podataka ili usklađenosti, Muse Glimmer predstavlja jednu od najjačih open-weights opcija za lokalnu agentnu implementaciju dostupnih danas.
Anthropic je potvrdio prošireno strateško partnerstvo s Googleom i Broadcomom za višestruke gigavate sljedeće generacije compute kapaciteta. Partnerstvo je strukturirano za osiguranje dugoročne inference infrastrukture ispred anticipiranog rasta potražnje kako ubrzava usvajanje Claude Opus 5. Za poslovne klijente, ovo signalizira da je Anthropic osigurao fizičke compute resurse za podršku API skaliranja koje $2T kompanija treba.
OpenAI je 13. kolovoza imenovao Dalija Rajica za Chief Revenue Officera — signal da kompanija gradi poslovnu GTM infrastrukturu potrebnu za natjecanje s Anthropicovim ubrzanim rastom prihoda. CRO uloga u OpenAI-u je novokreirana na razini C-suite, odražavajući pomak od usvajanja kojeg vode programeri prema usvajanju kojeg vode poduzeća — gdje nabava, pravni odjeli i usklađenost zahtijevaju dediciranu prodajnu infrastrukturu.
xAI-ev Grok Voice Think Fast 2.0 automatski je migriran 5. kolovoza, prelazeći s $0,05/min na $0,08/min. Model poboljšava latenciju i konverzacijsku tečnost za voice-first aplikacije — segment u kojem xAI pozicionira Grok kao differentiator u odnosu na tekst-primarne ChatGPT i Claude.
Hrvatska AI startup scena nastavlja privlačiti međunarodnu pažnju, a zagrebačke kompanije sve češće pronalaze product-market fit u nišnim poslovnim AI aplikacijama koje veći platformski dobavljači još nisu komodificirali. Mindsmiths ostaje jedna od najaktivnijih hrvatskih AI kompanija u poslovnom prostoru, razvijajući alate za AI dizajn interakcija i decision intelligence — područja koja doživljavaju snažnu potražnju od klijenata u financijskim uslugama i telekomunikacijama.
Šira slika investicija ostaje solidna: $125 milijuna prikupljeno u šest equity rundova financiranja do svibnja 2026. Ono što se materijalno promijenilo u posljednjih 60 dana jest priroda dolaznih upita: hrvatske kompanije koje su prethodno primale interes primarno od regionalnih investitora, sada imaju razgovore s pan-europskim i američkim investitorima koji aktivno grade portfelje Srednje-europskog AI-a.
EU AI akt sve više funkcionira kao mehanizam za stvaranje tržišta za hrvatska mala i srednja poduzeća. Kompanije koje su izgradile alate za usklađenost, sposobnosti procjene sukladnosti ili revizijske tokove rada na vrhu Claudea ili sličnih frontier modela pronalaze da potražnja od austrijskih, njemačkih i slovenskih poduzeća — koja se suočavaju s zahtjevima Akta i preferiraju rad s obližnjim partnerima koji razumiju regulatorni kontekst — premašuje njihove kapacitete isporuke.
Za hrvatska poduzeća koja razmatraju AI investiciju: Konvergencija Geminija na milijardu korisnika, ChatGPT-a na milijardu tjednih korisnika i Ultrafast inferencije stavlja AI alate potrošačke razine na razinu sposobnosti koji većina internih poslovnih alata ne može dostići. Praktično pitanje više nije treba li usvojiti AI, već kako to učiniti na način koji je usklađen sa zahtjevima EU AI akta, čuva suverenitet podataka i generira branjivu konkurentsku prednost.
Naš tim pomaže hrvatskim i europskim poduzećima u evaluaciji, implementaciji i upravljanju frontier AI-em — od odabira modela i arhitekture brzog sloja do EU AI akta i DMA usklađenosti. Certificirani Claude partner, bez vendor lock-ina.
Razgovarajmo