OpenAI betreibt GPT-5.6 Sol mit 750 Token/Sekunde auf Cerebras-Chips. Google Gemini erreicht 1 Milliarde monatliche Nutzer. Anthropic zielt auf $2 Billionen beim Oktober-IPO. Das Weiße Haus versammelt KI-Labore. Palantir Q2-Umsatz +93%.
Die zweite Augustwoche 2026 bestätigte, dass die KI-Branche in eine Phase eingetreten ist, in der Geschwindigkeit und Skalierung — nicht nur Fähigkeit — die Wettbewerbsposition definieren. OpenAI stellte am 13. August GPT-5.6 Sol Ultrafast vor und betrieb das Frontier-Modell mit 750 Ausgabe-Token pro Sekunde (14× schneller als der Standard) auf Cerebras-Hardware. Einen Tag zuvor hatte Googles CEO Sundar Pichai angekündigt, dass Gemini 1 Milliarde monatliche Nutzer überschritten hat — das schnellste Produktwachstum in der Unternehmensgeschichte — und gleichzeitig Gemini 3.7 Flash veröffentlicht. Anthropic bestätigte, beim geplanten Oktober-IPO eine Bewertung von $2 Billionen anzupeilen, gestützt durch einen Run-rate-Umsatz von über $30 Milliarden. Und in Washington versammelte die Trump-Regierung OpenAI, Anthropic und Google zu den ersten formellen KI-Sicherheitsgesprächen des Weißen Hauses im laufenden Jahr.
Kurzüberblick: OpenAI stellt GPT-5.6 Sol Ultrafast vor (750 Token/s, 14× schneller, Cerebras-betrieben, eingeschränkter Zugang ab 13. Aug.). Gemini überschreitet 1 Milliarde monatliche Nutzer; ChatGPT bei 1 Milliarde wöchentlich. Google veröffentlicht Gemini 3.7 Flash. Anthropic peilt $2B IPO-Bewertung im Oktober an; Umsätze projiziert bei $100-120B bis Jahresende. Weißes Haus versammelt KI-Labore für freiwilligen Sicherheitstestrahmen. Palantir Q2 Umsatz $1,94B (+93% YoY). Meta veröffentlicht Muse Glimmer (30B, Apache 2.0, multimodal). Anthropic ernennt ersten Chief Global Affairs Officer.
Am 13. August öffnete OpenAI den eingeschränkten Zugang zu GPT-5.6 Sol Ultrafast — einem neuen Inferenzmodus, der das GPT-5.6 Sol Modell mit bis zu 750 Ausgabe-Token pro Sekunde betreibt. Der entscheidende Unterschied zu früheren geschwindigkeitsorientierten Releases: Ultrafast wechselt nicht zu einem kleineren oder weniger leistungsfähigen Modell. Es liefert das vollständige Frontier-Modell schneller, angetrieben von Cerebras-Hardware — Wafer-Scale-Silizium, das Cerebras Systems speziell für Hochdurchsatz-Inferenz entwickelt hat.
Die praktische Implikation ist erheblich. Aufgaben, die früher eine Wahl zwischen Geschwindigkeit (kleineres, schnelleres Modell) und Intelligenz (Frontier-Modell mit höherer Latenz) erforderten, können nun mit Frontier-Qualität nahezu in Echtzeit ausgeführt werden. Zu den Zielanwendungen gehören Incident Response, Kundensupport, Finanzmarktanalyse und E-Commerce — alles Workflows, bei denen die Antwortlatenz die Qualität der Mensch-KI-Zusammenarbeit direkt beeinflusst.
Die Ultrafast-Ankündigung hat eine direkte Konsequenz für KI-Architekten in Unternehmen: Latenz ist kein akzeptabler Grund mehr, die Modellqualität zu reduzieren. Teams, die GPT-4o-mini oder GPT-5.5 Flash für interaktive Anwendungen gewählt haben — ausschließlich weil Frontier-Modelle zu langsam waren — haben jetzt einen Weg zu Frontier-Qualität ohne Geschwindigkeitseinbußen. Das Modell mit eingeschränktem Zugang signalisiert, dass OpenAI die Kapazitäten sorgfältig verwaltet — Organisationen mit latenzempfindlichen Workflows sollten sich sofort für den Zugang registrieren.
Cerebras als Infrastruktur: OpenAIs Entscheidung, Cerebras-Hardware für Ultrafast zu verwenden — anstatt Nvidia-GPUs — ist bemerkenswert. Cerebras-Wafer-Scale-Silizium ist für Speicherbandbreite optimiert, das primäre Engpass für den Durchsatz bei der Inferenz großer Modelle. Dies deutet darauf hin, dass die aktuelle Generation der Nvidia-zentrischen Inferenzinfrastruktur echte Obergrenzen bei der Token-Generierungsgeschwindigkeit hat, die alternative Siliziumlösungen deutlich übertreffen können.
Googles CEO Sundar Pichai gab am 11. August bekannt, dass die Gemini-App 1 Milliarde monatliche Nutzer überschritten hat — das schnellste Produktwachstum in der Unternehmensgeschichte. Dieser Meilenstein stellt Gemini auf ungefähr das gleiche Niveau wie ChatGPT — das im Mai 2026 eine Milliarde monatliche App-Nutzer und im Juli eine Milliarde wöchentliche Nutzer überschritt. Der KI-Assistentenmarkt hat sich um zwei dominante Plattformen mit echtem Massenmarktpublikum konsolidiert.
Neben dem Nutzer-Meilenstein veröffentlichte Google Gemini 3.7 Flash — ein Hochdurchsatz-Inferenzmodell für agentische Workloads, das direkt mit OpenAIs GPT-5.6 Sol Ultrafast im Hochgeschwindigkeits-Inferenzsegment konkurriert. Die gleichzeitige Veröffentlichung eines Hochgeschwindigkeits-Modells von OpenAI und Google in derselben Woche ist kein Zufall — beide Unternehmen konvergieren zur Erkenntnis, dass die Unternehmensadoption agentischer KI genauso durch Inferenzgeschwindigkeit wie durch Modellintelligenz begrenzt wird.
Anthropics Investoren peilen eine Bewertung von $2 Billionen oder mehr für den geplanten Oktober-IPO an — ein Wert, der Anthropic zu einem der wertvollsten Technologieunternehmen machen würde, die jemals an die Börse gegangen sind. Das Ziel ist durch eine Umsatztrajektorie verankert, die fast alle Prognosen übertroffen hat: von einer Run-rate von $9 Milliarden Ende 2025 auf rund $30 Milliarden im April 2026, mit Analysten, die $100-120 Milliarden annualisierten Umsatz bis Ende 2026 projizieren. Anthropic hat OpenAI nach Berichten auf Run-rate-Basis beim Umsatz überholt — eine Umkehr der Wettbewerbsposition seit dem Start von ChatGPT bis 2025.
Vor dem IPO ernannte Anthropic Tino Cuéllar — ehemaliger Richter am Obersten Gerichtshof Kaliforniens und Präsident der Carnegie Endowment for International Peace — zum ersten Chief Global Affairs Officer. Die Einstellung signalisiert Anthropics Absicht, proaktiv mit Regierungen und Regulierern auf höchster Ebene in Kontakt zu treten, während seine Technologie zur wirtschaftlich kritischen Infrastruktur in mehreren Jurisdiktionen wird.
Die Trump-Regierung lud Vertreter von OpenAI, Anthropic und Google ins Weiße Haus ein, um einen neuen US-Rahmen für freiwillige KI-Sicherheitstests zu diskutieren. Der Rahmen, der aus einer Executive Order vom Juni zur KI-Cybersicherheit stammt, beschreibt einen Opt-in-Ansatz für Sicherheitsüberprüfungen von Frontier-Modellen — ein Ansatz, der sich strukturell von den obligatorischen Offenlegungsanforderungen unterscheidet, die im Rahmen der EU-KI-Gesetz-Implementierung diskutiert werden.
OpenAI erweiterte diese Woche sein Daybreak-Cybersicherheitsprogramm und führte GPT-5.6-Cyber ein — ein spezialisiertes Modell für autorisierte Sicherheitsarbeit — zusammen mit Daybreak Blue (für Verteidiger) und Daybreak Red (für offensives Sicherheitsforschung unter kontrollierten Bedingungen). Die Initiative gibt zugelassenen Sicherheitsprofis Zugang zu Frontier-Modellen für Schwachstellenforschung, Code-Review, Incident Response und Sicherheitstests.
Palantir Technologies meldete Q2 2026-Umsatz von $1,94 Milliarden, +93% gegenüber dem Vorjahr — übertraf die Analystenschätzungen bei weitem und lieferte den konkretesten öffentlich verfügbaren Beweis dafür, dass die Unternehmens-KI-Adoption von Pilotprojekten zur Produktion in großem Maßstab übergegangen ist. Der US-Geschäftsumsatz wuchs um 149% im Jahresvergleich. Der bereinigte EPS betrug $0,41 gegenüber dem erwarteten $0,34, und Palantir hob die Gesamtjahresprognose 2026 auf $8,15 Milliarden an.
Palantirs Ergebnisse sind ein nützlicher Frühindikator für den breiteren Unternehmens-KI-Markt, da die Umsätze des Unternehmens fast ausschließlich aus dem Einsatz von KI in der Produktion stammen — nicht aus dem Verkauf von SaaS oder Beratungsleistungen. Die Beschleunigung beim US-Geschäftsumsatz (+149%) ist besonders bedeutsam und deutet darauf hin, dass die größten US-Unternehmen entschlossen die Evaluierungsphase hinter sich gelassen haben.
750 Ausgabe-Token/s (14× Standardgeschwindigkeit) mit Cerebras-Chips. Frontier-Qualitätsmodell mit nahezu Echtzeit-Inferenz. Eingeschränkter Zugang, nur auf Einladung. Gleiche Preise wie Standard-Sol.
Hochdurchsatz-Inferenzmodell für agentische Workloads. Für geschwindigkeitsempfindliche Entwickler- und Unternehmens-APIs konzipiert. Ergänzt Gemini 3.7 Pro. Verfügbar über Vertex AI und AI Studio.
30B-Parameter-Multimodal-Modell, Apache 2.0. Optimiert für lokales agentisches Tool-Nutzung, Coding und LLM-as-Judge-Aufgaben. 131K Kontext, 100+ Sprachen. Starke On-Premise-Deployment-Option.
Geschwindigkeitsoptimiertes Modell aus ByteDances Seed-Familie. Zielt auf Entwickler- und Unternehmens-API-Märkte mit wettbewerbsfähigen Preisen. Starke Leistung bei chinesischsprachigen und mehrsprachigen Benchmarks.
Metas Muse Glimmer verdient unter den Open-Weights-Releases dieser Woche besondere Aufmerksamkeit. Mit 30 Milliarden Parametern unter Apache-2.0-Lizenzierung ist es vollständig lokal einsetzbar — und speziell für lokale agentische Tool-Nutzung und LLM-as-Judge-Aufgaben abgestimmt. Für Organisationen, die Daten aufgrund von Datensouveränitäts- oder Compliance-Anforderungen nicht an Cloud-Inferenz-APIs senden können, stellt Muse Glimmer eine der stärksten Open-Weights-Optionen für lokale agentische Deployments dar. Der 131K-Kontext und die Unterstützung von 100+ Sprachen machen es für europäische mehrsprachige Unternehmensanwendungen geeignet.
Anthropic bestätigte eine erweiterte strategische Partnerschaft mit Google und Broadcom für mehrere Gigawatt an Rechenkapazität der nächsten Generation. Die Partnerschaft ist darauf ausgelegt, langfristige Inferenzinfrastruktur angesichts des erwarteten Nachfragewachstums bei der Beschleunigung der Claude Opus 5 Adoption zu sichern. Für Unternehmenskunden signalisiert dies, dass Anthropic die physischen Compute-Ressourcen gesichert hat, um die API-Skalierung zu unterstützen, die ein $2B-Unternehmen benötigt.
OpenAI ernannte Dali Rajic am 13. August zum Chief Revenue Officer — ein Signal, dass das Unternehmen die Unternehmens-GTM-Infrastruktur aufbaut, die erforderlich ist, um mit Anthropics beschleunigtem Umsatzwachstum zu konkurrieren. Die CRO-Rolle bei OpenAI ist neu auf C-Suite-Ebene geschaffen und spiegelt die Verschiebung von entwicklergesteuerter Adoption zu unternehmensgesteuerter Adoption wider — wo Beschaffung, Recht und Compliance dedizierte Umsatzinfrastruktur erfordern.
xAIs Grok Voice Think Fast 2.0 wurde automatisch am 5. August migriert, mit einem Wechsel von $0,05/min auf $0,08/min. Das Modell verbessert Latenz und Konversationsfluenz für Voice-First-Anwendungen — ein Segment, in dem xAI Grok als Differenziator gegenüber dem textprimären ChatGPT und Claude positioniert.
Kroatiens KI-Startup-Ökosystem zieht weiterhin internationale Aufmerksamkeit auf sich. Mindsmiths aus Zagreb bleibt eines der aktivsten kroatischen KI-Unternehmen im Unternehmensbereich und entwickelt Tools für KI-Interaktionsdesign und Decision Intelligence — Bereiche mit starker Nachfrage von Kunden aus Finanzdienstleistungen und Telekommunikation in der gesamten Adria-Region. Bonsai.tech baut seine Position in Automatisierung und Robotic Process Automation aus und positioniert sich für die steigende Nachfrage nach agentengestützten Workflows in mittelständischen Unternehmen.
Das breitere Investitionsbild bleibt solide: $125 Millionen wurden in sechs Eigenkapital-Finanzierungsrunden bis Mai 2026 in Kroatien aufgebracht. Was sich in den letzten 60 Tagen materiell verändert hat, ist die Art der eingehenden Anfragen: Kroatische Unternehmen, die zuvor hauptsächlich Interesse von regionalen Investoren erhalten haben, führen jetzt Gespräche mit pan-europäischen und US-amerikanischen Investoren, die aktiv mitteleuropäische KI-Portfolios aufbauen.
Das EU-KI-Gesetz fungiert zunehmend als Marktschaffungsmechanismus für kroatische KMU. Unternehmen, die Compliance-Tooling, Konformitätsbewertungsfähigkeiten oder Audit-Workflows auf Claude oder ähnlichen Frontier-Modellen aufgebaut haben, stellen fest, dass die Nachfrage von österreichischen, deutschen und slowenischen Unternehmen — die mit den Anforderungen des Gesetzes konfrontiert sind und es vorziehen, mit nahegelegenen Partnern zu arbeiten — ihre Lieferkapazitäten übersteigt. Für kroatische Gründer im KI-benachbarten Bereich ist EU-KI-Gesetz-Compliance-Beratung und -Tooling eine der klarsten kurzfristigen Umsatzchancen auf dem Markt.
Für kroatische und österreichische Unternehmen, die KI-Investitionen erwägen: Die Konvergenz von Gemini auf 1 Milliarde Nutzer, ChatGPT auf 1 Milliarde wöchentliche Nutzer und Ultrafast-Inferenz bringt KI-Tools auf Verbraucherniveau auf ein Fähigkeitsniveau, das die meisten internen Unternehmens-Tools nicht erreichen können. Die praktische Frage ist nicht mehr ob KI adoptiert werden soll, sondern wie man es auf eine Art und Weise tut, die EU-KI-Gesetz-konform ist, Datensouveränität bewahrt und einen vertretbaren Wettbewerbsvorteil schafft.
Unser Team hilft kroatischen und europäischen Unternehmen bei der Evaluierung, Implementierung und Verwaltung von Frontier-KI — von der Modellauswahl und Hochgeschwindigkeits-Tier-Architektur bis hin zu EU-KI-Gesetz- und DMA-Compliance. Zertifizierter Claude-Partner, kein Vendor Lock-in.
Kontakt aufnehmen