Wöchentlicher KI-Digest

Claude Opus 5.5, GPT-6 und Grok 4.7 kamen diese Woche — und das war erst der Anfang

Drei Frontier-Modelle, eine Agents-API für alle, eine 20-Milliarden-Dollar-Fusion in Europa und das EU-KI-Gesetz, das endlich Zähne zeigt. Willkommen zur dichtesten KI-Woche des Jahres 2026.

25. September 2026  ·  Boris Agatić  ·  AI Workshop Zagreb

Der 22. September 2026 wird als der Tag in die Geschichte eingehen, an dem das Frontier-Modellrennen jeden Anschein eines geordneten Zeitplans verlor. Innerhalb von 48 Stunden veröffentlichte Anthropic Claude Opus 5.5 mit nahezu übermenschlichen Software-Engineering-Ergebnissen, OpenAI startete zwei Varianten von GPT-6, und xAI erweiterte den Zugang zu Grok 4.7, das am 21. September debütierte. Unterdessen zeigte Xiaomis MiMo-V2.6-Pro still und leise, dass ein Modell mit einer Billion Parametern für rund 3 Millionen Dollar trainiert werden kann. Neben den Modellveröffentlichungen war die Geschäftsgeschichte der Woche die Cohere–Aleph-Alpha-Fusion, die einen europäischen KI-Champion mit einem Wert von 20 Milliarden Dollar schafft — und das EU-KI-Gesetz, das formelle Auskunftsersuchen an mehr als 30 Unternehmen zustellt.

Die Modellkaskade: drei Flaggschiffe in 48 Stunden

Die Veröffentlichungen folgten in rascher Folge, und jede verdient individuelle Aufmerksamkeit, bevor das Gesamtbild bewertet werden kann.

Claude Opus 5.5
Anthropic · 22. September

89,9 % auf SWE-bench Pro, 66,4 % auf Terminal-Bench. Anthropics neues Flaggschiff für agentische Workflows und Coding. Preis: 4 $/20 $ pro Million Token. Ausdrücklich für langfristige Software-Engineering-Aufgaben konzipiert.

GPT-6 Sol
OpenAI · 22. September

Reasoning-Flaggschiff mit 1,05 Millionen Token Kontextfenster. Preis: 2 $/10 $ pro Million Token. Positioniert gegen Claude Opus 5.5 für Enterprise Reasoning und agentische Aufgaben.

GPT-6 Luna
OpenAI · 22. September

Ultra-günstige Ergänzung zu Sol für 0,10 $/0,50 $ pro Million Token, gleiches Kontextfenster von 1,05 M. Zielt auf hochvolumige, kostenempfindliche Enterprise-Workloads ab.

Grok 4.7
xAI · 21. September

2,1 Billionen Parameter, 71,0 % auf DeepSWE-Benchmark. Preis: 2 $/6 $ pro Million Token. xAIs bisher stärkstes Software-Engineering-Modell, konkurrenzfähig mit Opus 5.5 bei bestimmten Coding-Metriken.

MiMo-V2.6-Pro
Xiaomi · Open-Weight

1 Billion Parameter Mixture-of-Experts, trainiert für ca. 3 Mio. $. Bestes chinesisches Open-Weight-Modell auf aktuellen Benchmarks. Signalisiert, dass das Training von Frontier-Klasse-Open-Modellen auf Commodity-Trainingskosten zugeht.

Preissignal für Enterprise-Einkäufer: GPT-6 Luna für 0,10 $/0,50 $ pro Million Token stellt eine Kostensenkung von 95 % im Vergleich zu GPT-6 Sol dar — innerhalb derselben Modellfamilie, gleiches Kontextfenster. Für deutsche und österreichische Unternehmen, die derzeit GPT-4o- oder Claude-Sonnet-Preisstufen nutzen, verdient der Luna-Preispunkt einen Evaluierungszyklus vor Q4-Infrastrukturentscheidungen.

Claude Opus 5.5 im Detail: Was 89,9 % auf SWE-bench Pro bedeutet

SWE-bench Pro ist der aktuelle Goldstandard-Benchmark für agentisches Software-Engineering — er testet, ob ein Modell echte GitHub-Issues in Produktionskodbasen autonom beheben kann, nicht nur Codeausschnitte in kontrollierten Bedingungen schreiben. Mit 89,9 % kann Claude Opus 5.5 nahezu neun von zehn Problemen autonom lösen, an denen erfahrene Softwareingenieure typischerweise stundenlang arbeiten würden.

Der Terminal-Bench-Wert von 66,4 % misst die Leistung bei offenen Terminalaufgaben — der Art von Kommandozeilen- und Systemadministrationsarbeit, die agentische KI in DevOps- oder Infrastrukturautomatisierungskontexten ausführen muss. Für Enterprise-Softwareteams übersetzt sich Opus 5.5 in eine konkrete Deployment-Frage: Welche Kategorien von Engineering-Arbeit sind jetzt mit akzeptablem Risiko automatisierbar, und welche erfordern noch menschliche Aufsicht?

Agentische KI

OpenAI Agents API erreicht allgemeine Verfügbarkeit für alle Entwickler

Die OpenAI Agents API — die programmatischen Zugriff auf Agentenorchestrierung, Speicherverwaltung, Werkzeugnutzung und Multi-Agenten-Koordination bietet — erreichte diese Woche die allgemeine Verfügbarkeit. Die GA-Version fällt mit dem Start von GPT-6 zusammen, was bedeutet, dass Entwickler ab dem ersten Tag Produktionsagenten auf GPT-6 Sol und Luna aufbauen können. Für Enterprise-Einkäufer reduziert Agents API GA die Beschaffungsreibung für agentische Workloads: Die Infrastruktur ist jetzt stabil, dokumentiert und durch OpenAIs Standard-SLAs abgedeckt.

Sicherheit

OWASP: 88 % der Organisationen, die Agenten einsetzen, hatten Sicherheitsvorfälle

OWASP veröffentlichte diese Woche einen Bericht, der dokumentiert, dass 88 % der Organisationen, die Produktions-KI-Agenten eingesetzt haben, bereits mindestens einen dem Verhalten des Agenten zuzuschreibenden Sicherheitsvorfall erlebt haben. Die Vorfälle reichen von Prompt-Injection-Angriffen bis zu unbeabsichtetem Datenabfluss, nicht autorisierten API-Aufrufen und Credential-Lecks durch agentische Werkzeugnutzung. Für Unternehmen, die agentische KI-Deployment auf Opus 5.5, GPT-6 oder Grok 4.7 bewerten, stellt der OWASP-Befund fest, dass Agentensicherheit kein theoretisches Anliegen ist — es ist eine Produktionsrealität.

Europas souveräner KI-Moment: Die Cohere–Aleph-Alpha-Fusion

Die bedeutendste europäische KI-Geschäftsnachricht des Septembers 2026 war die Ankündigung, dass Cohere — die kanadische Enterprise-KI-Plattform — und Aleph Alpha — Deutschlands bestkapitalisiertes souveränes KI-Unternehmen — zu einem kombinierten Unternehmen mit einem Wert von rund 20 Milliarden Dollar fusionieren. Der Beitrag von 600 Millionen Euro der Schwarz Gruppe (Betreiber von Lidl und Kaufland) ist die größte einzelne Privatinvestition in europäische KI bis heute.

Die strategische Logik ist nachvollziehbar. Aleph Alpha verfügt über regulatorische Glaubwürdigkeit, deutsche institutionelle Beziehungen und KI-Gesetz-Compliance-Positionierung, die Jahre zu aufzubauen kostete. Cohere hat Enterprise-API-Infrastruktur, mehrsprachige Modellfähigkeiten und nordamerikanische Enterprise-Traction. Keines kann allein mit OpenAI und Anthropic an der Frontier konkurrieren. Zusammen können sie das Segment europäischer Unternehmen anvisieren — insbesondere in regulierten Sektoren — das US-gehostete Frontier-Modelle aufgrund von Datensouveränitätsanforderungen nicht nutzen kann.

Für deutsche und österreichische Unternehmen, die europäische Alternativen zu US-Frontier-Modellen bewerten, ist das fusionierte Cohere-Aleph-Alpha-Unternehmen die seriöseste Option, die aus 2026 hervorgehen wird. Es wird Claude Opus 5.5 oder GPT-6 auf reinen Capability-Benchmarks wahrscheinlich nicht übertreffen — aber für Workloads, bei denen Datensouveränität, EU-Gerichtsbarkeit und DSGVO-Compliance primäre Anforderungen sind, wird es der Anbieter mit der tiefsten Compliance-Infrastruktur sein.

Finanzen

Nscale reicht S-1 mit Ziel-IPO-Bewertung von 14,6 Mrd. $ ein

Nscale, der britische KI-Infrastrukturanbieter, der große GPU-Cluster für KI-Training und -Inferenz betreibt, reichte diese Woche seinen S-1 mit einer angestrebten IPO-Bewertung von 14,6 Milliarden Dollar ein. Die Einreichung stellt das erste große KI-Infrastrukturunternehmen dar, das nach dem GPT-6-Marktumfeld eine Börsennotierung anstrebt. Nscales Kundenstamm umfasst mehrere europäische Frontier-Modellprojekte und Enterprise-KI-Deployments.

EU-KI-Gesetz: Die ersten formellen Ersuchen treffen ein

Die Durchsetzung des EU-KI-Gesetzes beschleunigte sich diese Woche materiell mit der Zustellung formeller Auskunftsersuchen an mehr als 30 Unternehmen. Die Ersuchen sind noch keine Durchsetzungsmaßnahmen — sie sind der Verfahrensschritt, der einer Durchsetzungsmaßnahme vorausgeht, und verlangen von den Empfängern, ihre KI-Systeme zu dokumentieren, ihre Risikoklassifizierungsmethodik zu beschreiben und die Einhaltung der geltenden Verpflichtungen nachzuweisen.

Die im ersten Ersuchwellenziel angesteuerten Sektoren sind genau die im ursprünglichen Text des Gesetzes als hochriskant identifizierten: KI-Systeme für Einstellung und Rekrutierung, Kreditbewertungs- und Kreditentscheidungssysteme sowie medizinische Triage-Anwendungen. Unternehmen, die KI-Systeme in einem dieser drei Sektoren betreiben — einschließlich HR-Tech-Firmen, Fintech-Plattformen und Health-Tech-Unternehmen in Deutschland, Österreich und der Schweiz — sollten die First-Wave-Ersuchen als direktes Signal für ihren eigenen Compliance-Zeitplan behandeln, auch wenn sie nicht unter den Empfängern waren.

Die Deadline des 2. Dezember für verbotene Praktiken ist das nächste harte Compliance-Ereignis. Verbotene Praktiken umfassen biometrische Kategorisierungssysteme, Social Scoring durch Behörden und Echtzeit-Fernbiometrie-Identifizierung in öffentlichen Räumen. Jedes Technologieunternehmen, das KI-Systeme betreibt oder verkauft, die diese Kategorien berühren, muss seine Compliance-Risikoexposition vor diesem Datum bewertet haben.

Für deutsche und österreichische Unternehmen, die KI-Produkte auf EU-Märkten verkaufen: Die formellen Auskunftsersuchen dieser Woche sind eine Vorschau auf skalierte Durchsetzung. Wenn Sie ein KI-Produkt in Einstellungs-, Kredit- oder Gesundheitsworkflows in Deutschland, Österreich oder den Niederlanden verkaufen, sollten Sie bereits ein Compliance-Dossier haben, kein Compliance-Projekt. Ein Enterprise-Kunde, der ein EU-KI-Gesetz-Auskunftsersuchen erhält, wird sofort seine KI-Lieferanten nach Compliance-Dokumentation fragen.

Open-Weight-Frontier: MiMo-V2.6-Pro verändert die Kostenrechnung

Xiaomis Veröffentlichung von MiMo-V2.6-Pro — einem Billion-Parameter-Mixture-of-Experts-Modell, das für rund 3 Millionen Dollar trainiert wurde — ist die bedeutendste Open-Weight-Modellentwicklung des Septembers 2026. Die Trainingskostenzahl von 3 Millionen Dollar ist bemerkenswert: Sie stellt eine 100-fache Kostensenkung im Vergleich zu ähnlich großen Modellen dar, die vor zwölf Monaten trainiert wurden.

MiMo-V2.6-Pro erzielt die besten Benchmark-Ergebnisse aller chinesischen Open-Weight-Modelle und liegt deutlich über dem vorherigen Open-Weight-Frontier (Meta Llama 4 Familie) bei Code-Generierungs- und Reasoning-Benchmarks. Seine Open-Weight-Veröffentlichung bedeutet, dass jede Organisation mit der Infrastruktur zum Betrieb eines Billion-Parameter-Modells es auf proprietären Daten fine-tunen kann, ohne Token-API-Kosten zu zahlen.

Die praktische Relevanz für deutsche und österreichische Unternehmen liegt hauptsächlich in Fine-Tuning- und On-Premise-Deployment-Szenarien. Ein deutsches Finanzinstitut, das aus regulatorischen Gründen keine US-gehosteten API-Modelle für Kreditbewertungsworkflows verwenden kann, verfügt jetzt über eine Open-Weight-Option, die — nach entsprechendem Fine-Tuning auf deutschen Finanzdokumenten — seine Anforderungen ohne grenzüberschreitende Datenübertragung erfüllen könnte.

Kroatien-Ecke: drei Startups, eine starke Finanzierungswoche

Kroatische KI-Startups hatten eine starke Finanzierungswoche, mit drei Unternehmen, die Runden abschlossen, die zusammen die Breite des lokalen Ökosystems demonstrieren.

Zagreb · Seed

Codeplain schließt 3-Mio.-$-Seed-Runde ab

Codeplain, das Zagreber KI-Coding-Assistent-Unternehmen, schloss diese Woche eine Seed-Runde von 3 Millionen Dollar ab. Codeplains Produkt zielt auf Softwareentwicklungsteams mit kontextbewusstem Code-Generierung ab, die sich direkt in Enterprise-Codebases integriert und teamspezifische Coding-Standards durchsetzt. Der Zeitpunkt der Finanzierung ist bemerkenswert — sie erfolgte in derselben Woche wie Opus 5.5 und GPT-6 — und wirft die Frage auf, wie spezialisierte Coding-Tool-Unternehmen gegenüber Frontier-Modellanbietern differenzieren, die agentische Coding-Fähigkeiten direkt in ihre Kernprodukte integrieren.

Zagreb · Series A

Hypefy sammelt 7,2 Mio. $ für KI-gestützten Social Commerce

Hypefy, das KI nutzt, um Marken mit Content-Creatoren zu verbinden und Social-Commerce-Kampagnen zu optimieren, schloss eine Series A über 7,2 Millionen Dollar ab. Hypefys Plattform nutzt multimodale KI zur Analyse von Creator-Inhalten, Vorhersage der Kampagnenperformance und Automatisierung des Matching- und Briefing-Prozesses für Influencer-Marketing-Kampagnen. Die Finanzierung positioniert Hypefy als eines der besser kapitalisierten kroatischen B2B-SaaS-Unternehmen des Jahres 2026.

Zagreb · Auszeichnung

Mediqcode gewinnt Infobip Shift 2026

Mediqcode, das KI auf medizinische Kodierung und klinische Dokumentationsworkflows anwendet, gewann den Infobip Shift 2026 Wettbewerb — eines der sichtbarsten Startup-Anerkennungsveranstaltungen in der CEE-Region. Mediqcodes Plattform automatisiert den ICD-10- und DRG-Kodierungsworkflow, den Krankenhaus-Abrechnungsteams derzeit manuell durchführen, wodurch die Kodierungszeit reduziert und die Rückerstattungsgenauigkeit verbessert wird. Der Shift-Sieg bietet erhebliche Sichtbarkeit für europäische Gesundheitssystemkäufer.

Die Woche in Zahlen

89,9 %
Claude Opus 5.5 auf SWE-bench Pro
20 Mrd. $
Cohere + Aleph Alpha kombinierter Wert
88 %
Organisationen mit Agenten-Sicherheitsvorfällen (OWASP)
3 Mio. $
Trainingskosten MiMo-V2.6-Pro (1 Bio. Param.)

Was in den kommenden Wochen zu beobachten ist

Drei Frontier-Modelle in einer Woche — welches sollte Ihr Unternehmen wirklich nutzen?

Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna und Grok 4.7 haben unterschiedliche Preise, Fähigkeiten und Compliance-Profile. Die Wahl des richtigen Modells für Ihre Workloads — und der Aufbau einer Architektur, die Sie nicht an einen einzigen Anbieter bindet — erfordert mehr als das Lesen von Benchmarks. Wir helfen deutschen, österreichischen und europäischen Unternehmen bei der Modellauswahl, agentenbasierten Deployments und EU-KI-Gesetz-Compliance. Zertifizierter Claude-Partner.

Sprechen Sie uns an