Liebe Leserinnen und Leser, erinnern Sie sich noch daran, als GenAI lediglich lustige Katzenbilder erstellte? Der Juli 2026 hat uns mitgeteilt, dass diese Zeiten längst vorbei sind. Wir befinden uns derzeit in einem Fiebertraum aus Vollduplex-Sprachkommunikation, autonomen Agenten, die die Wall Street unterwandern, und Technologiegiganten, die darum streiten, wem der “kognitive Kreislauf” gehört.”
Ganz gleich, ob Sie als CTO versuchen, Ihre Infrastruktur zu planen, oder sich einfach nur fragen, warum Ihr Smartphone plötzlich 70 Sprachen in Echtzeit übersetzt – wir erklären Ihnen ausführlich, warum das Zeitalter der “oberflächlichen Chatbots” gerade zu Ende gegangen ist.
Podcast „GenAI & Agentic News“
Wirtschaftsnachrichten und Markteinblicke



Neue Modelle und Innovationen

Gedanken von Victor Coimbra

Die meisten CTOs entwickeln im Jahr 2026 ihre KI-Strategie lediglich an der sichtbaren Oberfläche – indem sie Copilot-Lizenzen und Chatbot-Lizenzen erwerben –, während die eigentliche strategische Arbeit in den tieferen, weniger sichtbaren Schichten des Stacks stattfindet. Das Kernframework beschreibt ein KI-natives Unternehmen anhand von vier Schichten:
1) Antrag – dort, wo Mensch und KI aufeinandertreffen (Chatbots, Copiloten, Agenten). Einfach zu beschaffen und im Budget zu veranschlagen, jedoch schwer zur Differenzierung geeignet, da alle Wettbewerber bei denselben Anbietern einkaufen.
2) KI-Plattform – Was die KI weiß und leisten kann (Prompts, Kompetenzbibliotheken, Informationsabruf/RAG, Verbindungsprotokolle, persistenter Speicher). Genau dies macht aus einem Chatbot einen Agenten, der innerhalb des Unternehmens agiert.
3) LLM-Infrastruktur – wie Modelle zugeordnet, verwaltet und kostenoptimiert werden (Frontier-Modelle vs. kleine/fein abgestimmte vs. spezialisierte vs. Edge-Modelle).
4) Hardware – wo die Modelle tatsächlich ausgeführt werden und wer diese Rechenleistung steuert (Hyperscaler, privates cloud-System, On-Premise, maßgeschneiderte Chips).
Drei Belastungen drücken die CTOs unter die Oberfläche: Plattformdruck (Die Plattformebene ist nun unverzichtbar und nicht mehr optional für alle, die von Pilotprojekten zu voll einsatzfähigen Agenten übergehen), Kostendruck (die Fördermittel für Pionierprojekte laufen aus – Uber soll Berichten zufolge sein gesamtes LLM-Budget für 2026 innerhalb von vier Monaten aufgebraucht haben), und Souveränitätsdruck (Die data-Residenz, das EU-KI-Gesetz und geopolitische Faktoren machen Hardware zu einem Thema auf Vorstandsebene, insbesondere da KI-Infrastrukturen nicht nur allgemeine Rechenleistung bereitstellen, sondern auch intelligente Systeme betreiben, die Entscheidungen treffen.).
Sequenzierung schlägt Abdeckung Das ist die zentrale Empfehlung. Es geht nicht darum, dass jedes Unternehmen jede Ebene selbst betreiben sollte – manche starke Marktpositionen entstehen dadurch, dass man bewusst auf die Abstraktionen der Hyperscaler setzt und Investitionen anderweitig konzentriert.
Entscheidend ist, dass die Wahl absichtlich anstatt eines Standardwerts. Die richtige Reihenfolge hängt vom Unternehmenstyp ab: Start-ups und Nischenunternehmen konzentrieren sich auf Anwendungen und Plattformen; multiregionale Konzerne (Konsumgüter, Pharma, Rechtswesen, Gesundheitswesen) erweitern ihren Fokus auf Plattformen; Branchen mit hohem Reifegrad (Finanzen, Telekommunikation, digital-native Unternehmen) treffen bereits Entscheidungen im Bereich der Infrastruktur; und BigTech, Behörden sowie spezialisierte Fertigungsunternehmen treffen konkrete Entscheidungen im Bereich der Hardware.
Dies ist ein replay des cloud-Übergang – die Frage “AWS oder nicht?” aus dem Jahr 2012, die sich bis 2018 zu einer Entscheidung über eine mehrschichtige Architektur entwickelte – allerdings innerhalb eines verkürzten Zeitraums von drei bis vier Jahren statt eines ganzen Jahrzehnts.
Die drei Maßnahmen, die CTOs in diesem Jahr empfohlen werden: Übertragen Sie der KI-Plattform-Ebene die ausdrückliche Verantwortung (der Kontext ist der Teil des Stacks, der nicht kostengünstiger wird), setzen Sie die Wirtschaftlichkeit der Inferenz auf die vierteljährliche Tagesordnung (Routing, kleinere Modelle, sogar die Prüfung eines internen Trainings) und überdenken Sie die Entscheidungen bezüglich Hardware und Infrastruktur bewusst, auch wenn die Antwort vorerst weiterhin “Hyperscaler” lautet. Die entscheidende Unterscheidung: CTOs, die sich auf die sichtbare Ebene beschränken, verwalten letztendlich nur Werkzeuge; diejenigen, die unter die Oberfläche blicken, verwalten letztendlich kognitive Kapazitäten – wobei die Entscheidung darin besteht, ob man ein operativer oder ein strategischer CTO sein möchte.






