Geachte lezers, Weet u nog dat GenAI vroeger alleen maar grappige afbeeldingen van katten maakte? Juli 2026 liet weten dat die tijden allang voorbij zijn. We bevinden ons momenteel in een koortsdroom van full-duplex spraak, autonome agenten die Wall Street infiltreren en techreuzen die strijden om wie de eigenaar is van de “cognitieve lus”.”
Of u nu een CTO bent die uw infrastructuur in kaart probeert te brengen, of gewoon iemand die zich afvraagt waarom uw telefoon plotseling 70 talen in realtime vertaalt: wij geven u een uitgebreid overzicht van de redenen waarom het tijdperk van de “oppervlakkige chatbot” zojuist ten einde is gekomen.
Podcast over GenAI en Agentic News
Zakelijk nieuws en marktinzichten



Nieuwe modellen en innovaties

Gedachten van Victor Coimbra

De meeste CTO’s zullen in 2026 hun AI-strategie uitsluitend op het zichtbare oppervlak ontwikkelen – door Copilot-licenties en chatbot-licenties aan te schaffen – terwijl het echte strategische werk zich afspeelt in de diepere, minder zichtbare lagen van de stack. Het kernraamwerk beschrijft een AI-native bedrijf als bestaande uit vier lagen:
1) Aanvraag – waar mensen en AI elkaar ontmoeten (chatbots, copiloten, agents). Eenvoudig aan te schaffen en te begroten, maar moeilijk om zich hiermee te onderscheiden, aangezien elke concurrent bij dezelfde leveranciers inkoopt.
2) AI-platform – wat de AI weet en kan (prompts, vaardighedenbibliotheken, informatieopvraging/RAG, verbindingsprotocollen, persistent geheugen). Dit is wat een chatbot tot een agent maakt die binnen het bedrijf actief is.
3) LLM-infrastructuur – hoe modellen worden ingezet, beheerd en qua kosten geoptimaliseerd (frontier-modellen versus kleine/fijn afgestemde modellen versus gespecialiseerde modellen versus edge-modellen).
4) Hardware – waar de modellen daadwerkelijk worden uitgevoerd en wie de controle heeft over die rekenkracht (hyperscaler, privé cloud, on-prem, op maat gemaakte chips).
Drie drukfactoren dringen CTO’s naar de achtergrond: platformdruk (de platformlaag is nu een essentiële component en niet langer optioneel voor iedereen die de overstap maakt van proefprojecten naar volledig geïmplementeerde agents), kosten druk (de subsidies voor grensverleggende onderzoeksprojecten lopen ten einde – Uber zou naar verluidt zijn volledige LLM-budget voor 2026 in vier maanden hebben opgebruikt), en druk op de soevereiniteit (De data-regeling, de EU-AI-wet en de geopolitieke situatie zorgen ervoor dat hardware een kwestie op bestuursniveau wordt, met name omdat AI-infrastructuur niet alleen standaard rekenkracht levert, maar ook intelligente systemen draait die beslissingen nemen).
Sequencing verslaat dekking is de kernaanbeveling. Het argument is niet dat elk bedrijf alle lagen in eigen beheer moet hebben – sommige sterke posities zijn juist te danken aan het bewust gebruikmaken van de abstracties van hyperscalers en het concentreren van investeringen op andere gebieden.
Het gaat erom dat de keuze opzettelijk in plaats van een standaardoplossing. De juiste volgorde hangt af van het bedrijfstype: start-ups en gespecialiseerde bedrijven richten zich op applicaties en platforms; multiregionale ondernemingen (consumptiegoederen, farmaceutica, juridische dienstverlening, gezondheidszorg) breiden uit naar platforms; sectoren met een hoge mate van volwassenheid (financiën, telecommunicatie, digitaal-native) nemen reeds beslissingen op het gebied van infrastructuur; en BigTech, de overheid en gespecialiseerde productiebedrijven maken daadwerkelijke keuzes op het gebied van hardware.
Dit is een replay van de cloud-overgang – de vraag uit 2012 “AWS of niet?”, die tegen 2018 uitmondde in een besluit over een gelaagde architectuur – maar dan binnen een verkort tijdsbestek van drie tot vier jaar in plaats van een decennium.
De drie aanbevolen stappen voor CTO’s dit jaar: Geef de AI-platformlaag expliciet de verantwoordelijkheid (de context is het deel van de stack dat niet goedkoper wordt), zet de economische aspecten van inferentie op de kwartaalagenda (routing, kleinere modellen, en zelfs het verkennen van interne training) en heroverweeg de keuzes op het gebied van hardware en infrastructuur weloverwogen, zelfs als het antwoord “voorlopig hyperscaler” blijft. Het doorslaggevende verschil: CTO’s die zich beperken tot de zichtbare laag, houden zich uiteindelijk bezig met het beheren van tools; degenen die onder de waterlijn kijken, houden zich uiteindelijk bezig met het beheren van cognitieve capaciteit – waarbij de keuze ligt tussen een operationele of een strategische CTO.






