Naar de inhoud
NLEN
Terugblik: welke juli-signalen zijn uitgekomen?

Terugblik: welke juli-signalen zijn uitgekomen?

Dit is de eerste terugblik op de AI-Radar. De 22 artikelen van juli bevatten tientallen signalen — uitspraken over wat er gaat gebeuren, met een inschatting van zekerheid en een geadviseerde actie. Signalen zijn echter nooit getoetst: er is geen artikel dat terugkeek en beoordeelde of de voorspellingen klopten. Deze terugblik doet dat voor de vier zwaarste thema's van juli: open modellen, het MCP-protocol, de prijzenoorlog en observability. Het genre is nieuw voor dit subdomein, maar het is precies het materiaal waar radar gezag opbouwt in plaats van samenvat: de voorspellingen staan hier, dus de toetsing kan nergens anders worden gemaakt.

Hoe deze terugblik toetst

Een signaal is pas toetsbaar als drie dingen vastliggen: wat er precies werd voorspeld, wanneer, en hoe je zou kunnen zien dat het uitkomt. Daarom werkt dit artikel per signaal met dezelfde opbouw. Eerst de voorspelling, letterlijk gekoppeld aan het juli-artikel waarin die stond. Daarna de stand van nu, met een bron en een datum — een signaal zonder bron is geen uitspraak maar een mening. En ten slotte het oordeel: uitgekomen, deels uitgekomen of nog open. De grens tussen die drie is bewust streng: een release die een week later komt dan voorspeld is uitgekomen, een release die alleen is aangekondigd maar nog niet beschikbaar is niet. Deze aanpak betekent ook dat sommige signalen bewust nog niet beoordeeld worden: een signaal met een horizon van drie maanden toets je niet na twee weken.

Uitgekomen: Kimi K3 is er, en de omvang bleek geen overdrijving

Het juli-artikel over open-weight modellen uit China voorspelde dat Moonshot de gewichten van Kimi K3 zou vrijgeven onder een aangepaste MIT-licentie, met 2,8 biljoen parameters — het grootste open model in de geschiedenis — en dat dit model de grens van wat lokaal draaibaar is definitief zou overtreffen. Op 26 juli gebeurde dat: Moonshot publiceerde de gewichten, en vroege reviewers plaatsten K3 op frontier-niveau voor agentic coding. Het tweede deel van de voorspelling is eveneens uitgekomen: de hardware-eisen liggen zo hoog dat vrijwel geen enkele organisatie het zelf draait, en de praktische toegang loopt via cloud-aanbieders. Het oordeel is daarmee tweeledig: de release is uitgekomen, en de kanttekening die het artikel erbij zette — groot betekent niet zelf-hostbaar — is bevestigd. Voor de bouwer verandert dat niets aan de beste aanpak: de eigen agent-logica lokaal, de zware modellen via API. De rekensom die daarbij hoort staat in de gids over lokaal of via een API.

Uitgekomen: MCP wordt stateless, met verplichte authenticatie

Het juli-artikel over MCP en agent-tooling meldde dat de specificatie voor de grootste MCP-update sinds de lancering op 28 juli zou worden gefinaliseerd: stateless architectuur, verplichte OAuth/OIDC-authenticatie, MCP Apps, een Tasks-extensie en OpenTelemetry-ondersteuning, met ongeveer zes breaking changes en een migratievenster van twaalf maanden. Eind juli kwam de officiële release candidate uit — precies op het aangekondigde schema. De kern van het signaal is uitgekomen: het protocol is formeel op weg naar de stateless breuk met zijn stateful verleden, en de authenticatie-eis is onderdeel van die route. Wat nog open is, is de adoptie: een release candidate is geen definitieve versie, en het migratievenster betekent dat de meeste productie-MCP-servers de komende maanden nog op de oude specificatie draaien. Het advies uit juli — begin nu met inventariseren, want uitstel is oplopende technische schuld — blijft daarmee overeind.

Uitgekomen: de prijzenoorlog werd structureel, sneller dan verwacht

Het artikel over de prijzenoorlog stelde dat de daling van API-prijzen geen tijdelijke marketingstunt meer was maar een structurele fase, mogelijk gemaakt door inference-engineering. Die stelling is in twee weken dubbel bevestigd. Ten eerste lanceerde Anthropic op 24 juli Claude Opus 5, dat dicht tegen de Fable 5-intelligentie aan zit voor ongeveer de helft van de prijs — een frontiermodel dat bewust op prijs wordt gezet in plaats van alleen op kwaliteit. Ten tweede bleef de budget-tier van OpenAI actief: GPT-5.6 Luna voor 1 dollar per miljoen inputtokens zet de onderkant van de markt onder druk, precies zoals het juli-artikel voorspelde met zijn prijsladder van Sol op 5 dollar, Terra op 2,50 en Luna op 1 dollar per miljoen inputtokens. Wat daarmee ook uitgekomen is, is de impliciete voorspelling uit het artikel over token-besparing: model-routing blijft de grootste financiële hefboom voor ontwikkelaars. Dat artikel rekende voor dat het verschil tussen DeepSeek V4 op 0,44 dollar en een duur frontiermodel per miljoen inputtokens zo groot is dat routing de eerste besparing oplevert die je kunt implementeren zonder de kwaliteit aan te tasten. De uitleg over model-routing op het api-subdomein geeft daar de praktische invulling voor.

Deels uitgekomen: observability-consolidatie, maar de golf is nog niet voorbij

Het juli-artikel over AI-observability signaleerde een consolidatiegolf: grote spelers verdelen het speelveld, self-hosted alternatieven winnen terrein, en de keuze voor een observability-stack is strategisch. Het artikel beschreef hoe ClickHouse met de overname van Langfuse uit januari 2026 zijn positie als standaard voor analytics-databases verstevigde, terwijl Langfuse zelf meldde meer dan 10 miljard observaties per maand te verwerken. Die consolidatie is deels uitgekomen — de overname staat, de MIT-licentie en de mogelijkheid tot self-hosting bleven intact, en de markt is niet teruggekeerd naar de wildgroei van kleine SaaS-tools. Maar het belangrijkste nieuwe signaal ligt elders: MCP krijgt OpenTelemetry-ondersteuning ingebouwd, wat betekent dat observability van agentgesprekken straks een protocolstandaard is in plaats van een zelfgebouwde extra. Dat was geen voorspelling van juli maar een ontwikkeling die de richting van het juli-artikel bevestigt. Het oordeel is daarom "deels": de consolidatie zelf is gerealiseerd, maar de volgende fase — observability als standaardonderdeel van de tooling-laag — moet zich nog bewijzen. Wie kosten per gebruiker wil bijhouden vindt in het api-artikel over kosten per gebruiker toerekenen een concrete eerste stap.

Nog open: de signalen met een langere horizon

Drie signalen uit juli zijn bewust nog niet afgerekend. Ten eerste de Gemini 3.5 Pro: het gerucht dat Google zijn vlaggenschip na mislukte tests opnieuw bouwt is bevestigd door het uitblijven van de release op 21 juli, maar er is geen nieuwe datum — een uitgesteld signaal is nog geen uitgekomen signaal. Ten tweede de beursgang van Anthropic: de investeerdersbijeenkomsten van medio juli wijzen op een mogelijke IPO in oktober, maar die datum ligt buiten deze terugblik en een beursgang kan altijd worden uitgesteld. Ten derde de EU AI Act: de transparantieverplichting is op 2 augustus ingegaan, maar de vraag of die in de praktijk handhaving krijgt, is pas over maanden te beantwoorden. Deze drie blijven op de radar, en de volgende terugblik toetst ze opnieuw.

Deels uitgekomen: token-besparing als doorlopende praktijk

Het artikel over token-besparing ging niet over één aankondiging maar over vijf technieken uit de community, en daarom is de toetsing anders dan bij een release. De techniek die het artikel als de grootste hefboom noemde — dynamische model-routing — is inmiddels dubbel bevestigd: het RouteLLM-framework uit het artikel liet tot 85 procent kostenbesparing zien met behoud van 95 procent van de kwaliteit, en de prijsbewegingen van de afgelopen weken (Opus 5 voor de helft, Luna als budget-tier) maken de prijsverschillen tussen modellen eerder groter dan kleiner. De overige vier technieken — context inkorten, caching, kleinere modellen voor routinetaken en het bewust niet meesturen van onnodige data — zijn geen gebeurtenissen maar gewoonten; die zijn alleen te toetsen aan de eigen rekening, niet aan nieuws. Het oordeel is daarom "deels uitgekomen als signaal, blijvend als praktijk": de claim dat routing de grootste besparing oplevert is bevestigd, maar of lezers de vijf technieken daadwerkelijk toepassen, is geen nieuwsfeit maar een gedragsvraag. Wie de besparing zelf wil meten, kan daarvoor de aanpak gebruiken die op het benchmark-subdomein voor latency-metingen staat: meet voor en na een wijziging met dezelfde opzet, en oordeel op de cijfers in plaats van op het gevoel.

Wat dit betekent voor de volgende edities

De eerste terugblik levert drie lessen op die de volgende edities van de radar scherper maken. Ten eerste: voorspellingen worden beter als ze toetsbaar worden opgeschreven. Een signaal met een horizon en een waarnemingscriterium ("binnen twee weken beschikbaar") kan worden afgerekend; een signaal zonder datum kan niet. Ten tweede: de kwaliteit van de toetsing staat of valt met bronnen — dit artikel gebruikte de release-aankondigingen en de maandoverzichten van begin augustus, en elk oordeel verwijst naar een gebeurtenis met een datum. Ten derde: een terugblik is geen scorekaart maar een correctiemechanisme. De signalen die uitgekomen zijn (K3, MCP, prijzen) bevestigen de keuze van juli; de signalen die nog open staan, bepalen wat de komende weken interessant is.

Conclusie

Van de vijf getoetste juli-thema's zijn er drie uitgekomen en twee deels. Kimi K3 is gepubliceerd en blijkt inderdaad te groot voor eigen hardware; MCP is op schema stateless geworden met verplichte authenticatie; en de prijzenoorlog is structureel gebleken, met Claude Opus 5 als sterkste bewijs. De observability-consolidatie is gedeeltelijk gerealiseerd, maar de volgende fase — observability als standaard in het protocol — moet zich nog bewijzen, en token-besparing is bevestigd als hefboom maar blijft een doorlopende praktijk in plaats van een afgeronde gebeurtenis. Dat is een goede uitslag voor een eerste editie: de radar voorspelt niet alleen, hij houdt zichzelf ook bij. De volgende terugblik komt over een maand, en dan zijn ook de langere-horizon-signalen van Gemini, Anthropic en de EU AI Act aan de beurt.