Google bracht op 13 augustus Gemini 3.7 Flash uit, met een introductieprijs die precies de helft is van het vorige Flash-model. Diezelfde dag kondigde IBM een strategisch partnerschap met OpenAI aan, waarmee GPT-5.6, Codex en ChatGPT Work in het consultingplatform van IBM landen. Een dag later, op 14 augustus, lanceerde het Chinese Z.ai het model GLM-5.3 en besloot het de open gewichten twee weken achter te houden vanwege cyberrisico. Drie berichten die samen bepalen waar uw AI-budget en uw risicoprofiel de komende maanden heen bewegen.
Gemini 3.7 Flash kost de helft en dat verandert uw rekensom
Google zette Gemini 3.7 Flash op 13 augustus live als opvolger van Gemini 3.6 Flash, dat pas drie weken eerder uitkwam. De introductieprijs is 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens. Dat is de helft van wat 3.6 Flash kostte. Die introprijs geldt tot en met 31 december 2026, daarna gaat het standaardtarief in. Google claimt vooral winst op codeertaken, debuggen en het in een keer goed genereren van bruikbare code.
Voor het MKB is dit het interessantste type nieuws, ook al klinkt het saai. Flash-modellen doen het volumewerk: documenten lezen, e-mails classificeren, gegevens uit PDF's halen, standaardantwoorden opstellen. De prijs per taak is in een maand tijd gehalveerd, terwijl de kwaliteit omhoog ging. Automatiseringen die vorig kwartaal net niet uit konden, kunnen nu wel uit.
Neem een installatiebedrijf met veertig monteurs dat maandelijks een paar duizend werkbonnen verwerkt. Een jaar geleden was het handmatig uitlezen en boeken van die bonnen goedkoper dan een AI-pijplijn. Bij deze tarieven kantelt die som. Belangrijk detail: reken met de prijs vanaf januari 2027, niet met de introprijs, anders bouwt u een business case op een tijdelijke korting.
IBM zet OpenAI in de machinekamer van grote organisaties
IBM maakte op 13 augustus bekend dat het OpenAI-modellen en producten inbouwt in IBM Consulting Advantage, het platform waarmee het zijn adviesdiensten levert. Concreet gaat het om GPT-5.6, Codex en ChatGPT Work. IBM treedt toe tot de Elite-partnerlaag van OpenAI en gaat de komende maanden tienduizenden consultants trainen en certificeren op deze technologie.
De focus ligt op financiële dienstverlening, overheid, telecom en retail, en binnen bedrijven op finance, inkoop, klantoperatie en HR. Daarnaast breiden beide partijen hun samenwerking op cybersecurity uit, gekoppeld aan IBM Autonomous Security.
U koopt waarschijnlijk geen IBM-consultancy. Toch raakt dit u langs twee kanten. Ten eerste doen uw grote opdrachtgevers dat wel, en die schuiven hun verwachtingen op over doorlooptijden, aanlevering en digitale koppelingen. Ten tweede wordt de vraag welk model onder uw software zit langzaam een inkoopvraag in plaats van een technisch detail.
Denk aan een accountantskantoor met dertig medewerkers. Als een groot deel van uw klantenbestand hun inkoop- en HR-processen door zo'n traject haalt, verandert de aanlevering die u binnenkrijgt van formaat en frequentie. Dat is geen bedreiging, maar het is wel een planningsvraag voor uw eigen software en uw eigen capaciteit.
Z.ai laat zien dat open modellen ook een beveiligingsvraag zijn
Op 14 augustus lanceerde Z.ai het model GLM-5.3, met 743 miljard parameters. Volgens eigen metingen presteert het ongeveer 50 procent beter op codeertaken dan de voorganger, en staat het eerste onder open modellen op publieke benchmarks. Opvallender is de beveiligingskant: GLM-5.3 scoorde 84,5 procent op CyberGym, een test die meet hoe goed een model bekende kwetsbaarheden vindt, en verslaat daarmee de topmodellen van Anthropic en OpenAI.
Z.ai vond die capaciteit zelf zo groot dat het de publicatie van de gewichten twee weken uitstelt om de veiligheidscontroles aan te scherpen. In de tussentijd krijgen alleen geselecteerde securitypartners toegang in afgeschermde omgevingen. Het bedrijf meldt dat zijn modellen inmiddels meer dan 2.400 kwetsbaarheden hebben gevonden, waarvan ruim duizend als kritiek of hoog gelden. Z.ai erkent daarbij dat het na publicatie geen controle meer heeft over wie het model aanpast en waarvoor.
De praktische conclusie is nuchter. Dezelfde capaciteit die kwetsbaarheden opspoort voor verdedigers, spoort ze ook op voor aanvallers. Uw patchvenster wordt korter, niet langer.
Voor een productiebedrijf met een machinepark betekent dat concreet: inventariseer welke systemen aan internet hangen, welke daarvan niet meer worden bijgewerkt en welke leverancier verantwoordelijk is voor updates. Dat is geen AI-project, het is basishygiëne die door AI urgenter wordt.
Wat u hiermee doet
Drie signalen, drie tempo's. De prijsdaling bij Google kunt u deze maand omzetten in een concrete berekening. Het IBM-nieuws is een kwartaalvraag over wat uw markt van u gaat verwachten. Het Z.ai-verhaal is een kwestie van weken, want beveiliging wacht niet op uw roadmap.
Welke van de drie staat bij u al op de agenda, en welke niet?
Bronnen
- Google, Introducing Gemini 3.7 Flash, 13 augustus 2026 - Bloomberg, Google Unveils Gemini 3.7 Flash Model as Gemini 3.5 Pro Delay Persists, 13 augustus 2026 - IBM Newsroom, IBM Partners with OpenAI to Accelerate Secure AI Deployment for Enterprises Across Core Operations, 13 augustus 2026 - TechCrunch, IBM partners with OpenAI to bolster enterprise AI push, 13 augustus 2026 - Z.ai, GLM-5.3: Frontier Coding with Emergent Cyber Capabilities, 14 augustus 2026 - Axios, China's Z.ai holds GLM 5.3 release over hacking risks, 14 augustus 2026



