OpenAI introduceerde op 10 augustus een Premium Seat voor ChatGPT Business van 125 dollar per gebruiker per maand, vijf keer de prijs van de bestaande stoel. Een dag later, op 11 augustus, bracht Nvidia het open model Nemotron 3.5 Lightning uit, dat gratis commercieel gebruikt mag worden en op een enkele GPU draait. Diezelfde dag meldde Google dat de Gemini-app de grens van een miljard maandelijkse gebruikers passeerde. Drie berichten die samen laten zien waar de rekening voor AI naartoe schuift, en welke keuze u als ondernemer daartegenover kunt zetten.
OpenAI zet een prijskaartje op zware ChatGPT-gebruikers
De standaardstoel van ChatGPT Business blijft 25 dollar per gebruiker per maand, of 20 dollar bij jaarlijkse facturering. Daarnaast komt nu een Premium Seat van 125 dollar per maand, of 100 dollar per jaar gefactureerd. Die stoel geeft vijf keer zoveel gebruik en haalt de limiet van vijf uur weg waar intensieve gebruikers tegenaan liepen.
Belangrijk detail: u hoeft niet te kiezen voor uw hele bedrijf. Beide types stoelen kunnen naast elkaar in dezelfde werkomgeving staan, per medewerker. OpenAI geeft bij vroege aanmelding 100 dollar aan werkruimtekrediet per Premium-stoel, tot maximaal 500 dollar bij vijf stoelen.
Voor het Nederlandse MKB is dit vooral een signaal over kostenstructuur. AI-gebruik werd tot nu toe verkocht als een vast bedrag per medewerker. Dat model kraakt zodra mensen agents inzetten die zelfstandig lange taken uitvoeren, want die verbruiken veel meer rekenkracht dan een chatgesprek. Verwacht dat andere leveranciers volgen met gelaagde prijzen.
Neem een accountantskantoor met twintig medewerkers. Twee of drie mensen draaien de zware klussen: jaarrekeningen doorlichten, controledossiers samenvatten, complexe fiscale vragen uitzoeken. De rest gebruikt AI voor mail, notulen en concepten. Op de oude prijs kost dat kantoor 500 dollar per maand. Met drie Premium-stoelen wordt dat ongeveer 800 dollar. Dat is te verantwoorden als die drie mensen er uren mee winnen, maar alleen als u weet wie wat doet. Meet dus eerst het gebruik per persoon, koop daarna pas stoelen bij.
Nvidia geeft een snel model weg dat op een enkele GPU past
Nemotron 3.5 Lightning telt 30 miljard parameters, waarvan er per token maar ongeveer 3 miljard actief zijn. Dat komt door een mixture-of-experts-opzet met Mamba-2-lagen, gedistilleerd uit het grotere Nemotron 3 Ultra. Het gevolg is dat het model op één consumenten-GPU draait, bijvoorbeeld in een RTX-werkstation of een DGX Spark.
De cijfers gaan over snelheid, niet over maximale intelligentie. Nvidia meet tot vier keer hogere uitvoersnelheid en ongeveer 30 procent snellere afhandeling van agent-taken dan vergelijkbare open modellen. In tests met de definitieve NVFP4-gewichten haalde het bijna 670 tokens per seconde. De gewichten staan op Hugging Face en op het build-platform van Nvidia, vrij te downloaden en commercieel te gebruiken zonder licentiekosten of toestemming vooraf.
Dat is precies de tegenhanger van het eerste bericht. Waar abonnementen duurder worden naarmate u meer gebruikt, betaalt u bij een lokaal model eenmalig voor hardware en daarna alleen stroom. Voor werk dat u honderden keren per dag herhaalt, kantelt die rekensom sneller dan veel ondernemers denken. Er is ook een privacyargument: gegevens verlaten uw netwerk niet.
Denk aan een installatiebedrijf dat dagelijks honderden werkbonnen, foto's van meterkasten en servicerapporten verwerkt tot facturen en onderhoudsadviezen. Dat is repetitief, hoog in volume en laag in complexiteit. Zo'n taak hoeft niet naar het duurste model in de cloud. Een machine van een paar duizend euro op kantoor kan dit type werk continu draaien, zonder dat het verbruik per maand oploopt. Reken het uit voordat u een groter abonnement afsluit.
Gemini passeert een miljard gebruikers per maand
Google maakte op 11 augustus bekend dat de Gemini-app meer dan een miljard maandelijkse gebruikers heeft. Het is het veertiende Google-product dat die grens haalt. De groeicurve is stevig: 650 miljoen in oktober, 750 miljoen in februari, 900 miljoen tijdens Google I/O in juni en ruim 950 miljoen in het kwartaalbericht van juli. ChatGPT bereikte dezelfde mijlpaal in juni. Google meldt daarnaast dat 63 procent van de gebruikers de assistent met spraak bedient en dat er dagelijks meer dan 150 miljoen afbeeldingen worden gegenereerd.
Voor het MKB is het gebruikersaantal zelf niet het nieuws. Het gaat om wat eronder ligt: uw klanten en uw medewerkers gebruiken deze assistenten al, vaak op hun eigen telefoon en zonder dat u het weet. Dat betekent bedrijfsinformatie in privé-accounts, buiten uw verwerkersovereenkomsten en buiten uw AI-inventarisatie voor de AI Act.
Een retailketen met tien filialen ziet dit dagelijks. Filiaalmanagers laten een assistent op hun telefoon een leverancierscontract samenvatten of een personeelsrooster uitrekenen. Dat is nuttig werk, maar het gebeurt in de schaduw. De praktische stap is niet verbieden, want dat werkt niet. Wijs één goedgekeurde assistent aan, zorg voor zakelijke accounts, en leg in twee regels vast welke gegevens er nooit in mogen. Dan houdt u het gebruik en het toezicht bij elkaar.
Wat dit deze week betekent
Drie berichten, één rode draad: AI wordt afgerekend op verbruik in plaats van op koppen. Dat maakt de vraag welke taken u waar laat draaien, in de cloud of op eigen hardware, ineens een financiële vraag in plaats van een technische. Weet u eigenlijk welke drie taken in uw bedrijf het meeste AI-verbruik veroorzaken?
Bronnen
- OpenAI: Premium seats are coming to ChatGPT Business, 10 augustus 2026 - The Register: Hey, big spender, OpenAI has a new SKU just for you, 10 augustus 2026 - CNBC: Nvidia releases Nemotron 3.5 Lightning, open-source AI model, 11 augustus 2026 - NVIDIA Technical Blog: Nemotron 3.5 Lightning delivers fast, accurate specialized task execution for long-running agents, 11 augustus 2026 - TechCrunch: Google's Gemini app surges to one billion users, 11 augustus 2026



