Anthropic maakte op vrijdag 21 augustus bekend dat Claude Mythos 5, tot nu toe alleen beschikbaar voor een kleine groep partners, vanaf nu in Claude Security draait als publieke beta voor Enterprise-klanten. Diezelfde dag publiceerde Nvidia onderzoek waaruit blijkt dat de software rondom een model, de harness, de prestaties op langlopende taken sterker bepaalt dan de modelkeuze zelf. En Deepseek zette V4-Flash-Vision-Exp live, een experimenteel model dat beeld verwerkt tegen het tarief van zijn goedkoopste tekstmodel. Drie berichten van dezelfde dag die naar hetzelfde punt wijzen: de laag om het model heen bepaalt wat een bedrijf er praktisch mee kan.
Anthropic laat zijn zwaarste model code scannen, maar houdt het model zelf dicht
Claude Mythos 5 is het model dat Anthropic zelf het sterkste ter wereld noemt op cybertaken, en juist daarom niet breed beschikbaar maakte. In april ging het via Project Glasswing naar een kleine groep organisaties die kritieke software beheren. Sinds 21 augustus draait het in Claude Security, in publieke beta voor Enterprise-klanten.
Claude Security scant een codebase, traceert datastromen tussen bestanden en levert bevindingen op met een CWE-categorie, een ernstinschatting en een voorgestelde patch. Een mens moet elke patch goedkeuren. De scans tellen als normaal tokengebruik, er is geen apart licentiemodel. Daarnaast komt Mythos 5 in beveiligingsproducten van partners die ziekenhuizen, nutsbedrijven en banken bedienen, waarbij eindgebruikers alleen de uitkomsten zien en nooit het model zelf benaderen. Anthropic kondigde ook een fonds van 35 miljoen dollar aan Claude-tegoed aan voor het beveiligen van open source software.
Die constructie is het interessante deel. Anthropic geeft toegang tot de resultaten, niet tot het model, precies omdat dezelfde capaciteit ook aanvallers zou helpen. Voor het Nederlandse MKB loopt dat via de keten. Een installatiebedrijf dat een eigen serviceportaal laat bouwen, krijgt deze scankracht niet via een API-sleutel maar via de securityleverancier of de softwarepartij die het portaal onderhoudt.
Nvidia-onderzoek: de harness doet het zware werk, niet het model
Nvidia publiceerde op 21 augustus onderzoek dat de aandacht verlegt van het model naar de omhulling ervan. Een harness is de softwarelaag rond een model: de tools, het geheugenbeheer en de regels die een ruw model laten handelen.
Op ARC-AGI-3, een set 2D-spellen zonder instructies waarin een model zelf moet uitvogelen hoe het wint, scoorde Claude Opus 5 zonder speciale harness 30 procent, het hoogste resultaat van alle geteste modellen. Met de harness van Nvidia, Agentic Variation Operators, kwam hetzelfde model op 100 procent. Het verschil zat volgens de onderzoekers in beter geheugenbeheer en in een toezichthoudende component die de agent bijstuurt als die vastloopt of een doodlopend pad opnieuw bewandelt. OpenAI verdrievoudigde vorige maand zijn scores door twee harness-instellingen aan te passen, maar haalde de 100 procent niet.
Adel El Hallak, vicepresident product bij de AI-divisie van Nvidia, zegt tegen TechCrunch dat de buitenwereld een agent vaak leest als een API van het model, terwijl het gaat om het model plus de scaffolding, de runtime en de bibliotheken. AVO is geen product, Nvidia publiceert losse onderdelen waarmee anderen harnassen bouwen.
Dat raakt de manier waarop MKB-bedrijven offertes van AI-leveranciers naast elkaar leggen. Een dienstverlener die een agent een aanvraag over meerdere dagen laat afhandelen, van intake tot dossier tot terugkoppeling, merkt volgens dit onderzoek meer van de kwaliteit van geheugen en toezicht dan van het modellabel. Twee partijen die hetzelfde model noemen, kunnen in de praktijk ver uit elkaar liggen.
Deepseek geeft zijn goedkoopste model ogen
Deepseek voegde op 21 augustus deepseek-v4-flash-vision-exp toe aan zijn API. Het model begrijpt beeld en behoudt verder de teksteigenschappen van V4-Flash. Op de eigen benchmarks van Deepseek komen de multimodale agentprestaties in de buurt van Opus 4.8, een claim van de leverancier zelf die niet onafhankelijk is getoetst.
De prijzen verklaren de aandacht. Het model volgt de tarieven van V4-Flash: 0,22 dollar per miljoen invoertokens buiten piekuren en 0,66 dollar per miljoen uitvoertokens, bij een contextvenster van een miljoen tokens. Een afbeelding kost maximaal 384 tokens, ongeacht de resolutie, en één verzoek mag tot 600 afbeeldingen bevatten. Het model werkt met de Chat Completions- en Responses-API van OpenAI en met de Messages-endpoint van Anthropic.
Voor een accountantskantoor dat bonnen, pakbonnen en screenshots uit klantadministraties verwerkt, verandert dat de rekensom. Een batch van honderden scans blijft bij deze tarieven in centen hangen. Daar staan twee dingen tegenover: het model is expliciet experimenteel, en het draait bij een Chinese aanbieder, wat voor administraties met persoonsgegevens een aparte afweging is.
Wat de drie berichten delen
Anthropic beperkt de toegang tot een model en levert alleen de uitkomst. Nvidia laat zien dat de omhulling het verschil maakt tussen 30 en 100 procent. Deepseek verlaagt de prijs van beeldverwerking tot het niveau van tekst. De beweging zit in alle drie de gevallen niet in het model zelf, maar in de manier waarop het wordt ingepakt, afgeschermd en afgerekend. Dat is de laag waar leveranciers van MKB-software hun keuzes maken.
Bronnen
- Claude by Anthropic, Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders, 21 augustus 2026 - The Decoder, Anthropic puts its most powerful model Claude Mythos 5 to work for cyber defense, 21 augustus 2026 - TechCrunch, Nvidia just showed that the harness, not the AI model, is now the real hero, 21 augustus 2026 - DeepSeek API Docs, Change Log: DeepSeek-V4-Flash-Vision-Exp Release, 21 augustus 2026 - The Decoder, Deepseek releases experimental Flash vision model that rivals Opus 4.8 on agent benchmarks, 21 augustus 2026



