Naar inhoud
BlackOak AgencyBlackOak.agency

// AI RADAR

AI Radar

Wat er in AI uitkomt aan modellen, agents, video en kapitaal — met per ontwikkeling wat het is, waarom het telt en wat je er maandag mee doet. Onder de brief staat het landschap: prijzen, tools en cijfers die langer meegaan.

De week in kunstmatige intelligentie

De regels kwamen eerder aan dan de gewenning.

Sinds eind juli verschoof de frontier twee keer — Fable 5.1 op 1 september, GPT-6 Astra twee dagen later, allebei op $10 in en $50 uit — maar het nieuws dat je maandag raakt is ouder: sinds 2 augustus moet door AI gemaakte content zichzelf als zodanig markeren. Dit is wat er in zes weken veranderde, en wat je ermee doet.

Augustus–september 2026 — de releasekalender

← sleep om te schuiven

  1. EU / CaliforniëTransparantieplicht van kracht02 AUG
  2. AlibabaQwen3.8-Max algemeen beschikbaar03 AUG
  3. OpenAIGPT-5.6-Cyber10 AUG
  4. xAIGrok 4.612 AUG
  5. DeepSeekV4 Pro uit preview12 AUG
  6. GoogleGemini 3.7 Flash13 AUG
  7. AnthropicWatermerk in alle output14 AUG
  8. SalesforceClaudeforce26 AUG
  9. AnthropicModel Hardware Standard27 AUG
  10. AnthropicFable 5.1 en Mythos 5.101 SEP
  11. OpenAIGPT-6 Astra03 SEP
  12. OpenAISora-API stopt24 SEP

De brief

Zes ontwikkelingen die je stack veranderen

Op datum, met wat er is gebeurd, waarom het telt en wat je eraan hebt.

02.08.2026Regels

Vanaf nu moet je content vertellen dat hij door een machine is gemaakt

Op 2 augustus werden artikel 50 van de EU AI Act en de Californische AI Transparency Act (SB 942, gewijzigd door AB 853) handhaafbaar. Beide eisen een machineleesbare markering op door AI gegenereerd beeld, geluid, video en — bij onderwerpen van algemeen belang — tekst. De Europese Commissie werkt aan een gestandaardiseerd label dat onderscheid maakt tussen "volledig door AI gegenereerd" en "met AI gemaakt". Anthropic zette het meteen om in beleid: alle Claude-producten markeren sinds 2 augustus hun output, wereldwijd en niet alleen in de EU. De boete bij overtreding loopt op tot €15 miljoen of 3% van de wereldwijde jaaromzet.

Waarom het telt

Dit is de eerste keer dat het gebruik van AI in je werk een administratieve verplichting wordt in plaats van een keuze. Voor een bureau betekent het dat de vraag "is dit met AI gemaakt?" niet langer een gespreksonderwerp met de klant is maar een veld in de oplevering. En omdat de markering machineleesbaar is, kan een opdrachtgever het achteraf controleren zonder het jou te vragen.

Wat nu

Maak deze maand een inventaris: welke opleveringen zijn volledig gegenereerd, welke met AI bewerkt, welke met de hand. Leg de markering vast in het productieproces, niet in de disclaimer onderaan een offerte — een label dat pas bij de factuur opduikt komt te laat.

13.08.2026Modellen

Gemini 3.7 Flash verdubbelt op kantoorwerk — en wordt op 1 januari twee keer zo duur

Google bracht Gemini 3.7 Flash uit op 13 augustus, drieëntwintig dagen na 3.6 Flash. Op AutomationBench, dat echte bedrijfsworkflows meet, gaat het van 17,0% naar 30,4%; op DeepSWE v1.1 van 49,0% naar 65,3%. Het introductietarief is $0,75 per miljoen invoertokens en $3,75 per miljoen uitvoertokens, met een context van ruim een miljoen tokens. Dat tarief loopt af op 31 december 2026: vanaf 1 januari 2027 geldt $1,50 en $7,50. De aangekondigde 3.5 Pro is er nog steeds niet; Google traint inmiddels Gemini 4.

Waarom het telt

De werkpaardlaag is waar de marge van een bureau zit — daar draait het volume. Een verdubbeling op een benchmark die kantoorprocessen nabootst, voor minder dan een dollar per miljoen invoertokens, verschuift welke taken je überhaupt nog met de hand doet. Het addertje staat in de kleine letters: wie nu op $0,75 begroot, begroot op een prijs die over vier maanden verdwijnt.

Wat nu

Verhuis bulkwerk hierheen — extractie, classificatie, eerste versies — maar reken je businesscase door op het tarief van 2027. Wat alleen uitkomt op het introductietarief, komt niet uit.

26.08.2026Agents

Claudeforce: het CRM verhuist naar de agent, niet andersom

Salesforce en Anthropic kondigden op 26 augustus Claudeforce aan. Twee richtingen tegelijk: Claude wordt het redeneermodel binnen Salesforce, en Salesforce wordt een plugin binnen Claude, met 37 kant-en-klare sales-skills — van gespreksvoorbereiding en deal health checks tot pipeline reviews. De plugin draait bij pilotklanten, met open beta in september; meer skills volgen eind 2026. Het is de eerste keer dat Salesforce zijn "force"-achtervoegsel aan het product van een ander bedrijf hangt.

Waarom het telt

Tot nu toe zat de agent naast de stack: je gaf hem toegang tot je systemen. Hier zit de klantcontext ín het gesprek, met de governance van het CRM eromheen. Dat verplaatst de vraag "welke agent gebruiken we?" naar "waar staat de data die hem nuttig maakt?" — en dat antwoord bepaalt wie de relatie met de klant bezit. Benioff wuifde de SaaSpocalypse-vraag niet toevallig weg in dezelfde week.

Wat nu

Kijk voor je grootste klanten na waar de klantcontext daadwerkelijk staat en wie hem mag ontsluiten. Een agent die in het CRM van je opdrachtgever woont, is geen tool die jij kiest maar een kanaal waar jij op aansluit.

01.09.2026Modellen

Fable 5.1 laat de tokenprijs staan en maakt het geheugen vier keer goedkoper

Anthropic bracht op 1 september Claude Fable 5.1 uit, met de besloten tweeling Mythos 5.1 voor gescreende organisaties in cybersecurity en life sciences. De lijstprijs blijft $10 in en $50 uit per miljoen tokens; de cache-leesprijs zakt met 75% van $1 naar $0,25. Anthropic zelf schat de besparing op ongeveer 25% bij gewoon tokenwerk en tot circa 45% bij sterk agentische workloads. Op Terminal-Bench-Science 0.1 gaat het van 24,7% naar 52,6%, met 55,8% op Terminal-Bench 4.0 en 73,4% op CursorBench 3.2. Een miljoen tokens context, 128K output, en beschikbaar via de Claude API, AWS, Google Cloud en Azure als claude-fable-5-1.

Waarom het telt

De interessante prijsdaling zit niet op de tokens maar op het geheugen. Een agent die dertig keer dezelfde briefing, huisstijlgids en klantdossier herleest, betaalt precies daar zijn rekening — en die post werd vier keer goedkoper zonder dat de lijstprijs bewoog. Wie geen caching gebruikt, ziet van die 45% niets terug.

Wat nu

Controleer of je langlopende taken prompt caching aan hebben staan en of je vaste context — merkrichtlijnen, toon, klantfeiten — vooraan in de prompt staat, waar hij te cachen valt. Dat is deze maand de goedkoopste optimalisatie die er is.

03.09.2026Modellen

GPT-6 Astra kan meer op een computer dan wat ervoor kwam — en laat minder zien van hoe

OpenAI kondigde GPT-6 Astra aan op 3 september, eerst voor deelnemers aan het Daybreak-programma en daarna gefaseerd naar Plus, Pro, Business, Enterprise en de API. Lijstprijs $10 in en $50 uit per miljoen tokens, met een sprong naar $20/$75 zodra een verzoek boven de 272K invoertokens uitkomt; context 1,05 miljoen tokens, 128K output. Op OSWorld 2.0 haalt het 72,6% bij ongeveer 47% minder tijd per taak dan Sol. Het is het eerste model dat OpenAI’s eigen drempel "Critical" haalt op cybercapaciteit. De techniek erachter — opaque recurrence, waarbij tokens herhaald door dezelfde lagen lopen in plaats van via een leesbare gedachtegang — maakt het redeneren minder controleerbaar; chief scientist Jakub Pachocki noemt dat een gevolg van toenemende capaciteit.

Waarom het telt

Er staan nu twee frontier-modellen op exact dezelfde lijstprijs: Astra en Fable 5.1, allebei $10/$50. De keuze gaat dus niet meer over budget maar over taak — en over wat je moet kunnen uitleggen. Astra is sneller en sterker op computerwerk; het is ook het model waarvan je de redenering het minst kunt navertellen. Voor werk dat naar een klant of een toezichthouder gaat, is dat een echt criterium geworden.

Wat nu

Hertest deze maand je twee zwaarste workflows op Astra én Fable 5.1 en vergelijk op uitkomst, niet op benchmark. Zet menselijke review verplicht op alles wat de deur uitgaat: bij een model waarvan je de gedachtegang niet kunt lezen, is de review je enige logboek.

H2 2026Markt

Een kwart van Google toont nu een AI-antwoord, en negen op de tien sessies eindigen zonder klik

Conductor mat over 21,9 miljoen zoekopdrachten dat AI Overviews inmiddels in 25,11% van de Google-resultaten verschijnen, tegen 13,14% in maart 2025. AI-verwijsverkeer is nog klein — 1,08% van al het websiteverkeer — maar groeit ongeveer een procentpunt per maand, en ChatGPT is goed voor 87,4% daarvan. Semrush telde dat circa 93% van de AI-zoeksessies eindigt zonder websitebezoek; Conductor ziet tegelijk dat bezoekers die wél uit een LLM komen in een derde van de sessies twee keer zo goed converteren.

Waarom het telt

Die twee cijfers zijn elkaars spiegelbeeld en samen zijn ze het hele verhaal: het verkeer daalt, de waarde per bezoeker stijgt. Wie zijn AI-zichtbaarheid blijft afrekenen op sessies, ziet een dalende grafiek en trekt de verkeerde conclusie. Wie hem afrekent op vermeldingen en op conversie, ziet een kanaal dat kleiner en beter tegelijk is.

Wat nu

Meet vermeldingen, niet alleen bezoeken. Leg per kwartaal vast voor welke vragen je genoemd wordt in ChatGPT, Perplexity, Gemini en de AI-overzichten van Google, met welke bron, en zet daarnaast de conversie van dat verkeer. Dat is één rapport en het beantwoordt de enige vraag die je opdrachtgever stelt.

Signalen

Kort, maar niet onbelangrijk

10 AUG · OPENAI

Een model dat expliciet exploits schrijft

GPT-5.6-Cyber, gebouwd op Sol, voltooit 95,0% van de gevorderde securityverzoeken waar Sol op 1,5% blijft steken — exploitketens, privilege-escalatie, authenticatiebypass. OpenAI vond er twee onbekende lekken in Chrome’s V8 mee (CVE-2026-15903). Toegang alleen via het Daybreak-programma, in twee lagen: Blue voor verdediging, Red voor de rest. Individuele Daybreak-accounts moeten sinds 1 september een hardwaresleutel gebruiken.

12 AUG · PRIJZEN

Twee releases, één dag, vijftien keer prijsverschil

Grok 4.6 verscheen op $2 in en $6 uit per miljoen tokens, met dubbel tarief boven 200K tokens. Dezelfde dag haalde DeepSeek V4 Pro zijn preview-label eraf op ongeveer $0,42 in en $0,87 uit. Op de Artificial Analysis Intelligence Index scheelt dat 7,9 punten (60,9 tegen 53,0) bij ongeveer vijftien keer de kosten per voltooide taak. Voor het meeste productiewerk is die 7,9 niet het verschil dat je factureert.

27 AUG · ANTHROPIC

MCP, maar dan voor apparaten

De Model Hardware Standard ging in research preview bij onderzoekslabs en fabrikanten: één stuurprogramma dat "lezen" en "schrijven" vertaalt naar microscopen, pipetteerrobots en robotarmen. Carnegie Mellon draaide er verdunningsreeksen drie keer zo snel mee, QuEra liet een agent zonder mens de frequentie van een laser terugvinden in 99,3% van de gevallen. Werk dat weken kostte om te koppelen, kost nu uren.

24 SEP · OPENAI

De Sora-API gaat over twee weken uit

Web en app sloten al op 26 april; op 24 september volgt de API. Wie er nog op bouwt, heeft nu echt haast. Veo 3.1 blijft de sterkste allrounder met native geluid, Kling 3.0 en Seedance zitten met meerdere modellen in de top tien, en Runway bundelt Kling 3.0 Pro, Veo 3.1, Seedance en zijn eigen Gen-4.5 onder één abonnement en één creditsysteem — precies het antwoord op leveranciersrisico dat Sora zichtbaar maakte.

AUG 2026 · KAPITAAL

Het geld gaat naar atomen en stroom

Crunchbase telde $42 mrd naar ruim 1.500 startups in augustus: 25% minder dan de $56 mrd van juli, maar 122% meer dan vorig jaar augustus. De miljardenrondes gingen naar defensietech (Hadrian), kernenergie (Valar Atomics), satellieten (Yuanxin), thuisbatterijen (Base Power) en codeermodellen (poolside). Vijf van de zeven hadden minder dan twaalf maanden geleden nog opgehaald.

SEP 2026 · AUTONOMIE

Elf dagen doorwerken zonder mens

Anthropic liet Claude via het Prove2Me-platform elf dagen grotendeels zelfstandig doorwerken aan het eerste volledig machinaal gecontroleerde bewijs van de laatste stelling van Fermat in Lean: 13 miljoen regels code en 30.300 bewezen stellingen. Het is geen marketingtaak, maar het is wel de duidelijkste maat tot nu toe voor hoe lang een agent op koers blijft zonder tussenkomst.

Radar

Het landschap, niet het nieuws

Wat er nu staat, met prijzen en kenmerken. Dit deel veroudert langzamer dan de brief hierboven — maar controleer tarieven altijd bij de leverancier.

Frontier-modellen

prijs per miljoen tokens · gecontroleerd 7 september 2026
ModelLabDatumContextIn $Uit $Waar het opvalt
GPT-6 AstraOpenAI3 sep1,05M1050Boven 272K invoertokens telt het hele verzoek als $20/$75. OSWorld 2.0 72,6%, ~47% sneller per taak dan Sol.
Claude Fable 5.1Anthropic1 sep1M1050Cache-lezen $0,25 (−75%). Terminal-Bench-Science 52,6% tegen 24,7% voor Fable 5. Mythos 5.1 is de besloten tweeling.
Claude Opus 5Anthropic24 jul1M525De helft van de prijs van Fable 5.1 en nog steeds sterk op agentwerk. Fast mode $10/$50, ~2,5× sneller.
GPT-5.6 SolOpenAI9 jul1M530De vorige vlaggenschiplaag; basis voor GPT-5.6-Cyber.
GPT-5.6 TerraOpenAI9 jul1M2,5015Het werkpaard: GPT-5.5-niveau voor ongeveer de helft van de prijs.
GPT-5.6 LunaOpenAI9 jul1M16Volumewerk: classificatie, extractie, bulk-samenvatting.
Gemini 3.7 FlashGoogle13 aug1M0,753,75Introductietarief t/m 31 dec 2026; daarna $1,50/$7,50. AutomationBench 30,4% tegen 17,0% voor 3.6 Flash.
Qwen3.8-MaxAlibaba3 aug1M262,4 bln params MoE, ~95 mrd actief. Eén tarief over de hele context; cache-invoer $0,25.
Grok 4.6xAI12 aug—26Dubbel tarief ($4/$12) zodra een verzoek boven 200K tokens komt. 60,9 op de Artificial Analysis-index.
DeepSeek V4 ProDeepSeek12 aug—≈ 0,42≈ 0,87Uit preview, in yuan geprijsd (3 en 6 CNY). 53,0 op de index bij ongeveer een vijftiende van de kosten per taak.
Kimi K3Moonshot16 jul1M——2,8 bln params MoE, ~50 mrd actief. Open gewichten sinds 27 jul (aangepaste MIT), maar ~1,4 TB snel geheugen om te draaien.

Bewegend beeld

in de laatste weken van de Sora-API · gecontroleerd 7 september 2026
ModelSterkteGeluidPrijs per secondeStatus
Veo 3.1De sterkste allrounder: 4K, prompttrouw, referentiecontroleNative 48 kHz gesynchroniseerde dialoogLite $0,05 · Fast $0,15 · Std $0,40Beschikbaar
Kling 3.0 TurboLipsync op foneemniveau, ook met meerdere personages—≈ $0,11 – $0,14Beschikbaar
Seedance 2.5Verhalend het sterkst: meerdere shots in één pass, tot 50 referentiesStandaard mee gegenereerd—Beschikbaar
Runway Gen-4.5De meeste controle over shot en richting; bundelt ook Veo, Kling en Seedance——Beschikbaar
FLUX 3 Video20 seconden beeld + geluid in één generatie, meertalige dialoogNative, in sync—Nog gated early access
SoraOpende de categorie——App gestopt 26 apr · API stopt 24 sep

De agent-stack

wat waar zit · gecontroleerd 7 september 2026

Protocol

  • MCP — de facto standaard, sinds dec 2025 bij de Agentic AI Foundation (Linux Foundation)
  • MHS — sinds 27 aug in research preview: hetzelfde idee voor microscopen, robotarmen en productielijnen
  • Native ondersteund door Anthropic, OpenAI, Google en Microsoft

Werkplek

  • Claude Cowork — desktop, web en mobiel; remote sessies en geplande taken
  • Codex — OpenAI, sinds 3 sep met GPT-6 Astra erin
  • Agentic Computer — Alibaba’s sandbox voor veilige uitvoering

Orkestratie

  • LangGraph · CrewAI · Dify — code-first multi-agent
  • AgentTeams — Alibaba’s multi-agent-laag in Agent Native Cloud
  • n8n — visueel, voor teams zonder engineering

In de bestaande stack

  • Claudeforce — Salesforce in Claude met 37 sales-skills, open beta sep 2026
  • HubSpot Agent Hub — public beta, agents delen klantcontext
  • SAP Joule · ServiceNow · UiPath · Copilot Studio — RPA die agentic werd

Waar de aandacht heen gaat

cijfers voor de pitch · gecontroleerd 7 september 2026
25,11%

van de Google-zoekopdrachten toont een AI Overview, tegen 13,14% in maart 2025

Conductor, AEO/GEO Benchmarks 2026 (21,9 mln zoekopdrachten)
93%

van de AI-zoeksessies eindigt zonder één websitebezoek

Semrush
1,08%

van al het websiteverkeer komt uit AI — en groeit ~1 procentpunt per maand

Conductor, AEO/GEO Benchmarks 2026
87,4%

van dat AI-verwijsverkeer komt van ChatGPT alleen

Conductor, AEO/GEO Benchmarks 2026
$42B

venture-investering in augustus 2026: −25% t.o.v. juli, +122% jaar op jaar

Crunchbase
€15M

of 3% van de wereldomzet: de maximale boete onder artikel 50 van de EU AI Act

EU AI Act, art. 50

Bronnen

Waar dit vandaan komt

Introducing Claude Fable 5.1 and Claude Mythos 5.1anthropic.com · Anthropic, 1 sep 2026Anthropic’s Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for cache readsVentureBeat · 1 sep 2026OpenAI launches Astra, its powerful (and controversial) new modelTechCrunch · 3 sep 2026OpenAI announces rollout of GPT-6 Astra modelCNBC · 3 sep 2026Gemini 3.7 Flash: our most intelligent workhorse modelblog.google · Google, 13 aug 2026Google’s Gemini 3.7 Flash arrives before Gemini 3.5 ProAxios · 13 aug 2026Salesforce and Anthropic announce Claudeforcesalesforce.com · Salesforce, 26 aug 2026Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concernsCNBC · 26 aug 2026Previewing the Model Hardware Standardanthropic.com · Anthropic, 27 aug 2026How Claude’s text watermark worksanthropic.com · Anthropic, 14 aug 2026EU compliance, delivered globally: Anthropic to watermark Claude’s output worldwideEuronews · 11 aug 2026The EU AI Act’s transparency rules: a practical guide to Article 50artificialintelligenceact.euEU finalises transparency rules for AI-generated contentPaul, WeissOpenAI unveils new cybersecurity model GPT-5.6-CyberSecurityWeek · 10 aug 2026OpenAI launches two-tier access programme alongside GPT-5.6-CyberInfosecurity Magazine · 10 aug 2026Grok 4.6 vs DeepSeek V4 Pro: 14.9× the cost, 7.9 more index pointsSpeedway Media · 17 aug 2026Qwen3.8-Max: Alibaba’s 2.4T model, generally availableDataNorth · 3 aug 2026Global venture funding jumps 122% in August as streak of billion-dollar deals continuesCrunchbase News · sep 2026The 2026 AEO / GEO benchmarks reportConductorAI search statistics 2026: 60+ data points on visibility, citations and trafficSuperlinesSora 2 shuts down September 24: move your prompts nowPrompt ArchitectsAI news for September 1, 2026 — daily editionAI Weekly · 1 sep 2026

Over deze pagina. De brief hierboven draagt de datum van zijn editie; elk blok in de radar daaronder vermeldt wanneer het voor het laatst is nagelopen. Alles komt uit openbare bronnen, met de primaire bron waar die beschikbaar is — de lijst staat hierboven. Prijzen, benchmarkscores en releasedata komen deels uit vaknieuws en trackers; controleer tarieven altijd bij de leverancier voordat je erop begroot. Benchmarks zijn momentopnames en zeggen niets over jouw specifieke werk: hertest op je eigen taken.