Naar inhoud
BlackOak AgencyBlackOak.agency

// AI RADAR

AI Radar

Wat er in AI uitkomt aan modellen, agents, video en kapitaal — met per ontwikkeling wat het is, waarom het telt en wat je er maandag mee doet. Onder de brief staat het landschap: prijzen, tools en cijfers die langer meegaan.

De week in kunstmatige intelligentie

Zeven modellen in zeven dagen. De vraag is niet meer welk model wint.

Tussen 7 en 24 juli kwamen er vijf frontier-modellen bij, verdween Sora uit de markt, ging Claude Cowork van bureaublad naar server en zette een Duits beeldlab zijn model op een Audi-productielijn. Dit is wat er overblijft als het stof neerdaalt — en wat je er maandag mee doet.

Juli 2026 — de releasekalender

← sleep om te schuiven

  1. AnthropicCowork naar web en mobiel07 JUL
  2. xAIGrok 4.508 JUL
  3. OpenAIGPT-5.6 — Sol, Terra, Luna09 JUL
  4. Helsing$1,8 mrd13 JUL
  5. MoonshotKimi K3 — 2,8 bln params16 JUL
  6. AlibabaAgent Native Cloud18 JUL
  7. GoogleDrie Gemini Flash-modellen21 JUL
  8. Black Forest LabsFLUX 323 JUL
  9. AnthropicClaude Opus 524 JUL
  10. MoonshotKimi K3 open gewichten27 JUL

De brief

Zes ontwikkelingen die je stack veranderen

Op datum, met wat er is gebeurd, waarom het telt en wat je eraan hebt.

07.07.2026Agents

Cowork verlaat het bureaublad — en blijft doorwerken als jij afsluit

Anthropic bracht Claude Cowork, sinds januari alleen een desktop-app, naar het web en naar iOS en Android — in beta, te beginnen bij Max-abonnees. De nieuwe versies draaien op een wezenlijk ander model: sessies staan op Anthropic’s servers, horen bij je account en lopen door zonder dat er één apparaat aanstaat. Geplande taken inbegrepen.

Waarom het telt

Dit is de eerste keer dat delegeren écht asynchroon is. Niet "de agent werkt terwijl ik toekijk", maar "de klus staat er morgenochtend". Anthropic’s eigen cijfers laten zien waar dat landt: 33,4% van het gebruik is bedrijfsproces en operations, 16,4% content en copywriting. Dat is precies het werk dat een bureau nu nog handmatig doet.

Wat nu

Geef een agent een map, nooit je schijf. Anthropic waarschuwt zelf voor destructieve acties bij dubbelzinnige instructies en voor indirecte prompt-injectie via bestanden en websites. Menselijke review op alles wat naar buiten gaat — mail, publicatie, betaling — is geen voorzichtigheid maar ontwerp.

09.07.2026Modellen

GPT-5.6 komt in drie lagen: Sol, Terra en Luna

OpenAI zette op 9 juli alle drie de lagen algemeen beschikbaar via de API en Codex, na een preview vanaf 26 juni. Sol is het vlaggenschip ($5/$30 per miljoen tokens), Terra het dagelijkse werkpaard ($2,50/$15), Luna de volumelaag ($1/$6). Alle drie: 1 miljoen tokens context, 128K output, kenniscutoff 16 februari 2026. De Responses API kreeg programmatic tool calling.

Waarom het telt

De suffixen mini en nano zijn weg. Sol, Terra en Luna zijn blijvende capaciteitslagen die elk hun eigen tempo mogen hebben. Praktisch betekent dat: je routeert per taak op prijs in plaats van per project op modelnaam, en je prompts overleven de volgende release.

Wat nu

Zet Luna op classificatie, extractie en bulk-samenvatting; Terra op redactiewerk; Sol alleen waar redeneren echt geld waard is. Het verschil tussen Luna en Sol is een factor vijf aan de invoerkant en vijf aan de uitvoerkant.

16.07.2026Open

Kimi K3 is open — en past op geen enkele machine die jij hebt

Moonshot AI bracht Kimi K3 op 16 juli via de API en publiceert de volledige gewichten op 27 juli onder een aangepaste MIT-licentie. Het is een mixture-of-experts van 2,8 biljoen parameters met ongeveer 50 miljard actief per token, 1 miljoen tokens context, en invoer in tekst, beeld en video. In de Frontend Code Arena pakte K3 de eerste plaats met 1.679 punten, vóór Fable 5 (1.631) en GPT-5.6 Sol (1.618).

Waarom het telt

"Open" is niet hetzelfde als "zelf te draaien". Zelfs op vier bits weegt K3 ongeveer 1,4 terabyte aan snel geheugen — dat zijn server-nodes met Blackwell of MI400, geen werkstation onder je bureau. De rekening verschuift van API-abonnement naar hardware en operations, en dat is voor de meeste bureaus een slechtere ruil.

Wat nu

Behandel open gewichten als onderhandelingspositie, niet als migratieplan. Ze drukken de prijs van gehoste modellen en geven je een uitweg bij leveranciersrisico. Draaien doe je bij een provider die de nodes al heeft staan.

23.07.2026Video

FLUX 3 leert beeld, video, geluid en handelen in één architectuur

Black Forest Labs kondigde op 23 juli FLUX 3 aan: één multimodaal fundamentmodel dat beeld, video en audio gezamenlijk leert, plus actievoorspelling. De kopregel is video tot twintig seconden met native, synchroon geluid in één generatie — inclusief meertalige dialoog, in verschillende stijlen en beeldverhoudingen. Video ging direct in gated early access, Image volgt over enkele weken, de open-weight Dev-variant komt als laatste. Een robotica-variant wordt getest op productielijnen van Audi.

Waarom het telt

Voor een bureau schrapt beeld-plus-geluid-in-één-generatie een hele montagestap. Geen losse voice-over die je later op het beeld legt, geen lipsync-correctie achteraf. Dat een beeldlab tegelijk naar robotica beweegt zegt bovendien iets over waar generatieve modellen heen gaan: van plaatje naar handeling.

Wat nu

De evaluaties zijn nog vroeg — het lab zegt het zelf. Zet FLUX 3 in voor pitchmateriaal en socials waar twintig seconden genoeg zijn; houd Veo of Kling erbij zolang je op gated access wacht.

24.07.2026Modellen

Claude Opus 5 wint de benchmark die er voor agents toe doet

Anthropic bracht Opus 5 op 24 juli uit voor dezelfde prijs als Opus 4.8: $5 in, $25 uit per miljoen tokens, met een Fast mode op het dubbele tarief die ongeveer 2,5× sneller draait. Eén miljoen tokens context, 128K output, kenniscutoff mei 2026 — de meest actuele van alle Claude-modellen. Op Frontier-Bench v0.1 meer dan een verdubbeling van Opus 4.8; op ARC-AGI 3 driemaal de score van de nummer twee; op OSWorld 2.0 boven het beste resultaat van Fable 5 tegen ruim een derde van de kosten.

Waarom het telt

OSWorld meet computergebruik: klikken, formulieren, echte schermen. Dat is de benchmark die voorspelt of een agent jouw werk kan overnemen, veel meer dan een kennisquiz. Een sprong dáár tegen een derde van de kosten verandert welke taken je überhaupt durft te delegeren.

Wat nu

Opus 5 is de nieuwe standaard op Claude Max en het sterkste model op Pro. Draai je eigen taken nog op een model uit 2025, dan betaal je hetzelfde voor minder. Herbenchmark je twee zwaarste workflows deze week.

H1 2026Markt

AI-zoek is geen experiment meer, het is een kanaal — en bijna niemand meet het

ChatGPT passeerde eind februari 2026 de 900 miljoen wekelijkse gebruikers. HubSpot’s State of Marketing 2026 vond dat de helft van de consumenten AI-zoek gebruikt, en dat 44% daarvan het hun primaire bron noemt voor het ontdekken van producten — vóór klassieke zoekmachines op 31%. Tegelijk meet slechts 14% van de marketeers hoe ze het in AI-zoek doen.

Waarom het telt

Het gat tussen "de helft van je markt zoekt hier" en "14% meet het" is het hele verhaal. Wie vandaag een meetbaar antwoord heeft op de vraag welk deel van de vraag via AI-antwoorden loopt, verkoopt geen trend maar een cijfer.

Wat nu

Begin met een nulmeting: voor welke vragen word je genoemd in ChatGPT, Perplexity, Gemini en Google’s AI-overzichten, en met welke bron? Dat is een rapport dat je vandaag kunt maken en dat vrijwel niemand heeft.

Signalen

Kort, maar niet onbelangrijk

21 JUL · GOOGLE

Drie Flash-modellen, geen flagship

Gemini 3.6 Flash (tot 17% minder tokengebruik), 3.5 Flash-Lite en een security-model 3.5 Flash Cyber voor overheden en partners. De 3.5 Pro die in mei "volgende maand" heette, zit nog bij testpartners. Pretraining voor Gemini 4 is begonnen.

26 APR / 24 SEP · OPENAI

Sora is uit de markt

Web en app stopten op 26 april 2026, de API stopt op 24 september. De categorie die OpenAI opende wordt nu verdeeld door Veo, Kling, Seedance en Runway. Wie nog op de Sora-API bouwt, heeft twee maanden.

2026 · MCP

Van protocol naar infrastructuur

41% van de onderzochte softwareorganisaties draait MCP-servers in beperkte of brede productie. De registry telde eind mei 9.652 servers; de Python- en TypeScript-SDK’s samen ongeveer 97 miljoen downloads per maand. Sinds december 2025 in beheer bij de Agentic AI Foundation onder de Linux Foundation.

18–22 JUL · ENTERPRISE

Agents kruipen in de bestaande stack

HubSpot opende Agent Hub en Agent Builder in public beta, Alibaba Cloud kondigde op de WAIC een Agent Native Cloud aan met multi-agent-orkestratie en een sandbox, en Ushur lanceerde een platform dat klantreizen end-to-end afhandelt. De verschuiving: van demo naar één echt proces met menselijke review.

H1 2026 · KAPITAAL

$510 miljard, en twee namen pakken 43%

Crunchbase telde een record van $510 mrd aan wereldwijde startupinvesteringen in de eerste helft van 2026. OpenAI en Anthropic haalden samen $217 mrd op — 43% van elke venture-dollar wereldwijd. Databricks tekende op 16 juli een term sheet op een waardering van $188 mrd.

Radar

Het landschap, niet het nieuws

Wat er nu staat, met prijzen en kenmerken. Dit deel veroudert langzamer dan de brief hierboven — maar controleer tarieven altijd bij de leverancier.

Frontier-modellen

prijs per miljoen tokens · gecontroleerd 27 juli 2026
ModelLabDatumContextIn $Uit $Waar het opvalt
Claude Opus 5Anthropic24 jul1M525ARC-AGI 3 op 3× de nummer twee; OSWorld 2.0 boven Fable 5. Fast mode $10/$50, ~2,5× sneller.
GPT-5.6 SolOpenAI9 jul1M530Vlaggenschip-laag; programmatic tool calling in de Responses API.
GPT-5.6 TerraOpenAI9 jul1M2,5015Het werkpaard: GPT-5.5-niveau voor ongeveer de helft van de prijs.
GPT-5.6 LunaOpenAI9 jul1M16Volumewerk: classificatie, extractie, bulk-samenvatting.
Grok 4.5xAI8 jul26Ondersnijdt de Opus 4.8-prijs met ruim 60%.
Gemini 3.6 FlashGoogle21 julTot 17% minder tokengebruik dan 3.5 Flash, en goedkoper. 3.5 Pro nog bij partners.
Kimi K3Moonshot16 jul1M2,8 bln params MoE, ~50 mrd actief. Open gewichten 27 jul (aangepaste MIT). #1 Frontend Code Arena, 1.679 punten.

Bewegend beeld

na het vertrek van Sora · gecontroleerd 27 juli 2026
ModelSterkteGeluidPrijs per secondeStatus
Veo 3.1Cinematisch de sterkste in de vergelijkingen van 2026Native 48 kHz gesynchroniseerde dialoogLite $0,05 · Fast $0,15 · Std $0,40Beschikbaar
Kling 3.0 TurboLipsync op foneemniveau, ook met meerdere personages≈ $0,11 – $0,14Beschikbaar
Seedance 2.530 seconden in één pass, tot 50 multimodale referentiesBeschikbaar
Runway Gen-4.5De meeste controle over shot en richtingBeschikbaar
FLUX 3 Video20 seconden beeld + geluid in één generatie, meertalige dialoogNative, in syncGated early access
SoraOpende de categorieApp gestopt 26 apr · API stopt 24 sep

De agent-stack

wat waar zit · gecontroleerd 27 juli 2026

Protocol

  • MCPde facto standaard, sinds dec 2025 bij de Agentic AI Foundation (Linux Foundation)
  • 9.652 servers in de registry · ~97M SDK-downloads per maand · 41% van organisaties in productie
  • Native ondersteund door Anthropic, OpenAI, Google en Microsoft

Werkplek

  • Claude Coworkdesktop, web en mobiel; remote sessies en geplande taken
  • Agentic ComputerAlibaba’s sandbox voor veilige uitvoering
  • CodexOpenAI, met GPT-5.6 in drie lagen

Orkestratie

  • LangGraph · CrewAI · Difycode-first multi-agent
  • AgentTeamsAlibaba’s multi-agent-laag in Agent Native Cloud
  • n8nvisueel, voor teams zonder engineering

In de bestaande stack

  • HubSpot Agent Hubpublic beta, agents delen klantcontext
  • Salesforce Agentforce · SAP Joule · ServiceNow
  • UiPath · Copilot Studio · Automation AnywhereRPA die agentic werd

Waar de aandacht heen gaat

cijfers voor de pitch · gecontroleerd 27 juli 2026
900M+

wekelijkse ChatGPT-gebruikers, eind februari 2026

OpenAI / ChatGPT
50%

van de consumenten gebruikt AI-zoek

HubSpot, State of Marketing 2026
44%

van hen noemt AI-zoek hun primaire bron voor productontdekking, tegen 31% klassieke zoek

HubSpot, State of Marketing 2026
14%

van de marketeers meet hun prestaties in AI-zoek

HubSpot, State of Marketing 2026
$510B

wereldwijde startupinvestering in H1 2026 — een record

Crunchbase
43%

van elke venture-dollar ging naar OpenAI en Anthropic samen

Crunchbase

Bronnen

Waar dit vandaan komt

Over deze pagina. De brief hierboven draagt de datum van zijn editie; elk blok in de radar daaronder vermeldt wanneer het voor het laatst is nagelopen. Alles komt uit openbare bronnen, met de primaire bron waar die beschikbaar is — de lijst staat hierboven. Prijzen, benchmarkscores en releasedata komen deels uit vaknieuws en trackers; controleer tarieven altijd bij de leverancier voordat je erop begroot. Benchmarks zijn momentopnames en zeggen niets over jouw specifieke werk: hertest op je eigen taken.