Zoeken

Claude Opus 5, Midjourney koopt Co-Star, Jensen Huang verdedigt open modellen

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

24 juli 2026 wordt gedomineerd door één structurerende gebeurtenis: Anthropic lanceert Claude Opus 5, op dezelfde dag overgenomen door Cursor, Devin, v0 en GitHub Copilot — de cyclus tussen de uitgave van een model en de adoptie ervan in code-tools is inmiddels bijna onmiddellijk. Diezelfde dag kondigt Midjourney zijn allereerste overname aan (Co-Star), Jensen Huang (NVIDIA) publiceert zijn allereerste persoonlijke bericht op X om open modellen te verdedigen, en xAI voegt het orkestreren van honderden agents parallel toe aan Grok Build. Rond deze vier onderwerpen draaien vijftien opmerkelijke nieuwigheden — van het ecosysteem van code-tools tot de Enterprise-uitbreiding van Genspark — en negen kleinere aankondigingen.


Claude Opus 5: nieuw Anthropic-model, op dezelfde dag overgenomen door Cursor, Devin, v0 en GitHub Copilot

24 juli — Anthropic lanceert Claude Opus 5, het nieuwe model uit de Claude 5-familie naast Sonnet 5 en Fable 5. Officiële positionering: een « doordacht en proactief » model dat zich voor de helft van de prijs dichter beweegt naar de frontier-intelligentie van Claude Fable 5 — Anthropic’s meest capabele model. Het is vanaf vandaag beschikbaar op alle betaalde plannen en via de API (identificator claude-opus-5), tegen hetzelfde tarief als Opus 4.8: $5 per miljoen tokens input, $25 per miljoen output. Een Fast-modus, ongeveer 2,5× sneller, wordt gefactureerd tegen het dubbele van het basistarief. Opus 5 wordt het standaardmodel op Claude Max en het meest capabele model dat op Claude Pro wordt aangeboden.

BenchmarkResultaat Opus 5
Frontier-Bench v0.1Overtreft alle modellen, meer dan het dubbele van de score van Opus 4.8, tegen lagere kosten per taak
CursorBench (maximale inspanning)Op 0,5 punt van de beste score van Fable 5, voor de helft van de prijs
ARC-AGI 3 (onbekende problemen)Score ongeveer drie keer hoger dan de beste concurrent
OSWorld 2.0 (computergebruik)Overtreft het beste resultaat van Fable 5 voor ongeveer een derde van de kosten

Anthropic meldt ook vooruitgang in de levenswetenschappen: +10,2 punten in organische chemie (inferentie van moleculaire structuren) en +7,7 punten bij de voorspelling van effecten van variaties in eiwitsequenties, vergeleken met Opus 4.8. Belangrijke nuance: deze resultaten van « state of the art » hebben betrekking op code en kenniswerk — op het gebied van offensieve cyberbeveiliging blijft Opus 5 bewust achter Mythos 5 (model met beperkte toegang): de veiligheidsclassifiers blokkeren binair scannen op kwetsbaarheden, penetratietests en het genereren van exploits, terwijl het opsporen van kwetsbaarheden in broncode wel wordt toegestaan. Anthropic schat dat deze classifiers ongeveer 85 % minder vaak zullen ingrijpen dan bij Fable 5.

Wat afstemming betreft, geeft Anthropic aan dat Opus 5, volgens zijn interne geautomatiseerde gedragsaudit, tot nu toe het best afgestemde model is (score van 2,3 op globaal onaangepast gedrag, de laagste van zijn recente modellen). In Claude Code is het onmiddellijk bruikbaar via /model claude-opus-5 of via /claude-api migrate om bestaande workloads over te zetten, en start het standaard in een hoge inspanningsmodus.

🔗 Officiële aankondiging — Anthropic

It’s a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

🇳🇱 Het is een doordacht en proactief model dat zich voor de helft van de prijs dichter beweegt naar de frontier-intelligentie van Fable 5.@claudeai op X

Adoptie op dag één in code-tools. In minder dan een half uur kondigen drie code-tools de integratie aan met slechts enkele minuten ertussen, later op dezelfde dag gevolgd door GitHub Copilot:

IntegratietoolAankondigingstijd (24 juli)Onderscheidend detail
Cursor19:03Evenaart Fable 5 op CursorBench (66,7 vs 66,5 bij standaardinspanning), helft van de prijs, compatibel met Zero Data Retention
Devin (Cognition)19:07« Benadert » het niveau van Fable 5 op FrontierCode 1.1, voor de helft goedkoper
v0 (Vercel)19:29Onmiddellijk beschikbaar via v0.app/?opus5
GitHub CopilotZelfde dagVS Code, Visual Studio, Copilot CLI, cloud agent, JetBrains, Xcode… voor Pro+/Max/Business/Enterprise

Cursor is het meest precies, met exacte cijfers en een extra voordeel: compatibiliteit met Zero Data Retention, die Fable 5 niet biedt. Aan GitHub-kant wijst Copilot op goede resultaten voor agentische codeerworkflows — autonome wijzigingen, verificatie van regressievrije werking, coördinatie van meerdere tools — maar waarschuwt het dat het model beveiligingswaarborgen bevat die bepaalde verzoeken met betrekking tot cyberbeveiliging kunnen blokkeren, met de aanbeveling om de vraag te herformuleren of een ander model te kiezen bij blokkering. De uitrol van Copilot verloopt geleidelijk; Enterprise- en Business-beheerders moeten het beleid Claude Opus 5 activeren om hun teams toegang te geven.

🔗 Cursor kondigt de integratie aan

🔗 Devin kondigt de integratie aan — @cognition

🔗 v0 kondigt de integratie aan

🔗 GitHub Copilot — officiële changelog


Midjourney neemt Co-Star over, eerste overname in zijn geschiedenis

23 juli — Midjourney kondigt zijn allereerste overname aan: Co-Star, de gepersonaliseerde astrologie-app die bekendstaat om haar directe toon en virale meldingen. De oprichtster, Banu Guler, treedt bij Midjourney in dienst als de pas gecreëerde Chief Design Officer, verantwoordelijk voor het opbouwen van een dwarsdoorsnijdende Product/Design/Frontend-organisatie voor alle projecten van het bedrijf. Co-Star blijft zelfstandig functioneren, volledig onder haar controle en leiding.

De officiële post, in een zeer persoonlijke toon, plaatst deze overname in een bredere koers: er wordt verwezen naar Midjourney Medical als het begin van een « ongebruikelijk onderzoekslaboratorium » en er worden in de komende zes maanden nog een half dozijn even ambitieuze projecten aangekondigd. Midjourney, tot nu toe geconcentreerd op beeld- en videogeneratie, geeft daarmee een expliciete strategische diversificatie aan buiten zijn historische kernactiviteit. De repost op X, de volgende dag gepubliceerd, verzamelde binnen enkele uren meer dan 426.000 weergaven, 1.300 likes en 226 reposts.

🔗 Repost op X — 426.000 weergaven in enkele uren

“As an adult I find myself in the unusual position of having everything I wanted and two questions come to mind next: How can I use this opportunity to make baby David proud?”

🇳🇱 Als volwassene bevind ik me in de ongewone positie dat ik alles heb waar ik ooit van droomde, en dan komen er twee vragen op: hoe kan ik deze kans gebruiken om kleine David trots te maken?Midjourney, officiële changelog


NVIDIA: Jensen Huang publiceert zijn eerste X-post, een open brief ter verdediging van open modellen

24 juli — Jensen Huang, oprichter en CEO van NVIDIA, publiceert zijn allereerste persoonlijke bericht op X: een open brief ondertekend door NVIDIA, getiteld « Open Weights and American AI Leadership », over het belang van open modellen (open models). Daarin stelt hij dat AI « elke industrie zal transformeren, elk bedrijf zal voeden en door elk land zal worden gebouwd », en dat open modellen veiligheid en cyberbeveiliging versterken, innovatie versnellen en soevereiniteit mogelijk maken — een standpunt dat NVIDIA, via zijn eigen Nemotron-reeks die in open weights is uitgebracht, expliciet aan de kant van het open-weight-ecosysteem plaatst, tegenover gesloten laboratoria zoals OpenAI, Anthropic of Google.

De post heeft een ongebruikelijk grote betrokkenheid opgeleverd voor een allereerste persoonlijke boodschap: meer dan 23,6 miljoen weergaven, 98.000 likes en 23.700 reposts in enkele uren. Verschillende actoren in open-weight AI, waaronder MiniMax, hebben Jensen Huang in de daaropvolgende golf publiekelijk bedankt voor dit standpunt.

“Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models.”

🇳🇱 Open modellen versterken veiligheid en cyberbeveiliging, versnellen innovatie en verspreiding ervan, en maken soevereiniteit mogelijk. De wereld heeft zowel gesloten frontier-modellen als open frontier-modellen nodig.@JensenHuang op X


Workflows in Grok Build : xAI orkestreert honderden agents parallel

23 juli — xAI lanceert workflows in Grok Build, zijn commandoregel-codeagent (vergelijkbaar met Claude Code of Codex). De gebruiker beschrijft een complexe taak in natuurlijke taal; Grok plant automatisch een orkestratiescript — de werkfasen, de agents die aan elke fase zijn toegewezen, hoe hun resultaten worden teruggekoppeld — en voert het vervolgens op de achtergrond uit terwijl de sessie beschikbaar blijft voor iets anders.

Technische parameterGemeten waarde
Agents standaard128
Maximum agents (grote taken)1024
Uitgelichte demoGitHub pull request review in 4 fasen (Context → Review → Verify → Synthesize)
Live opvolgingOpdracht /workflows

De gespecialiseerde reviewers uit de demo laten hun conclusies adversarieel verifiëren door onafhankelijke « sceptici » voordat ze in het eindrapport belanden. De voortgang wordt continu opgeslagen — pauzeren en hervatten vereisen nooit dat al gedaan werk opnieuw wordt uitgevoerd. Workflows kunnen worden opgeslagen en hergebruikt: die in .grok/workflows/ worden gedeeld met het team, die in ~/.grok/workflows/ volgen de gebruiker overal, en elke opgeslagen workflow wordt zijn eigen parametriseerbare slash command (bijvoorbeeld /pr-review 5137). De functie /deep-research, die een onderzoeksvraag opsplitst tussen meerdere onderzoekers parallel en elke bewering tegen zijn bronnen verifieert, is standaard ingebouwd.

Door xAI uitgelichte use-cases: elke functie van een grote pull request nakijken, de laatste 100 Linear-tickets sorteren om er een actielijst uit af te leiden, of elke route-handler in een codebase auditen op ontbrekende authenticatiecontroles.

🔗 Officiële aankondiging — xAI


Het code-ecosysteem: minder prompt, meer agents

Claude Code: Anthropic verwijdert 80 % van de system prompt voor Claude 5-modellen

24 juli — Thariq (@trq212), van het Anthropic-team, publiceert een artikel dat de evolutie van de context engineering van Claude Code uiteenzet: Anthropic heeft meer dan 80 % van de system prompt van Claude Code verwijderd voor Claude 5-modellen zoals Opus 5 en Fable 5, zonder meetbaar verlies op code-evaluaties. De oude system prompts legden starre regels op — bijvoorbeeld nooit meerregelige commentaren schrijven — die overbodig waren geworden, omdat recente modellen beter oordelen hadden om tegenstrijdige instructies afhankelijk van de context te wegen. Het artikel formaliseert zes doctrineveranderingen, waaronder: strikte regels geven → Claude laten oordelen; alles vooraf in de prompt zetten → geleidelijke onthulling. Anthropic stelt deze praktijken beschikbaar via een nieuwe opdracht, /doctor, die helpt om skills en CLAUDE.md-bestanden van een project te auditen en te herschalen.

🔗 Volledige thread — @trq212

v0 zet een volledig Figma-bestand om in een app

24 juli — v0 (Vercel) breidt zijn Figma-integratie uit, tot nu toe eerder gericht op het importeren van afzonderlijke componenten: vanaf één enkele link doorzoekt de agent automatisch alle pagina’s en frames van het bestand, selecteert de relevante elementen — design tokens, kleuren, lay-out, tekst, iconen — en assembleert vervolgens de geïdentificeerde schermen tot één samenhangende applicatie, zonder handmatige frame-voor-frame selectie. De officiële documentatie beschrijft alle geëxtraheerde gegevens op de speciale pagina van v0 Docs.

🔗 Aankondiging — @v0

Copilot cloud agent for Linear wordt algemeen beschikbaar

23 juli — GitHub brengt de toewijzing van Linear-issues aan Copilot cloud agent naar algemene beschikbaarheid: zodra een issue wordt toegewezen, analyseert de agent het issue, opent een concept-pull-request in een tijdelijke omgeving aangedreven door GitHub Actions, werkt zijn voortgang bij in de Linear-tijdlijn en vraagt vervolgens om review. Nieuw ten opzichte van de preview: keuze van het model en van de aangepaste agent rechtstreeks vanuit Linear, instellen van doelbranches en het aansturen van de sessie via een simpele opmerking. Beschikbaar met de Copilot-abonnementen Pro, Pro+, Business en Enterprise.

🔗 Officiële changelog

GitHub MCP Server anticipeert op de volgende MCP-specificatie

23 juli — Het MCP-protocol (Model Context Protocol) wordt vanaf 28 juli 2026 stateless, en GitHub MCP Server ondersteunt deze nieuwe specificatie al vóór de officiële publicatie. Resultaat: verwijdering van Redis-sessies, snellere verbindingen zonder initialize-stap en een bijgewerkte elicitation-implementatie naar gescheiden HTTP-verzoeken. Omdat de niveau-1 SDK’s achterwaartse compatibiliteit behouden, is er geen actie vereist aan de kant van bestaande clients.

🔗 Officiële changelog

Sakana AI publiceert Fugu-Ultra v1.1 en een Claude Code-compatibele interface

24 juli — Sakana AI publiceert een update van zijn multi-model orkestratie-engine Fugu-Ultra (v1.1), met verbeteringen tot 7,9 punten ten opzichte van v1.0, vooral sterk op ProgramBench en Terminal Bench 2.1. Sakana claimt betere prestaties dan Fable 5 bij complex coderen en redeneren, zonder dit laatste zelfs maar op te nemen in zijn pool van georkestreerde modellen. Tegelijkertijd stelt Sakana Claude Code-compatibele endpoints beschikbaar om de multi-agent-intelligentie van Fugu rechtstreeks vanuit deze client te gebruiken in plaats van te vertrouwen op één enkel model.

🔗 Officiële aankondiging — Sakana AI


Google / Gemini : uitbreiding van Spark, beveiligingsfix voor Gemini CLI

Gemini Spark uitgebreid naar Google AI Pro-abonnees in de Verenigde Staten

23 juliGemini Spark, Google’s persoonlijke AI-agent die 24/7 op de achtergrond werkt om taken uit te voeren onder leiding van de gebruiker, zet een stap in zijn uitrol: na Google AI Ultra-abonnees wordt hij nu ook uitgerold naar abonnees van het veel grotere Google AI Pro-niveau, voorlopig in de Verenigde Staten. Google kondigt een uitbreiding naar meer landen aan, „binnenkort”. Dit is niet strikt genomen een nieuwe functie, maar een verandering in doelgroep die een premium autonome agent dichter bij het betalende grote publiek brengt.

🔗 Aankondiging — @GeminiApp

Gemini CLI v0.53.0-preview.0 verhelpt een RCE-kwetsbaarheid

22 juli — Nieuwe preview-release van Gemini CLI (nog niet opgenomen in de officiële stabiele changelog), met twee beveiligingsgerichte fixes: versterking van de isolatie van taken en van het vertrouwen in de werkruimte in de Agent-to-Agent-server om willekeurige code-uitvoering (RCE) te voorkomen, en mitigatie van prompt-injectielussen en eindeloze ReAct-lussen. Daarnaast zijn er een LLM-gebaseerde triage-orchestrator en een verharding van Seatbelt-profielen op macOS naar een deny-by-default-model.

🔗 Release GitHub v0.53.0-preview.0


OpenAI : ChatGPT Work verbindt zich met beveiligde sites, een diagnose gecorrigeerd dankzij ChatGPT

ChatGPT Work kan nu verbinding maken met sites die authenticatie vereisen

24 juli — De ChatGPT Work-agent kan nu sites gebruiken waarvoor een login nodig is: de gebruiker neemt het over op de cloudbrowser zolang het authenticeren duurt, waarna de agent de taak automatisch weer oppakt. Belangrijk punt: de verbinding blijft behouden van sessie tot sessie; één authenticatie volstaat voor de volgende taken op dezelfde site — een klassieke beperking van webnavigatie-agents die hiermee wordt opgeheven. Deze ontwikkeling vergroot het bereik van automatiseerbare taken naar interne bedrijfstools en door inloggegevens beveiligde SaaS-diensten.

🔗 Aankondiging — @OpenAIDevs

Hoe ChatGPT hielp bij het corrigeren van een kankerdiagnose

24 juli — OpenAI Newsroom vertelt hoe de man van Kiley, bij wie op 18-jarige leeftijd een glioblastoom werd vastgesteld met een prognose van enkele maanden en die vijf jaar later nog steeds leeft zonder duidelijke verklaring, ChatGPT gebruikte om een recent radiologieverslag te ontcijferen. Die lezing bracht hem terug naar de resultaten van de eerste biopsie, waar ChatGPT hielp om een over het hoofd gezien detail naar voren te halen: een IDH1-mutatie. In overleg met Kiley’s neuro-oncoloog maakte dat detail het mogelijk om de diagnose te herkwalificeren als IDH-gemuteerd astrocytoom — nog steeds ernstig, maar met een veel gunstiger prognose.

🔗 Getuigenis — @OpenAINewsroom


NVIDIA & generatieve video: snellere infrastructuur, meer samenwerkende agents

NVIDIA verkort de opstart van DeepSeek-V4 Pro van 8 minuten naar minder dan 2 minuten

24 juli — NVIDIA licht een optimalisatie voor inferentie-infrastructuur toe: de opstarttijd van een DeepSeek-V4 Pro-uitrol daalt van 8 minuten naar minder dan 2 minuten door de modelgewichten via het snelste pad naar het GPU-geheugen te transporteren met RDMA GPU-naar-GPU. Het mechanisme steunt op NVIDIA ModelExpress, de service voor distributie en caching van gewichten die is geïntegreerd in NVIDIA Dynamo, het platform voor gedistribueerde inferentie. NVIDIA zegt dat dezelfde aanpak ook de reinforcement post-training versnelt.

🔗 Aankondiging — @NVIDIAAI

Runway voegt Workflows in natuurlijke taal toe aan zijn agent

24 juli — Runway voegt een Workflows-functie toe aan Runway Agent: het wordt mogelijk om node-based workflows te bouwen, uit te voeren of aan te passen rechtstreeks in natuurlijke taal, in plaats van via handmatige manipulatie van een visuele editor. Los van de Media Router die de dag ervoor werd gelanceerd — en die de automatische selectie van generatieve modellen op basis van kosten, kwaliteit en latency beheert — richt Workflows zich op de orkestratie van de productiestappen zelf.

🔗 Aankondiging — @runwayml

HeyGen — Companion mode: de video sturen in plaats van hem te bestellen

22 juli — HeyGen introduceert de companion mode voor zijn Video Agent: in plaats van een video te bestellen via één enkele prompt, stuurt de gebruiker hem iteratief — de agent stelt vijf creatieve invalshoeken voor, presenteert een storyboard ter goedkeuring en schetst vervolgens de sleutelbeelden die vóór de uiteindelijke generatie moeten worden bekeken. De gebruiker houdt op elke stap de controle en start de volledige productie pas na goedkeuring. Deze functie beantwoordt aan een veelgehoorde kritiek op video generators „in één keer” — onvoorspelbaar resultaat, iteraties die tijd en credits kosten — door de ervaring dichter bij samenwerking met een menselijke regisseur te brengen.

🔗 Aankondiging — @HeyGen


Genspark: partnerschap met Microsoft en investering van 100 miljoen dollar in Japan

SecondBrain integreert met Outlook, Teams en Microsoft Agent 365

24 juli — Bij de lancering van Genspark 6.0 in Seoel licht Genspark een strategisch partnerschap met Microsoft toe: SecondBrain, de laag voor persistente herinnering van zijn agents, integreert voortaan rechtstreeks in Outlook, Office, Teams, en ook Microsoft Agent 365 — waarvan Genspark aangeeft wereldwijde lanceringspartner te zijn geweest. Alles draait op Azure, dat volgens de presentatie de robuustheid garandeert die in een bedrijfsomgeving wordt verwacht. In het bericht worden Satya Nadella (CEO van Microsoft), Judson Althoff en Rodrigo Kede expliciet bedankt. Dit onderdeel stond niet in het oorspronkelijke lanceringsbericht van 20 juli.

🔗 Aankondiging — @genspark_ai

Genspark investeert 100 miljoen dollar in 3 jaar in Japan

24 juli — Na een evenement in Tokio op 21 juli voor zakelijke klanten, industriële partners en Japanse influencers — het tweede van Genspark in het land — kondigt het bedrijf een investering van $100 miljoen aan over de komende drie jaar in Japan, slechts zes maanden na de opening van zijn lokale activiteiten. Drie prioriteiten: dataresidency voor in aanmerking komende klanten (financiële instellingen, overheidsinstanties, grote ondernemingen), end-to-end-partnerschappen met resellers en integrators, en versterking van de teams op het terrein, in de taal en tijdzone van de klanten.

🔗 Aankondiging — @genspark_ai


Grok komt naar Google Workspace

24 juli — xAI lanceert een gratis add-on die Grok rechtstreeks integreert in Sheets, Slides en Docs, te installeren vanuit de Google Workspace Marketplace. In Sheets beantwoordt Grok vragen door de gebruikte cellen te citeren en formules te schrijven; in Slides zet het een outline om in een presentatie met behoud van het bestaande thema; in Docs schrijft en corrigeert het rechtstreeks op de plek van het schrijven, met toegang tot recente e-mails en Drive-bestanden als de connectors zijn geactiveerd. Deze integratie vult de suite aan die al beschikbaar is aan de Microsoft 365-kant (Word, Excel, PowerPoint, Outlook), gelanceerd tussen juni en juli.

🔗 Officiële aankondiging — xAI


Kort nieuws

  • Replit vat zijn nieuwtjes van de maand samen — spraakagent, creatie vanuit Claude of Slack, persistente stackgeheugen; minstens één van de genoemde mogelijkheden lijkt overlappen met een integratie die al op 17 juni werd gepubliceerd. 🔗 Bron
  • Kimi K3 bijna gelijk met Claude Fable 5 op DeepSWE — pass@1 met 1,4 punt verschil, maar voor op pass@2/pass@4, tegen 2,8× lagere kosten per opgeloste taak (Together AI). 🔗 Bron
  • Collectieve verklaring over open modellen als route naar AI-veiligheid — coalitie van een vijftiental organisaties waaronder Hugging Face, Meta, Mistral AI, NVIDIA en Microsoft, opnieuw geplaatst door het officiële account @huggingface. 🔗 Bron
  • HeyGen lanceert een Audio to Video API — stem en beeld naar video in één enkele call, met batchverwerking (bijv. 100 vertellingen op dezelfde afbeelding). 🔗 Bron
  • ElevenLabs publiceert een artikel over AI-stem en verkiezingsbescherming — institutionele positionering in aanloop naar belangrijke verkiezingsmomenten. 🔗 Bron
  • HeyGen — HyperFrames, dag 18 van 30 — nieuwe aflevering van de dagelijkse reeks, gewijd aan het gebruik ervan in Video Agent. 🔗 Bron
  • Zvec 0.6.0, vectorzoekmachine van Tongyi Lab (Alibaba) — Group-By-zoeken, meer dan 50 recall-punten gewonnen bij INT4-kwantisatie, uitgebreide ondersteuning voor 34 talen. 🔗 Bron
  • xAI vermenigvuldigt de third-party plugins in Grok Build — Tavily en Exa voor webzoekopdrachten, Grok STT beschikbaar op OpenRouter voor $0,10 per audio-uur. 🔗 Bron
  • ChatGPT Pet wordt deelbaar tussen gebruikers — deelbare link vanuit de instellingen voor Personalisatie op het web, zodat een andere gebruiker het pet kan overnemen. 🔗 Bron

Wat dit betekent

De lancering van Opus 5 illustreert een structurele verschuiving in de manier waarop frontier-modellen hun gebruikers bereiken: Cursor, Devin en v0 integreren het in minder dan een half uur, GitHub Copilot op dezelfde dag. De cyclus uitrol → adoptie, die nog niet zo lang geleden in weken werd gemeten, is nu bijna nul voor de best met het Anthropic-ecosysteem verbonden codetools — een dynamiek die het differentiatievenster tussen laboratoria evenredig verkort en de concurrentie verschuift naar integratiesnelheid naast de ruwe modelprestaties.

Op dezelfde dag klinkt met dezelfde intensiteit een tegengeluid. Jensen Huang publiceert zijn allereerste persoonlijke verklaring op X om open modellen te verdedigen als route naar veiligheid en soevereiniteit; een coalitie van een vijftiental organisaties, waaronder Hugging Face en Meta, brengt een vergelijkbare verklaring naar voren; en Sakana AI claimt Fable 5 te overtreffen door meerdere modellen te orkestreren zonder het zelfs in zijn pool op te nemen. Twee visies op AI-veiligheid — de ene gebaseerd op propriëtaire controle, de andere op transparantie van de gewichten — botsen op dezelfde dag publiekelijk, zonder dat duidelijk één van beide de overhand krijgt.

Cybersecurity blijft bovendien functioneren als een marker van bewuste voorzichtigheid in plaats van brute prestatie. Anthropic plaatst Opus 5 bewust achter Mythos 5 op offensieve taken, met specifieke classifiers die kwetsbaarheidsscans, pentests en exploitgeneratie blokkeren. Tegelijk corrigeert Google in Gemini CLI een kwetsbaarheid voor willekeurige code-uitvoering aan de serverzijde van agent-to-agent — een herinnering dat ook de agentische tools zelf, en niet alleen de modellen die ze bevatten, een aanvalsoppervlak blijven dat continu beveiligd moet worden.


Bronnen