ai-powered-markdown-translatorArtikel vertaald van het Frans naar het Nederlands met gpt-5.6-sol.
Op zaterdag en zondag bleven de laboratoria stil: DeepSeek, Meta, Ai2, Sakana, Mistral noch xAI publiceerde iets, en de officiële accounts rond open modellen bleven twee dagen lang leeg. Er was maar één echte release: Qwen-Image-2.1, zondag halverwege de middag uitgebracht met open gewichten. De rest bestaat grotendeels uit vijf berichten op de communityblog van Hugging Face, een versie van Antigravity die niets verhelpt en twee GitHub-changelogitems van 18 september die alsnog zijn meegenomen — een rustige dag die nergens voor hoeft te worden opgeblazen.
Qwen-Image-2.1, één model om transparante beelden te genereren, te bewerken en op te leveren
20 september — Qwen heeft Qwen-Image-2.1, zijn model voor het genereren en bewerken van afbeeldingen, met open gewichten gepubliceerd op Hugging Face, ModelScope en GitHub. Het verkooppunt is niet de omvang, maar de eenmaking: dezelfde reeks gewichten ondersteunt zowel creatie op basis van een tekstinstructie als het retoucheren van bestaande afbeeldingen, terwijl voor die twee toepassingen voorheen twee modellen nodig waren.
De concreetste vernieuwing is native transparantie: het model produceert en wijzigt rechtstreeks RGBA-lagen, waarbij de instructie bepaalt of de uitvoer een transparantiekanaal bevat. Qwen bood deze mogelijkheid sinds december 2025 aan via een speciaal model, Qwen-Image-Layered, dat nu is opgenomen. Daarmee verdwijnt een uitknipstap: een onderwerp uit een foto extraheren als herbruikbare laag, of tekst vervangen in een transparante laag.
Voor bewerking accepteert het model maximaal 10 referentieafbeeldingen voor één compositie. Het te retoucheren gebied kan worden aangeduid met een gekleurde cirkel, een geschilderde annotatie of een afzonderlijk aangeleverd masker — die derde methode bestaat omdat de eerste twee de oorspronkelijke inhoud bedekken. De efficiëntie berust op aandacht met gemengde granulariteit, waarbij de bewerkingsinvoer een statische context vormt die vanaf de eerste stap in de cache wordt opgeslagen.
| Technisch element | Aangekondigde waarde |
|---|---|
| Parameters voor visuele generatie | 7 miljard, verdeeld over 32 Single-Stream DiT-lagen |
| Geaccepteerde referentieafbeeldingen | Maximaal 10 |
| Transparantie van de uitvoer | Native RGBA-lagen, zowel bij generatie als bij bewerking |
| Opgenomen gespecialiseerd model | Qwen-Image-Layered, gepubliceerd in december 2025 |
| Ondersteuning vanaf de eerste dag | vLLM-Omni en ComfyUI |
Qwen publiceert een vergelijking op Qwen-Image-Bench, maar de waarden staan alleen in een afbeelding bij het bericht en worden daarom hier niet overgenomen.
Generate, edit, and create transparent images with one model: a 7.1B DiT paired with Qwen3-VL-8B.
🇳🇱 Afbeeldingen genereren, bewerken en transparant maken met één model: een DiT met 7,1 miljard parameters, gekoppeld aan Qwen3-VL-8B. — @vllm_project op X
Qwen Code v0.24.2, volledige spraakfunctionaliteit in de Web Shell en een uitgebreidere bwrap-sandbox
Dezelfde maker, dezelfde dag, een ander product. 20 september — v0.24.2 van Qwens command-line-codeagent verscheen iets meer dan vierentwintig uur na v0.24.1 en is de eerste versie in deze reeks zonder breaking changes, terwijl de twee voorgaande versies er elk één bevatten.
De bubblewrap-sandbox krijgt een volledige uitvoeringsbasis: gestructureerd starten van processen, toezicht en geïsoleerde workers. In dezelfde sfeer vereist een werkruimte waarvan de vertrouwensstatus nog niet is bepaald voortaan een expliciete beslissing. De Web Shell maakt de functie Live Voice daadwerkelijk bruikbaar: het model en de stem kunnen vanuit de configuratiekaart worden gekozen en het microfoonniveau wordt tijdens het gesprek weergegeven. Voor wie meerdere sessies parallel uitvoert, wordt elk inkomend bericht voortaan geëvalueerd voor de sessie waarvoor het bestemd is en blijft de promptcache behouden voor uitgestelde tools.
Een antwoord verifiëren zonder een token te schrijven, en een ranglijst waarvan de auteur rechter in eigen zaak is
20 september — Twee berichten, op dezelfde dag, over dezelfde set van 2.018 items. Het eerste presenteert Zero-Token Confidence: een probe leest in één voorwaartse doorgang de laatste verborgen toestand van het model en leidt daaruit een gekalibreerde waarschijnlijkheid af, zonder een token te genereren. Het model vragen of het zeker is, levert een oppervlakte onder de curve van 0,5000 op, oftewel toeval; zijn interne toestand uitlezen levert 0,8801 op, in 0,0615 seconde tegenover 1,631 voor het genereren van een antwoord. In het tweede worden dertien verificateurs erop losgelaten: slechts drie overschrijden 0,70 en ZTC ligt 0,0014 voor op JEV, een niet te onderscheiden verschil.
Het stevigste resultaat ligt elders: een referentiemethode die uitsluitend kijkt naar de lengte en opmaak van het antwoord en nooit naar de inhoud, behaalt 0,7036 en verslaat acht van de dertien systemen. Kanttekening: de auteur van de ranglijst is geen neutrale derde — hij geeft aan ook zijn eigen systeem te meten, zonder te vermelden welk van de dertien dat is, en beide berichten verschijnen op dezelfde dag. De cijfers kunnen kloppen; de onafhankelijkheid van de ranglijst staat echter niet vast.
Een LoRA van 54 dollar die tegelijk verbetert en beschadigt
20 september — ScalablyAI heeft voor 53,88 dollar twee LoRA-adapters op Qwen3.8-27B getraind met de 143.145 blokken toolgebruik die door zijn agentplatform waren verzameld, en deze vervolgens geëvalueerd met een testsuite die vóór de eerste trainingsstap was bevroren.
Het resultaat heeft twee kanten. Bij 73 hersteltoestanden na een afgewezen toolaanroep stijgt de adapter van 31 naar 38 successen, waarbij zeven gevallen in zijn voordeel omslaan en geen enkel geval in zijn nadeel. Maar bij 73 beslissingen over een foutloos traject daalt hij van 49 naar 45, vijf en een half punt tegenover een grens van twee. Omdat het verwijderen van een adapter atomair gebeurt, betekende het vermijden van die achteruitgang ook dat de winst moest worden opgegeven: beide adapters zijn afgewezen. Vandaar de gekozen architectuur — aan de ene kant 433 bewerkbare geheugenregels, aan de andere kant gewichten die met rust worden gelaten.
If every useful experience immediately changes the weights, learning and corruption can become the same operation, and at production sample sizes you cannot tell which one you performed.
🇳🇱 Als elke nuttige ervaring de gewichten onmiddellijk wijzigt, kunnen leren en beschadigen dezelfde handeling worden, en met de aantallen waarover de productie beschikt kun je niet weten welke van de twee je zojuist hebt uitgevoerd. — pavle-scalably op de Hugging Face-blog
🔗 Volledig rapport en bewijsregister
SeamFlow plaatst UV-naden waar een kunstenaar ze zou aanbrengen
20 september — Om een 3D-oppervlak naar 2D uit te vouwen, moet het worden doorgesneden; een goede indeling plaatst deze naden waar ze het minst zichtbaar zijn. SeamFlow, gepresenteerd door Meshy AI samen met de City University of Hong Kong, Bambu Lab en de Nanyang Technological University, verandert vóór het model de representatie: elke rand van de mesh wordt een token en het binaire label wordt versoepeld tot een continue waarde, waardoor flow matching toepasbaar wordt.
De voordelen zijn structureel: er is geen projectiestap of willekeurige tokenvolgorde meer en elke voorspelde snede valt op een bestaande rand. Het model is getraind op 350.000 Objaverse-meshes met door professionals gemaakte naden en plaatst zijn sneden in de plooien: de gemiddelde dihedrale hoek langs de naden bedraagt 67,59 graden, tegenover 56,65 voor xatlas en 55,97 voor PartUV. Het vouwt een model uit in 5,63 seconden, tegenover 11,46 voor een autoregressieve referentiemethode, en wordt in 61,0% van de gevallen als eerste keuze verkozen, tegenover 19,1% voor de nummer twee.
🔗 SeamFlow
Antigravity 2.15.1 stelt de sandbox beschikbaar op Windows, zonder hem in te schakelen
19 september — Versie 2.15.1 van Antigravity is in één regel samen te vatten: sandboxing van bestanden en het netwerk komt naar Windows. Eén enkele verbetering en geen enkele bugfix, terwijl versie 2.15.0 van de dag ervoor er zeven respectievelijk zestien bevatte — een gerichte toevoeging, geen onderhoudsrelease.
Het verschil met de rest van het aanbod is het eigenlijke onderwerp. Onder Linux berust de sandbox op kernel-namespaces; onder macOS op de Seatbelt-profielen van sandbox-exec; in beide gevallen is hij standaard actief. Op Windows is de gebruikte primitive niet gedocumenteerd, blijft activering handmatig via een selectievakje ‘Enable Sandbox Mode (Preview)’ en schakelt geen van de drie aangeboden beveiligingsinstellingen — Default, Full machine, Turbo mode — hem in: het aanvinken van het vakje zet de instelling op Custom. Google kondigt gelijktrekking in een latere versie aan, zonder tijdschema.
Kort nieuws
- Vijf annotatoren, dezelfde instructie, vijf verschillende antwoorden — voor 100 Turkse scènes en een menselijke referentie met 9 positieve gevallen komen vijf machineannotatoren uit op 0 tot 78 positieve gevallen, waarbij alle Cohen-kappawaarden tussen 0,000 en 0,185 blijven ondanks een ruwe overeenstemming van 74,7 tot 86,3%. De auteur, die verklaart de maker van het geëvalueerde schema te zijn, herinnert eraan dat een ontwerper geen neutrale beoordelaar is van de overdraagbaarheid van zijn schema. 🔗 bron
- De nightly van Gemini CLI van 20 september bevat geen wijzigingen — de tag
v0.62.0-nightly.20260920.gcfbcaa8dfverwijst naar dezelfde commit als die van de dag ervoor, met hetzelfde hash-achtervoegsel, en de releasepagina toont geen sectie ‘What’s Changed’. Ook de stable- (v0.60.0) en previewkanalen (v0.61.0-preview.0) zijn ongewijzigd. 🔗 bron - Eyeball, de Copilot CLI-plugin geschreven door een jurist van GitHub, is open source — de tool voegt schermafbeeldingen van het brondocument in bij de geanalyseerde clausule, zodat de analyse en het bewijs ernaast kunnen worden gelezen. De repository
dvelton/eyeballis openbaar onder de MIT-licentie, geschreven in Python, heeft 35 sterren en bevat sinds 5 april 2026 geen nieuwe commit. 🔗 bron - npm-tokens die alleen staging toestaan, sinds 18 september — met de machtiging ‘Read and write (stage only)’ kan een continuous-integration-pipeline via
npm stage publisheen versie klaarzetten zonder deze te kunnen publiceren; voor publicatie is 2FA-goedkeuring van een maintainer vereist. De blokkering wordt aan de kant van het register afgedwongen, ook voor een token dat is ingesteld om 2FA te omzeilen; npm schaft die rechtstreekse publicatiemogelijkheid in januari 2027 af. 🔗 bron - De regel voor codedekking is eveneens sinds 18 september via een REST API te beheren — de rulesetoptie ‘Restrict code coverage’, die een minimumdrempel oplegt of de toegestane daling bij een pull request begrenst, wordt algemeen beschikbaar in de API en daarmee in infrastructure as code. Alleen beschikbaar voor GitHub Enterprise Cloud en GitHub Team, niet voor GitHub Enterprise Server. 🔗 bron
- Wan zet zijn functie Peel-Off Sticker in de schijnwerpers — het Alibaba Wan-account toont een onderdeel van wan.video dat een persoonlijke foto in een scène verwerkt en met Wan 3.0 animeert. Het is geen lancering: het bericht bevat geen openingsdatum, prijs of kwaliteitsmeting. 🔗 bron
- Cohere publiceert vier foto’s van de ALL IN-conferentie in Montréal — het bericht van 19 september meldt dat Aston Martin F1 en Magnus Carlsen naast het bedrijf aanwezig waren. Geen productaankondiging, geen cijfers en geen link. 🔗 bron
Wat dit betekent
De enige modelrelease van het weekend is open en consolideert in plaats van iets toe te voegen. Qwen-Image-2.1 wordt niet naast Qwen-Image-Layered geplaatst: het neemt dat model op en laat een negen maanden oud gespecialiseerd model verdwijnen door transparantie in het hoofdmodel te integreren. Dezelfde beweging vindt plaats tussen generatie en bewerking, die in één reeks gewichten zijn samengebracht. Voor wie visuele content produceert, betekent dit een kortere workflow — één model om te laden, een direct bruikbare RGBA-laag en geen uitknipstap — en het ecosysteem volgde nog dezelfde dag, met vLLM-Omni en ComfyUI die vanaf de publicatie werkten.
Drie zondagse berichten behandelen dezelfde zorg vanuit drie invalshoeken: weten of we kunnen vertrouwen op wat een model produceert, en tegen welke kosten. Zero-Token Confidence antwoordt vanuit het kostenperspectief — 0,0615 seconde tegenover 1,631, omdat een verificateur die tokens genereert met de agent concurreert om hetzelfde budget. De ranglijst van dertien verificateurs antwoordt met metingen en de les daaruit is onaangenaam voor het vakgebied: een referentiemethode die alleen de lengte en opmaak van een antwoord leest, verslaat acht van de dertien. De lat om te bewijzen dat een verificateur echt leest, ligt dus hoger dan de meeste laten zien — en het feit dat de auteur erkent ook zijn eigen systeem te meten, geeft reden om op replicatie door een derde te wachten.
Het rapport van ScalablyAI voegt de dimensie toe die bij de andere twee ontbreekt: omkeerbaarheid. Een gewichtsupdate van 54 dollar leverde binnen hetzelfde artefact een gemeten verbetering op bij herstel na een fout en een mogelijk verlies bij correcte beslissingen, met aantallen waarbij de productie geen uitsluitsel kan geven. Omdat je niet de helft van een adapter kunt verwijderen, moest alles worden weggegooid. De operationele conclusie — goedkope kennis die eenvoudig ongedaan kan worden gemaakt, hoort in tekstbestanden; gewichten veranderen alleen achter een bevroren testsuite — vormt een nuttig tegenwicht tegen het discours over AI die zichzelf verbetert.
Aan de toolingkant wordt isolatie door het besturingssysteem een fundament in plaats van een optie. Qwen Code maakt bubblewrap tot een interne uitvoeringsbasis, Antigravity brengt zijn sandbox naar Windows en npm bedenkt een token dat een versie kan voorbereiden zonder haar te kunnen publiceren: drie makers die in drie dagen tijd beveiliging van woorden naar de standaardinstelling verplaatsen. Met één kanttekening voor Windows: een sandbox die handmatig moet worden aangevinkt en door geen van de drie aangeboden instellingen wordt geactiveerd, is nog geen standaardbescherming. Het verschil met macOS en Linux blijft volledig bestaan zolang Google geen tijdschema heeft gegeven.
Bronnen
- Alibaba Qwen op X, aankondiging van Qwen-Image-2.1
- Qwen, bericht over Qwen-Image-2.1
- Qwen-Image-2.1 op Hugging Face
- vLLM op X, ondersteuning vanaf de eerste dag
- Qwen Code, releaseopmerkingen voor v0.24.2
- Zero-Token Confidence
- Dertien antwoordverificateurs op één testset
- ScalablyAI, snel geheugen en trage gewichten
- ScalablyAI, bewijsregister
- SeamFlow, UV-unwrapping met flow matching
- SeamFlow, projectpagina
- Antigravity, changelog
- Antigravity, documentatie van de sandbox
- Overeenstemming tussen vijf LLM-annotatoren
- Gemini CLI, nightly van 20 september
- GitHub op X, Eyeball wordt open source
- GitHub, npm-tokens die alleen staging toestaan
- GitHub, regel voor codedekking via REST API
- Alibaba Wan op X, Peel-Off Sticker
- Cohere op X, ALL IN-conferentie