ai-powered-markdown-translatorArtikel översatt från franska till svenska med gpt-5.6-sol.
Den här onsdagen slår Anthropic samman chatten och Cowork till en enda Claude, som själv väljer sina verktyg, och lanserar Claude Docs och Claude Slides i beta. Zed öppnar Delta för alla genom att ersätta pull request med granskning i tråden, och NVIDIA låter Vera Rubin NVL72 debutera i MLPerf Inference v6.1 samtidigt som elförsörjningen blir den avgörande begränsningen för AI-fabriker. Varumärkesagenter tar också plats i annonseringen, både hos ChatGPT och på YouTube, samtidigt som Cohere tecknar det slutgiltiga avtalet med Aleph Alpha och Mistral kommer till Firefox.
En enda Claude: chatten och Cowork slås samman, Claude Docs och Claude Slides kommer i beta
16 september — Anthropic slår samman chatten och Claude Cowork: man behöver inte längre välja läge, utan Claude avgör själv om den ska söka på webben, läsa filer eller köra kod, och levererar färdiga filer. Långvariga uppgifter fortsätter i molnet även när datorn är avstängd, men lokala filer, den inbyggda webbläsaren och datorstyrning (computer use, i beta för Pro och Max) kräver att Claude Desktop är öppet.
Today, chat and Cowork start merging into one Claude. The direction: one Claude that carries context across everything you’re working on, wherever you are.
🇸🇪 I dag börjar chatten och Cowork slås samman till en enda Claude. Inriktningen: en enda Claude som behåller sammanhanget för allt du arbetar med, var du än befinner dig. — Boris Cherny (Anthropic) på X
De nya Claude Docs och Claude Slides skapar dokument och presentationer, och Claude Design, som lanserades i april, fungerar nu i konversationer. Alla tre är i beta för betalabonnemangen och kan aktiveras av Enterprise-administratörer. Varje skapelse kan delas via en länk, och presentationer kan exporteras till PowerPoint eller PDF. I läget Manuel, som är standardinställningen, frågar Claude före varje åtgärd; i läget Auto föregås varje åtgärd av automatiska säkerhetskontroller.
| Abonnemang eller berörd målgrupp | Tillkännagiven tidsplan |
|---|---|
| Pro och Max (webb, dator, mobil) | ”Under de kommande veckorna”, utan att något behöver aktiveras |
| Team och Free | ”Snart”, utan datum |
| Enterprise | Minst 30 dagars förvarning före varje förändring |
Övergången är permanent, men uppgifter, projekt, anslutningar, skills och artefakter från Cowork bevaras. Vid lanseringen uppger hjälpcentret vissa begränsningar: inget tillägg från GitHub eller skapande av konversationsgrenar, inkognitokonversationer öppnas i den gamla upplevelsen, äldre Cowork-uppgifter saknas i sökningen och Dispatch är stängt för nya användare. Chatten och Cowork hade redan delat projekt och artefakter sedan den 7 juli och minne sedan den 25 augusti.
🔗 Anthropics blogginlägg 🔗 Hjälpcenter
Design, Slides och Docs fungerar även i Claude Code
Samma dag uppger @ClaudeDevs att Claude Design, Claude Slides och Claude Docs även fungerar i Claude Code: där går det att be om underlag för en designgranskning (design review deck) eller en gränssnittsmodell genom att hänvisa Claude till de faktiska filerna och RFC-dokumenten i kodförrådet, ändra resultatet själv eller i konversationen och sedan dela länken. För Design är detta inget nytt, eftersom kommandot /design har funnits som förhandsversion sedan den 17 augusti: nyheten gäller Slides och Docs. Tweeten anger varken lägsta version, abonnemang eller dokumentation, och versionsanteckningarna för den senast publicerade versionen nämner det inte.
🔗 Tillkännagivande från @ClaudeDevs på X
Zed öppnar Delta i offentlig beta och ersätter pull request med granskning i tråden
16 september — Zed öppnar Delta för alla. Verktyget lanserades den 12 augusti med registrering och blev sedan tillgängligt i Windows den 4 september för registrerade användare. Nu kan det laddas ned fritt för macOS, Linux och Windows, användas på webben utan installation och dess diskussionstrådar (threads) följas från en mobil enhet.
Grundidén är att samarbeta utan commit eller push. En kollega som bjuds in till konversationen med agenten ser samma arbetskopior (worktrees), kan fortsätta arbeta med dem på sin dator, fråga agenten om dess val eller fortsätta om upphovspersonen kopplar ned. Kodgranskningen, som förhandsvisades den 10 september, ersätter pull request: en undertråd vägleder granskaren genom ändringarna i grenen, med sammanhanget från den ursprungliga agenten, i en isolerad kopia av worktrees. Kommandot /land låter sedan agenten samla allt i en enda commit, köra CI, slå samman efter teamets godkännande och radera grenen.
I Deltas kodförråd har pull requests varit avstängda sedan veckan före tillkännagivandet, och 33 personer har sedan dess slagit samman 570 ändringar där; Zed-redigerarens kodförråd finns ”tills vidare” kvar på GitHub. Under huven kompletterar DeltaDB Gits versionshantering med inkrementella deltan som mellan två commits bevarar ändringar och meddelanden från både människor och agenter. En commit förblir kontrollpunkten, så en kollega som aldrig öppnar Delta ser ett vanligt Git-förråd.
Zed säger sig vilja ersätta GitHub.com och kallar detta arbetssätt kontinuerlig utveckling (continuous engineering). Företagets odaterade färdplan omfattar Git-lagring i DeltaDB och överväger på sikt CI-liknande verifiering i tråden. Delta är kostnadsfritt under betaperioden, betalabonnemang har aviserats ”snart” utan pris eller datum, och Zed lovar att behålla en gratisversion.
🔗 Zeds blogginlägg om Deltas offentliga beta 🔗 Zeds tråd om kommandot /land
Vera Rubin NVL72 debuterar i MLPerf Inference v6.1 med upp till 3,7 gånger högre genomströmning än GB300 NVL72
16 september — NVIDIA låter Vera Rubin NVL72, företagets nästa generations rackplattform, debutera i MLPerf Inference v6.1, vars resultat publiceras av MLCommons, med bidrag i förhandsversion (preview). Enligt NVIDIAs jämförelser mellan de egna bidragen uppnår racket upp till 3,7 gånger genomströmningen hos GB300 NVL72 på Qwen3-VL i scenarierna offline, server och interaktivt, med vLLM och NVIDIA Dynamo, samt upp till 2,5 gånger på DeepSeek-R1 med TensorRT-LLM. Nebius har också lämnat in resultat för Vera Rubin NVL72 i förhandsversion.
NVIDIA tillskriver förbättringarna den gemensamma utformningen av hårdvara och mjukvara: NVFP4-precision för vikter, attention och KV-cache, disaggregerad serverdrift som separerar förifyllning (prefill) från avkodning, storskalig expertparallelism samt en sjätte generationens NVLink-domän, som enligt NVIDIA har tio gånger högre paketgenomströmning än standard-Ethernet. Den nuvarande generationen redovisar också sina siffror:
| Test i MLPerf Inference v6.1 | Inlämnat system | Resultat publicerat av NVIDIA |
|---|---|---|
| DeepSeek-R1 offline, från 72 till 288 GPU | GB300 NVL72, från 1 till 4 rack | 99 % skalningseffektivitet |
| WAN 2.2, text till video | GB300 NVL72 | 0,65 720p-video per sekund, 5,7 s per video |
| Qwen3-VL, v6.1 jämfört med v6.0 | GB300 NVL72 | Upp till 1,6 gånger, tack vare mjukvaran |
| Edge-Agentic, nytt test (Qwen3.6-27B) | Jetson AGX Thor, TensorRT Edge-LLM | Bidrag utan siffra i blogginlägget |
NVIDIA rapporterar också förbättringar för GPT-OSS-120B och DLRMv3 som uppnåtts efter tidsfristen och ännu inte verifierats av MLCommons. Företaget uppger sig ha 19 partner, varav åtta med Blackwell NVL72-system med flera noder, och nämner det kommande testet MLPerf Endpoints från MLCommons, som ska standardisera mätningen av agentbaserad inferens.
🔗 NVIDIA Vera Rubin NVL72 levererar ledande prestanda i debuten i MLPerf Inference v6.1
Elförsörjningen i centrum för AI-fabriker: DSX MaxLPS hos Lambda och AEMA-alliansen
15 och 16 september — Två tillkännagivanden från NVIDIA placerar elnätet i centrum för utbyggnaden av AI, med Emerald AI i båda: en AI-fabrik som styrs av dess programvara minskade sin förbrukning på begäran av en elleverantör, och därefter lanserade Emerald AI, Google och NVIDIA en allians för flexibla datacenter.
AI Infra Summit: Lambda validerar DSX MaxLPS, en AI-fabrik minskar förbrukningen på elnätets begäran
15 september — På AI Infra Summit handlade Ian Bucks (NVIDIA) keynote om antalet tokens som produceras per megawatt i AI-fabriker (AI factories). Lambda har validerat DSX MaxLPS, NVIDIAs programvara som övervakar GPU:ernas och rackens energiförbrukning och omfördelar effekten efter arbetsbelastningen: 19 HGX B200-noder kördes inom elbudgeten för 16 noder vid full effekt, varvid genomströmningen ökade från cirka 4 till 5 miljoner tokens per sekund (+24 %) och prestandan per watt steg med 23 %. NVIDIA räknar med upp till 40 % högre GPU-kapacitet för Vera Rubin NVL72 inom samma budget, ”i lämpliga miljöer”. En kväll i augusti fick en signal från Silicon Valley Power en AI-fabrik i Santa Clara, styrd av Emerald AI Conductor, att automatiskt minska effekten från 4 till 3 MW utan att avbryta prioriterad inferens. Sedan dess har fler än 200 signaler följts, med en svarstid på mindre än en minut. DSX Flex, som hanterar den här typen av signaler, får sin första särskilda kommersiella driftsättning i en 96 MW stor Vera Rubin-fabrik i Manassas i Virginia.
AEMA, en allians för datacenter som anpassar sig till elnätet
16 september — Emerald AI, Google och NVIDIA lanserar AI Energy Management Alliance (AEMA), en koalition för datacenter som kan anpassa sin förbrukning efter elnätets tillstånd: flytta arbetsbelastningar, använda lagrad energi, förlita sig på tillhörande elproduktion eller reagera på störningar. Dess principer är att före nätanslutningen fastställa skyldigheter för fortsatt drift (ride-through), förbrukningsminskning (curtailment) och incidenthantering, standardisera mätvärden, öppna snabbare vägar till nätanslutning för verifierbara flexibilitetsåtaganden och fördela kostnaderna efter faktisk påverkan. Alliansen riktar sig till USA, och dess lanseringspartner namnges inte. På sin webbplats lyfter den fram två potentialer: 100 GW som kan frigöras i det befintliga elnätet med måttligt flexibla datacenter och 733 miljoner dollar i undvikna kostnader per GW nya flexibla datacenter. NVIDIA och Emerald AI presenterade redan flexibla AI-fabriker på CERAWeek den 31 mars.
🔗 NVIDIAs blogginlägg om AEMA 🔗 AEMA:s webbplats
Varumärkesagenter tar plats i annonseringen hos ChatGPT och på YouTube
16 september — Samma dag placerar OpenAI och Google ett varumärkes konversationsagent i annonsformatet i USA: i ett test med utvalda annonsörer hos OpenAI och i en registreringsbaserad beta för handlare hos Google.
ChatGPT Ads testar Sponsored Agents och ansluter till HubSpot och Shopify
OpenAI lägger till AI på båda sidor av sin annonsplattform ChatGPT Ads. Med Sponsored Agents kan ett klick på en annons i ChatGPT öppna en tydligt markerad konversation med en agent som sponsras av varumärket, följd av en länk till dess webbplats. OpenAI förtydligar att detta utbyte är skilt från ChatGPTs oberoende svar och separerat från den ursprungliga konversationen.
| Nyhet i ChatGPT Ads | Status den 16 september |
|---|---|
| Sponsored Agents | Testas med utvalda annonsörer i USA |
| Plugin Ads Manager, promptstyrda kampanjer | Lanseras successivt |
| Föreslagna texter och bilder i Ads Manager | Lanseras successivt |
| Personalisering och översättning av text | Lanserade, kan aktiveras frivilligt (opt-in) |
| HubSpot-integration | Tillgänglig |
| ChatGPT Ads-applikation för Shopify | Amerikanska handlare, övriga ChatGPT Ads-marknader från den 23 september |
Blogginlägget anger varken pris eller antal annonsörer. Annonseringen testades i ChatGPT i februari, fick i maj en Ads Manager i beta och för självbetjäning (self-service), och den 31 augusti uppgav OpenAI en årlig intäktstakt på en miljard dollar efter att ha utökat självbetjäningen.
🔗 Att omforma annonsering med AI
Google placerar Business Agent i YouTube-annonser och bygger ut den agentbaserade handeln
Google publicerar sina uppdateringar för agentbaserad handel (agentic commerce) inför högtiderna. Business Agent, som enligt Google kom till Search ”tidigare i år”, går in i beta i YouTube-annonser i USA efter registrering av handlare: tittaren kan fråga agenten om produkterna utan att lämna YouTube. AI performance insights, som jämför ett varumärkes andel av synligheten (share of voice) i AI Mode och AI Overviews, blir tillgängligt i Merchant Center i Australien, Kanada, Indien, Nya Zeeland och USA. I Merchant Center lägger integrationshubben för UCP (Universal Commerce Protocol), protokollet som Google presenterade den 11 januari, till överföring av kundvagnen till handlarens webbplats och tester av betalningsflödet, medan analyser kommer ”snart”. Dessa funktioner lanseras gradvis i USA och därefter i Australien och Kanada ”i början av nästa år”. Tapestry (Coach, Kate Spade) säljer redan via UCP i Search och Gemini-applikationen. Enligt Google ger god praxis för produktflöden i genomsnitt 5 % fler konverteringar under den följande månaden, och i tester med lululemon användes varumärkets konversationsegenskaper i 50 % av de relevanta rekommendationerna i AI Mode.
🔗 Googles blogginlägg om agentbaserad handel
Cohere tecknar avtal med Aleph Alpha och lanserar Confidential Computing i Model Vault
16 september — Cohere presenterar flera nyheter, däribland två som riktar sig till kunder som vill behålla kontrollen över sina data och sin teknik.
Aleph Alpha: slutgiltigt avtal och dubbla huvudkontor i Berlin och Toronto
Cohere och Aleph Alpha har undertecknat det slutgiltiga samgåendeavtalet (definitive business combination agreement), vars plan tillkännagavs den 24 april. Den sammanslagna verksamheten kommer att bedrivas under namnet Cohere, med över 1 000 anställda, planerade dubbla huvudkontor i Berlin och Toronto samt ett forskningscentrum i Heidelberg på Aleph Alphas anläggning. Transaktionen, vars belopp inte har offentliggjorts, kräver fortfarande de sista myndighetsgodkännandena och väntas slutföras ”senare i år”. Ilhan Scheer, med-vd för Aleph Alpha, blir då operativ chef för Cohere, medan medgrundaren Samuel Weinbach blir forskningschef. Partnerskapet med Schwarz-gruppen fortsätter kring dess suveräna cloud STACKIT.
No government or enterprise should have to choose between capable AI and control over their tech. That belief is exactly why we’re joining forces with Aleph Alpha. Together, we’ll meet the rising global demand for frontier AI that’s both powerful and secure.
🇸🇪 Ingen regering eller verksamhet ska behöva välja mellan högpresterande AI och kontroll över sin teknik. Det är just denna övertygelse som driver oss att förena våra krafter med Aleph Alpha. Tillsammans kommer vi att möta den växande globala efterfrågan på frontier AI som är både kraftfull och säker. — Aidan Gomez (Cohere), citerad av @cohere på X
Confidential Computing i Model Vault, i tidig åtkomst
Cohere lanserar Confidential Computing i Model Vault, företagets dedikerade och helt hanterade inferensplattform, för att skydda data medan de behandlas och inte enbart när de lagras eller överförs. Tre mekanismer beskrivs: end-to-end-krypterad inferens, maskinvarubaserad isolering som sträcker sig ända till GPU:n med NVIDIA Confidential Computing samt en signerad attesterings-token som är tillgänglig på begäran och kan verifieras med maskinvarutillverkarens publika nycklar. Cohere hävdar att ingen, ”inte ens vi”, kan komma åt kundens workloads, utan att nämna någon tredjepartsrevision. Den tidiga åtkomsten är reserverad för en begränsad grupp betakunder, utan prisuppgifter, datum för allmän tillgänglighet eller lista över modeller, och tillkännagivandet begränsas till inlägg på X och en produktsida. Funktionen hade den 9 september meddelats komma snart.
🔗 Coheres tillkännagivande på X 🔗 Produktsida för Model Vault
Mistral driver Smart Window, Firefox AI-assistent
16 september — I ett gemensamt inlägg meddelar Mistral AI och Mozilla att Smart Window, Firefox AI-webbläsarassistent som fortfarande är i beta, nu drivs av Mistral-modeller, utan att ange vilka. Assistenten hjälper till att reda ut komplexa efterforskningar och sammanställa källor från öppna flikar. Mistral driver den inledningsvis för användare i Frankrike och Nordamerika, medan Storbritannien och Tyskland väntas följa ”senare i år”. Som standard sparas konversationerna inte på Mozillas servrar, och partner som Mistral förbinder sig till nollagring av data (zero data retention). För Mistral, som uppger att företaget ”traditionellt” betjänar andra företag, öppnar avtalet vägen till allmänheten. Arthur Mensch, medgrundare och CEO för Mistral, beskriver det som två förespråkare för open source som arbetar tillsammans, och Anthony Enzor-DeMeo, CEO för Mozilla Corporation, anser att en webbläsare inte ska vara en enkelriktad tratt.
🔗 Gemensamt inlägg från Mistral och Mozilla
Grok Build minns ett projekts konventioner och beslut mellan sessioner
16 september — SpaceXAI ger sin kodagent Grok Build ett minne. Efter varje avslutad tur går Grok igenom den i bakgrunden utan att blockera sessionen och antecknar sådant som består i en Markdown-fil: teamets konventioner, beslut och motiveringarna bakom dem samt fakta om projektet, exempelvis kommandot som startar testerna. Uppgifternas status, preliminära slutsatser, hemligheter och sådant som redan täcks av repot eller dess dokumentation undantas. Anteckningarna ordnas per projekt, med en global uppsättning för inställningar som gäller överallt. Kommandot /dream samlar dem i tematiska filer och körs även automatiskt med jämna mellanrum, medan /memory öppnar en skrivskyddad webbläsare. När man återvänder till ett projekt läser Grok de teman som hör till området där agenten ska arbeta, men det pågående samtalet har företräde framför anteckningarna. Minnet gäller endast nya sessioner. Betaversionen den 25 maj angav redan att beslut sparades mellan sessioner; inlägget beskriver mekanismen närmare.
Qwen Code v0.24.0 isolerar agenten på kärnnivå i Linux och ändrar bash-hooks
16 september — Två dagar efter v0.23.4 lägger Qwen Code v0.24.0 till en kärnbaserad sandbox i Linux via bubblewrap (bwrap), utan container, root-behörighet, daemon eller image. När alternativet aktiveras startar den om CLI:n bakom en skrivskyddad vy av filsystemet, där endast workspace och ett fåtal kataloger (temporära filer, cache, Qwen och Git) förblir skrivbara; qwen sandbox visar konfigurationen och --verify testar isoleringen. PR-författaren räknar upp begränsningarna: inget separat PID namespace, värdens Unix sockets förblir åtkomliga och inställningarna för Git och Qwen kan ändras. Inkompatibel ändring (breaking change): i hooks som körs under bash måste $QWEN_PROJECT_DIR och dess motsvarigheter för Claude och Gemini, som läses från miljön i stället för att ersättas, stå inom dubbla citattecken. web_search begränsas per session (200 som standard, högst 10 000), en budget som +500k i meddelandet dimensionerar en hel tur och meddelanden mellan sessioner är aktiverade som standard.
Devin lanserar Code Scans, målstyrda granskningar av hela kodbasen
16 september — Cognition lanserar Code Scans i Devin: utgångspunkten är ett brett mål snarare än en specifik ändring, vid behov kompletterat med egna kriterier (teamets standarder, riktlinjer för tillgänglighet eller krav för en migrering), varefter Devin undersöker kodbasen, prioriterar sina iakttagelser, diskuterar dem och sedan öppnar de pull requests som efterfrågas. Scanningen startas med /scan i webbappen, nämndes redan i versionsinformationen den 2 september och återanvänder Devin Security Swarms arkitektur Agentic MapReduce, som presenterades i juli, i fyra faser: planering, uppdelning i batcher, parallell utforskning och syntes. Cognition publicerar två tester: för Dioxus minskar tiden för en fullständig debug-kompilering av 22 crates från 58,6 till 21,0 sekunder, en minskning med 64 %; en SEO-scan av devin.ai och cognition.com identifierar 44 iakttagelser, varefter Ahrefs-poängen för devin.ai stiger från 87 till 92 och andelen långsamma sidor minskar med 73 %. Inga prisuppgifter anges.
Claude for Small Business utökas till 43 workflows och 27 nya integrationer
15 september — I ett inlägg som inte uppmärksammades i vår sammanställning den 15 september utökar Anthropic Claude for Small Business, företagets plugin för småföretag som lanserades i maj med 15 workflows. Det omfattar nu 43 workflows, med 27 nya integrationer, däribland Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Gusto, Square, Stripe och Zapier, och uppges ha installerats över 900 000 gånger. Varje workflow startar i godkännandeläge, och graden av autonomi ställs in separat för varje workflow och kan återställas. Anthropic återupptar även utbildningssatsningen: en höstturné med Tenex i 10 amerikanska städer, över 150 godkända utbildningsorganisationer för fler än 750 workshops samt 14 partnerwebbinarier. Erbjudandet är tillgängligt i alla betalplaner; sammanfattningen av vårturnén publicerades den 10 september.
🔗 Anthropics inlägg om Claude for Small Business
ElevenLabs lanserar Reception, en AI-receptionist för småföretag
16 september — ElevenLabs lanserar Reception, en AI-receptionist för småföretag byggd på plattformen ElevenAgents. Den svarar dygnet runt på frågor om tjänster, öppettider eller adress på uppringarens språk och bokar sedan tiden i kalendern, antingen som avlastning när teamet inte svarar eller efter stängning. Tjänsten har en egen webbplats, reception.ai, och kan provas kostnadsfritt i 14 dagar med 30 samtalsminuter.
| Reception-plan | Månadspris exklusive skatt | Inkluderade samtalsminuter |
|---|---|---|
| Basic | 29 dollar | 75 |
| Plus | 79 dollar | 275 |
| Premium | 199 dollar | 1 000 |
| Enterprise | Pris på begäran | Skräddarsytt |
Alla planer omfattar fler än 70 språk, Google Calendar, Calendly, Zapier, webhooks och en MCP-server.
🔗 Vi presenterar Reception, från ElevenAgents 🔗 Priser för Reception
Synthesia öppnar sitt Interactive Avatar API, realtidsavatarer för 0,10 euro per minut
16 september — Synthesia gör sitt Interactive Avatar API allmänt tillgängligt, vilket gör det möjligt att integrera avatarer som kan lyssna, tala och svara i realtid i en produkt. Kunden tillhandahåller sin LLM, sin kunskapsbas och sin logik; Synthesia hanterar ansiktet, rösten och läppsynkroniseringen. Avataren ansluter till ett LiveKit-rum som videodeltagare via ett plugin som enligt FAQ:n för närvarande endast stöder LiveKit-agenter skrivna i Python. API:t debiteras efter användning med 0,10 euro per minut, utan bindningstid och med 500 kostnadsfria minuter. Ett Pipecat-plugin och ett end-to-end-erbjudande med hanterad LLM, kunskap och röst meddelas komma ”snart”, utan datum. Synthesia publicerade i juli forskningsramverket för sina interaktiva avatarmodeller.
🔗 Synthesias tillkännagivande på X 🔗 Synthesias sida om Interactive Avatars
Koa, Salesforces CRM-modell byggd på Nemotron 3 Super
15 september — På Dreamforce presenterade Salesforce Koa, företagets första resonemangsmodell särskilt framtagen för customer relationship management (CRM), som skapats genom post-training av NVIDIA Nemotron 3 Super med NeMo RL, NeMo Gym och NeMo AutoModel på ett syntetiskt dataset. Salesforce kontrollerar vikterna och kör modellen på sin egen infrastruktur; enligt Salesforce har inga kunddata använts för träning eller inferens. På CRM Bench, företagets eget benchmark (uppdatera en affärsmöjlighet, dirigera ett ärende, planera en uppföljning), matchar eller överträffar Koa ledande modeller med tre gånger färre fel, utan att de jämförda modellerna namnges. Modellen används redan internt i Slack och går i oktober in i en pilotfas som valbar modell i Agentforce, bland annat hos Formula 1 och Xero, innan den förväntas bli allmänt tillgänglig vintern 2026 i de amerikanska regionerna.
🔗 NVIDIAs inlägg om Jensen Huang på Dreamforce
Runway beskriver realtidsmodereringen av sina kommande videomodeller
16 september — Runway planerar att lansera modeller för videogenerering i realtid ”under de kommande månaderna” och förklarar hur företaget ska moderera dem. Vid kontinuerlig överföring (streaming) ser användaren videon innan någon slutlig kontroll har gjorts. Runway har därför utformat och testat ett snabbare system: accelererad kontroll av input, synkron moderering som analyserar bilderna i strömmen och avbryter överföringen så snart problematiskt innehåll visas, följt av en kontroll av hela videon innan den kan laddas ned eller delas. Klassificeraren, CoPE-B från Zentropi, är en LoRA-adapter på Gemma-4-26B-A4B-it, en mixture of experts-modell med 25,2 miljarder parametrar, varav 3,8 miljarder är aktiva; kontrollen tar i genomsnitt mindre än 0,5 sekunder. I tester hann gränsfall kort visa förbjudet innehåll innan strömmen bröts. Systemet kompletterar Runways befintliga skydd, och realtidsvideorna kommer, liksom företagets övriga skapelser, att innehålla C2PA-provenienssignaler.
Kortnyheter
- Zed 1.20.1 lägger till Gemini 3.8 Flash — den veckovisa stabila versionen av redigeraren innehåller även en valfri marköranimering, öppning av Markdown-filer i renderad förhandsvisning samt cirka 25 % mindre binärfiler för macOS och Linux; den åtgärdar ett fel som kunde exponera privata filer för medarbetare via projektsökningen. 🔗 källa
- Replit lanserar anpassade anslutningar i beta (Custom Connectors) — administratörer för en arbetsyta kan ange ett REST API över HTTPS, autentiserat med en API-nyckel, så att Agent kan använda det utöver de officiella anslutningarna; dokumentationen nämner Pro- och Enterprise-kunder, men en informationsruta begränsar betaversionen till Enterprise. 🔗 källa
- NVIDIA låter agenter porta TileGym till cuTile Rust — åtta dagar efter lanseringen av CUDA Rust har en multi-agent-skill som levererats i TileGym portat bibliotekets 24 offentliga operatorer, vilka i genomsnitt behåller 99,5 % av prestandan hos cuTile Python i 347 konfigurationer uppmätta på DGX B200. 🔗 källa
- OpenAI publicerar en guide till analyserna i Admin Console — vyerna Usage, Insights och Outcomes, där den sistnämnda mäter andelen sammanslagna commits med bidrag från Codex, ska koppla användningen av ChatGPT Work och Codex till resultat; den angivna avkastningen på 245 % beskrivs uttryckligen som hypotetisk, och den länkade dokumentationen gick fortfarande inte att hitta vid vår genomgång. 🔗 källa
- OpenAI API reglerar skapandet av nycklar — avsnittet API Key Governance, som lades till i changeloggen den 15 september, fem dagar efter införandet av utgångsdatum, låter administratörer endast tillåta nycklar för tjänstekonton, endast projektnycklar som ägs av en användare eller blockera alla nya nycklar; befintliga nycklar påverkas inte. 🔗 källa
- Copilot: ansökningar om utökad budget blir allmänt tillgängliga — i Copilot Business och Enterprise med användningsbaserad fakturering kan en medlem som har förbrukat sina AI-krediter begära en extra budget; ägare och faktureringsansvariga fastställer beloppet och godkänner begäran, vilket omedelbart återställer åtkomsten. 🔗 källa
- AI Scan för pull requests kräver inte längre CodeQL:s standardkonfiguration — AI-baserad sårbarhetsidentifiering i pull requests utökas till behöriga repositories utan denna konfiguration, som offentlig förhandsversion för GitHub Advanced Security-kunder på github.com; GitHub Enterprise Server stöds inte. 🔗 källa
- GitHub Advanced Security-konfigurationer kan påtvingas organisationer — sedan den 15 september kan företagsadministratörer hindra organisationsadministratörer, och inte längre bara repository-ägare, från att ändra säkerhetskonfigurationer som fastställts på företagsnivå. 🔗 källa
- GitHub inaktiverar SHA-1 för HTTPS — som meddelades den 20 april bekräftar changeloggen den 15 september att stödet för SHA-1 upphör i HTTPS-anslutningar till github.com och dess partner-CDN:er, inklusive GitHub Enterprise Cloud; webbläsare, API-klienter och Git över HTTPS berörs, men inte GitHub Enterprise Server. 🔗 källa
- MiniMax H3 blir tillgänglig serverless på Together AI — modellen tillkännagavs i en tweet den 15 september klockan 16.58 Pacific Time. Den öppna videomodellen med 33 miljarder parametrar genererar klipp på 4–15 sekunder i upp till 2K med inbyggt stereoljud och listas där för 0,1391 dollar per video. 🔗 källa
- MiniMax presenterar H3 IP Edition — i sin sammanfattning av konferensen i Tokyo med KAGAMI AI uppger MiniMax att företaget presenterade en version av H3 kopplad till officiellt licensierade japanska immateriella rättigheter, utan att ange någon licenskatalog, något datum eller pris. 🔗 källa
- Runway lägger till fem tredjepartsmodeller med kollektionen Fall 2026 — Fish Audio S2.1 Pro, Cartesia Sonic 3.6, MiniMax H3 Max, FLUX Video Upscale och FLUX Video Edit ansluter till plattformen, utan tillkännagivna priser; flera fanns redan tillgängliga på andra håll, exempelvis FLUX Video Upscale hos Black Forest Labs sedan den 20 augusti och H3 Max sedan den 27 augusti. 🔗 källa
- Luma lanserar Camera Angles — funktionen i Luma Agents, som publicerades den 15 september klockan 16.26 Pacific Time, återskapar motivet i ett enskilt foto från valda vinklar med bevarade detaljer, utan någon namngiven modell eller angivna siffror. 🔗 källa
- Grok Voice kommer till fal — inferensplattformen erbjuder SpaceXAI:s röstmodell för Speech to Speech och i realtid; enligt fal svarar den på 0,70 sekunder och kostar 0,00083 dollar per sekund, och en direktsänd workshop med SpaceXAI planeras till den 22 september. 🔗 källa
- OpenText och Cohere samarbetar för reglerade branscher — partnerskapet, som tillkännagavs på konferensen ALL IN AI i Montréal, ska integrera North och Coheres modeller i OpenText Aviator-agenter, som kan driftsättas lokalt eller i privata, offentliga eller suveräna moln; det gemensamma erbjudandet väntas nå kunderna i början av 2027. 🔗 källa
- Manus ingår utbildningspartnerskap i Singapore — agenten ingår i SkillsFuture AI Subscription, som ger berättigade singaporeaner som deltar i vissa AI-kurser sex månaders kostnadsfri åtkomst, samt i Singtel AI Pass; en utmaning mellan olika campus fick fler än 1 100 anmälningar, och Manus efterlyser nu utbildningspartner globalt. 🔗 källa
- University of Manchester förutser luftföroreningar med Earth-2 — Earth-2 CorrDiff, som tränades om på två dagar på en nod med 8 GPU:er i superdatorn Isambard-AI, täcker hela Storbritannien med en upplösning på 2–3 km², och teamet lovar att publicera data och workflows som open source. 🔗 källa
- Barnsjukhuset i Philadelphia modellerar hjärtan på några sekunder — CHOP:s tjänst, som bygger på open source-frameworket MONAI, skapar hjärtmodeller som tidigare krävde omkring fyra timmars arbete, med cirka 200 planerade fall i år; verktyg byggda på Newton, som håller på att integreras, kan dessutom göra simuleringar av implantatplacering nästan i realtid. 🔗 källa
- Google publicerar en studie om amerikanska tonåringar och AI — studien U.S. Future Report, som genomfördes tillsammans med RXN bland fler än 1 000 ungdomar i åldern 13–17 år, visar att 94 % av dem har använt AI under det senaste året och att 55 % kontrollerar svaren mot andra källor; ingen produkt tillkännages. 🔗 källa
- Perplexity publicerar en guide om detektorer för AI-genererad text — dess exempel, som presenteras som hypotetiskt, visar att en detektor som felklassificerar 2 % av mänskligt skrivna texter kan flagga 64 av 1 000 artiklar, varav 19 är skrivna av människor, vilket innebär en felandel på nästan 30 %; guiden rekommenderar att en flaggning behandlas som början på en granskning. 🔗 källa
- GiniGEN AI rankar 425 modeller från OpenRouter — ett community-inlägg publicerat på Hugging Face-bloggen: rankningen lägger till uppmätt latens till den första token för 329 modeller samt ett kvalitetsbetyg för koreanska; endast 8,5 % av de betygsatta modellerna får A för hövlighetsformer och 9,4 % för koreanska institutioner. 🔗 källa
Vad det innebär
Agenten blir gränssnittet och valet av läge försvinner. I nya Claude behöver man inte längre välja mellan en konversation och en arbetsyta: Claude väljer mellan webbsökning, filer och kod och skapar sedan ett dokument eller en presentation. Delta tillämpar samma logik på kodleveransen, med granskning i tråden och kommandot /land, som sköter commit, CI och sammanslagning i följd i stället för en pull request. Devin Code Scans utgår från ett mål snarare än en ändring, och Grok Build kommer ihåg ett projekts konventioner och beslut från en session till nästa. Den mänskliga kontrollen flyttas utan att försvinna: Manuel-läget är standard hos Claude, teamets godkännande krävs före sammanslagning hos Zed och resultaten diskuteras före varje pull request hos Devin.
Agenterna tar också plats i den kommersiella processen. OpenAI testar Sponsored Agents som tar över efter en annons, Google placerar Business Agent i YouTube-annonser och möjliggör betalningar med UCP, och båda skiljer varumärkesagenten från resten: på ena sidan en tydligt markerad konversation som hålls åtskild från ChatGPT:s oberoende svar, på den andra en anmälningsbaserad beta för handlare. För småföretag uppger Claude for Small Business att tjänsten erbjuder 43 workflows och har fler än 900 000 installationer, medan ElevenLabs för 29 dollar i månaden säljer en receptionist som bokar möten. Synthesia tar 0,10 euro per minut för en avatar som talar inuti kundernas produkter, och Salesforce gör Koa till en valbar modell i Agentforce: agenten nöjer sig inte längre med att hjälpa företaget, utan vänder sig till kunderna i företagets namn.
Förtroende blir ett försäljningsargument, och leverantörerna försöker göra det verifierbart. Cohere och Aleph Alpha framhäver suveränitet, med dubbla huvudkontor i Berlin och Toronto, medan Model Vault utfärdar en attesterings-token som kunden kontrollerar med hårdvarutillverkarens publika nycklar. Mistral ger Firefox ett löfte om noll datalagring, Salesforce behåller Koa-vikterna i sin egen infrastruktur, Runway planerar att stoppa en videoström så snart problematiskt innehåll upptäcks, OpenAI låter administratörer begränsa skapandet av API-nycklar och Qwen Code isolerar sin agent på kärnnivå samtidigt som begränsningarna publiceras. De starkaste garantierna är sådana som kunden själv kan kontrollera; ett internt benchmark som CRM Bench eller ett påstående om ”inte ens vi” utan någon omnämnd tredjepartsrevision förblir just påståenden.
Slutligen sätter elektriciteten gränser för beräkningskapaciteten. Vera Rubin NVL72 ger enligt NVIDIA upp till 3,7 gånger högre genomströmning än GB300 NVL72, men de mest konkreta tillkännagivandena under dessa två dagar handlar om megawatt: Lambda ryms med 19 noder inom elbudgeten för 16, en AI-fabrik i Santa Clara minskar från 4 till 3 MW på begäran av sin elleverantör och AEMA kräver snabbare nätanslutningar i utbyte mot verifierbar flexibilitet. Genomströmning per rack är fortfarande det tekniska försäljningsargumentet, men tillgången till elnätet avgör hur snabbt dessa rack kan tas i drift.
Källor
- Claude, Claude Cowork och chatten är nu ett enda Claude
- Claude hjälpcenter, sammanslagningen av chatten och Cowork
- Boris Cherny på X, chatten och Cowork börjar slås samman
- Claude Devs på X, Design, Slides och Docs i Claude Code
- Zed, offentlig beta av Delta
- Zed på X, kommandot /land
- NVIDIA, Vera Rubin NVL72 i MLPerf Inference v6.1
- NVIDIA, direktrapportering från AI Infra Summit
- NVIDIA, lanseringen av AI Energy Management Alliance
- AI Energy Management Alliance, officiell webbplats
- OpenAI, att omforma annonsering med AI
- Google, uppdateringar av agentbaserad handel inför högtiderna
- Cohere, slutgiltigt avtal med Aleph Alpha
- Cohere på X, citat av Aidan Gomez
- Cohere på X, Confidential Computing i Model Vault
- Cohere, produktsidan för Model Vault
- Mistral AI, partnerskap med Mozilla
- SpaceXAI, Memory i Grok Build
- Qwen Code, versionsinformation för v0.24.0
- Cognition, presentation av Code Scans
- Claude, nya workflows i Claude for Small Business
- ElevenLabs, presentation av Reception
- Reception, priser
- Synthesia på X, Interactive Avatar API
- Synthesia, sidan Interactive Avatars
- NVIDIA, Jensen Huang på Dreamforce
- Runway, moderering i realtid
- Zed, versionsinformation för 1.20.1
- Replit på X, Custom Connectors i beta
- NVIDIA, portning av TileGym till cuTile Rust
- OpenAI, att koppla AI-användning till affärsvärde
- OpenAI, API-changelog
- GitHub Changelog, ansökningar om utökad Copilot-budget
- GitHub Changelog, AI Scan utan CodeQL:s standardkonfiguration
- GitHub Changelog, påtvingade GitHub Advanced Security-konfigurationer
- GitHub Changelog, slutet för SHA-1 i HTTPS
- Together AI på X, MiniMax H3 serverless
- MiniMax på X, H3 IP Edition
- Runway på X, kollektionen Fall 2026
- Luma på X, Camera Angles
- fal på X, Grok Voice
- OpenText, partnerskap med Cohere
- Manus på X, Learn AI with Manus
- NVIDIA, Earth-2 och luftföroreningar i Storbritannien
- NVIDIA, CHOP och hjärtmodellering
- Google, U.S. Future Report om tonåringar och AI
- Perplexity, guide om detektorer för AI-genererad text
- Hugging Face, GiniGEN AI:s rankning av OpenRouter-modeller