ai-powered-markdown-translatorArtikel översatt från franska till svenska med gpt-6-sol.
Den 23 september presenterar Anthropic sitt molekylärbiologiska laboratorium och dess första resultat: ART, ett tidigare okänt enzymsystem som omkring 950 Claude-agenter hittade i bakteriofagers DNA. Google lanserar Gemini 3.8 Flash TTS och Flash-Lite TTS, två modeller för talsyntes som skapar och replikerar röster, Black Forest Labs släpper FLUX 3 Action, en modell med öppna vikter för robotstyrning, och Perplexity publicerar den första säkerhetsgranskningen av SPACE, sandlådan där företagets agenter körs.
Anthropic öppnar ett molekylärbiologiskt laboratorium, där Claude upptäcker ART
23 september — Anthropic presenterar en ny forskargrupp inom livsvetenskap med ett eget molekylärbiologiskt laboratorium. Gruppen bildades under våren och finns i San Francisco Bay Area. Dess första resultat: Claude-agenter har i DNA från bakteriofager, virus som infekterar bakterier, hittat ett enzymsystem som aldrig tidigare beskrivits. Anthropic har döpt det till ART (array-associated reverse transcriptases, omvända transkriptaser kopplade till en sekvensuppsättning).
Allt började med en prompt: sök i en stor databas med DNA-sekvenser efter nya exempel på omvända transkriptaser, enzymer som kopierar RNA till DNA. Under 21 timmar använde omkring 950 agenter 210 miljoner tokens, samlade in över 200 000 omvända transkriptaser, identifierade 3 500 nya kandidatsystem och valde ut de 20 mest lovande. Varje kandidat åtföljdes av en rapport som människor kunde läsa. Enligt Anthropic skulle en sådan analys ta en expert veckor, kanske månader. Människornas insats begränsades till den ursprungliga prompten och laboratorieexperimenten.
| Steg i undersökningen | Uppmätt värde |
|---|---|
| Undersökningens längd | 21 timmar |
| Claude-agenter som deltog | omkring 950 |
| Använda tokens | 210 miljoner |
| Insamlade omvända transkriptaser | över 200 000 |
| Nya kandidatsystem | 3 500 |
| Utvalda och analyserade kandidater | 20 |
ART består av tre delar: ett omvänt transkriptas, en närliggande partnergen med okänd funktion och en lång uppsättning regelbundet åtskilda, upprepade DNA-sekvenser vars struktur påminner om en CRISPR-sekvensuppsättning. Själva transkriptaset, som finns i en jättefag, var redan känt. Enligt Anthropic ”verkar Claude vara först” med att ha uppmärksammat den icke-kodande sekvensuppsättningen och det tillhörande proteinet. De första experimenten visar att sekvensuppsättningen uttrycks som separata små RNA-molekyler. Anthropic är försiktigt: ART:s funktion är ännu okänd och fler experiment pågår. Enligt företaget har endast en handfull kända system dessa egenskaper, och alla är programmerbara och kan klippa, kopiera och klistra in DNA.
Claude has discovered a previously unknown enzyme system hidden in the DNA of bacteriophages. Beside the enzyme’s gene sits a long array of repeating DNA—a structure that looks somewhat similar to CRISPR.
🇸🇪 Claude har upptäckt ett hittills okänt enzymsystem som gömmer sig i bakteriofagers DNA. Bredvid genen för enzymet finns en lång uppsättning upprepat DNA, en struktur som till viss del liknar CRISPR. — @AnthropicAI på X
Laboratoriet arbetar endast på biosäkerhetsnivåerna BSL-1 och BSL-2 och hanterar inga patogener som kan infektera människor. Allt praktiskt laboratoriearbete utförs av mänskliga forskare. Teamet använder Claude Science och Claude Code, ibland med ett egenutvecklat system som samordnar många sessioner parallellt. Eftersom en undersökning ger hundratals eller till och med tusentals rapporter blir hypoteserna i sig föremål för studier: det som utmärker dem forskarna anser värda att testa används för att förbättra instruktionerna till Claude. Feng Zhang, pionjär inom genomredigering med CRISPR vid MIT och Broad Institute, har granskat förtrycket och ser det som ett spännande exempel på vad AI-agenter kan bidra med inom biologiska upptäckter. Anthropic publicerar förtrycket och uppmanar forskare att skicka in forskningsfrågor.
🔗 Claude upptäcker ett nytt enzymsystem med CRISPR-liknande upprepningar · Förtryck (PDF)
Gemini 3.8 Flash TTS och Flash-Lite TTS: Google skapar och replikerar röster
23 september — Google utökar Gemini-familjen med två modeller för talsyntes (text-to-speech), som företaget beskriver som sina mest uttrycksfulla ljudmodeller: Gemini 3.8 Flash TTS och Gemini 3.8 Flash-Lite TTS. Båda är allmänt tillgängliga i Gemini API och Google AI Studio, med en ny endpoint kallad Voices. API:ets ändringslogg daterar posten till den 22 september; det offentliga tillkännagivandet kom den 23 september.
De två modellerna har olika uppgifter. Flash TTS används för att skapa röster: man beskriver röstens roll, accent och karaktär i naturligt språk och styr sedan varje replik, inklusive uttryck, rytm och dialektbyte. Google riktar den till tv-spel, ljudböcker och poddar. Flash-Lite TTS är avsedd för stora volymer till lägre kostnad: dubbning i stor skala, massproduktion av ljud och röststyrda agenter i realtid. Den ska ersätta gemini-3.1-flash-tts-preview. Båda klarar dialoger med två röster i samma manus, flera timmars ljud utan märkbar förändring av klangfärgen och taggar som <laughs>, <sigh> eller |mhm|.
Blogginlägget uppger att det finns över 2 000 färdiga röster, med regionala varianter som kanadensisk franska. API-dokumentationen beskriver däremot 30 studioröster och ett utökat bibliotek med flera hundra röster. Röstreplikering fungerar med ett ljudprov på 30 sekunder, förutsatt att röstinnehavarens muntliga samtycke spelas in, och allt genererat ljud får vattenmärket SynthID. En viktig detalj för läsare i Frankrike: enligt en anmärkning i blogginlägget är röstreplikering via AI Studio inte tillgänglig inom Europeiska ekonomiska samarbetsområdet, i Storbritannien, Schweiz, Indien, Illinois eller Texas. Möjligheten att remixa befintliga röster ska komma snart.
| Modellegenskap | Gemini 3.8 Flash TTS | Gemini 3.8 Flash-Lite TTS |
|---|---|---|
| API-identifierare | gemini-3.8-flash-tts | gemini-3.8-flash-lite-tts |
| Språk som stöds (API-dokumentationen) | 130 | 101 |
| Avsedd användning | Skapande, detaljerad styrning | Stora volymer, dubbning, röststyrda agenter |
| Ljudutdata, Standard-pris till och med 31/12/2026 (miljon tokens) | 9 dollar | 6 dollar |
| Ljudutdata, Standard-pris från och med 01/01/2027 (miljon tokens) | 18 dollar | 12 dollar |
| Konsumentprodukt | Gemini Notebook | Google Vids (berättarröst aviserad) |
Som jämförelse kostar Gemini 3.1 Flash TTS Preview 20 dollar per miljon ljudtokens i utdata. Google stöder lanseringen med externa utvärderingar: Flash TTS kommer på första plats i Voice Design Benchmark från Hume AI (71,4), och de två modellerna tar de två första platserna i Hume AI:s Overall Quality Index. De ska också komma till Gemini Enterprise via API ”snart”.
🔗 Googles tillkännagivande · Versionsinformation för Gemini API · API-priser
FLUX 3 Action: Black Forest Labs släpper en modell med öppna vikter för robotstyrning
23 september — Black Forest Labs, känt för sina bildmodeller i FLUX-serien, släpper FLUX 3 Action, en World Action Model med 7 miljarder parametrar som är utformad för att styra robotar. Den bygger på den multimodala basmodellen FLUX 3 och förutsäger kommande bilder och motoriska kommandon i samma beräkning, utifrån kamerabilder och ledernas positioner. Vikterna är öppna (modellkortet för DROID-checkpointen på Hugging Face anger licensen ”flux-kommunity-license”), och laboratoriet publicerar även koden, anvisningarna för finjustering, benchmarks och reproducerbara exempel.
An open weights 7B World Action Model that achieves first place on the RoboLab benchmark. It outperforms the previous best open model by 6.1 percentage points while using 56% fewer parameters and running up to 3.95x faster.
🇸🇪 En World Action Model med 7B parametrar och öppna vikter som tar förstaplatsen i benchmarken RoboLab. Den överträffar den tidigare bästa öppna modellen med 6,1 procentenheter, samtidigt som den använder 56 % färre parametrar och körs upp till 3,95 gånger snabbare. — @bfl_ai på X
| Utvärderad modell | Modelltyp | Tillgång till vikter | Resultat på RoboLab-120 | Antal parametrar |
|---|---|---|---|---|
| FLUX 3 Action | WAM | Öppna | 42,92 % | 7B |
| OASIS WAM | VLM + WAM | Slutna | 39,0 % | – |
| Cosmos3-Nano-Policy | WAM | Öppna | 36,8 % | 16B |
| Phoenix | TAMP+FM | Slutna | 34,4 % | – |
| BiMind v0.1 | VLA | Slutna | 33,3 % | – |
| π0.5 | VLA | Öppna | 28,0 % | 3,3B |
| DreamZero | WAM | Öppna | 25,7 % | 14B |
| GR00T N1.6 | VLA | Öppna | 7,2 % | 3B |
Den tidigare bästa öppna modellen var NVIDIA:s Cosmos3-Nano-Policy. Uppgiften ”upp till 3,95 gånger snabbare” gäller i jämförelse med Cosmos 3 Nano i FP8: mellan 1,52 och 3,95 gånger beroende på GPU. Jämfört med π0.5, den bästa öppna modellen för syn, språk och handling (VLA), är den destillerade varianten med ett enda steg (38,3 %) snabbare på GPU:er för arbetsstationer och datacenter, men långsammare på en RTX 5090. Den förutsäger däremot 2,13 sekunders rörelse per prediktion, jämfört med 1 sekund för π0.5.
Blogginlägget testar också en hybridpolicy där OpenAI:s GPT-6 Astra övervakar roboten. Tillsammans med Astra på låg ansträngningsnivå (low) klarar FLUX 3 Action 90 % av episoderna till en kostnad av 8,77 dollar och omkring 8 minuter per lyckat försök. Astra ensam på nivån ”xhigh” klarar alla uppgifter, men kostar 13,47 dollar och tar 16 minuter per lyckat försök. På en verklig Franka-robotarm ger en blindad utvärdering av Positronic Robotics FLUX 3 Action 28 lyckade försök av 30, jämfört med 27 för Cosmos 3 Nano och 13 för π0.5. Tre checkpoints finns på Hugging Face (base, SO-101 och DROID), och modellen är integrerad i LeRobot tillsammans med NVIDIA och kan driftsättas på Jetson.
🔗 FLUX 3 Action (Black Forest Labs) · Samling på Hugging Face
Escaping SPACE: Perplexity publicerar den första säkerhetsgranskningen av Computers sandlåda
23 september — Perplexity Secure Intelligence Institute publicerar första delen av en rapport om intrångstester (red-teaming) av SPACE, sandlådan där agenterna i Perplexity Computer körs och som presenterades den 15 juli. Detta är den första publicerade säkerhetsutvärderingen av SPACE. Varje sandlåda består av en virtuell Firecracker-mikromaskin, isolerad från värddatorn, och en gateway för varje sandlåda tillämpar reglerna för utgående nätverkstrafik.
Nio modeller fick root-åtkomst i den virtuella maskinen och två uppdrag av typen capture the flag: att ta sig över gränsen mellan VM och värddator för att hämta en lockande AWS-identifierare, eller att nå en URL som blockeras av nätverkspolicyn. Testupplägget kombinerade åtkomst till SPACE:s källkod eller ingen sådan åtkomst med två nätverksnivåer: inget nätverk eller partiell åtkomst (paketarkiven PyPI och Ubuntu samt Perplexitys webbsökning). Varje konfiguration testades tre gånger. Resultatet: ingen lyckades ta sig från VM till värddatorn under 108 försök, inte ens med källkoden tillgänglig. Nätverksfiltret höll när allt var blockerat (0 av 54). Med partiell nätverksåtkomst nådde däremot 11 av 54 försök den förbjudna destinationen innan felet åtgärdades.
| Utvärderad modell | Lyckade försök med källkod | Lyckade försök utan källkod |
|---|---|---|
| Claude Opus 5.0 | 3 försök av 3 | Inga |
| GPT-5.6 Sol | 3 försök av 3 | 2 försök av 3 |
| Kimi K3 | 2 försök av 3 | Inga |
| GPT-5.6 Cyber | Inga | 1 försök av 3 |
| Fem andra utvärderade modeller | Inga | Inga |
Två sårbarheter utnyttjades. Den ena var DNS-förfalskning: agenten matade in ett falskt svar som kopplade pypi.org till målets adress, och gatewayen, som inte kontrollerade svarets ursprung, sparade det. Det krävde en intern adress som bara syntes i källkoden. Den andra byggde på att ett CDN delar IP-adresser mellan tjänster: GPT-5.6 Sol lät fiddle.fastly.dev, som kunde nås via samma adress som PyPI, hämta den förbjudna URL:en. GPT-5.6 Cyber tog sig via en bildtjänst från Taboola och skärmbildsgeneratorn thum.io innan den läste flaggan med teckenigenkänning. Claude Opus 5.0 upptäckte denna möjlighet men avstod, eftersom den bedömde att det stred mot instruktionen att inte rikta sig mot något externt system. Kimi K3 är den enda modellen med öppna vikter som lyckades. Två modeller kunde inte utvärderas: Fable vägrade delta trots att Perplexity var registrerat i Anthropics Cyber Verification Program, och även GPT-6 Astra vägrade.
Sårbarheterna, som upptäcktes den 26 augusti, har åtgärdats: varje utgående paket måste bära den adress som tilldelats dess VM, och gatewayen avslutar nu själv TLS-anslutningen för att kontrollera servernamnet (SNI) och HTTP-värden. När modellerna testades igen i den konfiguration som var mest gynnsam för angriparen lyckades ingen längre hämta flaggan. Perplexity testade sedan, utan agenter, tio externa sandlådeplattformar: åtta hade minst en väg runt skyddet, däribland E2B, Vercel Sandbox, Modal Sandboxes och Daytona Sandbox, medan Cloudflare Sandbox och NVIDIA OpenShell stod emot. Alla leverantörer, som underrättades den 1 september, har svarat. Den 10 september hade Daytona, Deno och microsandbox åtgärdat problemen, medan Vercel och Modal betraktade beteendet som en känd begränsning. Rapportens andra del, om modellernas strategier, har aviserats utan datum.
Claude Code 2.1.281: valfri attribuering och striktare autoläge
23 september — Claude Code 2.1.281 publicerades kl. 19.19 UTC, dagen efter 2.1.280. Versionen innehåller 176 poster, varav 112 är rättningar. Två förändringar märks i det dagliga arbetet: inställningen "attribution": false i settings.json tar bort all attribuering i commits och pull requests, och omedelbar sändning av ett meddelande (ctrl+enter) låter pågående verktyg fortsätta i bakgrunden i stället för att avbryta turen.
Autoläget blir striktare: där klassificeraren körs på serversidan måste även shellkommandon som bara läser invänta dess beslut. En säkerhetsrättning är värd att uppmärksamma: ett rekursivt rm riktat mot en kommandosubstitution, som rm -rf "$(pwd)", kördes utan bekräftelse i autoläge och med --dangerously-skip-permissions; nu krävs bekräftelse även om en Bash-regel tillåter kommandot. För att obevakade sessioner inte ska fastna väntar bekräftelsefrågan för ett farligt rm i två minuter och nekar sedan kommandot med ett förslag om att skriva om det.
En ändring som bryter kompatibiliteten för egenhostade runners: mellanliggande skript (wrappers) eller hooks som lägger till --system-prompt måste gå över till --system-prompt-file. För administratörer kan Claude apps-gatewayen anropa Amazon Bedrock med en IAM-roll som hämtas via STS (assume_role), vid behov i ett annat AWS-konto, och tillämpa en Bedrock-säkerhetsspärr på varje begäran.
Anthropic på produktsidan: snabbare claude.ai och bredare Marketplace
Två produktnyheter från Anthropic, publicerade samma dag, kompletterar det vetenskapliga resultatet.
claude.ai tre gånger snabbare på två veckor
23 september — På claude.dev berättar tre ingenjörer från Anthropic om den två veckor långa insatsen i augusti som gjorde claude.ai och skrivbordsappen ungefär tre gånger snabbare. Allt skedde i en enda Slack-kanal, med Claude Tag (beta) som drevs av en intern forskningsmodell ”ungefär jämförbar med Opus 5.5”: Claude hittade flaskhalsarna, byggde benchmarktester, föreslog rättningar och övervakade driftsättningarna, medan människor satte målen och godkände varje ändring. Resultatet blev över 3 000 sammanfogade ändringar, utan incidenter som kunderna märkte eller återställningar.
| Uppmätt förlopp (75:e percentilen) | Före insatsen | Efter insatsen |
|---|---|---|
| claude.ai-sidan redo för inmatning | 3,1 s | 0,55 s |
| Ny Claude Code-session (skrivbord) | 0,8 s | 0,3 s |
| Claude Cowork-session i molnet (skrivbord) | 2,6 s | 0,73 s |
| Geometriskt medelvärde för 13 mätningar | – | 3,1x snabbare |
Metoden bygger på en idé: så snart Claude har ett tal att slå kan den optimera. Teamet gjorde därför deterministiska mätvärden till CI-spärrar vars värden bara får sjunka. En del av förbättringarna, ungefär fyra gånger jämnare streaming, hade redan presenterats den 24 augusti.
🔗 Så gjorde vi claude.ai 3x snabbare på två veckor
Claude Marketplace samlar kopplingar, agenter och integratörer
23 september — Anthropic breddar Claude Marketplace, som lanserades i begränsad förhandsversion i mars. Marknadsplatsen samlar nu tre typer av erbjudanden: över 2 000 kopplingar och plugins (Atlassian, Google, Microsoft, Notion, Salesforce …), agenter och produkter som drivs av Claude (CrowdStrike, Cursor, Harvey, Legora, Lovable, Snowflake), som företag kan betala för med en del av sitt avtalade utgiftsåtagande hos Anthropic, samt konsultföretagen i Claude Partner Network (Accenture, Boston Consulting Group, Deloitte). Leverantörer har tre vägar in: bygga en koppling eller ett plugin med MCP och Agent Skills, ansöka om att få med en agent eller produkt, eller gå med i Partner Network. Ett kompletterande blogginlägg visar hur köpet fungerar: CodeRabbit finansierade en Vercel-plan med sitt budgetåtagande hos Anthropic, i en affär som slutfördes på en vecka. Betalning via åtagandet hos Anthropic är fortfarande i begränsad förhandsversion och kräver en ansökan om behörighet.
ChatGPT: Voice börjar utföra uppgifter, studiekort och Privacy Center
Voice använder plugins och kommer till ChatGPT Work
23 september — OpenAI utökar ChatGPT Voice på två sätt. Röstläget Live kan nu använda plugins och appar som är kopplade till kontot, till exempel e-post, kalender eller Slack, under ett samtal på webben, iOS och Android. Voice kommer också till ChatGPT Work på webben och i mobilen: där kan man med rösten be den skapa ett dokument, en presentation eller ett kalkylblad, använda en ansluten app eller utföra en uppgift i webbläsaren. Uppgiften kan fortsätta skriftligt efter samtalet.
När det gäller modeller uppger OpenAI:s inlägg på X att Voice även kan använda GPT-6 Astra, Sol och Luna. Hjälpartikeln anger däremot att Live bygger på GPT-Live-1 eller GPT-Live-1 mini beroende på abonnemang, utan att förklara vilken roll GPT-6-modellerna har. Användare med Free och Go har Voice i Chat med de plugins som ingår i deras abonnemang. Voice i Work kräver tillgång till båda, och uppgifter som startas på det sättet räknas in i den vanliga Work-användningen. Live stöder varken video eller skärmdelning. Funktionen har rullats ut globalt sedan den 23 september i den senaste appversionen.
🔗 OpenAI:s tillkännagivande på X · Hjälpartikel om ChatGPT Voice
Studiekort och integritetscenter
22 september — ChatGPT kan nu skapa interaktiva studiekort (flashcards) utifrån ett ämne eller uppladdade anteckningar. Man trycker på ett kort för att vända det och anger sedan om man kunde svaret eller behöver gå igenom det igen; kortens ordning kan blandas. Korten sparas automatiskt i biblioteket. Funktionen finns på mobil och webb för alla abonnemang, även gratisversionen.
21 september — En tillbakablick: samma sida med versionsinformation meddelade dagen innan att ett integritetscenter (Privacy Center) börjat rullas ut till inloggade användare med Free, Go, Plus och Pro. Det samlar information om samtalens integritet, minne, anpassning, dataanvändning, anslutna appar och kontosäkerhet på ett ställe, med direktlänkar till inställningarna. På webben nås det via kontomenyn (Help, sedan Privacy Center) och i mobilen via inställningarna.
🔗 ChatGPT:s versionsinformation
Två nya benchmarktester: psykisk hälsa och inferenstjänster
MentalHealthBench (OpenAI)
23 september — OpenAI publicerar MentalHealthBench, ett öppet benchmarktest som mäter hur modeller svarar i realistiska samtal om psykisk hälsa, från vardagliga samtal med känslomässiga inslag till akuta situationer. Det har utvecklats tillsammans med över 80 legitimerade psykologer och psykiatrer från 22 länder som talar 19 språk. De syntetiska samtalen skildrar fyra grupper: vuxna, ungdomar mellan 13 och 17 år, närstående som ger stöd och kliniker. För varje samtal skrev experterna viktade kriterier från -10 till +10; endast kriterier som godkänts av minst två av tre experter, utan att den tredje invände, behölls. Bedömningen sker automatiskt med GPT-5.6 Sol som utvärderare, och poängen delas upp i tio dimensioner, däribland säkerhet, inhämtning av sammanhang och respekt för användarens självbestämmande. OpenAI uppger att modellerna förbättras stadigt, särskilt när det gäller att inhämta sammanhang, men poängen per modell visas bara i blogginläggets diagram. OpenAI påminner om att ChatGPT inte ersätter terapi eller professionell vård.
🔗 Vi presenterar MentalHealthBench
SWE-Serve (NVIDIA)
23 september — NVIDIA:s team för data och utvärdering av Nemotron-modeller publicerar SWE-Serve, utvecklat tillsammans med SGLang-teamet: 83 pull requests som faktiskt har sammanfogats i denna motor för inferenstjänster har blivit 53 körbara uppgifter (spekulativ avkodning, modellstöd, kernels, cache och tjänste-API). Huvudresultatet gäller skillnaden mellan lokala tester och en verklig tjänst: för de 19 uppgifter som startar en riktig server klarar samma rättningar 69,4 % utan tester mot den aktiva tjänsten, men 45,9 % med den fullständiga kontrollen. Ungefär var tredje rättning som klarar de andra kontrollerna misslyckas alltså när modellen väl laddas och får frågor.
| Utvärderad modell (maximalt resonemang) | pass@1 över 3 körningar | Genomsnittlig kostnad per uppgift |
|---|---|---|
| Claude Opus 5 | 75 % | 17,40 dollar |
| GPT-5.6 Sol | 75 % | 12,26 dollar |
| Kimi K3 | 64 % | 7,24 dollar |
| GPT-5.6 Luna | 64 % | 0,95 dollar |
| DeepSeek V4 Flash (0731) | 55 % | 0,69 dollar |
Elva modeller utvärderades med en enkel agent utan webbtillgång. Tabellen omfattar varken Claude Opus 5.5 eller GPT-6 Sol och Luna, som släpptes den 22 september, eller GPT-6 Astra. Uppgifterna och kontrollverktygen är offentliga.
🔗 Så visar SWE-Serve skillnaden mellan lokala tester och en aktiv tjänst · GitHub-repository
Generativ video flyttar in i redigeringsprogrammen
Runway i DaVinci Resolve Studio
23 september — Två veckor efter sina plugins för Premiere Pro och After Effects kommer Runway till DaVinci Resolve Studio, Blackmagic Designs redigeringsprogram. Pluginet är gratis för macOS och Windows och öppnas via Workspace och sedan Workflow Integrations. Där skapar man bilder och videor med promptar och importerar dem med ett klick till Media Pool och tidslinjen, utan att använda webbläsaren. Funktionen Edit Studio arbetar med ett klipp som redan ligger i redigeringen: panelen exporterar det valda avsnittet, och Aleph 2.0 renderar om det i en ny stil med samma längd, utifrån högst fem redigerade nyckelbilder. DaVinci Resolve Studio 19 eller senare krävs. Generering är tillgänglig med alla Runways betalabonnemang och använder befintliga krediter; kostnaden för varje generering visas före bekräftelse.
🔗 Runway finns nu i DaVinci Resolve
Gemini Omni 1.1 Flash gratis i Google Vids
23 september — Alla som har ett Google- eller Google Workspace-konto kan nu skapa videor utan kostnad med Gemini Omni 1.1 Flash i Google Vids, via vids.new på datorn. Version 1.1 ger tre nya möjligheter: förlänga en scen och behålla personer, ljussättning och miljö; ange ett klipps exakta längd för att passa en berättarröst; och generera direkt i 1080p. Varje klipp får en SynthID-vattenstämpel. Den fullständiga utrullningen börjar den 23 september och kan ta 1 till 3 dagar. Betalabonnemang ger större genereringsvolymer, men inga siffror har publicerats. Google säger att berättarröst med Gemini 3.8 Flash-Lite TTS snart kommer till Vids på över 100 språk.
Made On YouTube 2026: Gemini Omni i redigeringen av Shorts
23 september — Vid sitt årliga evenemang Made On YouTube integrerar YouTube Gemini Omni i en samtalsbaserad redigeringsassistent för Shorts och appen YouTube Create: enkla textinstruktioner räcker för att klippa bort talade partier, synkronisera musik, lägga till text som fångar intresset eller ändra ordningen på klippen. Livesändningar får automatisk dubbning (Live auto-dubbing), YouTube Music får Ask Music för att skapa lyssningsköer genom samtal, och Podcast Lineup levererar varje vecka talade, AI-genererade smakprov på rekommenderade poddar. Kreatörer får också utökad likhetsdetektering för att skydda sin röst och sitt ansikte. Bara de personliga startflödena (Custom Feeds) har fått en tidsplan: de kommer i höst för tittare i USA. De övriga funktionerna har ännu inget exakt datum.
🔗 Made On YouTube 2026 · Googles sammanfattning
Assistenterna kopplas till fler appar
Gemini: en ny våg av anslutna appar
23 september — Google rullar ut en ny serie appar som kan kopplas till Gemini. Kontot @GeminiApp beskriver dem som MCP-anslutningar. Blogginlägget nämner 14 namn i tre grupper: produktivitet (Airtable, Linear, monday.com, PandaDoc, Wispr AI, Zoho), skapande (Adobe, Picsart, Squarespace, Webflow) och vardag (apartments.com, Experian, Peloton, SeatGeek). Inlägget från @GeminiApp på X talar däremot om 13 nya appar. Tjänsterna aktiveras i inställningarna eller anropas i samtalet genom att skriva @. Två exempel är att justera ljussättningen i ett foto med Adobe och att kontrollera sin kreditvärdighet med Experian. Blogginlägget anger varken vilka länder eller vilka abonnemang som omfattas.
🔗 Googles tillkännagivande · Tillkännagivande från @GeminiApp
Muse, Metas agent: Shopify, PayPal, Expedia, Instacart, sedan ElevenLabs och HeyGen
22 och 23 september — Muse, den personliga agent som Meta lanserade den 8 september, presenterade på mindre än ett dygn fyra kopplingar till handelstjänster. Enligt det officiella kontot @Muse blir alla tillgängliga ”snart”, utan uppgift om datum, pris eller länder. Den 23 september meddelade ytterligare två aktörer inom generativa medier att de ansluter sig: ElevenLabs, utan datum för tillgänglighet, och HeyGen, som använder sin MCP-server.
| Tillkännagiven tjänst | Användning enligt tillkännagivandet | Tillkännagiven av | Angiven tillgänglighet |
|---|---|---|---|
| Shopify | Betalning i ett steg på hela webben | @Muse | Snart |
| PayPal | Agenthanterade betalningar världen över | @Muse | Snart |
| Expedia | Hotellbokning | @Muse | Snart |
| Instacart | Matvaror levererade hem | @Muse | Snart |
| ElevenLabs | Berättarröster, ljudspår och videor | @ElevenLabs | Ej angiven |
| HeyGen | Publiceringsklar video med den egna avataren och rösten | @HeyGen | Ej angiven |
🔗 De fyra kopplingarna som @Muse tillkännagav · ElevenLabs kommer till Muse · HeyGen ansluter till Muse
Grok Bot i Tesla-bilar och i Google Slides, Sheets och Docs
22 september — Tesla meddelar att Grok Bot, SpaceXAI:s agent, kommer till företagets bilar. Med Connectors kan Grok hantera inkorgen, organisera kalendern eller ta upp befintliga filer, samtal och uppgifter utan att föraren släpper ratten. Kontot @grok delade tillkännagivandet samma kväll. Aktiveringen sker i tre steg: logga in i Grok-appen i bilen, lägg till Connectors från Groks mobilapp eller webbplats och teckna sedan SuperGrok, som krävs för Grok Bot. Meddelandena anger varken vilka bilmodeller eller vilka länder som omfattas.
Samma dag meddelar kontot @bot att Grok Bot ansluter direkt till Google Slides, Sheets och Docs, hanterar e-postbilagor bättre (läser och lägger till filer) och kan låta sin webbsurfning gå via användarens nätverk. SpaceXAI utlovar också snabbare uppgifter och en mer responsiv skrivbordsapp, utan att ange några siffror.
🔗 Inlägg från @grok · Teslas tillkännagivande · Grok Bots inläggstråd
Antigravity: lokala agenter och kommandot /plan
SDK:et kör sina agenter lokalt med Gemma 4 26B
23 september — Antigravity SDK, som ger åtkomst till Google Antigravitys agentfunktioner från Python, stöder nu helt lokala arbetsflöden. Det första stödet gäller Gemma 4 26B A4B som körs med LiteRT (Google AI Edge) på en dator med mer än 24 GB VRAM eller enhetligt minne; LocalOpenAIAgentConfig kan anslutas till vilken OpenAI-kompatibel server som helst, till exempel Ollama, LM Studio eller vLLM. Google framhåller att det inte finns några API-kostnader eller hastighetsgränser, att koden stannar på datorn och att hybrida arbetsflöden är möjliga. I företagets demonstration planerar Gemini 3.8 Flash en granskning av tre sårbara moduler i molnet med 95 tokens, utan att någonsin se koden, medan lokala instanser av Gemma 4 26B återskapar sårbarheterna samt skriver och validerar rättningarna; 97,2 % av alla tokens (3 322) stannar lokalt. Nyheterna kom med SDK-version 0.1.18 den 21 september, som också tar bort det interaktiva frågeverktyget ASK_QUESTION från standardverktygen så att agenterna kan arbeta självständigt.
🔗 Meddelande från Google Developers
Antigravity 2.16.0 och 2.17.0, CLI 1.2.8 och 1.2.9
22 september — Antigravity-appen släpper två versioner samma dag. Version 2.17.0 inför kommandot /plan: agenten skriver en plan som användaren kan granska och ändra innan den skriver en enda rad kod, med inställningen Plan Review Policy i tre lägen (granska varje plan, låta agenten avgöra eller hoppa över granskningen). Den avsätter också en budget på 20 000 tokens för regler och läser konfigurationen för varje kodförråd i .gemini/config.json; den tidigare .agents/settings.json används inte längre. Version 2.16.0 gör det möjligt att ansluta till en WSL-distribution, dra in Word-, Excel- och PowerPoint-dokument i en prompt och se underagenter på livekort.
| Appversion | Antal förbättringar | Antal rättningar | Viktigaste nyheten |
|---|---|---|---|
| 2.16.0 | 12 | 15 | WSL, Office-bilagor, kort för underagenter |
| 2.17.0 | 11 | 10 | /plan, budget på 20 000 tokens för regler |
22 och 23 september — I terminalen får CLI 1.2.9 en @-syntax för att skriva direkt till en underagent och ett tillförlitligare headless-läge: bakgrundsuppgifter får fortsätta i upp till 30 minuter i stället för att avbrytas några sekunder efter att agenten blivit inaktiv. Version 1.2.8 ändrar komprimeringen av kontexten och begränsar röstdiktering till 3 min 30 s.
🔗 Ändringslogg för Antigravity
Google DeepMind: krypterat beständigt minne för Private AI Compute
23 september — Google DeepMind beskriver hur företaget planerar att ge Private AI Compute, dess plattform för bearbetning i hårdvaruisolerade molnenklaver, ett beständigt minne. Hittills har plattformen varit ”tillståndslös”: all kontext försvann när uppgiften var klar. Det nya lagret fungerar som ett krypterat valv i molnet, vars nycklar bara finns på användarens enheter. Enligt Google gör det uppgifterna otillgängliga för alla andra, även Google. När en modell behöver information dekrypterar en säker enklav tillfälligt uppgifterna i isolerat minne, behandlar förfrågan, sparar den nya kontexten och krypterar om uppgifterna direkt. Ett exempel är att hitta monteringsanvisningar på datorn som användaren tidigare tittat på med uppkopplade glasögon.
Det är ett tillkännagivande om arkitekturen, formulerat som något som ska införas, utan datum för tillgänglighet eller namngiven produkt. För att stärka förtroendet publicerar Google en uppdaterad vitbok, ett offentligt manipulationssäkert register över sin serverprogramvara som enheter ska kunna kontrollera innan de skickar personuppgifter, samt resultaten från en oberoende granskning utförd av ett företag som Google inte namnger.
Qwen: agenter för smarttelefoner och billigare ljudmodeller
Qwen Intelligence, tre agenter för telefontillverkare
23 september — Qwen lanserar Qwen Intelligence, ett erbjudande med agenter för smarttelefoner som i första hand riktar sig till telefontillverkare. Modulerna (planering, utförande, bild och minne) kan kombineras efter behov, och en router fördelar beräkningarna mellan enheten och molnet. Tre agenter finns vid lanseringen: Mobile Planner planerar komplexa uppgifter, Mobile-Use utför dem i första hand via API:er och använder det grafiska gränssnittet vid behov (82,1 på MobileWorld, 97,2 på AndroidDaily och 90 % lyckade uppgifter från början till slut enligt Qwen), och Mobile Creative genererar en bild på 3 sekunder. Qwen öppnar fyra benchmarks, men varken agenternas vikter eller kod. Mobile-Use och Mobile Creative debiteras redan efter användning, medan debitering av Mobile Planner utlovas ”snart”.
| Utvärderad modell eller system (enligt Qwen) | Totalpoäng på MobilePA-Bench |
|---|---|
| Qwen-Planner-Agent 27B | 77,05 % |
| GPT-6 Astra | 76,84 % |
| Claude Opus 5 | 75,71 % |
| Claude Fable 5 | 74,53 % |
| GLM 5.3 | 73,88 % |
🔗 Qwens tillkännagivande på X · Rapport om Qwen-Planner-Agent
Qwen-Audio-3.1, upp till 95 % billigare
23 september — Qwen-Audio-3.1 uppgraderar Qwens tre ljudmodeller för taligenkänning (ASR), talsyntes (TTS) och samtal i realtid (Realtime) och lägger till två till: TTS-Next, som genererar röst, effekter och bakgrundsljud i ett enda steg, och ASR-Next, som skiljer mellan talare, tidsstämplar transkriptionen och känner igen känslor och omgivningsljud. Realtime lyssnar och talar samtidigt och kan avbrytas. På QwenCloud kostar qwen-audio-3.1-realtime-plus 6,4 dollar per miljon inkommande ljudtokens och 24 dollar för utgående text och ljud, med en kontext på 262K tokens; ASR för filer kostar 0,15 dollar per miljon inkommande tokens. Endast dessa två API:er är tillgängliga; de övriga utlovas ”snart”.
| Modellfamilj | Aviserad prissänkning |
|---|---|
| TTS | cirka 70 % |
| Realtime | cirka 85 % |
| ASR | upp till 95 % |
🔗 Tillkännagivande om Qwen-Audio-3.1 på X · Qwen-Audio-3.1-Realtime på QwenCloud
Mistral Vibe: Chat och Work slås ihop, CLI skärper sina behörigheter
Chat och Work slås ihop, kunskapsbas i förhandsversion
22 september — Mistral publicerar fyra versionsnoteringar för Vibe, sin assistent (tidigare Le Chat), utan blogginlägg eller inlägg på X. Den viktigaste ändringen slår ihop Chat och Work till en gemensam upplevelse: man ställer en fråga eller startar en uppgift på samma ställe, en Fast / Think-väljare ersätter byte av läge och Skills ersätter Chat Agents, där Deep Research blir en av dem. Migreringen började den 14 september för konton med Free, Pro och Teams; företagskunder följer från den 1 oktober under en period på ungefär sex månader. Den agentbaserade kunskapsbasen (Agentic Knowledge Base), i offentlig förhandsversion, ersätter ett ogenomskinligt minne med sidor som går att läsa och ändra och visar varifrån varje återkallad uppgift kommer. Mini App Canvas genererar små delbara React-appar utifrån en prompt, och Excel- eller CSV-kalkylblad blir tillgängliga i Vibe Work för betalande abonnemang.
Vibe CLI 2.25.8 rättar kringgåenden av behörigheter
23 september — Vibe CLI 2.25.8 innehåller 5 tillägg och 38 rättningar, varav flera gäller behörighetssäkerhet. En tillåtelselista med relativa sökvägar godkänner inte längre en fil bara för att dess sökväg slutar med samma suffix, jokertecken i shell-kommandon kringgår inte längre kontrollen av sökvägar utanför arbetsmappen, och en behörighet som beviljats för en överordnad mapp omfattar inte längre automatiskt dess undermappar. Därför kan vissa godkännandeförfrågningar dyka upp igen. Versionsnoteringarna nämner också för första gången en ”Rust CLI”, som berörs av 18 rader och bland annat gör det möjligt att konfigurera fjärrprojekt i Vibe Code. För företag tillämpas organisationens obligatoriska konfiguration när en Unified Harness-session öppnas, och OAuth-anslutningen till MCP-servrar som utfärdar en klienthemlighet, som Supabase, har rättats.
🔗 Versionsnoteringar för Vibe CLI 2.25.8
Öppna kodagenter och kodagenter på kommandoraden
ZCode blir öppen källkod efter säkerhetsproblem
21 september — En tidigare nyhet: Z.ai har öppnat källkoden till ZCode, dess ramverk för agentbaserad programmering som beskrivs som det officiella verktyget för GLM-5.3, efter säkerhetsproblem som rapporterats av användare. Kontot @zcode_ai säger att de nödvändiga rättningarna är klara och ber om ursäkt. Kodförrådet zai-org/ZCode, med licensen Apache-2.0, innehåller klienter, backendtjänster, CLI och agentens runtime; det hade omkring 6 500 stjärnor den 23 september.
With respect to the code data referenced by the community, we confirm that no such data is retained and that it has never been used for model training.
🇸🇪 När det gäller de koddata som användare har tagit upp bekräftar vi att inga sådana data lagras och att de aldrig har använts för att träna modeller. — @zcode_ai på X
Enligt ZCode har två organisationer därefter utvärderat situationen: enligt CAICT innehåller Alibaba Cloud OSS-bucketen ”zcode-prod” inte längre några data; enligt NSFOCUS har både dess objekt och själva bucketen raderats. Båda konstaterar att klientversion v3.14.0 innehåller rättningen, att funktionen Repo Wiki har tagits bort och att flödet som laddade upp ögonblicksbilder av lokala kodförråd har inaktiverats. Z.ai aviserar en permanent process för att rapportera sårbarheter, med belöningar, och lovar att publicera hela utvärderingsrapporten.
Kimi Code 2.1.0 stärker säkerheten
23 september — Moonshot släpper Kimi Code 2.1.0 (2 nyheter, 18 rättningar). Den synliga nyheten är en experimentell helskärmslayout som väljs i /settings och börjar gälla efter omstart. Flera rättningar stärker säkerheten: filverktyg kan inte längre ta sig ut ur arbetsmappen via symboliska länkar, ett projekts lokala konfiguration tillämpas först när arbetsytan har godkänts, git-konfigurationen i ett kodförråd kan inte längre köra kommandon under git-operationer i bakgrunden, och extra mappar som pekar på hemkatalogen eller rotkatalogen avvisas. OAuth för MCP-servrar begär nu åtkomst offline, vilket sätter stopp för kravet på ny auktorisering varje timme. Samtidigt har Moonshot arkiverat den äldre Python-baserade Kimi CLI (11 424 stjärnor), vars versioner 1.51.0 och 1.52.0 hänvisar till Kimi Code.
🔗 Versionsnoteringar för Kimi Code 2.1.0
DeepSeek Harness 0.1.7-rc.1, i förhandsversion
23 september — DeepSeek släpper v0.1.7-rc.1 av DeepSeek Harness, sitt agentramverk med öppen källkod under MIT-licens som presenterades den 13 augusti. Det är en versionskandidat (release candidate): kodförrådet har fått 21 förhandsversioner sedan augusti, men ännu ingen stabil version. De mest framträdande tilläggen är experimentella: ett Computer Use-läge där agenten kan använda den lokala datorn och ta skärmbilder (via Cua Driver MCP eller en inbyggd drivrutin), samt tre backends för webbläsarstyrning (Playwright MCP, Chrome DevTools MCP, Stagehand). Webbgränssnittet får inbyggda terminaler och en granskning av ändringar med diffs, headless-läget läser uppgifter från standardindata och skickar ut händelser som JSON, och agenten kan arbeta på en fjärrarbetsyta via SSH. Migreringar behöver planeras: DeepSeeks officiella adapter använder nu enbart Messages API, E2B-backends för körning tas bort och det experimentella teamläget utökas från 8 till 16 lagkamrater.
🔗 DeepSeek Harness v0.1.7-rc.1
GenCode, Gensparks kodagent
23 september — Genspark lanserar GenCode, en kodagent som ingår i dess Super App på macOS, Windows och Linux och även finns på kommandoraden. Huvudargumentet är valet av modell: Claude, GPT, DeepSeek eller en modell med öppna vikter kan väljas för varje uppgift från ett enda konto, utan att konfigurera någon API-nyckel; Genspark uppger att öppna modeller kostar ”mellan en tiondel och en tjugondel så mycket”. GenCode tar över instruktioner, regler och minne som byggts upp för Claude Code i ett enda steg. README-filen för npm-paketet @genspark/gencode klargör dess ursprung: det bygger på opencode, kodagenten med öppen källkod, men är en egenutvecklad produkt utan koppling till projektet som avsiktligt delar mappen .opencode/ i kodförråd. Kostnaden visas i Genspark-krediter vid varje steg.
🔗 GenCode · Gensparks tillkännagivande på X
GitHub Copilot: assisterade godkännanden och lokal sandlåda
Copilot för JetBrains 1.18.0
22 september — Version 1.18.0 av Copilot för JetBrains IDE:er inför assisterade godkännanden (assisted approvals) i offentlig förhandsversion: under agentsessioner godkänns verktygsanrop som bedöms ha låg risk automatiskt, medan mer riskfyllda åtgärder fortfarande kräver ett beslut. Det går också att redigera ett tidigare meddelande: Copilot spolar då tillbaka konversationen och filändringarna innan den nya instruktionen skickas. Agenten Codex, som finns i Copilot för JetBrains, får ett planläge där man kan granska, förfina eller godkänna tillvägagångssättet före varje ändring, och sessionerna stöder skills samt instruktioner för organisationer och företag. Den inbyggda GitHub MCP-servern, som är aktiv som standard, kan nu stängas av. Användare av en JetBrains IDE i version 2025.1 får en uppmaning att uppgradera till 2026.1 eller senare.
🔗 Nyheter i Copilot för JetBrains
Copilot-appen isolerar sina lokala sessioner
23 september — GitHub Copilot-appen, GitHubs datorapp för dess agenter, får en lokal sandlåda i offentlig förhandsversion. Den konfigureras per projekt och begränsar vad kommandon i en lokal session kan nå: filsystemet (mappar med läs- och skrivåtkomst, enbart läsåtkomst eller ingen åtkomst), nätverket (utgående åtkomst till internet och det lokala nätverket) och inloggningsuppgifter (Git via HTTPS, GitHub CLI). Företagsstyrda inställningar kan skärpa policyn. Om operativsystemet inte kan tillämpa den begärda policyn avslutas sandlådans shell med ett fel i stället för att köras utan skydd. Sandlådan är avstängd som standard och kan aktiveras för nya sessioner i projektet eller med /sandbox on för en pågående session; den omfattar varken molnsessioner eller fjärrvärdar, och dess inställningar är separata från inställningarna i Copilot CLI.
🔗 Lokal sandlåda i GitHub Copilot-appen
Cursor: två bottar för produktionssättning, 7 % färre tokens
Rollouts och Security Review
23 september — Cursor lanserar två botar för det sista steget i kodleveransen, tillgängliga med abonnemangen Teams och Enterprise. När en pull request öppnas publicerar Rollouts en övervakningsplan med risker, förväntad effekt och signaler att kontrollera. Efter varje driftsättning jämför den planen med loggar, mätvärden och spår och ger ett besked för varje miljö: utan problem, regression upptäckt eller inget säkert besked. Vid en regression pekar den ut den misstänkta ändringen och kan öppna en PR för att återställa den, som kräver godkännande. Den slår inte själv ihop eller återställer något. Security Review granskar varje pull request och flaggar exploaterbara sårbarheter, som injektioner, kringgående av autentisering, hemligheter som lämnats i koden och SSRF. För varje fynd anges allvarlighetsgrad, angreppsväg och en föreslagen åtgärd. Under 10 dagar gör provkrediter det möjligt att testa Rollouts på cirka 50 ändringar för Teams och 500 för Enterprise.
7 % lägre tokenkostnad utan kvalitetsförlust
23 september — Cursor beskriver hur företaget har sänkt agentens tokenkostnad för användarna med 7 % utan att kvaliteten försämrats. Eftersom nyare modeller inte längre behöver långa listor med förbud har systemprompten kortats med cirka 66 %, med nedskärningarna bekräftade genom A/B-tester på verklig trafik. De inbyggda verktygen, varav de flesta används i mindre än 20 % av samtalen, laddas nu vid behov.
| Optimeringsåtgärd | Effekt uppmätt av Cursor |
|---|---|
| Kortare systemprompt | cirka 66 % av prompten borttagen |
| Inbyggda verktyg laddas vid behov | -60 % beskrivningstoken i statisk kontext |
| Explicita brytpunkter för cache | -20 % misslyckade anrop vid kall cache |
| Ett radnummer var tionde rad | -1,6 % token lästa från cachen |
| Alla ändringar sammantaget | -7 % tokenkostnad för användarna |
NVIDIA: öppen talardiariansiering och AI Day Singapore
Nemotron 3 Diarization skiljer mellan upp till åtta talare
23 september — NVIDIA publicerar Nemotron 3 Diarization på Hugging Face, en modell med öppna vikter och 100 miljoner parametrar som avgör vem som talar och när i ett samtal, även när röster överlappar varandra. Den följer upp till åtta talare, jämfört med fyra för föregångaren Streaming Sortformer, och fungerar både i efterhand och i en kontinuerlig ström, med justerbar buffertlatens från 30,4 till 0,32 sekunder. Den transkriberar inte orden: den ger tidsintervall per talare som kan kombineras med en transkriptionsmodell. I de första resultaten från VoiceArenas Diarization-Bench ligger den etta av 12 system med 14,72 % fel vid talardiariansiering, jämfört med 19,3 % för nästa system. Enligt NVIDIA är det en preliminär placering som kan förändras. Jämfört med den äldre modellen minskar felen i genomsnitt med 41 % över åtta utvärderingsdataset, med en liten försämring för samtal med två talare i CALLHOME. Licens: OpenMDW 1.1.
| Publicerat mått | Nemotron 3 Diarization | Föregående modell |
|---|---|---|
| Högsta antal talare som följs | 8 | 4 |
| Genomströmning vid 30,4 s (batchar om 32, RTX PRO 5000) | 15 113 gånger realtid | 2 619 gånger |
| Fel på DIHARD III vid 30,4 s | 12,73 % | 19,09 % |
🔗 Nemotron 3 Diarization på Hugging Face-bloggen
AI Day Singapore: Vera Rubin och Nemotron i Sydostasien
22 september — I ett blogginlägg som publicerades den 22 september kl. 19.30 PT under AI Day Singapore (22 och 23 september) presenterar NVIDIA Sea Limited, moderbolag till Shopee, Garena och Monee, som det första företaget i ASEAN-regionen att ta i bruk plattformen Vera Rubin för att utveckla och driftsätta modeller och agenter i större skala. Resten av inlägget visar hur de öppna Nemotron-modellerna anpassas lokalt: AI Singapore utökar sin modellfamilj SEA-LION, inriktad på regionens språk, med Nemotron-modeller. I Vietnam har Viettel AI finjusterat Nemotron 3 Super för vietnamesiska, och modellen toppar benchmarken VMLU. I Thailand har iApp Technology anpassat Nemotron 3 Nano till thailändsk lagstiftning med OpenThai 2.0 Legal, som publicerats som öppen källkod och driver den juridiska chatboten Thanoy med omkring 43 000 användare.
🔗 På AI Day Singapore visar NVIDIA och dess partner upp AI-framsteg i Sydostasien
Sätta AI i produktion utan avbrott
Två tillkännagivanden bygger på samma idé: validera med verkliga arbetsbelastningar innan trafik flyttas eller maskiner uppdateras.
Together AI:s kanariedriftsättningar
22 september — Together AI beskriver de stegvisa driftsättningarna för tjänsten Dedicated Model Inference, tillgängliga sedan uppdateringen den 15 september: modellen bakom en endpoint kan bytas utan avbrott eller ändrad URL. Tre strategier erbjuds: kanariestrategin ökar trafiken till den nya modellen stegvis (som standard 5 %, 25 %, 50 % och sedan 100 %), blågrön driftsättning flyttar all trafik på en gång och stegvis ersättning byter ut replikerna en i taget. Efter varje kanariesteg jämför en kontrollpunkt latensen eller felfrekvensen med den gamla modellens och pausar driftsättningen om värdena försämras. I den publicerade demonstrationen stoppas bytet från Qwen2.5-7B till Qwen3.5-9B redan vid 10 % av trafiken på grund av en ökning på 137 % i p95-latens (1 740 ms mot 734 ms). Återgången till den gamla modellen skedde utan att någon av de 6 800 hanterade förfrågningarna misslyckades.
🔗 Kanariedriftsättningar: uppgradera modeller i produktion utan avbrott
NVCRE och NodeWright hos NVIDIA
23 september — NVIDIA beskriver två projekt med öppen källkod (Apache 2.0) inom DSX OS, mjukvarulagret i företagets plattform för AI-fabriker, för GPU-kluster som kör Kubernetes. NVIDIA Cluster Readiness Engine (NVCRE) utgår från ett problem: ett kluster kan klara alla hälsokontroller men ändå misslyckas med distribuerad träning. Därför certifierar det klustret med verkliga arbetsbelastningar (NCCL-kommunikationstester, DCGM-diagnostik och NeMo-förträning) på nodgrupper som valts utifrån topologin. Det identifierar felande noder och delar i diagnostikläge upp felande grupper i två delar tills misstänkta noder har isolerats. Blogginlägget nämner Nemotron 5-modeller med 8 respektive 56 miljarder parametrar bland dessa arbetsbelastningar, utan ytterligare detaljer. NodeWright, tidigare Skyhook och använt i produktion hos NVIDIA, uppdaterar nodernas system (kärninställningar, säkerhetsagenter och sårbarhetsfixar) när skyddade jobb har slutförts. Uppdateringarna sker i fasta, linjära eller exponentiella vågor som stoppas automatiskt om för många grupper misslyckas.
🔗 Validera GPU-klustrets beredskap innan AI-arbetsbelastningar körs · NodeWright
Två öppna dataset: samtal med flera röster och vetenskapligt korpusmaterial
Basis Conversations 1500
23 september — Basis publicerar Basis Conversations 1500 på Hugging Face: 1 502 timmar spontana samtal mellan 2 645 personer från 33 länder, på 22 språk, från engelska till mingreliska och xhosa. Varje samtal samlar två till fyra personer, var och en inspelad på ett eget synkroniserat spår (FLAC 48 kHz). Det gör det möjligt att studera överlappningar, avbrott och turtagning, som modellerna enligt teamet fortfarande har svårt med. Omkring 100 timmar har finannoterats av människor (113 096 bedömningar): medkännande eller irriterad röstrespons, besvärad tystnad och samarbetsinriktad eller konkurrerande överlappning. De medföljande transkriptionerna är automatiska och bör inte användas som träningsmål utan kontroll. Blogginlägget beskriver datasetet som fritt för kommersiell användning och forskning, men det omfattas av Basis egen licens (basis-data-license-1.0) och åtkomst beviljas efter manuell granskning.
QVAC Genesis III
23 september — Tether AI Research publicerar QVAC Genesis III, den tredje delen av sitt syntetiska korpusmaterial för förträning av små modeller inom naturvetenskap, teknik, ingenjörsvetenskap och matematik. Med ytterligare 43,06 miljarder token uppgår hela materialet till 191,43 miljarder token och cirka 160 miljoner dokument inom 19 områden. Den tillhörande artikeln har antagits till konferensen COLM 2026. Metoden frågar en liten elevmodell, Qwen3-1.7B-Base: ett fel leder till en korrigerande förklaring, medan ett rätt svar leder till en analys av varje svarsalternativ. En modell med 1,7 miljarder parametrar som tränats från grunden på materialet förbättras tydligt jämfört med samma modell tränad på Cosmopedia-v2, vid samma tokenbudget. Korpusmaterialet publiceras under en licens för icke-kommersiellt bruk (CC-BY-NC 4.0), och en modell tränad på det aviseras under Apache 2.0.
| Utvärderad benchmark | Förbättring jämfört med Cosmopedia-v2 (samma tokenbudget) |
|---|---|
| ARC-Easy | +28,57 poäng |
| ARC-Challenge | +21,35 poäng |
| GPQA Diamond | +2,52 poäng |
| MMLU STEM | +15,03 poäng |
AI för klimatet och livsmedelsförsörjningen
Ai2 och Global Fishing Watch övervakar haven med agenter
23 september — Under Climate Week i New York tillkännager Ai2 och Global Fishing Watch ett partnerskap för att använda AI, särskilt agenter, till havsövervakning och fiskerikontroll. Organisationerna samarbetade redan och går nu vidare till gemensam utveckling: en gemensam pipeline för detektering, nya visionsmodeller för satellitbilder i realtid och agenter som kan sammanföra flera datakällor. Global Fishing Watch får tillgång till OlmoEarth, Ai2:s plattform för jordobservation baserad på öppna modeller, för att annotera sina data och träna egna modeller. Skylights fartygsdetekteringar i realtid kommer att finnas i dess portal för förvaltare av marina områden. De två teamen ska också vidareutveckla agenter som Shippy, som en analytiker kan be om ett fartygs historik. Inget tidsschema eller belopp anges i tillkännagivandet.
🔗 Ai2 och Global Fishing Watch samarbetar om AI-agenter för havsövervakning
Google.org och Gates Foundation vill nå 200 miljoner småbrukare
18 och 22 september — En uppföljning: Google.org och Gates Foundation utökar sitt gemensamma initiativ för att ge 200 miljoner småbrukare i Afrika söder om Sahara och Sydasien tillgång till AI-verktyg för klimat, jordbruk och språk, jämfört med de 50 miljoner som planerades från början. De två partnerna bidrar med sammanlagt 100 miljoner dollar i finansiering, med tekniskt stöd från Googles forskare och ingenjörer. Gates Foundations pressmeddelande är daterat den 18 september; blog.google tog upp nyheten på kvällen den 22 september. Programmet finansierar lokala aktörer som Wadhwani AI och Digital Green i Indien, integrerar AI-prognoser i klimatplattformen TomorrowNow, kartlägger jordlotter med en upplösning på under en meter och stöder öppna röst- och textdataset på över 40 afrikanska språk. Småbrukare producerar närmare 35 % av världens livsmedel.
🔗 Google.orgs tillkännagivande · Gates Foundations pressmeddelande
Kortfattat
- Anthropic, modernisering av kod — I serien ”Notes from the Field” föreslår två Anthropic-ingenjörer som arbetar ute hos kunder, Jonah Ezekiel och Lexie Tonelli, sex steg för att förbereda en agentdriven modernisering av kod: mål, ett ”certifikat” för tester, mänsklig granskning i etapper, förutsättningar, agentarbetsflöde och sedan lansering. De anger inga kostnadssiffror utan råder läsarna att mäta kostnaden i ett pilotprojekt. 🔗 källa
- Boris Cherny verifierar Claude Agent SDK med Lean — På kvällen den 22 september berättade Boris Cherny (Claude Code) att han låtit Opus 5.5 formellt verifiera Claude Agent SDK med bevisassistenten Lean: några korta prompts resulterade i 16 pull requests som rättade buggar och samtidighetsproblem. Han säger att han även använder TLA+. 🔗 källa
- Codex CLI 0.156.1 — Den här korrigeringen av 0.156.0 lägger till GPT-6 Sol och GPT-6 Luna i CLI:ts modellväljare. Meddelandet som visas när hastighetsgränsen nås rekommenderar nu Luna, och migreringar erbjuds från GPT-5.5 och GPT-5.6. 🔗 källa
- Airbnb och GPT-6 Astra — Ett nytt avtal ger Airbnbs teknik- och produktteam bredare tillgång till OpenAI:s modeller, däribland GPT-6 Astra, via OpenAI:s API och Amazon Bedrock. Teknikchefen Ahmad Al-Dahle uppger att teamen levererar omkring 80 % fler funktioner än för ett år sedan. Något avtalsbelopp anges inte. 🔗 källa
- OpenAI Academy fyller två år — Sedan september 2024 har fler än 250 evenemang hållits och fler än 4 miljoner människor nåtts. OpenAI testar ett program för utbildare i lokalsamhället (Community Trainer Program), där anställda i partnerorganisationer efter en utvärdering får lära sig att leda workshoppar. 🔗 källa
- En LED-skärm blev röstassistent — På bloggen OpenAI Developers berättar Sid Rampally hur Codex hjälpte honom att koppla och programmera en LED-panel på 128 × 64 pixlar som styrs av en Raspberry Pi. GPT-Live-1 sköter samtalet och delegerar sökningar och visning till GPT-5.6 Luna via Responses API. 🔗 källa
- MedGemma passerar 10 miljoner nedladdningar — Google beskriver praktisk användning av sina öppna medicinska modeller: screening för livmoderhalscancer hos fler än 3 500 kvinnor i Zambia, pilotprojekt vid AIIMS-sjukhuset i Delhi och upptäckt av tuberkulos i Indonesien. Google påminner om att modellernas svar inte ska användas direkt som underlag för diagnos. 🔗 källa
- Gemini Notebook i Google Docs — Genom att skriva @ i Docs går det att ange en notebook som källa. Gemini grundar texten i dess källor, med hänvisningar i texten, och kombinerar dem med e-post och filer via Workspace Intelligence. Tillgängligt för Business Standard och Plus, Enterprise Standard och Plus, Education Plus samt prenumeranter på Google AI Pro och Ultra. 🔗 källa
- Sex verktyg i Google Flow — Google Labs publicerar sex verktyg som kreatörer byggt med Google Flow Tools: Mondo Sónico (synkroniserade ljudeffekter), CaptionCast (animerade undertexter), ThumbnailForge (miniatyrbilder), Surface (texturer på 3D-ytor), CollageMotion Pro och SwissFlow Studio (rörlig grafik). Alla kan kopieras och vidareutvecklas. 🔗 källa
- Google Beam levereras i Frankrike — Beam, Googles plattform för videokommunikation som ska återskapa känslan av ett möte ansikte mot ansikte och säljs tillsammans med HP, levereras nu i sex länder, däribland Frankrike, med 18 partner. En intern studie pekar på att team känner sig 50 % mer sammansvetsade och har 21 % färre uppföljningsmöten. 🔗 källa
- Android Enterprise och Gemini-agenter — Gemini kan utföra uppgifter i flera appar utifrån det som visas på skärmen, medan skydd hindrar personliga agenter från att komma åt arbetsprofilen. Administratörer kan begränsa eller stänga av AI-automatisering för hela enhetsflottan. 🔗 källa
- AI Brief på franska — Den slutna betaversionen av AI Brief, som hjälper användare att styra Google Ads-kampanjer med AI Max med egna ord, öppnas för franska, nederländska, tyska, italienska, japanska, portugisiska och spanska. 🔗 källa
- Gemini CLI, nightly-versionen från 23 september — Det rör sig endast om en nightly-version, inte en stabil version. Den lägger till Gemini 3.8 Flash och Gemini 3.5 Flash Lite, som kan användas direkt med API-nyckel, Vertex AI eller gateway och, med experimentfunktioner aktiverade, via ett Google-konto. Ingen stabil version släpptes tisdagen den 22 september. 🔗 källa
- EcoHash mäter sina videooptimeringar — På en RTX PRO 6000 med 96 GB minskar EcoHash tiden för en MiniMax H3-video från 174,8 till 40,8 sekunder och för Wan2.2 text-till-video från 132,3 till 10,7 sekunder, med en destillerad LoRA i 4 steg. Tre av de tio testade inställningarna, däribland båda kompileringslägena, gjorde ingen skillnad. 🔗 källa
- Krimtatariska: missvisande test undveks — Utvecklaren av en taligenkänningsmodell för krimtatariska upptäckte att fyra ljudböcker förekom två gånger i datamängden: 96,9 % av utdragen i huvudtestet hade en motsvarighet i träningsmaterialet. Efter korrigering, LoRA-finjustering och justering av avkodaren sjönk felfrekvensen per ord från 0,3463 till 0,1701. 🔗 källa
- Falcon-H1 och mlx-lm — I mlx-lm 0.31.3 körs, utan KV-cache, bara det första av Falcon-H1:s 66 lager under träning. Därmed tränas varje LoRA utan fel eller varning på en modell med ett enda lager. Korrigeringen kräver en rad kod, och ett ärende har öppnats. 🔗 källa
- Agenter och bidrag till öppen källkod — Quentin Gallouédec (Hugging Face) anser att agentgenererade bidrag suddar ut signalen om ett verkligt behov och tar tid från underhållarnas granskning. Han uppmanar folk att sluta släppa lös agenter på slumpmässigt valda projekt och börja med att använda projektet. 🔗 källa
- Phionyx hos IETF — Phionyx upphovsperson lämnar in ett individuellt utkast, Claim-Preserving Exchange of AI Evaluation Evidence, med målet att ett utvärderingsresultat ska behålla sina villkor och begränsningar när det förs mellan system. Ingen arbetsgrupp har antagit texten. 🔗 källa
- Kimi Work 3.2.12 — Moonshots skrivbordsagent låter användaren markera ett avsnitt i en PPT-, Excel-, Word- eller Markdown-fil och få just det avsnittet ändrat. Storleksgränsen för bilagor tas bort. 🔗 källa
- Qwen-Image-2.1 toppar bland öppna modeller — Enligt Arena är Qwen-Image-2.1 nu den främsta öppna modellen för bildredigering (1 367 poäng, plats 16 totalt) och för bildgenerering från text (1 228 poäng, plats 17 totalt). 🔗 källa
- OpenTelemetry i Copilot-appen — Administratörer kan exportera spår från agentsessioner i GitHub Copilot-appen, såsom modellförfrågningar och använda verktyg, till sina övervakningsverktyg via egenskapen
telemetryimanaged-settings.json. Innehållet i prompts och svar ingår inte som standard. 🔗 källa - Copilot CLI och C++ — Microsoft C++ Language Server i Copilot CLI bygger nu ett beständigt index över symbolerna i hela projektet, aktiverat som standard. Den första indexeringen kan ta lång tid och kräva mycket minne, och GitHub anger ingen siffra på förbättringen. 🔗 källa
- En pull request med en miljon rader — Ett teknikinlägg från GitHub förklarar hur Copilot-appen visar en pull request med 2 200 filer, mer än en miljon rader och över 400 kommentarer genom att skilja kodens geometri, som beräknas i förväg, från kommentarernas, som mäts nära det synliga området. 🔗 källa
- Genspark lägger till Opus 5.5, GPT-6 och Grok 4.7 — Under natten till den 23 september öppnar Genspark för Claude Opus 5.5, Grok 4.7, GPT-6 Sol och GPT-6 Luna i AI Chat, Code Agent och Claw. Företaget återger modellutvecklarnas argument utan att ange abonnemang eller pris. 🔗 källa
- Undersökning från GitHub och Yale — Bland 1 039 GitHub-användare i USA uppger 71 % att de oroar sig för AI:s miljöpåverkan, och åtta av tio vill ha verktyg för att skriva mer energieffektiv kod. GitHub påpekar att urvalet, som består av personer som tackat ja till företagets marknadsföringsutskick, inte är representativt. 🔗 källa
- Zed 1.21.0 — Den stabila versionen ger tillgång till Claude Opus 5.5 samt GPT-6 Astra, Sol och Luna med egen API-nyckel, lägger till inloggning med SuperGrok i Agent-panelen och hindrar som standard datorn från att gå i viloläge medan en agent arbetar. 🔗 källa
- Warp — GPT-6 Sol och Luna, följda av Claude Opus 5.5, blir tillgängliga i terminalen Warp och Warp Agent CLI. Grok 4.7 tillkommer för den som ansluter sitt Grok-abonnemang. Det handlar om tillgänglighet; några priser anges inte. 🔗 källa
- Devin i Microsoft Teams — Devin, som hittills varit begränsad till kanaler, svarar nu även i direktmeddelanden och gruppchattar, startar Automations från en kanal och skickar fråge- eller godkännandekort. Appen begär inga nya behörigheter. 🔗 källa
- Scribe v2 Medical — ElevenLabs modell för klinisk transkribering har funnits sedan den 11 september och får nu en officiell presentation med en ny siffra: 35 % färre ordfel på kliniskt ljud jämfört med Scribe v2. Priset börjar på 0,22 dollar per timme. 🔗 källa
- Sora 2 lämnar ElevenLabs — ElevenLabs tar bort Sora 2 och Sora 2 Pro från sin studio eftersom OpenAI stänger Sora API den 24 september, en tidsfrist som OpenAI meddelade den 24 mars. Berörda arbetsflöden måste byta till en annan videomodell, till exempel Gemini Omni 1.1 Flash. 🔗 källa
- Cohere Model Vault i Kanada — Cohere meddelar att Model Vault, företagets dedikerade inferensplattform för en enda kund, finns tillgänglig i Kanada utan att ange molnregion, leverantör eller pris. Produktsidan nämner ännu inte Kanada. 🔗 källa
- Cohere och förändringsledning — I ett inlägg uppmanar Katherine Correia (Cohere) läsarna att behandla AI som en deltagare snarare än enbart ett verktyg, dela in uppgifter i verifierbara, bedömningsbaserade eller hybrida och styra utifrån användningsfall. Inlägget presenterar varken någon produkt eller några siffror. 🔗 källa
Vad det betyder
Anthropics resultat tar kodagenter vidare till grundläggande biologi. Omkring 950 Claude-agenter sorterade över 200 000 omvända transkriptaser på 21 timmar, och människor ingrep bara i början, med en prompt, och i slutet, för experimenten. Flaskhalsen flyttas till urvalet av hypoteser, som Anthropic nu studerar som ett forskningsområde i sig. Försiktighet krävs fortfarande: ART:s funktion är okänd och resultatet finns än så länge i form av ett preprint. Samma upplägg med många agenter som styrs av mätningar syns i sprinten som gjorde claude.ai snabbare, med över 3 000 ändringar, och i den formella verifieringen av Claude Agent SDK med Lean.
Säkerheten i agenternas sandlådor blir en offentlig fråga. Perplexitys granskning skiljer mellan två gränser: isoleringen av den virtuella maskinen höll i samtliga 108 försök, medan nätverksfiltreringen kringgicks 11 gånger av 54 när modeller utnyttjade bristfälligt kontrollerad DNS eller delade adresser hos ett CDN. På 8 av 10 tredjepartsplattformar gick minst en skyddsåtgärd att kringgå. Två modeller, Fable och GPT-6 Astra, vägrade delta i övningen. Samma dag lanserar GitHub Copilot-appen en lokal sandlåda som hellre stoppar körningen än kör utan skydd, Claude Codes auto-läge skickar även skrivskyddade kommandon till klassificeraren, och Vibe CLI och Kimi Code täpper till vägar runt behörighetskontroller. Två dagar tidigare hade ZCode öppnat sin källkod efter problem som dess användare rapporterat.
Rösten blir ett gränssnitt för att utföra uppgifter. Gemini 3.8 Flash TTS och Flash-Lite TTS gör ljudutmatning mer än hälften så dyr jämfört med den föregående förhandsversionen (9 respektive 6 dollar per miljon token till slutet av 2026, jämfört med 20) och lägger till röstkloning som kräver inspelat samtycke. Funktionen är inte tillgänglig via AI Studio i Europeiska ekonomiska samarbetsområdet. Qwen aviserar prissänkningar på 70–95 % för sina ljudmodeller, NVIDIA släpper en modell som kan skilja mellan åtta talare och Basis publicerar 1 500 timmar samtal där röster överlappar varandra. Samtidigt går ChatGPT Voice från samtal till handling med plugins och uppgifterna i ChatGPT Work.
Slutligen blir fysisk AI mer öppen, men på olika villkor. FLUX 3 Action placerar en modell med 7 miljarder parametrar överst i RoboLab-120, integrerar den i LeRobot tillsammans med NVIDIA och visar att en snabb och tillförlitlig policy minskar behovet av kostsam slutledning: 8,77 dollar per lyckat försök med GPT-6 Astra som övervakare, jämfört med 13,47 dollar för enbart Astra. Men ”öppen” betyder olika saker: en egen licens för såväl FLUX 3 Action som Basis Conversations 1500, en icke-kommersiell licens för QVAC Genesis III och publicerade benchmarks utan modellvikter för Qwen Intelligence. För den som vill återanvända resurserna är licensen lika viktig som resultatet.
Källor
- Claude upptäcker ett nytt enzymsystem med CRISPR-liknande upprepningar (Anthropic)
- Förhandsversion av ART (PDF, Anthropic)
- @AnthropicAI: enzymsystemet som Claude upptäckte
- Gemini 3.8 Flash TTS och Flash-Lite TTS (Google)
- Versionsinformation för Gemini API, 22 september
- Priser för Gemini API
- FLUX 3 Action (Black Forest Labs)
- @bfl_ai: lansering av FLUX 3 Action
- FLUX 3 Action-samling på Hugging Face
- Escaping SPACE, Part I (Perplexity)
- Claude Code v2.1.281
- Så gjorde vi claude.ai tre gånger snabbare på två veckor (claude.dev)
- Claude Marketplace (Anthropic)
- @OpenAI: ChatGPT Voice med plugins och i ChatGPT Work
- Hjälpartikel om ChatGPT Voice
- Versionsinformation för ChatGPT
- Vi presenterar MentalHealthBench (OpenAI)
- SWE-Serve (NVIDIA)
- NVIDIA/swe-serve-kodarkivet
- Runway finns nu i DaVinci Resolve
- Gemini Omni 1.1 Flash i Google Vids
- Made On YouTube 2026
- Sammanfattning av Made On YouTube 2026 (Google)
- Nya anslutna appar för Gemini
- @GeminiApp: 13 nya anslutna appar
- @Muse: fyra kommande kopplingar
- @ElevenLabs: ElevenLabs kommer till Muse
- @HeyGen: HeyGen ansluter sig till Muse
- @grok: Grok Bot i Tesla-bilar
- @Tesla: Grok och kopplingarna
- @bot: Grok Bot kopplad till Google Slides, Sheets och Docs
- Lokala modeller i Antigravity SDK (Google Developers)
- Ändringslogg för Antigravity
- Beständigt minne för Private AI Compute (Google DeepMind)
- @Alibaba_Qwen: Qwen Intelligence
- Rapport om Qwen-Planner-Agent
- @Alibaba_Qwen: Qwen-Audio-3.1
- Qwen-Audio-3.1-Realtime på QwenCloud
- Versionsinformation för Mistral
- Vibe CLI 2.25.8
- @zcode_ai: ZCodes källkod blir öppen
- zai-org/ZCode-kodarkivet
- Kimi Code 2.1.0
- DeepSeek Harness v0.1.7-rc.1
- GenCode (Genspark)
- @genspark_ai: lansering av GenCode
- Copilot för JetBrains 1.18.0 (GitHub Changelog)
- Lokal sandbox i GitHub Copilot-appen (GitHub Changelog)
- Rollouts och Security Review (Cursors ändringslogg)
- Förbättrad tokeneffektivitet (Cursor)
- Nemotron 3 Diarization (NVIDIA, Hugging Face-bloggen)
- AI Day Singapore (NVIDIA)
- Canary-utrullningar (Together AI)
- NVIDIA Cluster Readiness Engine (NVIDIA)
- NodeWright (NVIDIA)
- Basis Conversations 1500 (Hugging Face-bloggen)
- QVAC Genesis III (Hugging Face-bloggen)
- Ai2 och Global Fishing Watch (Skylight)
- Google.org och Gates Foundation (blog.google)
- Pressmeddelande från Gates Foundation
- Så förbereder du AI-drivna projekt för modernisering av kod (Anthropic)
- @bcherny: formell verifiering av Claude Agent SDK i Lean
- Codex CLI 0.156.1
- Airbnb och GPT-6 Astra (OpenAI)
- Två år med OpenAI Academy
- Så fick jag liv i min LED-skärm (OpenAI Developers)
- MedGemma och global hälsa (Google)
- Gemini Notebook i Google Docs (Workspace Updates)
- Sex verktyg i Google Flow (Google Labs)
- Google Beam lanseras i ytterligare sex länder (Google)
- Nyheter i Android Enterprise 2026 (Google)
- AI Brief och AI Max (Google Ads)
- Gemini CLI v0.62.0-nightly.20260923
- Tre av tio optimeringar gjorde ingen skillnad (EcoHash)
- Taligenkänning för krimtatariska (Hugging Face-bloggen)
- Finjustering av Falcon-H1 på en Mac (Hugging Face-bloggen)
- Vägen till helvetet för öppen källkod är kantad av goda avsikter (Hugging Face-bloggen)
- Instrumentpanelen visar PASS. Vad var det egentligen som godkändes? (Phionyx)
- Versionsinformation för Kimi Work
- @arena: Qwen-Image-2.1 är den främsta öppna modellen
- OpenTelemetry i GitHub Copilot-appen
- Kodintelligens för C++ i Copilot CLI
- Visning av stora pull requests i GitHub Copilot-appen
- @genspark_ai: Claude Opus 5.5 i Genspark
- GitHubs och Yales undersökning om effektivitet inom mjukvaruutveckling
- Zed 1.21.0
- @warpdotdev: GPT-6 Sol och Luna i Warp
- Devin, Microsoft Teams och Microsoft 365
- @ElevenLabs: Scribe v2 Medical
- ElevenLabs ändringslogg från 23 september
- @cohere: Model Vault i Kanada
- Förändringsledning för AI (Cohere)