Sök

Cursor lanserar Cursor Router, OpenAI presenterar Presence och Project Camellia, Alibaba avslöjar Qwen-Image-3.0

Cursor lanserar Cursor Router, OpenAI presenterar Presence och Project Camellia, Alibaba avslöjar Qwen-Image-3.0

ai-powered-markdown-translator

Artikel översatt från fr till sv med gpt-5.4-mini.

Visa projekt på GitHub ↗

Den 22 juli 2026 domineras av företagsinriktade AI-verktyg och AI-agenter: Cursor lanserar Cursor Router, en modelrouter som sänker kostnaderna med 60 % utan märkbar kvalitetsförlust, OpenAI presenterar på en gång sin agentplattform Presence och sitt 3,2 gigawatt stora datacenter Project Camellia i Georgia, Alibaba lanserar Qwen-Image-3.0 och Synthesia lanserar Roleplay Sessions för yrkesutbildning. Runt dessa fem stora tillkännagivanden kretsar ett trettiotal andra notabla nyheter — från det amerikanska energidepartementets Genesis Mission (Google, OpenAI, Arcee AI) till nyheter från Anthropic, GitHub Copilot, NVIDIA och Cohere.


Cursor lanserar Cursor Router, intelligent modellrouting till 60 % lägre kostnad

22 juli — Cursor har lanserat Cursor Router, en integrerad modellrouter i läget Auto som analyserar varje förfrågan och automatiskt väljer den modell som bäst passar uppgiften, i stället för att konsekvent skicka alla förfrågningar till en gränsmodell (frontier). Funktionen är tillgänglig från och med idag på alla ytor (desktop, webb, iOS, CLI, SDK) för planerna Teams och Enterprise.

OptimeringslägeMålDebitering
IntelligenceSystematisk gränskvalitetPris för den modell som faktiskt används
BalanceKvalitet nära gränsen, daglig användningPris för den modell som faktiskt används
CostAcceptabel kvalitet, optimerad för tokensPris för den modell som faktiskt används

På administrationssidan har Teams- och Enterprise-grupperna finmaskiga kontroller: aktivera eller inaktivera Router per team, begränsa tillgängliga lägen, ange ett standardläge, tillåta eller blockera vissa underliggande modeller samt välja om namnet på den modell som faktiskt routas ska visas eller inte (dolt som standard). Mjuka eller strikta tillämpningsalternativ gör det möjligt att standardisera användningen av läget Auto inom en organisation.

In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.

🇸🇪 I förtida åtkomst har kunderna inte observerat någon kvalitetsförsämring, för en kostnad per commit som är lägre jämfört med att routa alla förfrågningar till Opus 4.8.@cursor_ai på X

🔗 Cursor Router changelog


OpenAI Presence, plattform för röst- och textagenter för företag

22 juli — OpenAI lanserar Presence, en AI-agentplattform avsedd för företag för att driftsätta tillförlitliga röst- och textagenter i produktion, bortom en ren teknisk demonstration. Presence kombinerar modellernas resonemang med policyer, skyddsräcken och regler för mänsklig eskalering.

Varje driftsättning börjar med en specifik uppgift (fakturering, försäkringsärenden, interna IT-begäranden): agenten får endast den kunskap och de systemåtkomster som behövs, och kundföretaget definierar vad den får göra, när en mänsklig validering krävs och när en person måste ta över. Efter produktionssättningen avslöjar verkliga sessioner och eskaleringsfall systemets brister; Codex föreslår då uppdateringar som teamen testar och validerar, vilket gör det möjligt för agenten att anpassa sig till användarnas förändrade beteende.

Från och med idag stöder Presence realtidsupplevelser i röst och text för kundsupport, utgående försäljning eller interna flöden med höga krav. Produkten är tillgänglig för kvalificerade företagskunder via ett program för begränsad allmän tillgänglighet, med direkt stöd från OpenAI:s team och därefter, för löpande uppföljning, av utvalda systemintegratörer.

🔗 Fullständigt tillkännagivande — OpenAI


Project Camellia, OpenAI:s 3,2 gigawatt stora datacenter i Georgia

22 juli — OpenAI beskriver Project Camellia, ett långsiktigt AI-infrastrukturprojekt i Effingham County, Georgia. Företaget har tecknat avtal med Georgia Power om 3,2 gigawatt effekt, levererad i etapper mellan 2028 och 2032.

När det gäller elektricitet åtar sig OpenAI att bära samtliga infrastruktur- och servicekostnader, utan att dessa förs vidare till invånarnas elpriser, och anläggningen är utformad för att proaktivt minska sin förbrukning vid hög efterfrågan innan bostadskunder påverkas. På vattensidan återcirkulerar ett slutet system vattnet i stället för att kontinuerligt ta in och släppa ut det, vilket ger en löpande förbrukning jämförbar med en motsvarande kontorsbyggnad.

Ekonomiskt tillkännager OpenAI 80 miljoner dollar i samhällsnyttiga förmåner under projektets livstid (skolor, allmän säkerhet, hälsa, boende, veteraner, småföretag), utöver hundratals miljoner dollar i förväntade lokala och delstatliga skatteintäkter — företaget räknar med att bli den största skattebetalaren i countyt. Därtill kommer upp till 71 miljoner dollar i Codex-krediter för kvalificerade studenter vid Georgia-colleges, community colleges och tekniska skolor, där var och en får 100 dollar i krediter via sitt ChatGPT-konto.

🔗 Fullständigt tillkännagivande — OpenAI


Qwen-Image-3.0, Aliclouds tredje generation av bildgenereringsmodellen

22 juli — Alibaba har lanserat Qwen-Image-3.0, den tredje generationen av sin bildgenereringsmodell, sammanfattad av teamet med ledordet: « Real » (« 实 »), efter version 1.0:s precision och 2.0:s variation/fullständighet.

DimensionVad det konkret förändrar
Rikt innehållPrompter upp till 4,5k tokens; komplex layout i ett enda svep (tidningar, storyboards, provuppgifter, 3×3-infografikrutor, inbäddade gränssnitt)
Autentiska detaljerLäsbar text ned till 10 px, fullständiga LaTeX-sidor, nästan fotorealistiska texturer (porer, hårstrån, hud)
Djup kunskapNativ rendering på 12 språk, mer än 100 konstnärliga stilar, realistiska gränssnitt (webb, spel, streams), live-webbsökning

Ett framlyft exempel från Alibaba illustrerar denna « horisontella expansion »: med bara 3,7k tokens genererar modellen en 3×3-infografik som täcker nio mycket olika områden (tunnelsäkerhet, spatial geometri, stilanalys av en klassisk kinesisk text, projektilrörelse, parasitologi, medicinsk diagnostik, Sylows satser, bankkontroll, DNA-struktur), med exakt text och exakta visuella element i varje ruta. Alibaba positionerar modellen inte som ett enkelt « snyggt att titta på »-verktyg, utan som ett produktivitetsverktyg för design, innehållsskapande, utbildning och e-handel. Den är tillgänglig redan nu via Qwen Chat.

🔗 Tillkännagivande på X


Synthesia lanserar Roleplay Sessions för yrkesutbildning

22 juli — Synthesia lanserar Roleplay Sessions, den första byggstenen i sin framtida plattform « Sessions » för yrkesutbildning med AI. Principen: en live-träningssamtal med en avatar som svarar och driver på i realtid, coachar användaren med ett poängsystem och mäter sedan kompetensutvecklingen på teamnivå. Den uttalade målgruppen är försäljning, ledarskap, kundservice och alla situationer där en anställd behöver öva på ett svårt samtal.

IndikatorVärde
Grundläggande färdigheter som omvälvs till 2027 (källa Synthesia)44 % av arbetstagarna
Arbetsgivare som uppger att de saknar kapacitet att täppa till gapet63 %
Genomsnittlig kompetenshöjning (globalt stort rekryteringsbolag)cirka 30 %
Säljare som frivilligt kommer tillbaka för att öva (Fortune 10-företag)cirka 70 %

Roleplay Sessions försöker samla fyra steg som vanligtvis är utspridda i en enda plattform — informera, öva, coacha och mäta — genom att bygga på Synthesias videobas, som redan används av 90 % av Fortune 100-företagen. De första utrullningarna gäller en stor europeisk koncern och ett Fortune 10-bolag.

🔗 Tillkännagivande på X


DOE:s Genesis Mission: Google, OpenAI och Arcee AI ökar sina åtaganden

22 juli — Tre olika aktörer annonserade samma dag nya åtaganden kring Genesis Mission, det amerikanska energidepartementets (DOE) initiativ för att fördubbla takten i den vetenskapliga upptäckten inom ett decennium.

OrganisationÅtagandeDetalj
Google DeepMind40 miljoner dollarAI-tokens och Google Cloud-krediter för att ge fler forskare vid nationella laboratorier tillgång till Gemini och andra modeller
OpenAI17 miljoner dollarCodex-tillgång för cirka 2 000 forskare, API-stöd för två vetenskapliga kampanjer, upp till 10 miljoner dollar i erbjuden API-användning för 2,5 miljoner spenderade, tillgång till GPT-Rosalind för biologi
Arcee AIPartnerskap (belopp ej offentliggjort)Byggandet av Genesis-Science-1 (GS1), en amerikansk modell med öppna vikter kopplad till ett styrt forskningsramverk för arbetsflöden inom vetenskaplig beräkning

Google utvidgar ett redan etablerat samarbete kring beräkningsbiologi (AlphaFold, Isomorphic Labs). OpenAI bygger vidare på arbete som redan gjorts med det nationella laboratorienätverket, inklusive en « AI Jam »-session som samlade mer än 1 000 forskare från nio laboratorier. Arcee AI öppnar å sin sida ett bidragsprogram riktat till forskare, laboratorier, universitet, företag och ideella organisationer; projektet är i ett tidigt skede, utan lanseringsdatum eller kommunicerat benchmark för GS1 i nuläget.

🔗 Google DeepMind på X — 🔗 OpenAI om ämnet — 🔗 Arcee AI på X


Anthropic multiplicerar tillkännagivanden kring Claude

Claude Security går in i beta för Claude Code

22 juli — Anthropic lanserar i betaversion pluginen Claude Security för Claude Code: skanning av pågående ändringar efter sårbarheter innan commit, eller fullständig analys av repot, allt från terminalen och med stöd av den Claude-inferens som redan används (ingen separat tredjepartstjänst att provisionera). Denna lansering placerar Claude Code på samma spelplan som OpenAIs Codex Security eller GitHub Copilots förstärkta secret scanning. Varken prissättning eller berörda planer utöver betastatus specificeras.

Claude kan fråga Anthropic Economic Index via en connector

22 juli — En ny inbyggd connector ger åtkomst till Anthropic Economic Index, den offentliga datamängd som mäter användningen av AI i ekonomin. När den aktiverats från menyn för connectors kan Claude svara på frågor som « vilka yrken använder AI mest » genom att direkt luta sig mot Indexets data snarare än mot sin allmänna kunskap.

Claude Managed Agents: effort, seeding, 500 skills och webhooks

22 juli — Anthropic rullar ut en uppsättning funktioner för Claude Managed Agents: konfigurerbara effort-nivåer per agent (snabbare och billigare svar vid lägre effort), « seedade » sessioner med upp till 50 händelser direkt vid skapandet, upp till 500 skills totalt över alla agenter i en session, webhooks för miljöer och minneslager samt streaming av underagenternas händelser.

Claude Code på desktop integreras med iOS-simulatorn

21 juli — Claude Code på desktop stöder iOS-simulatorn: appen kan kompileras och startas av Claude, som observerar den, interagerar med den och itererar fram till att uppgiften är klar, i en panel bredvid konversationen. Tillgängligt från och med idag i offentlig beta, begränsat till macOS och kräver Xcode.

🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 iOS-simulatorn


Kodverktyg: Amp, Warp och Replit

Amp lanserar Multiplayer, samarbete i realtid på orbs

22 juli — Tre veckor efter lanseringen av agenter i orbs lägger Amp till Multiplayer: en och samma orb kan nu delas och arbetas med samtidigt av flera medlemmar i en arbetsyta, med meddelanden till agenten, granskning av portalen, direkt observation av filändringar och en delad terminal, aktiverbar från en tråds Share-menyn.

Warp lägger till stöd för OSC 8-hyperlänkar

22 juli — Warp levererar stöd för OSC 8, en terminalstandard som gör det möjligt för CLI:er och kodningsagenter att emitera klickbara länkar i stället för råtext. Funktionen har utvecklats av en extern bidragsgivare på en begäran som varit öppen i fem år och rullas ut i Dev-version bakom en feature flag, medan ytterligare tester på terminalrutnätets renderingsmotor pågår.

Replit relanserar sin mobilapp

22 juli — Replit publicerar en omarbetning av sin mobilapp (iOS, stegvis utrullning på Android): omarbetad startsida, röståtkomst för att tala direkt med Agenten, svepnavigering mellan chatt, uppgifter och förhandsgranskning samt iOS Live Activities som följer agentens framsteg i realtid, även utanför appen.

🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit mobil


Microsoft Asia publicerar Mage-Flow, kompakt modell för bildgenerering

22 juli — Microsoft Asia publicerar på Hugging Face Mage-Flow, en modell för bildgenerering och bildredigering med endast 4 miljarder parametrar, som påstår sig hålla en kvalitet jämförbar med betydligt större modeller. Prestandamässigt genererar modellen en bild i 4 steg på mindre än en sekund vid 1024×1024 och kan skala upp till 4K. En demo finns tillgänglig via Hugging Face Spaces.

🔗 Tillkännagivande på X


Gemini: Galaxy Unpacked 2026 och Gemini 3.5 Pro

Tre nya Gemini-funktioner på Samsung-sidan

22 juli — I samband med Galaxy Unpacked 2026 beskriver Google tre nyheter för Gemini i Galaxy-ekosystemet: en utökad uppgiftsautomation till mer än 40 populära appar (inköp, bokningar, biljettköp, kan hantera komplexa bilder som instruktioner och köras i bakgrunden); Gemini Notebook (tidigare NotebookLM) förinstallerad på Galaxy Z Fold8-serien, med sex månaders provversion av Google AI Pro inkluderad; samt Gemini på Galaxy Watch 9 (aktivering med en enkel handledsrörelse, utan väckningsord), med smarta glasögon utvecklade tillsammans med Samsung (bågar från Gentle Monster och Warby Parker) planerade till hösten 2026.

Gemini 3.5 Pro går in i partner-testning

21 juli — Josh Woodward, VP ansvarig för Gemini, bekräftar att den kommande flaggskeppsmodellen, Gemini 3.5 Pro, officiellt har gått in i testfas med partners. Inget datum för allmän tillgänglighet anges, men bekräftelsen placerar Gemini 3.5 Pro som nästa stora förväntade lansering på modelsidan för Gemini.

🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro


Manus lanserar Plan Mode

22 juli — Manus introducerar Plan Mode, ett strukturerat granskningssteg före exekvering: i stället för att direkt börja bygga genererar agenten en genomförbarhetsplan i Markdown-format, med mål, steg och begränsningar, som användaren kan redigera eller låta granska innan den godkänns. Aktiveringen sker via / på webben eller + på mobil; läget kan också utlösas mitt under en uppgift för att planera nästa faser. Tillgängligt omedelbart för alla användare, på webben och i mobilen, som ett opt-in.

🔗 Tillkännagivande — Manus


GitHub Copilot : Canvas och fakturering

GitHub Copilot lanserar Canvas

21 juli — GitHub introducerar canvas, interaktiva arbetsytor i appen GitHub Copilot där utvecklare och agenter samarbetar i realtid: visualisering av komplex information, direkta interaktioner (klick, redigeringar), förfining genom prompt-iterationer. Skapas via kommandot /create-canvas. Illustrerade användningsområden: sortering av issues genom att svepa kort, interaktiva arkitekturdiagram, dashboards för worktrees, coaching i promptkvalitet, kunskapssökning över flera plattformar. En användare dokumenterade ett fall där appen automatiskt startade en webbläsarcanvas för att klicka sig fram till betalningsskärmen och verifiera en funktion, och därmed ersatte ett manuellt skrivet Playwright-test.

Vad Copilot tillför utöver rå åtkomst till ett API

22 juli — GitHub förklarar sin faktureringspolicy, som nu bygger på AI-krediter som debiteras enligt modellernas publicerade API-priser. Kodkompletteringar och Next Edit Suggestions ingår fortfarande i betalda planer; chatt och agentiska uppgifter förbrukar AI-krediter. GitHubs argument: utöver modellåtkomst tillför Copilot ett integrerat flöde (issues, repositorier, pull requests, organisationspolicyer), minskad tokenförbrukning vid motsvarande uppgiftslösning enligt dess utvärderingar, policykontroller för administratörer och en agentinfrastruktur som redan har bevisats i produktion via Copilot SDK.

🔗 Canvas — 🔗 Copilot vs rå API-åtkomst


ElevenLabs : ElevenMusic och ukrainsk offentlig tjänst

ElevenLabs introducerar Vocals och Styles i ElevenMusic

22 juli — ElevenLabs lägger till två funktioner i ElevenMusic, även tillgängliga i ElevenCreatives Finetunes: Vocals, som gör det möjligt att generera originallåtar med sin egen röst eller en röst från röstbiblioteket (uppladdning av spår för att finjustera Music v2 på ens klang, eller punktläge utifrån en enda inspelning); och Styles, för stilistisk konsekvens över hela spår, kompatibla med Vocals. ElevenLabs preciserar att alla uppladdningar kontrolleras för upphovsrättslig efterlevnad.

ElevenLabs utrustar Obrii (Ukraina) med en röstassistent för arbetsförmedlingen

22 juliObrii, Ukrainas nya digitala ekosystem för arbetsmarknaden, lanserar sin första AI-tjänst: en röstassistent utvecklad med ElevenLabs för den offentliga arbetsförmedlingen, tillgänglig dygnet runt, även under flyglarm.

“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”

🇸🇪 Med ElevenLabs har vi lanserat en AI-röstassistent för den offentliga arbetsförmedlingen — som för offentliga tjänster närmare medborgarna, dygnet runt, året om, även under flyglarm.@C_o_S på X

🔗 ElevenMusic Vocals och Styles


NVIDIA : medicinsk simulering, Texas-fabrik och Cosmos-modeller

Öppen källkodsramverk för medicinsk fysiksimulering

22 juli — NVIDIA publicerar med öppen källkod, i NVIDIA Isaac for Healthcare, ett GPU-accelererat ramverk för simulering av medicinsk fysik, presenterat som det första i sitt slag: interaktioner mellan medicinteknisk utrustning (kateter, ledare) och patientens anatomi, där klassisk fysiksimulering kombineras med generativ AI (Cosmos-H Dreams). Genom att köra 8 192 miljöer parallellt uppger NVIDIA att de har minskat en tränings-tid för robotpolicys (policies) från över fem timmar till mindre än två minuter. CMR Surgical, Johnson & Johnson MedTech, XCath och Medtronic Structural Heart använder det redan; tillgängligt nu på GitHub.

NVIDIA och Wistron öppnar en superchipfabrik i Fort Worth

21 juli — Wistron öppnar sin första amerikanska fabrik, en anläggning på 30 000 m² i Fort Worth (Texas), som redan producerar superchipen Grace Blackwell Ultra och på sikt ska tillverka Vera Rubin. En investering på 700 miljoner dollar, fler än 500 jobb skapade (mål 1 000 före årets slut), inom ramen för NVIDIAs 500-miljardersåtagande för tillverkning av AI-plattformar i USA.

Cosmos 3 Super, upp till 25 gånger snabbare

22 juli — NVIDIA släpper Cosmos 3 Super, en 4-stegsvariant av sin Cosmos 3-familj, som genererar bilder och videor upp till 25 gånger snabbare än originalmodellerna, samtidigt som den behåller en hög placering på Artificial Analysis: första plats i bild-till-video (utan ljud), andra plats i text-till-bild. Tillgänglig nu på Hugging Face.

Sammanfattning av Nemotron Model Reasoning Challenge på Kaggle

22 juli — NVIDIA publicerar sammanfattningen av sin Nemotron Model Reasoning Challenge på Kaggle: fler än 5 000 deltagare fördelade på fler än 4 000 lag, kring tekniker för att förbättra resonemanget hos öppna modeller. Lagen NullSira, vli och YS-L tar de tre första platserna.

🔗 Medicinsk simulering — 🔗 Wistron-fabrik — 🔗 Cosmos 3 Super — 🔗 Kaggle-sammanfattning


Kimi K3 : andra plats på AA-Briefcase, men dyr och långsam

21 juli — Artificial Analysis publicerar resultaten för Kimi K3 (Moonshot AI) på AA-Briefcase, dess benchmark för agentiskt kunskapsarbete (kalkylblad, presentationer, UI-mockups). Modellen får den näst bästa uppmätta poängen, ett hopp på mer än 700 poäng jämfört med föregående generation.

Utvärderad modellElo AA-BriefcaseGenomsnittlig kostnad per uppgiftGenomsnittlig tid per uppgift
Claude Fable 5 (max)1574
Kimi K3154310,57 dollar56,4 minuter
GPT-5.6 Sol (max)1501
Claude Sonnet 5 (max)1388
Claude Opus 4.8 (max)1347
Kimi K2.6 (referens)816~1 dollar

Kimi K3 uppvisar en lyckandefrekvens på 51 % i utvärderingsrutorna, strax bakom Claude Fable 5 (56 %), med jämförbar analytisk kvalitet men sämre presentationskvalitet. Nackdelen: en genomsnittlig kostnad på 10,57 dollar per uppgift, ungefär tio gånger mer än Kimi K2.6, en följd av modellpriset, hög användning av utgående tokens och ett genomsnitt på 83 rundor per uppgift (mot 67 för Claude Fable 5 och 50 för GPT-5.6 Sol).

🔗 Tillkännagivande på X


OpenAI : pressanvändning och API-tak

Hur redaktioner använder OpenAI:s verktyg

22 juli — OpenAI publicerar en översikt över hur nyhetsorganisationer använder dess verktyg. Associated Press använder dem för rapportering, verifiering (spårning av uppladdning, geolokalisering, kronolokalisering av bilder och videor), omvandling av tusentals ärenden från Högsta domstolen till strukturerad information och konvertering av artiklar till manus för distribution, samtidigt som journalisterna behåller kontrollen över det redaktionella omdömet. POLITICO analyserar stora volymer offentliga dokument för snabbare originalrapportering; Axios nämns också. OpenAI förnyar sitt stöd till American Journalism Project och fortsätter sina partnerskap med Lenfest Institute och WAN-IFRA.

Strikta utgiftstak utökas till alla API-konton

22 juli — OpenAI utökar denna vecka till alla konton i API Platform tillgången till strikta utgiftstak (hard spend limits), vilket gör det möjligt för varje utvecklare att sätta ett tak för sin förbrukning till valfritt belopp, med användningsuppföljning i realtid från kontrollpanelen.

🔗 Pressanvändning — 🔗 API-tak


Cohere : arabisk diakritisering och lätt kodmodell

Speech Tashkeel 2B och det community-drivna ekosystemet Transcribe Arabic

22 juli — Cohere lyfter fram Speech Tashkeel 2B, en partnermodell utvecklad av NAMAA som konverterar rå arabiska till helt diakritiserad text (grammatiska kasusmarkörer, harakāt, tanwīn, sukūn, shadda), med en kvantiserad version i 4 bitar. Tillkännagivandet åtföljs av community-bidrag kring Transcribe Arabic, Cohere:s modell för arabisk taligenkänning: appen listen-habibi, inbyggt stöd för Ruby och GGUF/ONNX-kvantiseringar publicerade på Hugging Face. Cohere meddelar dessutom ett partnerskap med HUMAIN för att utvidga detta arbete till andra resursfattiga språk.

North Mini Code, lätt och kostnadseffektiv kodmodell

21 juli — Cohere presenterar North Mini Code, en open source-kodmodell utformad för repetitiva och okomplicerade uppgifter — felsökning, skapande av enhetstester — positionerad som ett ekonomiskt alternativ till större modeller för att minska inferenskostnaderna.

🔗 Speech Tashkeel 2B — 🔗 North Mini Code


Kortnytt

  • Warp publicerar ett inlägg om de ekonomiska spänningarna för AI-startups i hypergrowth — analys av en kommande åtstramning av intäkterna för snabbväxande startups. 🔗 Källa
  • Hugging Face ordnar sitt första evenemang i Japan, i Tokyo — presentation av ny verktygslåda och företagets planer för den japanska marknaden, i Otemachi. 🔗 Källa
  • Ai2 publicerar en ny version av PaperFinder — verktyg för vetenskaplig dokumentforskning som hyllas av en forskare som använder det regelbundet, utan tekniska detaljer som kommunicerats. 🔗 Källa
  • Sakana AI publicerar en allmän presentation av Fugu, “One Model to Command Them All” — blogginlägg som breddar modellens orkestreringsområde bortom den redan bevakade Fugu-Cyber-varianten. 🔗 Källa
  • Gemini Live — kameraguide för visuell assistans i realtid — rikta kameran mot ett objekt eller dokument för att få kontextuell hjälp utan att behöva beskriva situationen skriftligt. 🔗 Källa
  • AlphaFold — ny tillämpning inom proteinteknik inför basens 5-årsjubileum — Pushmeet Kohli (Google DeepMind) lyfter fram en användning för att fylla strukturella kunskapsluckor i biologin. 🔗 Källa
  • Ny översiktsvy för Copilot-metrikers påverkan (Enterprise) — antagningskohorter (Code-first, Agent-first, Multi-agent, Passiva) med indikatorer för hastighet och merge per användare. 🔗 Källa
  • Copilot Business/Enterprise — synlighet för AI-krediter per faktureringscykel — visning möjlig nu även utan tilldelad individuell budget. 🔗 Källa
  • GHES — kommande skärpning av uppladdning av supportbundlar (18 augusti 2026) — avvisning av uppladdningar från opatchade instanser; uppdatering krävs till 3.21.3, 3.20.5, 3.19.9, 3.18.12 eller 3.17.18. 🔗 Källa
  • NVIDIA lanserar modulerna Jetson Thor T2000 och T3000 — nya moduler för robotik och edge-AI, utan detaljerat datablad tillgängligt i detta skede. 🔗 Källa
  • Cisco lanserar Antares, små modeller för upptäckt av sårbarheter i kod — Antares-350M och Antares-1B, tillgängliga på Hugging Face, kan köras lokalt för att undvika att skicka känslig kod till molnet. 🔗 Källa
  • HeyGen HyperFrames — Dag 17/30: Storyboard-flödet — plan i tre pass (kort, skisser, slutlig rendering) med granskning via kommentar bild för bild. 🔗 Källa
  • Kling AI publicerar en MCP-handledning för att skapa filmiska prestationer med agenter — komplett kreativt flöde i en agent: karaktär, känsla, videogenerering i batch. 🔗 Källa
  • En familj bygger ett trädkoja med ChatGPT som konsult — strukturell design, materialval och översättning av barnens idéer till genomförbara planer. 🔗 Källa
  • Codex Live Build — liveströmmad byggsession — sändning med skaparna av Codex Micro-tangentborden. 🔗 Källa
  • En spelare återskapar de italienska Dolomiterna i ett videospel med Codex — öppen värld “Valdiluce” med klättring, glidflygning och fungerande linbana. 🔗 Källa
  • ChatGPT Work-kampanj — 100 dollar i krediter erbjuds — till de första 10 000 deltagarna som på X publicerar vad de uppskattar med ChatGPT Work. 🔗 Källa

Vad det betyder

Modellrouting håller på att bli den nya tävlingsarenan för kodverktyg: Cursor Router utlovar 60 % besparingar utan märkbar kvalitetsförlust genom att automatiskt välja rätt modell för varje förfrågan, medan Artificial Analysis å andra sidan visar att Kimi K3, som får näst högst poäng i deras benchmark för agentiskt kunskapsarbete, kostar ungefär tio gånger mer än föregångaren och tar nästan en timme per uppgift. Budskapet är detsamma från båda håll: en modells råa kraft räcker inte längre för att motivera användningen, utan avvägningen mellan kostnad, kvalitet och latens blir den verkliga beslutsfaktorn för team som skalar dessa verktyg.

Företagsagenter går tydligt från demonstrationslogik till produktionslogik. OpenAI Presence strukturerar uttryckligen policyer, skyddsräcken och mänsklig eskalering kring modellernas resonemang; Synthesia Roleplay Sessions kvantifierar konkreta kompetensvinster i verkliga förhållanden; GitHub Copilot Canvases dokumenterar ett fall där en agent verifierade sitt eget arbete hela vägen till betalningsskärmen och ersatte manuellt skrivna tester; och Claude Managed Agents lägger till nivåer av ansträngning och webhooks utformade för komplexa agentiska arbetsflöden i produktion. Dessa tillkännagivanden pekar mot samma krav: att göra agenter tillförlitliga och styrbara över tid, inte bara kapabla i en demo.

På det institutionella området illustrerar DOE:s Genesis Mission en nu öppen trevägskamp — Google, OpenAI och Arcee AI — om att etablera sig i amerikansk offentlig vetenskaplig forskning, var och en med sin egen logik: tokens och molnkrediter för Google, Codex- och API-tillgång för OpenAI, en styrd öppen modell för Arcee AI. Denna institutionella dynamik kompletteras av en kapplöpning om fysisk infrastruktur, där Project Camellia (3,2 gigawatt i Georgia) och Wistrons superchipfabrik i Fort Worth (700 miljoner dollar, flera hundra jobb) visar att beräkningskapacitet och territoriell förankring håller på att bli fullt ut kommunikativa argument, offentligt kvantifierade och detaljerade.

Slutligen fortsätter den multimodala genereringen att diversifieras både nedifrån och uppifrån: Qwen-Image-3.0 driver realism och professionell nytta i en frontiermodell, medan Mage-Flow (Microsoft Asia, 4 miljarder parametrar) och Cosmos 3 Super (NVIDIA, upp till 25 gånger snabbare) satsar på kompakthet och hastighet för att göra dessa förmågor mer tillgängliga till lägre beräkningskostnad. Fallet ElevenLabs/Obrii i Ukraina påminner dessutom om att dessa röstteknologier också hittar användning i offentlig service med hög samhällelig påverkan, utöver de rent kommersiella användningsfallen.


Källor