Sök

Project Glasswing och Claude Mythos Preview, Meta Muse Spark, Gemini CLI v0.37.0

Project Glasswing och Claude Mythos Preview, Meta Muse Spark, Gemini CLI v0.37.0

Veckan 5 till 9 april 2026 dominerades av två stora tillkännagivanden: Anthropic presenterade Project Glasswing, en koalition av elva stora techbolag kring Claude Mythos Preview för att upptäcka zero-day-sårbarheter i stor skala, samtidigt som Meta gjorde comeback med Muse Spark, sin första modell utan open-weights på ett år. Parallellt publicerade Google, OpenAI, GitHub och Perplexity var och en anmärkningsvärda uppdateringar för sina utvecklare och användare.


Project Glasswing och Claude Mythos Preview

7 april 2026 — Anthropic tillkännagav Project Glasswing, ett initiativ för programvarusäkerhet som samlar elva organisationer: Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, The Linux Foundation, Microsoft, NVIDIA och Palo Alto Networks. Initiativet bygger på kapaciteterna hos en ny frontier-modell med begränsad åtkomst: Claude Mythos Preview.

Vad Mythos Preview gör

Modellen visade förmåga att identifiera tusentals zero-day-sårbarheter i de viktigaste operativsystemen och webbläsarna, varav vissa hade legat oupptäckta i flera decennier. Tre konkreta exempel illustrerar bredden i fynden:

  • En 27 år gammal sårbarhet i OpenBSD som gjorde det möjligt att fjärrkrascha vilken ansluten maskin som helst
  • En 16 år gammal sårbarhet i FFmpeg, dold i en kodrad som testats mer än fem miljoner gånger utan att upptäckas
  • Flera sårbarheter i Linux-kärnan som möjliggör privilegieeskalering till full kontroll över maskinen

Dessa exempel visar att Mythos Preview inte bara gör ytlig upptäckt — den hittar djupt liggande logiska fel i kritiska kodbaser som har granskats kontinuerligt av tusentals forskare i åratal.

Benchmarks

Mythos Previews prestanda på referensbenchmarks visar ett tydligt lyft jämfört med Opus 4.6:

BenchmarkMythos PreviewOpus 4.6
SWE-bench Verified93,9 %80,8 %
SWE-bench Pro77,8 %53,4 %
Terminal-Bench 2.082,0 %65,4 %
SWE-bench Multilingual87,3 %77,8 %
CyberGym (cybersäkerhet)83,1 %66,6 %
GPQA Diamond94,6 %91,3 %
Humanity’s Last Exam (utan verktyg)56,8 %40,0 %

Språnget på SWE-bench Verified — från 80,8 % till 93,9 % — är särskilt betydelsefullt: det är den mest använda benchmarken för att mäta en modells förmåga att lösa verkliga buggar i verkliga open source-repositorier. På CyberGym, som är inriktad på cybersäkerhet, placerar ökningen med mer än 16 poäng Mythos Preview i en egen kategori för offensiva och defensiva säkerhetsuppgifter.

Ekonomiskt åtagande och styrning

Anthropic åtar sig 100 miljoner dollar i användningskrediter för projektets partners, tillsammans med 4 miljoner dollar i direkta donationer till open source-säkerhetsorganisationer:

  • 2,5 M$ till Alpha-Omega och OpenSSF via Linux Foundation
  • 1,5 M$ till Apache Software Foundation

Denna nivå av ekonomiskt åtagande signalerar att Anthropic positionerar Glasswing som ett långsiktigt initiativ, inte bara som ett kommunikationspartnerskap. Rapporten om åtgärdade sårbarheter publiceras inom 90 dagar.

Tillgänglighet och prissättning

Mythos Preview görs inte offentligt tillgänglig omedelbart. När den initiala kreditfasen är slut kommer modellen att vara tillgänglig för deltagarna till priset 25 /125/125 per miljon tokens (inmatning/utmatning), via Claude API, Amazon Bedrock, Google Cloud Vertex AI och Microsoft Foundry.

En detaljerad teknisk rapport om upptäckta sårbarheter och exploits finns tillgänglig på Anthropics Red Team-blogg, och den fullständiga system card publiceras på anthropic.com.

“This project represents a watershed moment for AI-assisted cybersecurity — not because of what Claude can do today, but because of what it will be able to do as capabilities continue to scale.”

🇸🇪 Detta projekt utgör en milstolpe för AI-assisterad cybersäkerhet — inte på grund av vad Claude kan göra i dag, utan på grund av vad den kommer att kunna göra i takt med att kapaciteterna fortsätter att skala upp. — Officiellt tillkännagivande från Anthropic

🔗 Project Glasswing · System Card Mythos Preview · Red Team-rapport


Meta Muse Spark : Metas återkomst med en sluten modell

8 april 2026 — Meta tillkännagav Muse Spark, den första modellen i den nya familjen “Muse”, utvecklad av Meta Superintelligence Labs (MSL) — en ny intern enhet dedikerad till forskning om avancerad AI. Det är Metas första modell sedan Llama 4 i april 2025, alltså ett års tystnad, och framför allt den första Meta-modellen som inte finns tillgänglig som open-weights.

Kapaciteter och positionering

Muse Spark positioneras som ett steg mot “personlig superintelligens” (personal superintelligence). Modellen täcker flera områden med avancerade kapaciteter:

OmrådeBeskrivning
MultimodalAvancerad visuell perception och förståelse, integrering av korsvis visuell information
ResonemangStegvis resonemang, tänkande före svar (test-time reasoning)
HälsaAnalys av medicinska bilder, personliga kostrekommendationer
AgentiskAgentiska förmågor för komplexa uppgifter
Contemplating modeOrkestrering av flera agenter som resonerar parallellt (gradvis utrullning)

Modellen integrerar “thought compression” för att optimera resonemangstokens, och stöder test-time scaling via flera parallella agenter. Contemplating-läget, som fortfarande rullas ut gradvis, är en av de mest efterlängtade funktionerna: det gör det möjligt att tilldela flera agenter samma problem parallellt, där var och en resonerar självständigt innan syntes.

Prestanda

Enligt Artificial Analysis (8 april 2026) når Muse Spark ett score på 52 på Artificial Analysis Intelligence Index, vilket placerar den bland de fyra bästa i världen bakom Gemini 3.1 Pro, GPT-5.4 och Claude Opus 4.6. En uppmärksammad återkomst för Meta, som direkt tar plats bland de bästa frontier-modellerna.

Arkitektur

Meta beskriver tre scaling-axlar för Muse Spark:

  1. Förträning: total omarbetning av stacken under nio månader, med förbättringar i arkitektur och data
  2. Förstärkningsinlärning (Reinforcement Learning): skalbar förstärkning av kapaciteter efter förträning
  3. Test-time reasoning: utvidgat resonemang utan ökad latens tack vare parallellisering av agenter

Säkerhet och tillgänglighet

Meta uppger att man genomfört omfattande utvärderingar via sitt Advanced AI Scaling Framework v2. Apollo Research genomförde tredjepartstester på en checkpoint före lansering och fann starka avvisningsbeteenden inom högriskområden (biologi, etc.).

Muse Spark finns tillgänglig från och med 8 april på meta.ai och i Meta AI-appen. API-åtkomst finns i privat preview för utvalda partners — ingen omedelbar offentlig åtkomst.

🔗 Meta AI-blogg — Muse Spark · Tillkännagivandetråd · Benchmark Artificial Analysis


Anthropic : infrastruktur och agenter

Partnerskap Google + Broadcom — flera gigawatt TPU från 2027

6 april 2026 — Anthropic tillkännagav ett avtal med Google och Broadcom om flera gigawatt TPU-datorkapacitet av nästa generation, som ska tas i drift från och med 2027. Det är Anthropics största infrastrukturåtagande någonsin.

Tillväxtkontexten är betydande:

  • Den annualiserade omsättningen (run-rate revenue) överstiger nu 30 miljarder dollar, jämfört med cirka 9 miljarder i slutet av 2025
  • Mer än 1 000 företagskunder spenderar vardera över en miljon dollar per år, jämfört med 500+ i februari 2026 — alltså en fördubbling på mindre än två månader

“This groundbreaking partnership with Google and Broadcom is a continuation of our disciplined approach to scaling infrastructure: we are building the capacity necessary to serve the exponential growth we have seen in our customer base while also enabling Claude to define the frontier of AI development.”

🇸🇪 Detta banbrytande partnerskap med Google och Broadcom är en fortsättning på vårt disciplinerade arbetssätt för att skala infrastrukturen: vi bygger den kapacitet som krävs för att möta den exponentiella tillväxt vi har sett i vår kundbas, samtidigt som vi gör det möjligt för Claude att definiera gränsen för AI-utvecklingen. — Krishna Rao, CFO på Anthropic

Merparten av den nya beräkningkapaciteten kommer att installeras i USA, i linje med åtagandet från november 2025 att investera 50 miljarder dollar i amerikansk infrastruktur. Claude förblir den enda frontier-modellen som är tillgänglig på de tre stora molnplattformarna: AWS Bedrock, Google Cloud Vertex AI och Microsoft Azure Foundry.

🔗 Partnerskapsannons

Managed Agents — frikopplad arkitektur, 90 % lägre latens

8 april 2026 — Anthropics Engineering Blog publicerade en teknisk artikel som beskriver arkitekturen bakom Managed Agents, den hostade tjänsten för att köra långkörande agenter på Claude-plattformen.

Huvudidén är att koppla loss hjärnan (Claude och dess harness) från händerna (exekveringssandbox, verktyg) och sessionen (händelselogg). Varje komponent blir ett oberoende, utbytbart och separat skalbart gränssnitt.

Mätta resultat av frikopplingen:

MetrikFörbättring
p50 TTFT (tid till första token)-60 %
p95 TTFT-90 %

Frikopplingen löser också två säkerhetsproblem: isolation of credentials (OAuth-tokens är aldrig åtkomliga från kodens exekveringssandbox) och resiliens (om harness kraschar startar ett nytt från den senaste sessionhändelsen utan kontextförlust).

🔗 Skalning av Managed Agents


Google Gemini

Gemini CLI v0.37.0 — Dynamisk sandbox, Chapters och beständig browser

8 april 2026 — Version v0.37.0 av Gemini CLI introducerar tre utvecklingar för utvecklararbetsflöden:

FunktionBeskrivning
Dynamic Sandbox ExpansionDynamisk utvidgning av sandbox + stöd för worktree för Linux och Windows
Chapters (Narrative Flow)Tematisk gruppering av verktyg i “kapitel” för bättre sessionsstruktur
Advanced Browser CapabilitiesBeständiga webbläsarsessioner och dynamisk upptäckt av verktyg i browser agent

Funktionen Chapters ger långvariga sessioner en narrativ kontinuitet: varje grupp av åtgärder bildar ett “kapitel” med egen logik, vilket underlättar uppföljning och återupptagning av en komplex session. Browser agent får ökad beständighet — sessioner förblir aktiva mellan anrop, och tillgängliga verktyg upptäcks dynamiskt.

🔗 Gemini CLI Changelog

Interaktiva simuleringar och 3D-modeller i Gemini App

9 april 2026 — Gemini App kan nu förvandla komplexa koncept till interaktiva visualiseringar direkt i chatten. En användare kan justera fysiska parametrar i realtid (hastighet, gravitation, massa) och se effekten på en fungerande simulering — månbanor, molekylrotation, dynamiska system. Tillgängligt globalt med Pro-modellen i promptfältet. Inte tillgängligt för Education- och Workspace-konton i nuläget.

🔗 3D-simuleringar i Gemini App

Gemini Notebooks — synkronisering med NotebookLM

8 april 2026 — Google lanserar Notebooks i Gemini App: persistenta arbetsytor som synkroniserar Gemini App och NotebookLM för komplexa projekt. Notebooks gör det möjligt att organisera konversationer, anpassade instruktioner och filer (dokument, PDF:er). En källa som läggs till i Gemini App visas automatiskt i NotebookLM, och vice versa. Tillgängligt denna vecka för abonnenter på Google AI Ultra, Pro och Plus på webben. Mobil och gratis åtkomst kommer senare.

🔗 Gemini Notebooks + NotebookLM


OpenAI

Ny Pro-nivå till 100 $/månad — 5x mer Codex

9 april 2026 — OpenAI introducerar en ny Pro-nivå till **100 /ma˚nad,placeradmellanPlusniva˚n( 20/månad**, placerad mellan Plus-nivån (~20 /månad) och den befintliga Pro till 200 $/månad. Den erbjuder fem gånger mer Codex-användning än Plus-nivån, utformad för långa och intensiva sessioner.

NivåPrisCodex-användning
Plus~20 $/månadStandard
Pro (ny)100 $/månad5× Plus
Pro (befintlig)200 $/månadMaximal

Parallellt förlänger OpenAI 2x Codex-användningskampanjen för befintliga abonnenter till 200 $/månad till och med 31 maj 2026 och återställer deras hastighetsgränser.

”Next phase of enterprise AI” — notis av Denise Dresser

8 april 2026 — Chief Revenue Officer Denise Dresser publicerar en sammanfattning efter sina första 90 dagar. Huvudpunkter: enterprise-verksamheten står nu för mer än 40 % av omsättningen (på väg mot paritet med konsumentsegmentet i slutet av 2026), Codex överstiger 3 miljoner veckovisa användare (+5x sedan början av 2026), och ChatGPT har 900 miljoner veckovisa användare. OpenAI presenterar två strategiska spår: OpenAI Frontier (agenter som korsar företagens system) och en enhetlig AI-superapp för team.

🔗 Nästa fas av enterprise AI

Safety Fellowship och Child Safety Blueprint

6-8 april 2026 — OpenAI tillkännager två säkerhetsinitiativ. OpenAI Safety Fellowship (6 apr.) är ett externt forskningsprogram öppet till 3 maj 2026, med ersättning i form av beräkningsresurser, för arbete kring utvärdering, robusthet och agentisk övervakning — tidsplan: 14 september 2026 till 5 februari 2027. Child Safety Blueprint (8 apr.) föreslår ett ramverk för att bekämpa exploatering av barn genom AI, samutvecklat med NCMEC, Thorn och Attorney General Alliance, strukturerat kring tre spår: modernisera lagarna om AI-genererat CSAM-innehåll, förbättra rapporteringen och bygga in säkerhet från början (safety-by-design).

🔗 Safety Fellowship · Child Safety Blueprint


GitHub Copilot

OWASP Top 10-säkerhetsskanning från terminalen 9 april 2026 — GitHub Copilot CLI integrerar ett automatiserat säkerhetsarbetsflöde direkt från terminalen. Med några få kommandon kan utvecklare köra en fullständig skanning av sitt repository, mappa resultaten till kategorierna OWASP Top 10, och automatiskt öppna GitHub-ärenden för varje upptäckt sårbarhet — utan att lämna CLI-miljön. Ett direkt komplement till Project Glasswing för team som redan använder GitHub-verktygen.

Agent “Rubber Duck” — automatisk granskning

8 april 2026 — GitHub Research-teamet publicerar en “Rubber Duck”-agent för Copilot CLI. Inspirerad av den klassiska felsökningstekniken (att förklara sin kod högt för att hitta problemen), analyserar agenten automatiskt inskickad kod och formulerar en strukturerad granskning direkt i terminalen. Experimentell men officiellt återpublicerad av @github.

🔗 Tweet Copilot CLI OWASP · Tweet Rubber Duck


Perplexity

Plaid-integration — privatekonomi i Perplexity Computer

9 april 2026 — Perplexity lanserar en integration med Plaid som gör det möjligt för användare att länka sina bankkonton, kreditkort och lån direkt i Perplexity Computer. Åtkomsten är endast läsning — data passerar inte genom Perplexitys servrar. Plaid-nätverket täcker över 12 000 institutioner (Chase, Fidelity, Vanguard, Robinhood, etc.). Användningsfall: beräkning av nettovärde, budgetuppföljning, planerare för återbetalning av skulder, pensionsprognoser. Tillgängligt på dator i USA och Kanada.

TierFunktioner
StandardLänka portföljen, grundläggande Portfolio-åtkomst
Pro / MaxAvancerade analyser, interaktiva instrumentpaneler

Billion Dollar Build — startup-tävling

8 april 2026 — Perplexity lanserar “Billion Dollar Build”, en åtta veckor lång tävling där team använder Perplexity Computer för att bygga ett företag med en bana mot 1 miljard dollar i värdering. Belöningar för finalisterna: upp till 1 miljon dollar i investering från Perplexity Fund + upp till 1 miljon dollar i Computer-krediter.

🔗 Plaid-integration i bloggen · Tweet Billion Dollar Build


Agenter och verktyg

Manus integreras i Slack — tre lägen

6 april 2026 — Manus (nu med koppling till Meta) lanserar en komplett uppsättning Slack-integrationer byggda kring tre lägen: en agent i DM med ihållande minne för personliga uppgifter, en @manus-omnämning i teamkanaler för kollektiva uppgifter (utan ihållande minne — varje tråd är en ny uppgift), och en MCP-anslutning för att automatisera rapporter och sammanfattningar för din räkning från manus.im. Tillgängligt på betald Slack-plan.

🔗 Manus for Slack-bloggen

Genspark AI Workspace 4.0 — Claw Desktop, Office-plugins

8 april 2026 — Genspark lanserar version 4.0 av sin AI-arbetsyta med fyra komponenter: Claw for Desktop (Computer Use och Browser Use för att styra datorn), Microsoft Office-plugins för PowerPoint, Excel och Word, Speakly (översättning i realtid och mötesanteckningar), samt Advanced Workflows på en ny OpenCode-motor.

🔗 Genspark-bloggen


Generativa medier och hårdvara

Stability AI Brand Studio — kreativ plattform för varumärken

8 april 2026 — Stability AI lanserar Brand Studio, en komplett kreativ produktionsplattform framtagen för företagens marknadsföringsteam. Kärnan i systemet är Brand Central Hub: Brand ID-modeller tränade på ett varumärkes visuella element (fotografisk stil, palett, mönster, logoplacering). Producer Mode omvandlar en beskrivning till en strukturerad produktionsplan och kör den automatiskt steg för steg. Curated Model Routing väljer intelligent den mest lämpliga modellen bland Stability AI:s egna och tredjepartsutbud (inklusive Seedream och Nano Banana). På företagssidan: SSO, rollbaserade åtkomstkontroller, godkännandearbetsflöden. Lanseringspartner: den kreativa byrån Huge. Tillgänglighet: Core-plan (gratis provperiod) + Enterprise-plan.

🔗 Brand Studio av Stability AI

NVIDIA — Nationella robotikveckan

9 april 2026 — I samband med Nationella robotikveckan publicerar NVIDIA en resursartikel om sina Physical AI-teknologier: NVIDIA Cosmos (världsgrundmodeller), Isaac Sim (simulering), Jetson-serien (edge AI), Nemotron och NemoClaw (öppen källkod). Ingen ny hårdvarulansering — en pedagogisk sammanfattning av NVIDIAs robotikekosystem för utvecklare.

🔗 NVIDIAs robotikvecka


Claude Code — uppdateringar v2.1.94 / v2.1.96 / v2.1.97

Tre nya versioner publicerades under veckan.

VersionDatumNyckelpunkter
v2.1.945-6 apr.Bedrock-stöd powered by Mantle, standardinsats high för API-nyckel/Bedrock/Enterprise, kompakt visning av Slack MCP-länkar
v2.1.967 apr.Åtgärdad Bedrock-regression: fel 403 "Authorization header is missing" med AWS_BEARER_TOKEN_BEDROCK
v2.1.978-9 apr.Fokusvy-toggle Ctrl+O i NO_FLICKER-läge, parameter refreshInterval för statusraden, indikator ● N running i /agents, Cedar-syntaxmarkering

v2.1.94 introducerar också en anmärkningsvärd beteendeförändring: skills-plugins som deklareras via "skills": ["./"] använder nu fältet name i frontmatter i stället för katalognamnet. v2.1.97 rättar flera Bash-behörighetsproblem (prefix för miljövariabler, nätverksomdirigeringar) och en bugg där behörighetsregler vars namn matchade en JavaScript-prototypegenskap (toString, etc.) tyst ignorerades i settings.json.

🔗 Claude Code CHANGELOG


Vad detta betyder

Veckan 5 till 9 april 2026 markerar en acceleration i två riktningar som korsar varandra. Å ena sidan lämnar Anthropic en produktlogik för konsumentmarknaden och går in i en logik för kritisk infrastruktur: Project Glasswing och partnerskapet med Google/Broadcom signalerar att Anthropic positionerar sig som leverantör av AI-förmågor på nivån för det globala teknikekosystemet, och inte bara som konkurrent i loppet om benchmarkresultat. Åtagandet om 100 miljoner dollar i krediter och 30 miljarder dollar i årliga intäkter stärker denna tolkning.

Å andra sidan gör Meta comeback med Muse Spark genom att bryta med sin policy för open weights. Det är en betydande strategisk förändring: Meta väljer att konkurrera i det stängda frontier-segmentet i stället för att behålla sin open source-positionering. Skapandet av Meta Superintelligence Labs och den första modellen som inte är Llama signalerar en djup omorientering av koncernens AI-strategi.

För utvecklare är veckan tät men sammanhängande: Gemini CLI får mer persistens och struktur, GitHub Copilot utökar sitt säkerhetsområde, Perplexity satsar på personliga data, och Claude Code fortsätter sin snabba uppdateringscykel.


Källor

Detta dokument har översatts från versionen fr till språket sv med hjälp av modellen gpt-5.4-mini. För mer information om översättningsprocessen, se https://gitlab.com/jls42/ai-powered-markdown-translator