Cerca

Claude unifica la chat e Cowork, Zed apre Delta a tutti e Vera Rubin debutta in MLPerf

ai-powered-markdown-translator

Articolo tradotto dal francese all’italiano con gpt-5.6-sol.

Vedi progetto su GitHub ↗

Questo mercoledì Anthropic unifica la chat e Cowork in un unico Claude, che sceglie autonomamente i propri strumenti, e lancia Claude Docs e Claude Slides in beta. Zed apre Delta a tutti sostituendo la pull request con una revisione nel thread, mentre NVIDIA fa debuttare Vera Rubin NVL72 in MLPerf Inference v6.1 nel momento in cui l’elettricità si impone come vincolo per le fabbriche di IA. Gli agenti di marca entrano anche nella pubblicità, sia su ChatGPT sia su YouTube, mentre Cohere firma l’accordo definitivo con Aleph Alpha e Mistral arriva in Firefox.


Un unico Claude: la chat e Cowork si unificano, Claude Docs e Claude Slides arrivano in beta

16 settembre — Anthropic unifica la chat e Claude Cowork: non c’è più una modalità da scegliere, Claude decide autonomamente se cercare sul web, leggere file o eseguire codice e restituisce file completi. Le attività lunghe proseguono nel cloud anche a computer spento, ma i file locali, il browser integrato e il controllo del computer (computer use, in beta su Pro e Max) richiedono che Claude Desktop rimanga aperto.

Today, chat and Cowork start merging into one Claude. The direction: one Claude that carries context across everything you’re working on, wherever you are.

🇮🇹 Oggi, la chat e Cowork iniziano a fondersi in un unico Claude. La direzione: un unico Claude che conserva il contesto di tutto ciò su cui lavorate, ovunque vi troviate.Boris Cherny (Anthropic) su X

I nuovi Claude Docs e Claude Slides producono documenti e presentazioni, mentre Claude Design, lanciato ad aprile, ora funziona nelle conversazioni. Tutti e tre sono in beta nei piani a pagamento, a discrezione degli amministratori Enterprise. Ogni creazione può essere condivisa tramite link e le presentazioni possono essere esportate in PowerPoint o PDF. In modalità Manuale, l’impostazione predefinita, Claude chiede conferma prima di ogni azione; in modalità Auto, ogni azione è preceduta da controlli di sicurezza automatizzati.

Piano o pubblico interessatoCalendario annunciato
Pro e Max (web, desktop, mobile)«Nel corso delle prossime settimane», senza nulla da attivare
Team e Free«Prossimamente», senza una data
EnterprisePreavviso di almeno 30 giorni prima di qualsiasi modifica

Il passaggio è definitivo, ma attività, progetti, connettori, skill e artefatti di Cowork vengono conservati. Al lancio, il centro assistenza segnala alcuni limiti: impossibilità di aggiungere contenuti da GitHub o creare diramazioni delle conversazioni, conversazioni in incognito aperte nella vecchia esperienza, vecchie attività Cowork assenti dalla ricerca e Dispatch chiuso ai nuovi utenti. Chat e Cowork condividevano già progetti e artefatti dal 7 luglio e la memoria dal 25 agosto.

🔗 Articolo di Anthropic 🔗 Centro assistenza

Design, Slides e Docs funzionano anche in Claude Code

Lo stesso giorno, @ClaudeDevs comunica che Claude Design, Claude Slides e Claude Docs funzionano anche in Claude Code: è possibile chiedere una presentazione per la revisione del design (design review deck) o un mockup dell’interfaccia indirizzando Claude ai file reali e alle RFC del repository, modificare il risultato direttamente o nella conversazione e poi condividere il link. Per Design non si tratta di una novità, poiché il comando /design è disponibile in anteprima di ricerca dal 17 agosto: la novità riguarda Slides e Docs. Il tweet non specifica né la versione minima, né i piani, né la documentazione, e le note dell’ultima versione pubblicata non ne fanno menzione.

🔗 Annuncio di @ClaudeDevs su X


Zed apre Delta in beta pubblica e sostituisce la pull request con una revisione nel thread

16 settembre — Zed apre Delta a tutti. Lanciato il 12 agosto previa registrazione, poi reso disponibile su Windows il 4 settembre per gli iscritti, lo strumento ora può essere scaricato liberamente su macOS, Linux e Windows, può essere utilizzato sul web senza installazione e i suoi thread di discussione (threads) possono essere seguiti da dispositivo mobile.

L’idea centrale è collaborare senza commit né push. Un collega invitato nella conversazione con l’agente vede le stesse copie di lavoro (worktrees), può riprenderle sul proprio computer, interrogare l’agente sulle sue scelte o proseguire se l’autore si disconnette. La revisione del codice, mostrata in anteprima il 10 settembre, sostituisce la pull request: un sotto-thread guida il revisore attraverso le modifiche del branch, con il contesto dell’agente originale, su una copia isolata dei worktree. Il comando /land affida quindi all’agente il raggruppamento in un unico commit, il superamento della CI, il merge dopo l’approvazione del team e l’eliminazione del branch.

Nel repository di Delta, le pull request sono disattivate dalla settimana precedente all’annuncio e 33 persone vi hanno integrato 570 modifiche da allora; il repository dell’editor Zed rimane su GitHub «per il momento». Sotto il cofano, DeltaDB completa il versionamento di Git con delta incrementali che conservano, tra due commit, le modifiche e i messaggi sia degli esseri umani sia degli agenti; il commit rimane il punto di controllo, quindi un collega che non apre mai Delta vede un normale repository Git.

Zed afferma di voler sostituire GitHub.com e chiama questo modo di lavorare ingegneria continua (continuous engineering); la sua roadmap, senza date, prevede l’archiviazione Git in DeltaDB e considera, a lungo termine, una verifica di tipo CI nel thread. Delta è gratuito durante la beta, sono annunciati piani a pagamento «prossimamente», senza prezzo né data, e Zed promette di mantenere una versione gratuita.

🔗 Articolo di Zed sulla beta pubblica di Delta 🔗 Thread di Zed sul comando /land


Vera Rubin NVL72 debutta in MLPerf Inference v6.1 con un throughput fino a 3,7 volte superiore a GB300 NVL72

16 settembre — NVIDIA fa debuttare Vera Rubin NVL72, la sua piattaforma rack di nuova generazione, in MLPerf Inference v6.1, di cui MLCommons pubblica i risultati, con proposte in anteprima (preview). Secondo i confronti di NVIDIA tra le proprie proposte, il rack raggiunge un throughput fino a 3,7 volte superiore a GB300 NVL72 su Qwen3-VL, negli scenari offline, server e interattivo, con vLLM e NVIDIA Dynamo, e fino a 2,5 volte superiore su DeepSeek-R1 con TensorRT-LLM. Anche Nebius ha presentato risultati di Vera Rubin NVL72 in anteprima.

NVIDIA attribuisce questi miglioramenti alla progettazione congiunta di hardware e software: precisione NVFP4 per pesi, attenzione e cache KV, servizio disaggregato che separa il prefill (prefill) dalla decodifica, parallelismo degli esperti su larga scala e dominio NVLink di sesta generazione, per il quale NVIDIA rivendica un throughput dei pacchetti 10 volte superiore all’Ethernet standard. Anche la generazione attuale pubblica i propri dati:

Test MLPerf Inference v6.1Sistema presentatoRisultato pubblicato da NVIDIA
DeepSeek-R1 offline, da 72 a 288 GPUGB300 NVL72, da 1 a 4 rackEfficienza di scalabilità del 99%
WAN 2.2, da testo a videoGB300 NVL720,65 video 720p al secondo, 5,7 s per video
Qwen3-VL, v6.1 rispetto a v6.0GB300 NVL72Fino a 1,6 volte, grazie al software
Edge-Agentic, nuovo test (Qwen3.6-27B)Jetson AGX Thor, TensorRT Edge-LLMProposta senza dati numerici nell’articolo

NVIDIA segnala inoltre miglioramenti ottenuti dopo la scadenza su GPT-OSS-120B e DLRMv3, che MLCommons non ha ancora verificato. Rivendica 19 partner, di cui otto su sistemi multi-nodo Blackwell NVL72, e cita il futuro test MLPerf Endpoints di MLCommons, che dovrà standardizzare la misurazione dell’inferenza agentica.

🔗 NVIDIA Vera Rubin NVL72 offre prestazioni di punta al debutto in MLPerf Inference v6.1


L’elettricità al centro delle fabbriche di IA: DSX MaxLPS presso Lambda e l’alleanza AEMA

15 e 16 settembre — Due annunci di NVIDIA pongono la rete elettrica al centro dell’implementazione dell’IA, entrambi con Emerald AI: una fabbrica di IA gestita dal suo software ha ridotto i consumi su richiesta di un fornitore di energia elettrica, poi Emerald AI, Google e NVIDIA hanno lanciato un’alleanza per data center flessibili.

AI Infra Summit: Lambda convalida DSX MaxLPS, una fabbrica di IA riduce i consumi su richiesta della rete

15 settembre — All’AI Infra Summit, il keynote di Ian Buck (NVIDIA) era incentrato sui token prodotti per megawatt nelle fabbriche di IA (AI factories). Lambda ha convalidato DSX MaxLPS, il software di NVIDIA che monitora il consumo di GPU e rack e ridistribuisce la potenza in base ai carichi: 19 nodi HGX B200 hanno operato entro il budget energetico di 16 nodi a piena potenza, con un throughput passato da circa 4 a 5 milioni di token al secondo (+24%) e prestazioni per watt aumentate del 23%. NVIDIA prevede fino al 40% di capacità GPU aggiuntiva per Vera Rubin NVL72 con lo stesso budget, «in ambienti idonei». Una sera di agosto, un segnale di Silicon Valley Power ha ridotto automaticamente da 4 a 3 MW i consumi di una fabbrica di IA di Santa Clara gestita da Emerald AI Conductor, senza interrompere l’inferenza prioritaria; da allora sono stati rispettati più di 200 segnali, con tempi di risposta inferiori a un minuto. DSX Flex, che gestisce questo tipo di segnali, avrà la sua prima implementazione commerciale dedicata in una fabbrica Vera Rubin da 96 MW a Manassas, in Virginia.

🔗 Blog in diretta di NVIDIA

AEMA, un’alleanza per data center che si adattano alla rete

16 settembre — Emerald AI, Google e NVIDIA lanciano l’AI Energy Management Alliance (AEMA), una coalizione per data center capaci di modulare i propri consumi in base alle condizioni della rete: spostare i carichi, attingere a sistemi di accumulo, affidarsi a una produzione associata o reagire agli incidenti. I suoi principi: stabilire prima della connessione gli obblighi di continuità operativa (ride-through), riduzione dei consumi (curtailment) e risposta agli incidenti, standardizzare le metriche, aprire percorsi di connessione più rapidi in cambio di impegni di flessibilità verificabili e ripartire i costi in base agli impatti reali. L’alleanza si concentra sugli Stati Uniti e i suoi partner di lancio non vengono nominati. Sul proprio sito indica due potenziali benefici: 100 GW sbloccabili sulla rete esistente grazie a data center moderatamente flessibili e 733 milioni di dollari di costi evitati per ogni GW di nuovi data center flessibili. NVIDIA ed Emerald AI avevano già presentato fabbriche di IA flessibili alla CERAWeek, il 31 marzo.

🔗 Articolo di NVIDIA su AEMA 🔗 Sito di AEMA


Gli agenti di marca entrano nella pubblicità, su ChatGPT e YouTube

16 settembre — Lo stesso giorno, OpenAI e Google inseriscono l’agente conversazionale di un marchio nel formato pubblicitario negli Stati Uniti: in fase di test con inserzionisti selezionati presso OpenAI e in beta previa registrazione per i commercianti presso Google.

ChatGPT Ads testa gli Sponsored Agents e si collega a HubSpot e Shopify

OpenAI aggiunge l’IA a entrambi i lati della propria piattaforma pubblicitaria ChatGPT Ads. Con gli Sponsored Agents, un clic su una pubblicità in ChatGPT può aprire una conversazione chiaramente contrassegnata con un agente sponsorizzato dal marchio, prima di un link al suo sito. OpenAI precisa che questo scambio è distinto dalle risposte indipendenti di ChatGPT e separato dalla conversazione originale.

Novità di ChatGPT AdsStato al 16 settembre
Sponsored AgentsIn fase di test con inserzionisti selezionati negli Stati Uniti
Plugin Ads Manager, campagne gestite tramite promptIn fase di distribuzione
Testi e contenuti visivi suggeriti in Ads ManagerIn fase di distribuzione
Personalizzazione e traduzione del testoLanciate, attivabili su adesione facoltativa (opt-in)
Integrazione con HubSpotDisponibile
Applicazione ChatGPT Ads per ShopifyCommercianti statunitensi, altri mercati di ChatGPT Ads dal 23 settembre

L’articolo non fornisce né tariffe né il numero di inserzionisti. Testata in ChatGPT a febbraio, la pubblicità ha ottenuto a maggio un Ads Manager in beta e self-service (self-service), poi il 31 agosto OpenAI ha dichiarato un miliardo di dollari di ricavi annualizzati ampliando questo servizio self-service.

🔗 Reinventare la pubblicità con l’IA

Google inserisce Business Agent nelle pubblicità di YouTube e amplia il commercio agentico

Google pubblica i propri aggiornamenti sul commercio agentico (agentic commerce) per le festività. Business Agent, arrivato in Search «all’inizio di quest’anno» secondo Google, entra in beta nelle pubblicità di YouTube negli Stati Uniti, previa registrazione dei commercianti: lo spettatore può interrogare l’agente sui prodotti senza lasciare YouTube. AI performance insights, che confronta la quota di voce (share of voice) di un marchio in AI Mode e AI Overviews, diventa disponibile in Merchant Center in Australia, Canada, India, Nuova Zelanda e Stati Uniti. In Merchant Center, l’hub di integrazione di UCP (Universal Commerce Protocol), il protocollo presentato da Google l’11 gennaio, aggiunge il trasferimento del carrello al sito del commerciante e i test del percorso di pagamento, mentre le analisi arriveranno «prossimamente»; queste funzionalità vengono distribuite progressivamente negli Stati Uniti, poi in Australia e Canada «all’inizio del prossimo anno». Tapestry (Coach, Kate Spade) vende già tramite UCP in Search e nell’applicazione Gemini. Secondo Google, le buone pratiche per i feed dei prodotti generano in media il 5% di conversioni in più nel mese successivo e, durante i test con lululemon, gli attributi conversazionali del marchio sono stati ripresi nel 50% delle raccomandazioni pertinenti di AI Mode.

🔗 Articolo di Google sul commercio agentico


Cohere firma con Aleph Alpha e lancia Confidential Computing in Model Vault

16 settembre — Cohere moltiplica gli annunci, tra cui due rivolti ai clienti che desiderano mantenere il controllo dei propri dati e della propria tecnologia.

Aleph Alpha: accordo definitivo e doppia sede a Berlino e Toronto

Cohere e Aleph Alpha hanno firmato l’accordo definitivo di aggregazione (definitive business combination agreement), il cui progetto era stato annunciato il 24 aprile. L’insieme opererà con il nome Cohere, con oltre 1.000 dipendenti, una doppia sede prevista a Berlino e Toronto e un centro di ricerca a Heidelberg, presso la sede di Aleph Alpha. La transazione, il cui importo non è stato comunicato, resta soggetta alle ultime autorizzazioni normative; la sua chiusura è prevista «più avanti quest’anno». Ilhan Scheer, co-CEO di Aleph Alpha, diventerà allora direttore operativo di Cohere, mentre Samuel Weinbach, cofondatore, diventerà direttore della ricerca. La partnership con il gruppo Schwarz prosegue su STACKIT, il suo cloud sovrano.

No government or enterprise should have to choose between capable AI and control over their tech. That belief is exactly why we’re joining forces with Aleph Alpha. Together, we’ll meet the rising global demand for frontier AI that’s both powerful and secure.

🇮🇹 Nessun governo né impresa dovrebbe essere costretto a scegliere tra un’IA performante e il controllo della propria tecnologia. È proprio questa convinzione a spingerci a unire le forze con Aleph Alpha. Insieme risponderemo alla crescente domanda globale di un’IA di frontiera al tempo stesso potente e sicura. — Aidan Gomez (Cohere), citato da @cohere su X

🔗 Articolo di Cohere sull’accordo

Confidential Computing in Model Vault, in accesso anticipato

Cohere introduce Confidential Computing in Model Vault, la sua piattaforma di inferenza dedicata e completamente gestita, per proteggere i dati durante l’elaborazione e non più soltanto quando sono inattivi e in transito. Sono descritti tre meccanismi: un’inferenza cifrata end-to-end, un isolamento imposto dall’hardware che si estende fino alla GPU con NVIDIA Confidential Computing e un token di attestazione firmato, disponibile su richiesta e verificabile con le chiavi pubbliche del produttore dell’hardware. Cohere afferma che nessuno, «nemmeno noi», può accedere ai carichi di lavoro del cliente, senza menzionare audit di terze parti. L’accesso anticipato è riservato a un gruppo limitato di clienti beta, senza prezzo, data di disponibilità generale né elenco dei modelli, e l’annuncio si limita ad alcuni tweet e a una pagina prodotto. La funzionalità era stata annunciata come imminente il 9 settembre.

🔗 Annuncio di Cohere su X 🔗 Pagina prodotto di Model Vault


Mistral alimenta Smart Window, l’assistente IA di Firefox

16 settembre — In un articolo congiunto, Mistral AI e Mozilla annunciano che Smart Window, l’assistente di navigazione IA di Firefox ancora in beta, ora funziona con modelli Mistral, senza precisare quali. L’assistente aiuta a districare ricerche complesse e a raccogliere fonti a partire dalle schede aperte. Mistral lo alimenta inizialmente per gli utenti in Francia e Nord America, mentre Regno Unito e Germania sono previsti «più avanti quest’anno». Per impostazione predefinita, le conversazioni non vengono conservate sui server di Mozilla e partner come Mistral si impegnano a non conservare alcun dato (zero data retention). Per Mistral, che afferma di servire «tradizionalmente» le imprese, l’accordo apre l’accesso al grande pubblico. Arthur Mensch, cofondatore e CEO di Mistral, parla di due sostenitori dell’open source che lavorano insieme, mentre Anthony Enzor-DeMeo, CEO di Mozilla Corporation, ritiene che un browser non debba essere un imbuto a senso unico.

🔗 Articolo congiunto di Mistral e Mozilla


Grok Build conserva le convenzioni e le decisioni di un progetto tra una sessione e l’altra

16 settembre — SpaceXAI dota Grok Build, il suo agente di coding, di una memoria. Dopo ogni turno completato, Grok lo rilegge in background, senza bloccare la sessione, e annota in una nota Markdown ciò che permane: convenzioni del team, decisioni e relative motivazioni, fatti sul progetto come il comando che avvia i test. Sono esclusi lo stato delle attività, le conclusioni provvisorie, i segreti e ciò che è già coperto dal repository o dalla sua documentazione. Le note sono organizzate per progetto, con un insieme globale per le preferenze valide ovunque. Il comando /dream le raggruppa in file tematici e viene eseguito automaticamente anche a intervalli regolari, mentre /memory apre un browser in sola lettura. Tornando su un progetto, Grok legge i temi dell’area in cui lavorerà, ma la conversazione in corso ha la precedenza sulle note. La memoria vale soltanto per le nuove sessioni. La beta del 25 maggio elencava già la persistenza delle decisioni tra le sessioni; l’articolo ne descrive in dettaglio il meccanismo.

🔗 Memoria in Grok Build


Qwen Code v0.24.0 confina l’agente a livello del kernel su Linux e modifica gli hook bash

16 settembre — Due giorni dopo la v0.23.4, Qwen Code v0.24.0 aggiunge su Linux una sandbox basata sul kernel tramite bubblewrap (bwrap), senza container, privilegi root, daemon né immagine. Se attivata, riavvia la CLI dietro una vista del file system in sola lettura, nella quale rimangono scrivibili soltanto lo spazio di lavoro e alcune directory (temporanee, cache, Qwen, Git); qwen sandbox mostra la configurazione e --verify verifica il confinamento. L’autore della PR ne elenca i limiti: nessun namespace PID separato, socket Unix dell’host raggiungibili, impostazioni Git e Qwen modificabili. Modifica incompatibile (breaking change): negli hook eseguiti sotto bash, $QWEN_PROJECT_DIR e i suoi equivalenti Claude e Gemini, letti dall’ambiente anziché sostituiti, devono essere racchiusi tra virgolette doppie. web_search è limitato per sessione (200 per impostazione predefinita, 10.000 al massimo), un budget come +500k nel messaggio dimensiona un intero turno e la messaggistica tra sessioni è attivata per impostazione predefinita.

🔗 Note di rilascio


Devin introduce Code Scans, audit dell’intera codebase guidati da un obiettivo

16 settembre — Cognition introduce Code Scans in Devin: si parte da un obiettivo ampio anziché da una modifica precisa, eventualmente con criteri propri (standard del team, griglia di accessibilità, requisiti di una migrazione), e Devin analizza la codebase, ordina per priorità i risultati, ne discute e quindi apre le pull request richieste. Avviata tramite /scan nell’applicazione web e già menzionata nelle note di rilascio del 2 settembre, la scansione riprende l’architettura Agentic MapReduce (Agentic MapReduce) di Devin Security Swarm, presentata a luglio, in quattro fasi: pianificazione, suddivisione in lotti, esplorazione in parallelo, sintesi. Cognition pubblica due test: su Dioxus, una compilazione debug completa di 22 crate passa da 58,6 a 21,0 secondi, ovvero il 64% in meno; una scansione SEO di devin.ai e cognition.com rileva 44 risultati, dopodiché il punteggio Ahrefs di devin.ai passa da 87 a 92 e le sue pagine lente diminuiscono del 73%. Non viene indicato alcun prezzo.

🔗 Presentazione di Code Scans


Claude for Small Business passa a 43 workflow e 27 nuove integrazioni

15 settembre — In un articolo che la nostra rassegna del 15 settembre non aveva individuato, Anthropic amplia Claude for Small Business, il suo plugin per piccole imprese lanciato a maggio con 15 workflow (workflows). Ora ne conta 43, con 27 nuove integrazioni tra cui Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Gusto, Square, Stripe e Zapier, e dichiara oltre 900.000 installazioni. Ogni workflow parte in modalità approvazione e l’autonomia può essere configurata workflow per workflow, in modo reversibile. Anthropic rilancia anche la formazione: tour autunnale con Tenex in 10 città statunitensi, oltre 150 organizzazioni formative accreditate per più di 750 workshop e 14 webinar dei partner. L’offerta è disponibile con tutti i piani a pagamento; il bilancio del tour primaverile era stato pubblicato il 10 settembre.

🔗 Articolo di Anthropic su Claude for Small Business


ElevenLabs introduce Reception, un receptionist IA per le piccole imprese

16 settembre — ElevenLabs introduce Reception, un receptionist IA per piccole imprese costruito sulla sua piattaforma ElevenAgents. Risponde 24 ore su 24 alle domande sui servizi, sugli orari o sull’indirizzo, nella lingua del chiamante, quindi prenota l’appuntamento nel calendario, a scelta come supporto quando il team non risponde oppure dopo la chiusura. Il servizio dispone di un proprio sito, reception.ai, e può essere provato gratuitamente per 14 giorni con 30 minuti di chiamate.

Piano ReceptionPrezzo mensile tasse escluseMinuti di chiamata inclusi
Basic29 dollari75
Plus79 dollari275
Premium199 dollari1 000
EnterpriseSu preventivoSu misura

Tutti i piani includono oltre 70 lingue, Google Calendar, Calendly, Zapier, webhook e un server MCP.

🔗 Presentazione di Reception, di ElevenAgents 🔗 Prezzi di Reception


Synthesia apre la sua Interactive Avatar API, avatar in tempo reale a 0,10 euro al minuto

16 settembre — Synthesia rende generalmente disponibile la sua Interactive Avatar API, che integra in un prodotto avatar capaci di ascoltare, parlare e rispondere in tempo reale. Il cliente fornisce il proprio LLM, la propria knowledge base e la propria logica; Synthesia gestisce il volto, la voce e la sincronizzazione labiale. L’avatar entra in una stanza LiveKit come partecipante video grazie a un plugin che, secondo le FAQ, al momento supporta soltanto gli agenti LiveKit scritti in Python. L’API viene fatturata in base all’utilizzo, a 0,10 euro al minuto, senza impegno, con 500 minuti gratuiti. Un plugin Pipecat e un’offerta end-to-end, con LLM, conoscenze e voce gestiti, sono annunciati «prossimamente», senza data. A luglio Synthesia aveva pubblicato il quadro di ricerca dei suoi modelli di avatar interattivi.

🔗 Annuncio di Synthesia su X 🔗 Pagina Interactive Avatars di Synthesia


Koa, il modello CRM di Salesforce costruito su Nemotron 3 Super

15 settembre — A Dreamforce, Salesforce ha presentato Koa, il suo primo modello di ragionamento dedicato alla gestione delle relazioni con i clienti (CRM), ottenuto tramite post-training di NVIDIA Nemotron 3 Super con NeMo RL, NeMo Gym e NeMo AutoModel su un dataset sintetico. Salesforce controlla i pesi ed esegue il modello sulla propria infrastruttura; secondo Salesforce, nessun dato dei clienti è stato usato per l’addestramento né viene usato per l’inferenza. Su CRM Bench, il suo benchmark proprietario (aggiornamento di un’opportunità, instradamento di una pratica, pianificazione di un follow-up), Koa eguaglia o supera i modelli all’avanguardia con tre volte meno errori, senza che vengano nominati i modelli confrontati. Già utilizzato internamente in Slack, a ottobre entrerà in fase pilota come modello selezionabile in Agentforce, in particolare presso Formula 1 e Xero, prima di una disponibilità generale prevista per l’inverno 2026 nelle regioni statunitensi.

🔗 Articolo di NVIDIA su Jensen Huang a Dreamforce


Runway illustra nel dettaglio la moderazione in tempo reale dei suoi futuri modelli video

16 settembre — Runway prevede di lanciare modelli di generazione video in tempo reale «nei prossimi mesi» e spiega come li modererà. Nella diffusione continua (streaming), l’utente vede il video prima di qualsiasi controllo finale. Runway ha quindi progettato e testato un sistema più rapido: verifica accelerata degli input, moderazione sincrona che analizzerà i fotogrammi del flusso e interromperà la trasmissione non appena apparirà un contenuto problematico, quindi controllo del video completo prima di qualsiasi download o condivisione. Il classificatore, CoPE-B di Zentropi, è un adattatore LoRA su Gemma-4-26B-A4B-it, un mixture of experts da 25,2 miliardi di parametri, di cui 3,8 miliardi attivi; la verifica richiede in media meno di 0,5 secondi. Nei test, alcuni input borderline hanno lasciato apparire brevemente contenuti vietati prima dell’interruzione. Il sistema si aggiungerà alle protezioni esistenti di Runway e i video in tempo reale conterranno, come le sue altre creazioni, segnali di provenienza C2PA.

🔗 Moderazione in tempo reale


In breve

  • Zed 1.20.1 aggiunge Gemini 3.8 Flash — la versione stabile settimanale dell’editor introduce anche un’animazione opzionale del cursore, l’apertura dei file Markdown in anteprima renderizzata e binari macOS e Linux più piccoli di circa il 25%; corregge inoltre un difetto che poteva esporre file privati ai collaboratori tramite la ricerca nel progetto. 🔗 fonte
  • Replit apre in beta i connettori personalizzati (Custom Connectors) — gli amministratori di uno spazio di lavoro possono dichiararvi un’API REST su HTTPS, autenticata tramite chiave API, affinché l’Agent la utilizzi oltre ai connettori ufficiali; la documentazione cita i clienti Pro ed Enterprise, ma un riquadro riserva la beta a Enterprise. 🔗 fonte
  • NVIDIA affida agli agenti il porting di TileGym verso cuTile Rust — otto giorni dopo il lancio di CUDA Rust, una skill multi-agent distribuita con TileGym ha effettuato il porting dei 24 operatori pubblici della libreria, che mantengono in media il 99,5% delle prestazioni di cuTile Python su 347 configurazioni misurate su DGX B200. 🔗 fonte
  • OpenAI pubblica una guida alle analisi dell’Admin Console — le viste Usage, Insights e Outcomes, quest’ultima dedicata a misurare la quota di commit uniti con il contributo di Codex, devono collegare l’utilizzo di ChatGPT Work e Codex ai risultati; il ritorno sull’investimento del 245% citato è esplicitamente ipotetico e la documentazione collegata risultava ancora introvabile al momento della nostra rilevazione. 🔗 fonte
  • L’API OpenAI regolamenta la creazione delle chiavi — aggiunta al changelog il 15 settembre, cinque giorni dopo l’introduzione delle date di scadenza, la sezione API Key Governance permette agli amministratori di autorizzare soltanto le chiavi degli account di servizio, oppure soltanto le chiavi di progetto detenute da un utente, o di bloccare qualsiasi nuova chiave; le chiavi esistenti non cambiano. 🔗 fonte
  • Copilot: le richieste di aumento del budget diventano generalmente disponibili — con Copilot Business ed Enterprise con fatturazione in base all’uso, un membro che ha esaurito i propri crediti IA può richiedere un budget aggiuntivo; proprietari e responsabili della fatturazione stabiliscono l’importo e approvano la richiesta, ripristinando immediatamente l’accesso. 🔗 fonte
  • L’AI Scan delle pull request non richiede più la configurazione predefinita di CodeQL — il rilevamento tramite IA delle vulnerabilità nelle pull request viene esteso ai repository idonei privi di questa configurazione, in anteprima pubblica per i clienti GitHub Advanced Security su github.com; GitHub Enterprise Server non è supportato. 🔗 fonte
  • Le configurazioni di GitHub Advanced Security si impongono alle organizzazioni — dal 15 settembre, gli amministratori aziendali possono impedire agli amministratori dell’organizzazione, e non più soltanto ai proprietari dei repository, di modificare le configurazioni di sicurezza definite a livello aziendale. 🔗 fonte
  • GitHub disabilita SHA-1 su HTTPS — come annunciato il 20 aprile, il changelog del 15 settembre conferma la fine di SHA-1 nelle connessioni HTTPS verso github.com e i suoi CDN partner, incluso GitHub Enterprise Cloud; sono interessati browser, client API e Git su HTTPS, mentre GitHub Enterprise Server non lo è. 🔗 fonte
  • MiniMax H3 arriva in modalità senza server (serverless) su Together AI — annunciato in un tweet del 15 settembre alle 16:58, ora del Pacifico, il modello video aperto da 33 miliardi di parametri, che genera clip da 4 a 15 secondi fino a 2K con audio stereo nativo, è proposto a 0,1391 dollari per video. 🔗 fonte
  • MiniMax presenta H3 IP Edition — facendo il bilancio della sua conferenza di Tokyo con KAGAMI AI, MiniMax afferma di aver presentato un’edizione di H3 associata a proprietà intellettuali giapponesi con licenza ufficiale, senza indicare un catalogo delle licenze, una data o un prezzo. 🔗 fonte
  • Runway aggiunge cinque modelli di terze parti con la sua collezione Fall 2026 — Fish Audio S2.1 Pro, Cartesia Sonic 3.6, MiniMax H3 Max, FLUX Video Upscale e FLUX Video Edit entrano nella piattaforma, senza prezzi annunciati; diversi erano già disponibili altrove, come FLUX Video Upscale presso Black Forest Labs dal 20 agosto e H3 Max dal 27 agosto. 🔗 fonte
  • Luma lancia Camera Angles — pubblicata il 15 settembre alle 16:26, ora del Pacifico, la funzione di Luma Agents rigenera il soggetto di una singola foto dalle angolazioni scelte, preservandone i dettagli, senza indicare il nome di un modello né fornire cifre. 🔗 fonte
  • Grok Voice arriva su fal — la piattaforma di inferenza propone il modello vocale di SpaceXAI in modalità Speech to Speech e in tempo reale; secondo fal, risponde in 0,70 secondi e costa 0,00083 dollari al secondo, mentre un workshop in diretta con SpaceXAI è previsto per il 22 settembre. 🔗 fonte
  • OpenText e Cohere si alleano per i settori regolamentati — annunciata alla conferenza ALL IN AI di Montréal, la partnership integrerà North e i modelli Cohere negli agenti OpenText Aviator, distribuibili on-premise oppure su cloud privato, pubblico o sovrano; l’offerta congiunta dovrebbe arrivare ai clienti all’inizio del 2027. 🔗 fonte
  • Manus stringe partnership per la formazione a Singapore — l’agent è incluso in SkillsFuture AI Subscription, che offre sei mesi di accesso gratuito ai cittadini di Singapore idonei iscritti a determinati corsi di IA, e nel Singtel AI Pass; una sfida interuniversitaria ha raccolto oltre 1.100 iscrizioni e Manus lancia un invito globale a potenziali partner per l’apprendimento. 🔗 fonte
  • L’Università di Manchester prevede l’inquinamento atmosferico con Earth-2 — riaddestrato in due giorni su un nodo con 8 GPU del supercomputer Isambard-AI, Earth-2 CorrDiff copre l’intero Regno Unito con una risoluzione di 2-3 km² e il team promette di pubblicare dati e workflow in open source. 🔗 fonte
  • L’ospedale pediatrico di Filadelfia modella i cuori in pochi secondi — basato sul framework open source MONAI, il servizio del CHOP produce modelli cardiaci che in precedenza richiedevano circa quattro ore di lavoro, con circa 200 casi previsti quest’anno; strumenti basati su Newton, attualmente in fase di integrazione, possono inoltre ridurre a tempi quasi reali le simulazioni di impianto dei dispositivi. 🔗 fonte
  • Google pubblica uno studio sugli adolescenti statunitensi e l’IA — condotto con RXN su oltre 1.000 giovani tra i 13 e i 17 anni, lo studio U.S. Future Report indica che il 94% di loro ha utilizzato l’IA nell’ultimo anno e che il 55% verifica le risposte confrontandole con altre fonti; non viene annunciato alcun prodotto. 🔗 fonte
  • Perplexity pubblica una guida sui rilevatori di testo generato dall’IA — il suo esempio, presentato come ipotetico, mostra che un rilevatore che sbaglia sul 2% dei testi scritti da esseri umani può segnalare 64 articoli su 1.000, 19 dei quali scritti da persone, pari a quasi il 30% di errori; la guida consiglia di considerare una segnalazione come il punto di partenza di una verifica. 🔗 fonte
  • GiniGEN AI classifica 425 modelli di OpenRouter — articolo della community pubblicato sul blog di Hugging Face: la classifica aggiunge una latenza al primo token misurata su 329 modelli e un punteggio di qualità in coreano; soltanto l’8,5% dei modelli valutati ottiene una A per le forme onorifiche e il 9,4% per le istituzioni coreane. 🔗 fonte

Cosa significa

L’agent diventa l’interfaccia e la scelta della modalità scompare. Nel nuovo Claude non si decide più tra una conversazione e uno spazio di lavoro: Claude sceglie tra ricerca web, file e codice, quindi restituisce un documento o una presentazione. Delta applica la stessa logica alla distribuzione del codice, con una revisione nel thread e un comando /land che esegue in sequenza commit, CI e merge al posto della pull request. Devin Code Scans parte da un obiettivo anziché da una modifica, mentre Grok Build conserva da una sessione all’altra le convenzioni e le decisioni di un progetto. Il controllo umano cambia posizione senza scomparire: modalità Manuale predefinita in Claude, approvazione del team prima del merge in Zed, discussione dei riscontri prima di qualsiasi pull request in Devin.

Gli agent entrano anche nel circuito commerciale. OpenAI testa gli Sponsored Agents, che subentrano a una pubblicità, Google inserisce Business Agent negli annunci YouTube e fornisce gli strumenti per il pagamento con UCP, mentre entrambe separano l’agent del marchio dal resto: da una parte, una conversazione segnalata e distinta dalle risposte indipendenti di ChatGPT; dall’altra, una beta a cui i commercianti accedono previa registrazione. Per le piccole imprese, Claude for Small Business dichiara 43 workflow e oltre 900.000 installazioni, mentre ElevenLabs vende a partire da 29 dollari al mese un receptionist che fissa gli appuntamenti. Synthesia addebita 0,10 euro al minuto per un avatar che parla all’interno del prodotto dei suoi clienti, mentre Salesforce rende Koa un modello selezionabile in Agentforce: l’agent non si limita più ad assistere l’azienda, ma si rivolge ai clienti per suo conto.

La fiducia diventa un argomento di vendita e gli sviluppatori cercano di renderla verificabile. Cohere e Aleph Alpha mettono in primo piano la sovranità, con una doppia sede a Berlino e Toronto, mentre Model Vault fornisce un token di attestazione che il cliente controlla con le chiavi pubbliche del produttore dell’hardware. Mistral offre a Firefox un impegno di conservazione nulla dei dati, Salesforce mantiene i pesi di Koa sulla propria infrastruttura, Runway prevede di interrompere un flusso video non appena appare un contenuto problematico, OpenAI consente agli amministratori di limitare la creazione di chiavi API e Qwen Code confina il proprio agent a livello del kernel pubblicando l’elenco dei suoi limiti. Le garanzie più solide sono quelle che il cliente può controllare autonomamente; un benchmark interno come CRM Bench o un «nemmeno noi» senza alcun audit di terze parti menzionato restano semplici affermazioni.

Infine, la capacità di calcolo si scontra con i limiti dell’elettricità. Vera Rubin NVL72 offre, secondo NVIDIA, fino a 3,7 volte il throughput di GB300 NVL72, ma gli annunci più concreti di questi due giorni riguardano i megawatt: Lambda ospita 19 nodi nel budget energetico previsto per 16, una fabbrica di IA di Santa Clara scende da 4 a 3 MW su richiesta del proprio fornitore e AEMA chiede connessioni più rapide alla rete in cambio di una flessibilità verificabile. Il throughput per rack resta l’argomento tecnico, ma l’accesso alla rete determina la velocità con cui questi rack entrano in servizio.


Fonti