Buscar

Claude une el chat y Cowork, Zed abre Delta a todos y Vera Rubin debuta en MLPerf

ai-powered-markdown-translator

Artículo traducido del francés al español con gpt-5.6-sol.

Ver proyecto en GitHub ↗

Este miércoles, Anthropic fusiona el chat y Cowork en un único Claude, que elige por sí mismo sus herramientas, y lanza Claude Docs y Claude Slides en beta. Zed abre Delta a todos sustituyendo la pull request por una revisión en el hilo, y NVIDIA hace debutar Vera Rubin NVL72 en MLPerf Inference v6.1 cuando la electricidad se impone como la principal limitación de las fábricas de IA. Los agentes de marca también entran en la publicidad, tanto en ChatGPT como en YouTube, mientras Cohere firma el acuerdo definitivo con Aleph Alpha y Mistral llega a Firefox.


Un único Claude: el chat y Cowork se fusionan, Claude Docs y Claude Slides llegan en beta

16 de septiembre — Anthropic fusiona el chat y Claude Cowork: ya no hay que elegir un modo, Claude decide por sí mismo si debe buscar en la web, leer archivos o ejecutar código, y entrega archivos terminados. Las tareas largas continúan en la nube incluso con el ordenador apagado, pero los archivos locales, el navegador integrado y el control del ordenador (computer use, en beta para Pro y Max) requieren que Claude Desktop esté abierto.

Today, chat and Cowork start merging into one Claude. The direction: one Claude that carries context across everything you’re working on, wherever you are.

🇪🇸 Hoy, el chat y Cowork comienzan a fusionarse en un único Claude. El rumbo: un único Claude que conserva el contexto de todo aquello en lo que trabajas, estés donde estés.Boris Cherny (Anthropic) en X

Como novedades, Claude Docs y Claude Slides crean documentos y presentaciones, y Claude Design, lanzado en abril, ahora funciona dentro de las conversaciones. Los tres están en beta en los planes de pago, a elección de los administradores de Enterprise. Cada creación puede compartirse mediante un enlace, y las presentaciones pueden exportarse a PowerPoint o PDF. En modo Manual, la configuración predeterminada, Claude pide permiso antes de cada acción; en modo Auto, cada acción va precedida de comprobaciones de seguridad automatizadas.

Plan o público afectadoCalendario anunciado
Pro y Max (web, desktop, mobile)«Durante las próximas semanas», sin necesidad de activar nada
Team y Free«Próximamente», sin fecha
EnterpriseAviso de al menos 30 días antes de cualquier cambio

El cambio es definitivo, pero se conservan las tareas, los proyectos, los conectores, las skills y los artefactos de Cowork. En el lanzamiento, el centro de ayuda señala algunas limitaciones: no se puede añadir contenido desde GitHub ni ramificar conversaciones, las conversaciones de incógnito se abren en la experiencia anterior, algunas tareas antiguas de Cowork no aparecen en la búsqueda y Dispatch está cerrado para nuevos usuarios. Chat y Cowork ya compartían proyectos y artefactos desde el 7 de julio, y memoria desde el 25 de agosto.

🔗 Publicación de Anthropic 🔗 Centro de ayuda

Design, Slides y Docs también funcionan en Claude Code

Ese mismo día, @ClaudeDevs indica que Claude Design, Claude Slides y Claude Docs también funcionan en Claude Code: se le puede pedir una presentación para una revisión de diseño (design review deck) o una maqueta de interfaz remitiendo a Claude a los archivos y RFC reales del repositorio, modificar el resultado directamente o en la conversación, y después compartir el enlace. En el caso de Design, no se trata de una novedad absoluta, puesto que el comando /design está disponible como investigación preliminar desde el 17 de agosto: la novedad reside en Slides y Docs. El tuit no especifica una versión mínima, planes ni documentación, y las notas de la última versión publicada no lo mencionan.

🔗 Anuncio de @ClaudeDevs en X


Zed abre Delta en beta pública y sustituye la pull request por una revisión en el hilo

16 de septiembre — Zed abre Delta a todos. Lanzada el 12 de agosto mediante inscripción y después en Windows el 4 de septiembre para los usuarios inscritos, la herramienta ya puede descargarse libremente en macOS, Linux y Windows, utilizarse en la web sin instalación, y sus hilos de discusión (threads) pueden seguirse desde un móvil.

La idea central es colaborar sin commit ni push. Un compañero invitado a la conversación con el agente ve las mismas copias de trabajo (worktrees), puede retomarlas en su equipo, preguntar al agente por sus decisiones o continuar si el autor se desconecta. La revisión de código, mostrada como avance el 10 de septiembre, sustituye a la pull request: un subhilo guía al revisor por los cambios de la rama, con el contexto del agente original, en una copia aislada de los worktrees. Después, el comando /land encarga al agente agruparlo todo en un único commit, superar la CI, realizar la fusión tras la aprobación del equipo y eliminar la rama.

En el repositorio de Delta, las pull requests están desactivadas desde la semana anterior al anuncio, y desde entonces 33 personas han fusionado allí 570 cambios; el repositorio del editor Zed permanece en GitHub «por ahora». Bajo el capó, DeltaDB complementa el control de versiones de Git con deltas incrementales que conservan, entre dos commits, las modificaciones y los mensajes tanto de humanos como de agentes; el commit sigue siendo el punto de control, de modo que un compañero que nunca abra Delta ve un repositorio Git normal.

Zed afirma que quiere sustituir GitHub.com y denomina a esta forma de trabajar ingeniería continua (continuous engineering); su hoja de ruta, sin fecha, contempla almacenar Git en DeltaDB y, a largo plazo, una verificación de tipo CI dentro del hilo. Delta es gratuito durante la beta, se anuncian planes de pago «próximamente», sin precio ni fecha, y Zed promete mantener una versión gratuita.

🔗 Publicación de Zed sobre la beta pública de Delta 🔗 Hilo de Zed sobre el comando /land


Vera Rubin NVL72 debuta en MLPerf Inference v6.1 con hasta 3,7 veces el rendimiento de GB300 NVL72

16 de septiembre — NVIDIA hace debutar Vera Rubin NVL72, su plataforma rack de próxima generación, en MLPerf Inference v6.1, cuyos resultados publica MLCommons, con resultados preliminares (preview). Según las comparaciones de NVIDIA entre sus propios resultados, el rack alcanza hasta 3,7 veces el rendimiento de GB300 NVL72 en Qwen3-VL, en los escenarios offline, servidor e interactivo, con vLLM y NVIDIA Dynamo, y hasta 2,5 veces en DeepSeek-R1 con TensorRT-LLM. Nebius también ha presentado resultados preliminares de Vera Rubin NVL72.

NVIDIA atribuye estas mejoras al diseño conjunto del hardware y el software: precisión NVFP4 para los pesos, la atención y la caché KV, servicio desagregado que separa el precargado (prefill) y la decodificación, paralelismo de expertos a gran escala y dominio NVLink de sexta generación, para el cual NVIDIA afirma un rendimiento de paquetes 10 veces superior al Ethernet estándar. La generación actual también publica sus cifras:

Prueba MLPerf Inference v6.1Sistema presentadoResultado publicado por NVIDIA
DeepSeek-R1 offline, de 72 a 288 GPUGB300 NVL72, de 1 a 4 racks99 % de eficiencia de escalado
WAN 2.2, texto a vídeoGB300 NVL720,65 vídeos 720p por segundo, 5,7 s por vídeo
Qwen3-VL, v6.1 frente a v6.0GB300 NVL72Hasta 1,6 veces, gracias al software
Edge-Agentic, nueva prueba (Qwen3.6-27B)Jetson AGX Thor, TensorRT Edge-LLMResultado presentado sin cifra en la publicación

NVIDIA también informa de mejoras obtenidas después de la fecha límite en GPT-OSS-120B y DLRMv3, que MLCommons aún no ha verificado. Afirma contar con 19 socios, ocho de ellos en sistemas multinodo Blackwell NVL72, y menciona la futura prueba MLPerf Endpoints de MLCommons, que deberá estandarizar la medición de la inferencia agéntica.

🔗 Vera Rubin NVL72 de NVIDIA ofrece un rendimiento líder en su debut en MLPerf Inference v6.1


La electricidad en el centro de las fábricas de IA: DSX MaxLPS en Lambda y la alianza AEMA

15 y 16 de septiembre — Dos anuncios de NVIDIA sitúan la red eléctrica en el centro del despliegue de la IA, ambos con Emerald AI: una fábrica de IA controlada por su software redujo su consumo a petición de un proveedor eléctrico, y después Emerald AI, Google y NVIDIA lanzaron una alianza para crear data centers flexibles.

AI Infra Summit: Lambda valida DSX MaxLPS y una fábrica de IA reduce su consumo a petición de la red

15 de septiembre — En el AI Infra Summit, la keynote de Ian Buck (NVIDIA) se centró en los tokens producidos por megavatio en las fábricas de IA (AI factories). Lambda validó DSX MaxLPS, el software de NVIDIA que supervisa el consumo de las GPU y los racks y redistribuye la potencia según las cargas: 19 nodos HGX B200 funcionaron dentro del presupuesto eléctrico de 16 nodos a plena potencia, con un rendimiento que aumentó de unos 4 a 5 millones de tokens por segundo (+24 %) y un incremento del 23 % en el rendimiento por vatio. NVIDIA proyecta hasta un 40 % más de capacidad GPU para Vera Rubin NVL72 con el mismo presupuesto, «en entornos adecuados». Una noche de agosto, una señal de Silicon Valley Power redujo automáticamente de 4 a 3 MW el consumo de una fábrica de IA de Santa Clara controlada por Emerald AI Conductor, sin interrumpir la inferencia prioritaria; desde entonces se han atendido más de 200 señales, con un tiempo de respuesta inferior a un minuto. DSX Flex, que procesa este tipo de señales, tendrá su primer despliegue comercial dedicado en una fábrica Vera Rubin de 96 MW en Manassas, Virginia.

🔗 Blog en directo de NVIDIA

AEMA, una alianza para data centers que se adaptan a la red

16 de septiembre — Emerald AI, Google y NVIDIA lanzan la AI Energy Management Alliance (AEMA), una coalición para crear data centers capaces de modular su consumo según el estado de la red: desplazar cargas, recurrir al almacenamiento, apoyarse en una producción asociada o reaccionar ante incidentes. Sus principios son establecer antes de la conexión las obligaciones de permanencia en servicio (ride-through), reducción de consumo (curtailment) y respuesta ante incidentes; estandarizar las métricas; abrir vías de conexión más rápidas a cambio de compromisos de flexibilidad verificables; y distribuir los costes según los impactos reales. La alianza se centra en Estados Unidos y no nombra a sus socios de lanzamiento. En su sitio web, presenta dos cifras potenciales: 100 GW que podrían liberarse en la red existente mediante data centers moderadamente flexibles, y 733 millones de dólares de costes evitados por cada GW de nuevos data centers flexibles. NVIDIA y Emerald AI ya presentaron fábricas de IA flexibles en la CERAWeek el 31 de marzo.

🔗 Publicación de NVIDIA sobre AEMA 🔗 Sitio web de AEMA


Los agentes de marca entran en la publicidad, en ChatGPT y YouTube

16 de septiembre — Ese mismo día, OpenAI y Google incorporan el agente conversacional de una marca al formato publicitario en Estados Unidos: en pruebas con anunciantes seleccionados en OpenAI y en beta mediante inscripción para comerciantes en Google.

ChatGPT Ads prueba Sponsored Agents y se conecta con HubSpot y Shopify

OpenAI añade IA a ambos lados de su plataforma ChatGPT Ads. Con Sponsored Agents, un clic en un anuncio dentro de ChatGPT puede abrir una conversación claramente identificada con un agente patrocinado por la marca antes de mostrar un enlace a su sitio web. OpenAI precisa que este intercambio es distinto de las respuestas independientes de ChatGPT y está separado de la conversación original.

Novedad de ChatGPT AdsEstado al 16 de septiembre
Sponsored AgentsEn pruebas con anunciantes seleccionados en Estados Unidos
Plugin Ads Manager, campañas gestionadas mediante promptsEn proceso de despliegue
Textos y elementos visuales sugeridos en Ads ManagerEn proceso de despliegue
Personalización y traducción del textoLanzadas, disponibles mediante activación opcional (opt-in)
Integración con HubSpotDisponible
Aplicación ChatGPT Ads para ShopifyComerciantes estadounidenses; otros mercados de ChatGPT Ads desde el 23 de septiembre

La publicación no indica tarifas ni número de anunciantes. Probada en ChatGPT en febrero, la publicidad obtuvo en mayo un Ads Manager en beta y de autoservicio (self-service), y después OpenAI afirmó el 31 de agosto haber alcanzado mil millones de dólares de ingresos anualizados al ampliar este autoservicio.

🔗 Reimaginar la publicidad con IA

Google incorpora Business Agent a los anuncios de YouTube y amplía el comercio agéntico

Google publica sus novedades de comercio agéntico (agentic commerce) para las fiestas. Business Agent, que según Google llegó a Search «a principios de este año», entra en beta en los anuncios de YouTube en Estados Unidos mediante inscripción para comerciantes: el espectador puede preguntar al agente sobre los productos sin salir de YouTube. AI performance insights, que compara la cuota de voz (share of voice) de una marca en AI Mode y AI Overviews, pasa a estar disponible en Merchant Center en Australia, Canadá, India, Nueva Zelanda y Estados Unidos. En Merchant Center, el hub de integración de UCP (Universal Commerce Protocol), el protocolo presentado por Google el 11 de enero, añade la transferencia del carrito al sitio del comerciante y pruebas del proceso de pago; los análisis llegarán «próximamente». Estas funciones se despliegan progresivamente en Estados Unidos y después en Australia y Canadá «a principios del próximo año». Tapestry (Coach, Kate Spade) ya vende mediante UCP en Search y en la aplicación Gemini. Según Google, las buenas prácticas para los feeds de productos generan de media un 5 % más de conversiones el mes siguiente y, en las pruebas con lululemon, los atributos conversacionales de la marca aparecieron en el 50 % de las recomendaciones pertinentes de AI Mode.

🔗 Publicación de Google sobre el comercio agéntico


Cohere firma con Aleph Alpha y lanza Confidential Computing en Model Vault

16 de septiembre — Cohere multiplica sus anuncios, entre ellos dos dirigidos a clientes que quieren conservar el control de sus datos y su tecnología.

Aleph Alpha: acuerdo definitivo y doble sede en Berlín y Toronto

Cohere y Aleph Alpha han firmado el acuerdo definitivo de combinación empresarial (definitive business combination agreement), cuyo proyecto se anunció el 24 de abril. El conjunto operará bajo el nombre de Cohere, con más de 1.000 empleados, una doble sede prevista en Berlín y Toronto y un centro de investigación en Heidelberg, en las instalaciones de Aleph Alpha. La transacción, cuyo importe no se ha comunicado, sigue sujeta a las últimas autorizaciones regulatorias; se espera que se cierre «más adelante este año». Ilhan Scheer, codirector ejecutivo de Aleph Alpha, se convertirá entonces en director de operaciones de Cohere, y Samuel Weinbach, cofundador, en director de investigación. La colaboración con el grupo Schwarz continúa en STACKIT, su cloud soberano.

No government or enterprise should have to choose between capable AI and control over their tech. That belief is exactly why we’re joining forces with Aleph Alpha. Together, we’ll meet the rising global demand for frontier AI that’s both powerful and secure.

🇪🇸 Ningún gobierno ni ninguna empresa debería tener que elegir entre una IA de alto rendimiento y el control de su tecnología. Es precisamente esta convicción la que nos impulsa a unir fuerzas con Aleph Alpha. Juntos responderemos a la creciente demanda mundial de una IA de frontera que sea a la vez potente y segura. — Aidan Gomez (Cohere), citado por @cohere en X

🔗 Publicación de Cohere sobre el acuerdo

Confidential Computing en Model Vault, en acceso anticipado

Cohere lanza Confidential Computing en Model Vault, su plataforma de inferencia dedicada y totalmente gestionada, para proteger los datos durante su procesamiento, y no solo en reposo y en tránsito. Se describen tres mecanismos: inferencia cifrada de extremo a extremo, aislamiento impuesto por hardware que se extiende hasta la GPU con NVIDIA Confidential Computing y un token de certificación firmado, disponible bajo demanda y verificable mediante las claves públicas del fabricante del hardware. Cohere afirma que nadie, «ni siquiera nosotros», puede acceder a las cargas de trabajo del cliente, sin mencionar ninguna auditoría de terceros. El acceso anticipado está reservado a un grupo limitado de clientes beta, sin precio, fecha de disponibilidad general ni lista de modelos, y el anuncio se limita a publicaciones en X y a una página del producto. La función se había anunciado como próxima el 9 de septiembre.

🔗 Anuncio de Cohere en X 🔗 Página del producto Model Vault


Mistral impulsa Smart Window, el asistente de IA de Firefox

16 de septiembre — En una publicación conjunta, Mistral AI y Mozilla anuncian que Smart Window, el asistente de navegación con IA de Firefox que todavía está en fase beta, funciona ahora con modelos Mistral, sin precisar cuáles. El asistente ayuda a desentrañar investigaciones complejas y a reunir fuentes a partir de las pestañas abiertas. Mistral lo proporciona primero a los usuarios de Francia y Norteamérica, mientras que el Reino Unido y Alemania lo recibirán «más adelante este año». De forma predeterminada, las conversaciones no se conservan en los servidores de Mozilla, y socios como Mistral se comprometen a no retener datos (zero data retention). Para Mistral, que afirma atender «tradicionalmente» a empresas, el acuerdo abre el acceso al público general. Arthur Mensch, cofundador y CEO de Mistral, habla de dos defensores del open source que trabajan juntos, y Anthony Enzor-DeMeo, CEO de Mozilla Corporation, considera que un navegador no debe ser un embudo unidireccional.

🔗 Publicación conjunta de Mistral y Mozilla


Grok Build conserva las convenciones y decisiones de un proyecto entre sesiones

16 de septiembre — SpaceXAI dota de memoria a Grok Build, su agente de código. Después de cada turno completado, Grok lo revisa en segundo plano, sin bloquear la sesión, y registra en una nota Markdown aquello que perdura: convenciones del equipo, decisiones y su justificación, y datos del proyecto como el comando que inicia las pruebas. Se excluyen el estado de las tareas, las conclusiones provisionales, los secretos y lo que ya está cubierto por el repositorio o su documentación. Las notas se organizan por proyecto, con un conjunto global para las preferencias aplicables en todas partes. El comando /dream las agrupa en archivos temáticos y también se ejecuta automáticamente de forma periódica, mientras que /memory abre un navegador en modo de solo lectura. Al volver a un proyecto, Grok lee los temas del área en la que va a trabajar, pero la conversación en curso prevalece sobre las notas. La memoria solo se aplica a las sesiones nuevas. La beta del 25 de mayo ya enumeraba la persistencia de las decisiones entre sesiones; la publicación detalla su mecanismo.

🔗 Memoria en Grok Build


Qwen Code v0.24.0 confina el agente a nivel del kernel en Linux y cambia los hooks de bash

16 de septiembre — Dos días después de la v0.23.4, Qwen Code v0.24.0 añade en Linux un sandbox basado en el kernel mediante bubblewrap (bwrap), sin contenedor, permisos root, daemon ni imagen. De forma opcional, reinicia la CLI detrás de una vista de solo lectura del sistema de archivos, en la que únicamente el espacio de trabajo y algunos directorios (temporales, caché, Qwen y Git) permanecen disponibles para escritura; qwen sandbox muestra la configuración y --verify prueba el confinamiento. El autor de la PR enumera sus limitaciones: no hay un namespace PID separado, los sockets Unix del host son accesibles y las configuraciones de Git y Qwen pueden modificarse. Cambio incompatible (breaking change): en los hooks ejecutados con bash, $QWEN_PROJECT_DIR y sus equivalentes de Claude y Gemini, leídos del entorno en lugar de sustituirse, deben ir entre comillas dobles. web_search está limitado por sesión (200 de forma predeterminada y 10.000 como máximo), un presupuesto como +500k en el mensaje dimensiona un turno completo, y la mensajería entre sesiones está activada de forma predeterminada.

🔗 Notas de la versión


Devin lanza Code Scans, auditorías de toda la base de código guiadas por un objetivo

16 de septiembre — Cognition lanza Code Scans en Devin: se parte de un objetivo amplio en lugar de una modificación concreta, incorporando si es necesario criterios propios (normas del equipo, matriz de accesibilidad, requisitos de una migración), y Devin investiga la base de código, prioriza sus hallazgos, los analiza y después abre las pull requests solicitadas. Iniciado mediante /scan en la aplicación web y ya mencionado en las notas de la versión del 2 de septiembre, el análisis retoma la arquitectura MapReduce agéntica (Agentic MapReduce) de Devin Security Swarm, presentada en julio, en cuatro fases: planificación, división en lotes, exploración en paralelo y síntesis. Cognition publica dos pruebas: en Dioxus, una compilación debug completa de 22 crates pasa de 58,6 a 21,0 segundos, es decir, un 64 % menos; un análisis SEO de devin.ai y cognition.com detecta 44 hallazgos, tras lo cual la puntuación Ahrefs de devin.ai pasa de 87 a 92 y sus páginas lentas disminuyen un 73 %. No se especifica ningún precio.

🔗 Presentación de Code Scans


Claude for Small Business alcanza 43 flujos de trabajo y 27 nuevas integraciones

15 de septiembre — En una publicación que nuestro informe del 15 de septiembre no había detectado, Anthropic amplía Claude for Small Business, su plugin para pequeñas empresas lanzado en mayo con 15 flujos de trabajo (workflows). Ahora cuenta con 43, junto con 27 nuevas integraciones, entre ellas Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Gusto, Square, Stripe y Zapier, y afirma superar las 900.000 instalaciones. Cada flujo se inicia en modo de aprobación, y la autonomía se configura flujo por flujo de forma reversible. Anthropic también relanza la formación: una gira de otoño con Tenex por 10 ciudades estadounidenses, más de 150 organizaciones de formación acreditadas para más de 750 talleres y 14 seminarios web de socios. La oferta está disponible en todos los planes de pago; el balance de la gira de primavera se había publicado el 10 de septiembre.

🔗 Publicación de Anthropic sobre Claude for Small Business


ElevenLabs lanza Reception, un recepcionista de IA para pequeñas empresas

16 de septiembre — ElevenLabs lanza Reception, un recepcionista de IA para pequeñas empresas basado en su plataforma ElevenAgents. Responde las 24 horas del día a preguntas sobre los servicios, los horarios o la dirección, en el idioma de quien llama, y después reserva la cita en el calendario, ya sea para atender el desbordamiento cuando el equipo no responde o después del cierre. El servicio tiene su propio sitio web, reception.ai, y puede probarse gratuitamente durante 14 días con 30 minutos de llamadas.

Plan ReceptionPrecio mensual sin impuestosMinutos de llamadas incluidos
Basic29 dólares75
Plus79 dólares275
Premium199 dólares1.000
EnterpriseBajo presupuestoA medida

Todos los planes incluyen más de 70 idiomas, Google Calendar, Calendly, Zapier, webhooks y un servidor MCP.

🔗 Presentación de Reception, de ElevenAgents 🔗 Precios de Reception


Synthesia abre su Interactive Avatar API, avatares en tiempo real a 0,10 euros por minuto

16 de septiembre — Synthesia pone en disponibilidad general su Interactive Avatar API, que integra en un producto avatares capaces de escuchar, hablar y responder en tiempo real. El cliente aporta su LLM, su base de conocimientos y su lógica; Synthesia gestiona el rostro, la voz y la sincronización labial. El avatar se une a una sala de LiveKit como participante de vídeo mediante un plugin que, según las preguntas frecuentes, por ahora solo admite agentes de LiveKit escritos en Python. La API se factura según el uso, a 0,10 euros por minuto, sin compromiso, con 500 minutos gratuitos. Se anuncian «próximamente», sin fecha, un plugin Pipecat y una oferta de extremo a extremo, con LLM, conocimientos y voz gestionados. Synthesia había publicado en julio el marco de investigación de sus modelos de avatares interactivos.

🔗 Anuncio de Synthesia en X 🔗 Página de Interactive Avatars de Synthesia


Koa, el modelo CRM de Salesforce construido sobre Nemotron 3 Super

15 de septiembre — En Dreamforce, Salesforce presentó Koa, su primer modelo de razonamiento dedicado a la gestión de relaciones con los clientes (CRM), obtenido mediante el posentrenamiento de NVIDIA Nemotron 3 Super con NeMo RL, NeMo Gym y NeMo AutoModel sobre un conjunto de datos sintéticos. Salesforce controla los pesos y ejecuta el modelo en su propia infraestructura; según Salesforce, no se utilizó ningún dato de clientes para el entrenamiento ni se utiliza para la inferencia. En CRM Bench, su propio benchmark (actualización de una oportunidad, enrutamiento de un caso y planificación de un seguimiento), Koa iguala o supera a los modelos de vanguardia con tres veces menos errores, sin que se indiquen los modelos comparados. Ya utilizado internamente en Slack, entrará en octubre en fase piloto como modelo seleccionable en Agentforce, especialmente en Formula 1 y Xero, antes de una disponibilidad general prevista para el invierno de 2026 en las regiones estadounidenses.

🔗 Publicación de NVIDIA sobre Jensen Huang en Dreamforce


Runway detalla la moderación en tiempo real de sus futuros modelos de vídeo

16 de septiembre — Runway prevé lanzar modelos de generación de vídeo en tiempo real «en los próximos meses» y explica cómo los moderará. En transmisión continua (streaming), el usuario ve el vídeo antes de cualquier control final. Por ello, Runway ha diseñado y probado un sistema más rápido: verificación acelerada de las entradas, moderación síncrona que analizará las imágenes del flujo e interrumpirá la transmisión en cuanto aparezca contenido problemático, y después control del vídeo completo antes de cualquier descarga o difusión. El clasificador, CoPE-B de Zentropi, es un adaptador LoRA sobre Gemma-4-26B-A4B-it, una mezcla de expertos de 25.200 millones de parámetros, de los cuales 3.800 millones están activos; la verificación tarda de media menos de 0,5 segundos. En las pruebas, algunas entradas límite permitieron que apareciera brevemente contenido prohibido antes de la interrupción. El sistema se añadirá a las protecciones existentes de Runway, y los vídeos en tiempo real incluirán, como sus demás creaciones, señales de procedencia C2PA.

🔗 Moderación en tiempo real


Noticias breves

  • Zed 1.20.1 añade Gemini 3.8 Flash — la versión estable semanal del editor también incorpora una animación opcional del cursor, la apertura de archivos Markdown en vista previa renderizada y binarios para macOS y Linux aproximadamente un 25 % más pequeños; además, corrige un defecto que podía exponer archivos privados a los colaboradores mediante la búsqueda en el proyecto. 🔗 fuente
  • Replit abre en beta los conectores personalizados (Custom Connectors) — los administradores de un espacio de trabajo pueden declarar una API REST mediante HTTPS, autenticada con una clave de API, para que el Agent la utilice más allá de los conectores oficiales; la documentación menciona a los clientes Pro y Enterprise, pero un recuadro reserva la beta para Enterprise. 🔗 fuente
  • NVIDIA encarga a agentes la migración de TileGym a cuTile Rust — ocho días después del lanzamiento de CUDA Rust, una skill multiagente incluida en TileGym migró los 24 operadores públicos de la biblioteca, que conservan de media el 99,5 % del rendimiento de cuTile Python en 347 configuraciones medidas en DGX B200. 🔗 fuente
  • OpenAI publica una guía sobre los análisis de la Admin Console — las vistas Usage, Insights y Outcomes, esta última destinada a medir la proporción de commits fusionados con contribuciones de Codex, deben vincular el uso de ChatGPT Work y Codex con resultados; el retorno de la inversión del 245 % citado es explícitamente hipotético y la documentación enlazada seguía sin aparecer durante nuestra revisión. 🔗 fuente
  • La API de OpenAI regula la creación de claves — incorporada al changelog el 15 de septiembre, cinco días después de la llegada de las fechas de caducidad, la sección API Key Governance permite a los administradores autorizar únicamente las claves de cuentas de servicio, o solo las claves de proyecto pertenecientes a un usuario, o bloquear cualquier clave nueva; las claves existentes no cambian. 🔗 fuente
  • Copilot: las solicitudes de ampliación de presupuesto pasan a disponibilidad general — en Copilot Business y Enterprise con facturación por uso, un miembro que haya agotado sus créditos de IA puede solicitar un presupuesto adicional; los propietarios y responsables de facturación establecen el importe y lo aprueban, lo que restablece el acceso de inmediato. 🔗 fuente
  • AI Scan para pull requests ya no exige la configuración predeterminada de CodeQL — la detección de vulnerabilidades mediante IA en las pull requests se amplía a los repositorios que cumplen los requisitos sin necesidad de esta configuración, en versión preliminar pública para los clientes de GitHub Advanced Security en github.com; GitHub Enterprise Server no es compatible. 🔗 fuente
  • Las configuraciones de GitHub Advanced Security se imponen a las organizaciones — desde el 15 de septiembre, los administradores de empresa pueden impedir que los administradores de organización, y no solo los propietarios de repositorios, modifiquen las configuraciones de seguridad establecidas en el ámbito empresarial. 🔗 fuente
  • GitHub desactiva SHA-1 en HTTPS — tal como se anunció el 20 de abril, el changelog del 15 de septiembre confirma el fin de SHA-1 en las conexiones HTTPS con github.com y sus CDN asociadas, incluido GitHub Enterprise Cloud; afecta a navegadores, clientes de la API y Git mediante HTTPS, pero no a GitHub Enterprise Server. 🔗 fuente
  • MiniMax H3 llega en modalidad sin servidor (serverless) a Together AI — anunciado en un tuit del 15 de septiembre a las 16:58, hora del Pacífico, el modelo de vídeo abierto de 33.000 millones de parámetros, que genera clips de entre 4 y 15 segundos hasta en 2K con sonido estéreo nativo, figura allí con un precio de 0,1391 dólares por vídeo. 🔗 fuente
  • MiniMax presenta H3 IP Edition — al hacer balance de su conferencia de Tokio con KAGAMI AI, MiniMax afirma haber presentado una edición de H3 asociada a propiedades intelectuales japonesas con licencia oficial, sin catálogo de licencias, fecha ni precio. 🔗 fuente
  • Runway añade cinco modelos de terceros con su colección Fall 2026 — Fish Audio S2.1 Pro, Cartesia Sonic 3.6, MiniMax H3 Max, FLUX Video Upscale y FLUX Video Edit se incorporan a la plataforma, sin precio anunciado; varios ya estaban disponibles en otros lugares, como FLUX Video Upscale en Black Forest Labs desde el 20 de agosto y H3 Max desde el 27 de agosto. 🔗 fuente
  • Luma lanza Camera Angles — publicada el 15 de septiembre a las 16:26, hora del Pacífico, la función de Luma Agents regenera al sujeto de una sola fotografía desde los ángulos elegidos, conservando los detalles, sin indicar ningún modelo ni cifra. 🔗 fuente
  • Grok Voice llega a fal — la plataforma de inferencia ofrece el modelo de voz de SpaceXAI en Speech to Speech y en tiempo real; según fal, responde en 0,70 segundos y cuesta 0,00083 dólares por segundo, y está previsto un taller en directo con SpaceXAI para el 22 de septiembre. 🔗 fuente
  • OpenText y Cohere se alían para los sectores regulados — anunciada en la conferencia ALL IN AI de Montreal, la alianza integrará North y los modelos de Cohere en los agentes OpenText Aviator, que pueden implementarse localmente o en una nube privada, pública o soberana; se espera que la oferta conjunta llegue a los clientes a principios de 2027. 🔗 fuente
  • Manus establece alianzas de formación en Singapur — el agente figura en SkillsFuture AI Subscription, que ofrece seis meses de acceso gratuito a los singapurenses que cumplan los requisitos y estén inscritos en determinados cursos de IA, y en Singtel AI Pass; un desafío entre campus reunió más de 1.100 inscripciones y Manus abre una convocatoria mundial para socios de aprendizaje. 🔗 fuente
  • La Universidad de Manchester pronostica la contaminación atmosférica con Earth-2 — reentrenado en dos días en un nodo de 8 GPU del superordenador Isambard-AI, Earth-2 CorrDiff cubre todo el Reino Unido con una resolución de entre 2 y 3 km², y el equipo promete publicar los datos y workflows como open source. 🔗 fuente
  • El Hospital Infantil de Filadelfia modela corazones en pocos segundos — desarrollado sobre el framework open source MONAI, el servicio de CHOP produce modelos cardíacos que antes exigían unas cuatro horas de trabajo, con cerca de 200 casos previstos este año; además, las herramientas desarrolladas sobre Newton, actualmente en proceso de integración, pueden reducir las simulaciones de colocación de dispositivos a un tiempo casi real. 🔗 fuente
  • Google publica un estudio sobre los adolescentes estadounidenses y la IA — realizado con RXN entre más de 1.000 jóvenes de 13 a 17 años, el estudio U.S. Future Report indica que el 94 % utilizó la IA durante el último año y que el 55 % contrasta las respuestas con otras fuentes; no se anuncia ningún producto. 🔗 fuente
  • Perplexity publica una guía sobre los detectores de texto generado por IA — su ejemplo, presentado como hipotético, muestra que un detector que se equivoca con el 2 % de los textos humanos puede señalar 64 artículos de cada 1.000, 19 de ellos escritos por seres humanos, lo que supone cerca de un 30 % de errores; la guía recomienda tratar una detección como el inicio de una revisión. 🔗 fuente
  • GiniGEN AI clasifica 425 modelos de OpenRouter — entrada comunitaria publicada en el blog de Hugging Face: la clasificación añade una latencia hasta el primer token medida en 329 modelos y una puntuación de calidad en coreano; solo el 8,5 % de los modelos evaluados obtiene una A en las formas honoríficas y el 9,4 % en las instituciones coreanas. 🔗 fuente

Qué significa

El agente se convierte en la interfaz y desaparece la elección del modo. En el nuevo Claude ya no se elige entre una conversación y un espacio de trabajo: Claude decide entre la búsqueda web, los archivos y el código, y después genera un documento o una presentación. Delta aplica la misma lógica a la entrega del código, con una revisión dentro del hilo y un comando /land que encadena el commit, la CI y la fusión en lugar de la pull request. Devin Code Scans parte de un objetivo en vez de una modificación, y Grok Build conserva de una sesión a otra las convenciones y decisiones de un proyecto. El control humano cambia de lugar sin desaparecer: modo Manual predeterminado en Claude, aprobación del equipo antes de la fusión en Zed y debate de los hallazgos antes de cualquier pull request en Devin.

Los agentes también entran en el circuito comercial. OpenAI prueba Sponsored Agents que toman el relevo de un anuncio, Google incorpora Business Agent a los anuncios de YouTube y facilita los pagos con UCP, y ambas compañías separan el agente de marca del resto: por un lado, una conversación identificada y distinta de las respuestas independientes de ChatGPT; por otro, una beta para comerciantes mediante inscripción. Para las pequeñas empresas, Claude for Small Business afirma ofrecer 43 workflows y superar las 900.000 instalaciones, mientras que ElevenLabs vende desde 29 dólares al mes un recepcionista que concierta citas. Synthesia cobra 0,10 euros por minuto por un avatar que habla dentro del producto de sus clientes, y Salesforce convierte Koa en un modelo seleccionable en Agentforce: el agente ya no se limita a ayudar a la empresa, sino que se dirige a sus clientes en su nombre.

La confianza se convierte en un argumento de venta y los proveedores buscan hacerla verificable. Cohere y Aleph Alpha destacan la soberanía, con una doble sede en Berlín y Toronto, mientras que Model Vault entrega un token de certificación que el cliente controla con las claves públicas del fabricante del hardware. Mistral ofrece a Firefox un compromiso de retención cero, Salesforce mantiene los pesos de Koa en su infraestructura, Runway prevé interrumpir un flujo de vídeo en cuanto aparezca contenido problemático, OpenAI permite a los administradores restringir la creación de claves de API y Qwen Code confina su agente en el nivel del kernel mientras publica la lista de sus limitaciones. Las garantías más sólidas son aquellas que un cliente puede comprobar por sí mismo; un benchmark propio como CRM Bench o un «ni siquiera nosotros» sin mención de una auditoría externa siguen siendo meras afirmaciones.

Por último, la computación tropieza con la electricidad. Vera Rubin NVL72 ofrece hasta 3,7 veces el throughput de GB300 NVL72 según NVIDIA, pero los anuncios más concretos de estos dos días se centran en los megavatios: Lambda aloja 19 nodos dentro del presupuesto eléctrico de 16, una fábrica de IA de Santa Clara reduce su consumo de 4 a 3 MW a petición de su proveedor y AEMA reclama conexiones más rápidas a cambio de una flexibilidad verificable. El throughput por rack sigue siendo el argumento técnico, pero el acceso a la red determina la velocidad con la que esos racks entran en servicio.


Fuentes