Buscar

Cursor lanza Cursor Router, OpenAI presenta Presence y Project Camellia, Alibaba presenta Qwen-Image-3.0

Cursor lanza Cursor Router, OpenAI presenta Presence y Project Camellia, Alibaba presenta Qwen-Image-3.0

ai-powered-markdown-translator

Artículo traducido del fr al es con gpt-5.4-mini.

Ver proyecto en GitHub ↗

El 22 de julio de 2026 está dominado por las herramientas y agentes de IA empresariales: Cursor lanza Cursor Router, un router de modelos que reduce los costes en un 60 % sin pérdida perceptible de calidad, OpenAI presenta de una vez su plataforma de agentes Presence y su centro de datos Project Camellia de 3,2 gigavatios en Georgia, Alibaba presenta Qwen-Image-3.0 y Synthesia lanza Roleplay Sessions para la formación profesional. En torno a estos cinco grandes anuncios giran una treintena de novedades destacables —desde la Genesis Mission del Departamento de Energía de EE. UU. (Google, OpenAI, Arcee AI) hasta las novedades de Anthropic, GitHub Copilot, NVIDIA y Cohere.


Cursor lanza Cursor Router, enrutamiento inteligente de modelos un 60 % más barato

22 de julio — Cursor ha lanzado Cursor Router, un router de modelos integrado en el modo Auto que analiza cada solicitud y elige automáticamente el modelo más adecuado para la tarea, en lugar de enviar sistemáticamente todas las solicitudes a un modelo frontera (frontier). La funcionalidad está disponible desde hoy en todas las superficies (desktop, web, iOS, CLI, SDK) para los planes Teams y Enterprise.

Modo de optimizaciónObjetivoFacturación
IntelligenceCalidad frontera sistemáticaTarifa del modelo realmente utilizado
BalanceCalidad cercana a la frontera, uso diarioTarifa del modelo realmente utilizado
CostCalidad correcta, optimizada en tokensTarifa del modelo realmente utilizado

En el plano de administración, los equipos Teams y Enterprise disponen de controles precisos: activar o desactivar Router por equipo, restringir los modos accesibles, definir un modo predeterminado, autorizar o bloquear determinados modelos subyacentes, y elegir mostrar o no el nombre del modelo realmente enroutado (oculto por defecto). Las opciones de aplicación flexible o estricta permiten estandarizar el uso del modo Auto dentro de una organización.

In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.

🇪🇸 En acceso anticipado, los clientes no han observado ninguna bajada de calidad, con un coste por commit inferior en comparación con enrutar todas las solicitudes a Opus 4.8.@cursor_ai en X

🔗 Registro de cambios de Cursor Router


OpenAI Presence, plataforma de agentes de voz y texto para la empresa

22 de julio — OpenAI lanza Presence, una plataforma de agentes de IA destinada a las empresas para desplegar en producción agentes de voz y texto fiables, más allá de la simple demostración técnica. Presence combina el razonamiento de los modelos con políticas, guardarraíles y reglas de escalado humano.

Cada despliegue comienza con una tarea precisa (facturación, siniestros de seguros, solicitudes internas de TI): el agente solo recibe los conocimientos y accesos al sistema necesarios, y la empresa cliente define qué puede hacer, cuándo se requiere validación humana y cuándo debe tomar el relevo una persona. Tras la puesta en producción, las sesiones reales y los casos de escalado revelan las carencias del sistema; Codex propone entonces actualizaciones que los equipos prueban y validan, lo que permite al agente adaptarse a la evolución del comportamiento de los usuarios.

Desde hoy, Presence admite experiencias en tiempo real por voz y texto para atención al cliente, ventas salientes o flujos internos de alto impacto. El producto está disponible para clientes empresariales elegibles mediante un programa de disponibilidad general limitada, con acompañamiento directo de los equipos de OpenAI y, para el seguimiento continuo, por integradores de sistemas seleccionados.

🔗 Anuncio completo — OpenAI


Project Camellia, centro de datos de OpenAI de 3,2 gigavatios en Georgia

22 de julio — OpenAI detalla Project Camellia, un proyecto de infraestructura de IA a largo plazo en el condado de Effingham, en Georgia. La empresa ha contratado con Georgia Power 3,2 gigavatios de potencia, que se entregarán por fases entre 2028 y 2032.

En cuanto a la electricidad, OpenAI se compromete a asumir la totalidad de los costes de infraestructura y servicio, sin repercusión en las tarifas de los residentes, y el sitio está diseñado para reducir proactivamente su consumo en caso de alta demanda antes de que los clientes residenciales se vean afectados. En el frente del agua, un circuito cerrado recircula el agua en lugar de extraerla y verterla de forma continua, para un consumo continuo comparable al de un edificio de oficinas equivalente.

En el plano económico, OpenAI anuncia 80 millones de dólares en beneficios comunitarios a lo largo de la vida del proyecto (escuelas, seguridad pública, salud, vivienda, veteranos, pequeñas empresas), además de cientos de millones de dólares en ingresos fiscales locales y estatales previstos; la empresa espera convertirse en el mayor contribuyente del condado. A ello se suman hasta 71 millones de dólares en créditos Codex para estudiantes elegibles de colleges, community colleges y escuelas técnicas de Georgia, recibiendo cada uno 100 dólares en créditos a través de su cuenta de ChatGPT.

🔗 Anuncio completo — OpenAI


Qwen-Image-3.0, tercera generación del modelo de generación de imágenes de Alibaba

22 de julio — Alibaba ha lanzado Qwen-Image-3.0, tercera generación de su modelo de generación de imágenes, resumida por el equipo en una consigna: «Real» (« 实 »), tras la precisión de la versión 1.0 y la variedad/exhaustividad de la 2.0.

DimensiónLo que cambia concretamente
Contenido ricoPrompts de hasta 4,5k tokens; maquetación compleja en una sola pasada (periódicos, storyboards, exámenes, cuadrículas de infografía 3×3, interfaces anidadas)
Detalles auténticosTexto legible hasta 10px, páginas LaTeX completas, texturas casi fotorrealistas (poros, mechones de pelo, piel)
Conocimiento profundoRenderizado nativo en 12 idiomas, más de 100 estilos artísticos, interfaces realistas (web, juegos, streams), recuperación web en directo

Un ejemplo destacado por Alibaba ilustra esta «expansión horizontal»: con solo 3,7k tokens, el modelo genera una infografía 3×3 que cubre nueve campos muy distintos (seguridad en túneles, geometría espacial, análisis estilístico de un texto clásico chino, movimiento de proyectil, parasitología, diagnóstico médico, teoremas de Sylow, control bancario, estructura del ADN), con texto y elementos visuales precisos en cada casilla. Alibaba posiciona el modelo no como una simple herramienta «bonita de ver», sino como una herramienta de productividad para diseño, creación de contenido, educación y e-commerce. Ya está accesible a través de Qwen Chat.

🔗 Anuncio en X


Synthesia lanza Roleplay Sessions para la formación profesional

22 de julio — Synthesia lanza Roleplay Sessions, primer bloque de su futura plataforma «Sessions» destinada a la formación profesional mediante IA. El principio: una conversación de entrenamiento en directo con un avatar que responde y empuja en tiempo real, acompaña al usuario con un sistema de puntuación y luego mide el progreso de las competencias a escala de un equipo. El objetivo declarado es ventas, management, atención al cliente y cualquier situación en la que un empleado deba entrenarse para una conversación difícil.

IndicadorValor
Competencias básicas trastocadas de aquí a 2027 (fuente Synthesia)44 % de los empleados
Empleadores que declaran carecer de capacidad para cubrir la brecha63 %
Mejora media de habilidades (gran firma global de reclutamiento)alrededor del 30 %
Comerciales que vuelven a entrenarse voluntariamente (empresa del Fortune 10)alrededor del 70 %

Roleplay Sessions busca reunir en una sola plataforma cuatro etapas habitualmente dispersas —informar, entrenar, acompañar y medir— apoyándose en la base de vídeo de Synthesia, ya utilizada por el 90 % de las empresas del Fortune 100. Los primeros despliegues afectan a un gran grupo europeo y a una empresa del Fortune 10.

🔗 Anuncio en X


Genesis Mission del DOE: Google, OpenAI y Arcee AI multiplican los compromisos

22 de julio — Tres actores distintos anunciaron el mismo día nuevos compromisos en torno a la Genesis Mission, la iniciativa del Departamento de Energía de EE. UU. (DOE) que busca duplicar el ritmo del descubrimiento científico en una década.

OrganizaciónCompromisoDetalle
Google DeepMind40 millones de dólaresTokens de IA y créditos de Google Cloud para dar a más investigadores de laboratorios nacionales acceso a Gemini y a otros modelos
OpenAI17 millones de dólaresAcceso a Codex para unos 2.000 investigadores, soporte API para dos campañas científicas, hasta 10 millones de dólares de uso API ofrecidos por 2,5 millones gastados, acceso a GPT-Rosalind para biología
Arcee AIAsociación (importe no comunicado)Construcción de Genesis-Science-1 (GS1), modelo estadounidense en pesos abiertos asociado a un arnés de investigación gobernado para flujos de trabajo de cálculo científico

Google amplía una colaboración ya establecida en torno a la biología computacional (AlphaFold, Isomorphic Labs). OpenAI se apoya en trabajos ya realizados con el sistema de laboratorios nacionales, incluida una sesión «AI Jam» que reunió a más de 1.000 científicos de nueve laboratorios. Arcee AI, por su parte, abre un programa de contribuciones destinado a investigadores, laboratorios, universidades, empresas y organizaciones sin ánimo de lucro; el proyecto está en sus inicios, sin fecha de salida ni benchmark comunicado para GS1 por el momento.

🔗 Google DeepMind en X — 🔗 OpenAI sobre el tema — 🔗 Arcee AI en X


Anthropic multiplica los anuncios sobre Claude

Claude Security entra en beta para Claude Code

22 de julio — Anthropic lanza en versión beta el plugin Claude Security para Claude Code: escaneo de los cambios en curso en busca de vulnerabilidades antes de hacer commit, o análisis completo del repositorio, todo ello desde el terminal, apoyándose en la inferencia de Claude ya utilizada (sin servicio de terceros separado que aprovisionar). Este lanzamiento sitúa a Claude Code en el mismo terreno que Codex Security de OpenAI o el escaneo de secretos reforzado de GitHub Copilot. No se precisan ni tarificación ni planes afectados más allá del estado beta.

Claude puede consultar el Anthropic Economic Index a través de un connector

22 de julio — Un nuevo connector nativo da acceso al Anthropic Economic Index, el conjunto de datos público que mide el uso de la IA en la economía. Una vez activado desde el menú de connectors, Claude puede responder a preguntas como «qué profesiones usan más la IA» apoyándose directamente en los datos del Index en lugar de en sus conocimientos generales.

Claude Managed Agents: esfuerzo, seeding, 500 skills y webhooks

22 de julio — Anthropic despliega un paquete de funcionalidades para Claude Managed Agents: niveles de esfuerzo configurables por agente (respuestas más rápidas y menos costosas con menor esfuerzo), sesiones «seeded» con hasta 50 eventos directamente en la creación, hasta 500 skills en total a través de todos los agentes de una sesión, webhooks para los entornos y las stores de memoria, y streaming de eventos de subagentes.

Claude Code en desktop se integra con el simulador iOS

21 de julio — Claude Code en desktop admite el simulador iOS: la aplicación puede ser compilada y lanzada por Claude, que la observa, interactúa con ella e itera hasta finalizar la tarea, en un panel junto a la conversación. Disponible desde hoy en beta pública, reservado para macOS y requiere Xcode.

🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 Simulador iOS


Herramientas de código: Amp, Warp y Replit

Amp lanza Multiplayer, la colaboración en tiempo real sobre las orbs

22 de julio — Tres semanas después del lanzamiento de los agentes en orbs, Amp añade Multiplayer: una misma orb ahora puede compartirse y trabajarse simultáneamente por varios miembros de un espacio de trabajo, con envío de mensajes al agente, consulta del portal, observación de los cambios de archivos en directo y terminal compartido, activable desde el menú Share de un thread.

Warp añade compatibilidad con los enlaces hipervínculo OSC 8

22 de julio — Warp incorpora compatibilidad con OSC 8, un estándar de terminal que permite a las CLI y a los agentes de codificación emitir enlaces clicables en lugar de texto plano. Desarrollada por un colaborador externo sobre una solicitud abierta desde hace cinco años, la funcionalidad se despliega en versión Dev detrás de un indicador de funcionalidad (feature flag), mientras se realizan pruebas adicionales sobre el motor de renderizado de la cuadrícula del terminal.

Replit relanza su aplicación móvil

22 de julio — Replit publica una renovación de su aplicación móvil (iOS, despliegue progresivo en Android): pantalla de inicio rediseñada, entrada por voz para hablar directamente con el Agent, navegación por deslizamiento entre chat, tareas y vista previa, y Live Activities de iOS que siguen el progreso del agente en directo, incluso fuera de la aplicación.

🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit móvil


Microsoft Asia publica Mage-Flow, modelo compacto de generación de imágenes

22 de julio — Microsoft Asia publica en Hugging Face Mage-Flow, un modelo de generación y edición de imágenes de solo 4.000 millones de parámetros, que presume de una calidad comparable a la de modelos mucho más grandes. En cuanto al rendimiento, el modelo genera una imagen en 4 pasos en menos de un segundo a 1024×1024, y puede llegar hasta 4K. Hay una demo disponible a través de los Spaces de Hugging Face.

🔗 Anuncio en X


Gemini: Galaxy Unpacked 2026 y Gemini 3.5 Pro

Tres novedades de Gemini en Samsung

22 de julio — Al margen del Galaxy Unpacked 2026, Google detalla tres novedades de Gemini para el ecosistema Galaxy: una automatización de tareas ampliada a más de 40 aplicaciones populares (compra, reservas, compra de billetes, capaz de procesar imágenes complejas como instrucciones y ejecutarse en segundo plano); Gemini Notebook (el antiguo NotebookLM) preinstalado en la serie Galaxy Z Fold8, con seis meses de prueba de Google AI Pro incluidos; y Gemini en el Galaxy Watch 9 (activación con un simple levantar de muñeca, sin palabra clave de activación), con unas gafas inteligentes desarrolladas con Samsung (monturas Gentle Monster y Warby Parker) previstas para el otoño de 2026.

Gemini 3.5 Pro entra en pruebas con socios

21 de julio — Josh Woodward, vicepresidente a cargo de Gemini, confirma que el próximo modelo estrella, Gemini 3.5 Pro, ha entrado oficialmente en fase de pruebas con socios. No se da ninguna fecha de disponibilidad general, pero esta confirmación sitúa a Gemini 3.5 Pro como el próximo gran lanzamiento esperado en el lado de los modelos Gemini.

🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro


Manus lanza Plan Mode

22 de julio — Manus introduce Plan Mode, una etapa de revisión estructurada antes de la ejecución: en lugar de lanzarse directamente a construir, el agente genera un plan de viabilidad en formato Markdown, con objetivos, pasos y restricciones, que el usuario puede editar o hacer revisar antes de validarlo. La activación se hace mediante / en la web o + en móvil; el modo también puede activarse durante una tarea para planificar las fases siguientes. Disponible de inmediato para todos los usuarios, en web y móvil, bajo opt-in.

🔗 Anuncio — Manus


GitHub Copilot: Canvases y facturación

GitHub Copilot lanza los Canvases

21 de julio — GitHub introduce los canvases, espacios de trabajo interactivos dentro de la app GitHub Copilot donde desarrolladores y agentes colaboran en tiempo real: visualización de información compleja, interacciones directas (clics, ediciones), refinamiento mediante iteraciones de prompts. Creación mediante el comando /create-canvas. Usos ilustrados: clasificación de issues mediante el barrido de tarjetas, diagramas interactivos de arquitectura, paneles de worktrees, coaching sobre la calidad de los prompts, búsqueda de conocimiento multiplataforma. Un usuario documentó un caso en el que la app lanzó automáticamente un canvas de navegador para hacer clic hasta la pantalla de pago y verificar una función, sustituyendo una prueba Playwright escrita a mano.

Lo que Copilot aporta más allá del acceso bruto a una API

22 de julio — GitHub explica su política de facturación, ahora basada en créditos de IA facturados a las tarifas API publicadas de los modelos. Las completions de código y Next Edit Suggestions siguen incluidas en los planes de pago; chat y tareas agénticas consumen créditos de IA. El argumento de GitHub: más allá del acceso al modelo, Copilot aporta un flujo integrado (issues, repositorios, pull requests, políticas de organización), un consumo de tokens reducido a paridad de resolución de tareas según sus evaluaciones, controles de política para administradores, y una infraestructura de agente ya probada en producción mediante el SDK Copilot.

🔗 Canvases — 🔗 Copilot frente a acceso API bruto


ElevenLabs: ElevenMusic y servicio público ucraniano

ElevenLabs introduce Vocals y Styles en ElevenMusic

22 de julio — ElevenLabs añade dos funcionalidades a ElevenMusic, también disponibles en los Finetunes de ElevenCreative: Vocals, que permiten generar canciones originales con su propia voz o una voz de la biblioteca vocal (subida de pistas para afinar Music v2 sobre su timbre, o modo puntual a partir de una sola grabación); y Styles, para una coherencia estilística en piezas completas, compatibles con Vocals. ElevenLabs precisa que todas las subidas se controlan para el cumplimiento de los derechos de autor.

ElevenLabs equipa a Obrii (Ucrania) con un asistente de voz para el servicio público de empleo

22 de julioObrii, el nuevo ecosistema digital del mercado laboral ucraniano, pone en línea su primer servicio de IA: un asistente de voz desarrollado con ElevenLabs para el servicio público de empleo, accesible las 24 horas del día, incluso durante las alertas de ataque aéreo.

“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”

🇪🇸 Con ElevenLabs, hemos lanzado un asistente de voz de IA para el servicio público de empleo, acercando los servicios públicos a los ciudadanos, las 24 horas del día, los 7 días de la semana, incluso durante las alertas de ataque aéreo.@C_o_S en X

🔗 Vocals y Styles de ElevenMusic


NVIDIA: simulación médica, fábrica en Texas y modelos Cosmos

Framework open source de simulación física médica

22 de julio — NVIDIA publica en open source, dentro de NVIDIA Isaac for Healthcare, un framework GPU-acelerado de simulación de física médica, presentado como el primero de su tipo: interacciones entre dispositivos médicos (catéter, guía) y la anatomía del paciente, combinando simulación física clásica e IA generativa (Cosmos-H Dreams). Al ejecutar 8 192 entornos en paralelo, NVIDIA anuncia haber reducido un tiempo de entrenamiento de políticas robóticas (policies) de más de cinco horas a menos de dos minutos. CMR Surgical, Johnson & Johnson MedTech, XCath y Medtronic Structural Heart ya lo utilizan; disponible desde ahora en GitHub.

NVIDIA y Wistron abren una fábrica de superchips en Fort Worth

21 de julio — Wistron abre su primera fábrica estadounidense, un centro de 30 000 m² en Fort Worth (Texas), que ya produce los superchips Grace Blackwell Ultra y fabricará a la larga los Vera Rubin. Inversión de 700 millones de dólares, más de 500 empleos creados (objetivo 1 000 para finales de año), dentro del compromiso de 500 000 millones de dólares de NVIDIA para la fabricación de plataformas de IA en Estados Unidos.

Cosmos 3 Super, hasta 25 veces más rápido

22 de julio — NVIDIA publica Cosmos 3 Super, una variante de 4 pasos de su familia Cosmos 3, que genera imágenes y vídeos hasta 25 veces más rápido que los modelos originales, manteniendo al mismo tiempo una posición alta en Artificial Analysis: primer puesto en imagen a vídeo (sin audio), segundo puesto en texto a imagen. Disponible desde ahora en Hugging Face.

Balance del Nemotron Model Reasoning Challenge en Kaggle

22 de julio — NVIDIA publica el balance de su Nemotron Model Reasoning Challenge en Kaggle: más de 5 000 participantes repartidos en más de 4 000 equipos, en torno a técnicas de mejora del razonamiento de los modelos abiertos. Los equipos NullSira, vli y YS-L terminan en los tres primeros puestos.

🔗 Simulación médica — 🔗 Fábrica Wistron — 🔗 Cosmos 3 Super — 🔗 Balance Kaggle


Kimi K3: segundo en AA-Briefcase, pero caro y lento

21 de julio — Artificial Analysis publica los resultados de Kimi K3 (Moonshot AI) en AA-Briefcase, su benchmark de trabajo de conocimiento agéntico (hojas de cálculo, presentaciones, maquetas de interfaz). El modelo obtiene la segunda mejor puntuación registrada, un salto de más de 700 puntos respecto a la generación anterior.

Modelo evaluadoElo AA-BriefcaseCoste medio por tareaTiempo medio por tarea
Claude Fable 5 (max)1574
Kimi K3154310,57 dólares56,4 minutos
GPT-5.6 Sol (max)1501
Claude Sonnet 5 (max)1388
Claude Opus 4.8 (max)1347
Kimi K2.6 (referencia)816~1 dólar

Kimi K3 muestra una tasa de éxito del 51 % en las cuadrículas de evaluación, justo detrás de Claude Fable 5 (56 %), con una calidad analítica comparable pero una calidad de presentación inferior. Reverso de la medalla: un coste medio de 10,57 dólares por tarea, alrededor de diez veces más que Kimi K2.6, consecuencia de la tarifa del modelo, de un uso elevado de tokens de salida y de una media de 83 turnos por tarea (frente a 67 para Claude Fable 5 y 50 para GPT-5.6 Sol).

🔗 Anuncio en X


OpenAI: usos en prensa y límites de API

Cómo usan las redacciones las herramientas de OpenAI

22 de julio — OpenAI publica un panorama de los usos de sus herramientas por parte de organizaciones de prensa. Associated Press las utiliza para el reportaje, la verificación (trazado de upload, geolocalización, cronolocalización de imágenes y vídeos), la transformación de miles de expedientes del Tribunal Supremo en información estructurada, y la conversión de artículos en guiones para la emisión, manteniendo a los periodistas como responsables del juicio editorial. POLITICO analiza grandes volúmenes de documentos públicos para un reportaje original más rápido; Axios también se menciona. OpenAI renueva su apoyo al American Journalism Project y continúa sus alianzas con el Lenfest Institute y WAN-IFRA.

Límites de gasto estrictos ampliados a todas las cuentas API

22 de julio — OpenAI amplía esta semana a todas las cuentas de la API Platform el acceso a los límites de gasto estrictos (hard spend limits), permitiendo a cada desarrollador fijar un tope de consumo a la cantidad que elija, con seguimiento de uso en tiempo real desde el panel.

🔗 Usos en prensa — 🔗 Límites API


Cohere: diacritización árabe y modelo de código ligero

Speech Tashkeel 2B y el ecosistema comunitario Transcribe Arabic

22 de julio — Cohere destaca Speech Tashkeel 2B, un modelo asociado desarrollado por NAMAA que convierte el árabe en bruto en texto completamente diacritizado (marcas gramaticales de caso, harakāt, tanwīn, sukūn, shadda), con una versión cuantizada en 4 bits. El anuncio va acompañado de contribuciones comunitarias en torno a Transcribe Arabic, el modelo de reconocimiento de voz árabe de Cohere: la aplicación listen-habibi, soporte nativo para Ruby, y cuantizaciones GGUF/ONNX publicadas en Hugging Face. Cohere anuncia además una alianza con HUMAIN para extender este trabajo a otras lenguas con pocos recursos.

North Mini Code, modelo de código ligero y económico

21 de julio — Cohere presenta North Mini Code, un modelo de código open source diseñado para tareas repetitivas y poco complejas — depuración, creación de pruebas unitarias — posicionado como una alternativa económica a modelos más voluminosos para limitar los costes de inferencia.

🔗 Speech Tashkeel 2B — 🔗 North Mini Code


Breves

  • Warp publica un artículo sobre las tensiones económicas de las startups de IA en hipercrecimiento — análisis de un endurecimiento de los ingresos que se avecina para las startups de gran crecimiento. 🔗 Fuente
  • Hugging Face organiza su primer evento en Japón, en Tokio — presentación de las herramientas recientes y de los planes de la empresa para el mercado japonés, en Otemachi. 🔗 Fuente
  • Ai2 publica una nueva versión de PaperFinder — herramienta de búsqueda documental científica elogiada por un investigador usuario habitual, sin detalle técnico comunicado. 🔗 Fuente
  • Sakana AI publica una presentación general de Fugu, «One Model to Command Them All» — artículo de blog que amplía el alcance del modelo de orquestación más allá de la variante Fugu-Cyber ya cubierta. 🔗 Fuente
  • Gemini Live — guía de cámara para asistencia visual en tiempo real — apuntar la cámara hacia un objeto o un documento para obtener ayuda contextual sin tener que describir la situación por escrito. 🔗 Fuente
  • AlphaFold — nueva aplicación en ingeniería de proteínas al acercarse los 5 años de la base — Pushmeet Kohli (Google DeepMind) celebra un uso para cubrir zonas de sombra estructurales en biología. 🔗 Fuente
  • Nuevo panel de impacto de las métricas Copilot (Enterprise) — cohortes de adopción (Code-first, Agent-first, Multi-agent, Passive) con indicadores de velocidad y de fusión por usuario. 🔗 Fuente
  • Copilot Business/Enterprise — visibilidad de los créditos de IA por ciclo de facturación — visualización ahora posible incluso sin presupuesto individual asignado. 🔗 Fuente
  • GHES — próximo endurecimiento de la carga de bundles de soporte (18 de agosto de 2026) — rechazo de cargas desde instancias sin parchear; actualización requerida a 3.21.3, 3.20.5, 3.19.9, 3.18.12 o 3.17.18. 🔗 Fuente
  • NVIDIA lanza los módulos Jetson Thor T2000 y T3000 — nuevos módulos para robótica e IA en el borde, sin ficha técnica detallada disponible en esta etapa. 🔗 Fuente
  • Cisco lanza Antares, pequeños modelos para la detección de vulnerabilidades en el código — Antares-350M y Antares-1B, disponibles en Hugging Face, ejecutables localmente para evitar enviar código sensible a la nube. 🔗 Fuente
  • HeyGen HyperFrames — Día 17/30: el flujo Storyboard — plan en tres pases (tarjetas, bocetos, render final) con revisión mediante comentario frame por frame. 🔗 Fuente
  • Kling AI publica un tutorial MCP para crear actuaciones cinematográficas con agentes — flujo creativo completo en un agente: personaje, emoción, generación de vídeo por lotes. 🔗 Fuente
  • Una familia construye una cabaña en los árboles con ChatGPT como consultor — diseño estructural, elección de materiales y traducción de las ideas de los niños en planos viables. 🔗 Fuente
  • Codex Live Build — sesión de construcción en directo — retransmisión con los creadores de los teclados Codex Micro. 🔗 Fuente
  • Una jugadora recrea los Dolomitas italianos en un videojuego con Codex — mundo abierto «Valdiluce» con escalada, planeo y teleférico funcional. 🔗 Fuente
  • Promoción ChatGPT Work — 100 dólares en créditos gratis — para los 10 000 primeros participantes que publiquen en X lo que aprecian de ChatGPT Work. 🔗 Fuente

Lo que significa

El enrutamiento de modelos se impone como el nuevo terreno de competencia de las herramientas de código: Cursor Router promete un 60 % de ahorro sin pérdida perceptible de calidad al elegir automáticamente el modelo adecuado por consulta, mientras que Artificial Analysis muestra, por el contrario, que Kimi K3, segunda mejor puntuación en su benchmark de trabajo de conocimiento agéntico, cuesta alrededor de diez veces más que su generación anterior y tarda cerca de una hora por tarea. El mensaje es el mismo en ambos lados: la potencia bruta de un modelo ya no basta para justificar su uso; el arbitraje coste/calidad/latencia se convierte en el verdadero parámetro de decisión para los equipos que despliegan estas herramientas a gran escala.

Los agentes empresariales pasan claramente de una lógica de demostración a una lógica de producción. OpenAI Presence estructura explícitamente políticas, salvaguardas y escalada humana en torno al razonamiento de los modelos; Synthesia Roleplay Sessions cuantifica ganancias concretas de capacitación en condiciones reales; GitHub Copilot Canvases documenta un caso en el que un agente verificó su propio trabajo hasta la pantalla de pago, sustituyendo pruebas escritas a mano; y Claude Managed Agents añade niveles de esfuerzo y webhooks pensados para workflows agénticos complejos en producción. Estos anuncios convergen hacia una misma exigencia: hacer que los agentes sean fiables y pilotables en el tiempo, no solo capaces en una demostración.

En el terreno institucional, la Genesis Mission del DOE ilustra una carrera ya abierta a tres — Google, OpenAI y Arcee AI — para implantarse en la investigación científica pública estadounidense, cada uno con su propia lógica: tokens y créditos cloud para Google, acceso Codex y API para OpenAI, modelo abierto gobernado para Arcee AI. Esta dinámica institucional se acompaña de una carrera por la infraestructura física, con Project Camellia (3,2 gigavatios en Georgia) y la fábrica de superchips Wistron en Fort Worth (700 millones de dólares, varios cientos de empleos) que muestran que la capacidad de cómputo y el anclaje territorial se están convirtiendo en argumentos de comunicación en sí mismos, cuantificados y detallados públicamente.

Por último, la generación multimodal sigue diversificándose tanto por abajo como por arriba: Qwen-Image-3.0 impulsa el realismo y la utilidad profesional de un modelo frontera, mientras que Mage-Flow (Microsoft Asia, 4 mil millones de parámetros) y Cosmos 3 Super (NVIDIA, hasta 25 veces más rápido) apuestan por la compacidad y la velocidad para hacer que estas capacidades sean accesibles con un menor coste de cómputo. El caso de uso ElevenLabs/Obrii en Ucrania recuerda además que estas tecnologías de voz también encuentran usos de servicio público de gran impacto social, más allá de los únicos casos de uso comerciales.


Fuentes