Buscar

Health in ChatGPT, FLUX 3 unifica imagen y vídeo, ChatGPT Voice llega a escritorio

ai-powered-markdown-translator

Artículo traducido del fr al es con gpt-5.4-mini.

Ver proyecto en GitHub ↗

El 23 de julio de 2026 concentra siete anuncios importantes: OpenAI despliega Health in ChatGPT en Estados Unidos y lleva ChatGPT Voice a la aplicación de escritorio, Black Forest Labs unifica imagen, vídeo, audio y predicción de acciones en FLUX 3, GitHub establece por primera vez límites sobre lo que sus agentes modifican por sí solos en las Issues, HeyGen transforma su framework HyperFrames en un agente completo de creación de vídeo, y Cognition amplía su huella con la adquisición de Poke y luego un memorando de entendimiento con el Departamento de Energía estadounidense. En torno a estos siete temas giran dieciocho novedades destacables: desde el modo de voz de Claude hasta las herramientas de código (Cursor, Replit, Zed, v0, Amp), pasando por la ciberdefensa en Gemini y Hugging Face.


Health in ChatGPT llega a Estados Unidos

23 de julio — OpenAI despliega Health in ChatGPT entre los usuarios estadounidenses conectados, a partir de los 18 años, en web e iOS, para los planes Free, Go, Plus y Pro. La funcionalidad permite conectar de forma segura Apple Health, así como historiales médicos compatibles (sistemas hospitalarios estadounidenses, One Medical, Function Health), para que ChatGPT disponga del contexto de salud del usuario: comparar un resultado de análisis con pruebas anteriores, resumir lo que ha cambiado desde la última cita o cruzar el sueño y la actividad con su rutina diaria.

OpenAI destaca una cifra: más de 300 millones de personas hacen cada semana preguntas relacionadas con la salud a ChatGPT. La empresa indica que trabaja con cientos de médicos para medir y mejorar la precisión, la seguridad y el reconocimiento de situaciones que requieren atención profesional. En cuanto a los modelos, GPT-5.5 Instant (plan gratuito) aporta una base común para todos los usuarios, mientras que GPT-5.6 Sol (planes de pago) va más allá en las preguntas complejas; en HealthBench Professional, la evaluación desarrollada con médicos, todos los modelos GPT-5.6 superan a GPT-5.5.

Sobre la privacidad, OpenAI insiste: los historiales médicos y los datos de Apple Health conectados, así como las conversaciones que los utilizan, nunca se usan para entrenar los modelos ni para dirigir publicidad, independientemente del ajuste de entrenamiento elegido por otra parte. Por defecto, ChatGPT pide permiso antes de cada uso de esos datos; al desconectar una cuenta, los datos sincronizados se eliminan en un plazo de 30 días. Dato notable: Health no está disponible en Codex. Una primera versión, a principios de este año, limitaba esos intercambios a un espacio dedicado, pero más del 70 % de las conversaciones relacionadas con la salud tenían lugar en otra parte, de ahí la integración nativa en el conjunto de las conversaciones.

🔗 Anuncio oficial — OpenAI


FLUX 3: Black Forest Labs unifica imagen, vídeo, audio y predicción de acciones

23 de julio — Black Forest Labs (BFL), los creadores de los modelos FLUX para imagen, anuncian FLUX 3, presentado como un modelo multimodal único entrenado en una arquitectura unificada en lugar de como modelos separados ensamblados después. La empresa destaca una renderización «más fiel a la realidad en todos los estilos» frente a las generaciones anteriores.

Modalidad cubiertaEstado al 23 de julio
ImagenDisponible
Vídeo (FLUX 3 Video)Acceso anticipado, disponible desde hoy
AudioIntegrado en la arquitectura unificada
Predicción de acciónTrabajos de robótica con mimic y Audi

Dos aspectos diferencian este lanzamiento. Primero, FLUX 3 Video amplía el perímetro histórico de BFL —hasta ahora centrado en la imagen fija— hacia el vídeo, un terreno dominado hasta ahora por Runway, Luma, Kling o Wan. Después, BFL indica que la arquitectura unificada del modelo puede ampliarse para predecir acciones físicas, con trabajos realizados en colaboración con mimic (especialista en teleoperación y aprendizaje robótico) y Audi — una dimensión que acerca BFL al terreno de la IA física, en el que NVIDIA invierte masivamente con Cosmos e Isaac.

La publicación del anuncio reunió más de 393 000 visualizaciones en unas horas, con un hilo de seguimiento que mostraba las primeras muestras de FLUX 3 Image. Es el lanzamiento de modelo más destacado de la ventana en el segmento de los medios generativos, tanto por su ambición —un solo modelo para cuatro modalidades— como por su apertura hacia la robótica.

🔗 Anuncio en X


ChatGPT Voice controla Chat, Work y Codex por voz

23 de julio (21:43) — OpenAI anuncia la llegada de ChatGPT Voice a la aplicación de escritorio (macOS y Windows), para los planes Plus, Pro, Business, Edu y Enterprise, con despliegue mundial desde hoy. Impulsada por GPT-Live, la funcionalidad permite controlar el ordenador y dirigir varios agentes —ChatGPT Work o Codex— solo con la voz: el modelo habla, escucha y coordina el trabajo en la aplicación simultáneamente.

ChatGPT Voice is now in the desktop app. Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. It’s powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans.

🇪🇸 ChatGPT Voice ya está disponible en la aplicación de escritorio. Controla tu ordenador y dirige varios agentes que se ejecutan en ChatGPT Work o Codex, solo con tu voz. Está impulsado por GPT-Live, que puede hablar, escuchar y coordinar el trabajo en la aplicación al mismo tiempo. Despliegue mundial desde hoy en macOS y Windows para los planes Plus, Pro, Business, Edu y Enterprise.@OpenAI en X

El changelog oficial de Codex (versión 26.715) añade un detalle ausente del tuit: en macOS, una opción «Screen context» permite compartir con ChatGPT una captura de la ventana en primer plano durante una conversación de voz, para que el asistente vea lo que el usuario está mirando mientras trabaja en voz alta. Un tuit de seguimiento precisa que ChatGPT Voice también se puede usar en Codex desde la app iOS, mediante un acceso remoto emparejado — el soporte para Android se anuncia «próximamente» sin fecha especificada.

🔗 Changelog de Codex — versión 26.715


El modo de voz de Claude también se enriquece

23 de julio — Anthropic actualiza el modo de voz de Claude, disponible en todos los planes. Ahora se apoya en modelos más potentes —Opus y Sonnet— en lugar de un modelo dedicado más ligero, para intercambios orales más profundos.

Voice mode now runs on Claude’s more capable models and reaches the tools you’ve connected mid-conversation. Talk through the hard problems out loud, in many more languages.

🇪🇸 El modo de voz funciona ahora con los modelos más potentes de Claude y puede acceder a las herramientas que has conectado durante la conversación. Piensa en voz alta sobre problemas complejos, en muchas más lenguas.@claudeai en X

Claude también puede acceder ahora durante la conversación a las herramientas ya conectadas a la cuenta (mensajería, calendario), sin interrumpirla. El modo de voz gana español, francés, hindi y japonés, en beta pública desde hoy en móvil, ordenador y web.

🔗 Artículo de blog asociado


Codex: proyectos que atraviesan varios carpetas

23 de julio (22:31) — En la misma entrega que ChatGPT Voice (changelog Codex 26.715), Codex introduce los proyectos locales multicarpeta en la app de escritorio de ChatGPT. Un proyecto local puede ahora agrupar código, documentación y archivos de referencia repartidos entre varias carpetas; Codex puede leer y escribir en todo el conjunto, mientras que una carpeta principal sigue siendo la raíz Git.

Desde el menú de un proyecto, la opción «Edit project» permite añadir carpetas y designar la carpeta principal. Los nuevos chats, las operaciones Git, el descubrimiento automático de AGENTS.md, las skills y el archivo config.toml utilizan todos la carpeta principal; las carpetas secundarias siguen estando disponibles en lectura y escritura para la búsqueda de archivos.

🔗 Anuncio en X


GitHub encuadra a los agentes que modifican las Issues

23 de julio — GitHub ha lanzado en vista previa pública un conjunto de controles destinados a encuadrar las automatizaciones de agentes en GitHub Issues. El hallazgo de partida: los agentes (GitHub Agentic Workflows, Copilot cloud agent) etiquetan, tipifican, asignan y cierran cada vez más issues automáticamente, sin que los equipos puedan siempre saber por qué ni mantener fácilmente el control.

Capacidad añadidaLo que hace
AprobacionesLa automatización sugiere en lugar de aplicar; los cambios esperan validación, uno a uno o en bloque
Puntuación de confianzaCada acción recibe confianza alta / media / baja; solo la alta se aplica automáticamente
JustificaciónCada acción registra su motivo, aplicada o pendiente — pista de auditoría consultable

La búsqueda has:suggestions encuentra las issues con cambios pendientes de revisión; los administradores configuran el umbral de confianza que determina qué se aplica automáticamente. Estos controles funcionan con GitHub Agentic Workflows (añadiendo issue-intents: true al frontmatter del workflow) y con Copilot cloud agent (sin actualización requerida). En el lanzamiento, las acciones cubiertas son: etiquetas, campos personalizados, tipo, cierre y asignación, mediante las API REST y GraphQL.

Punto de cautela formulado por el propio GitHub: las aprobaciones se presentan como «una comodidad de workflow, no un control de seguridad»; no imponen una barrera del lado del servidor, y un agente con los permisos necesarios siempre puede aplicar un cambio directamente en lugar de sugerirlo. Casos de uso destacados: triage automático, enriquecimiento de metadatos, detección de spam con justificación.

🔗 Changelog de GitHub


GitHub Mobile corrige tus fallos de CI con Copilot

23 de julio — GitHub extiende a la aplicación móvil (iOS y Android) la funcionalidad Fix with Copilot, ya disponible en los comentarios de pull request. Ahora, cuando un check de GitHub Actions falla en una pull request, aparece un botón Fix with Copilot directamente en el check fallido desde GitHub Mobile.

Con un gesto, Copilot coding agent analiza el fallo, abre una nueva pull request sobre la pull request existente con una corrección propuesta y luego notifica al usuario para revisión. El objetivo declarado es permitir reaccionar a fallos de CI en movimiento, sin volver a una estación de trabajo, para mantener las pull requests avanzando incluso lejos del teclado.

🔗 Changelog de GitHub


Runway automatiza la elección del modelo generativo

23 de julio — Runway lanza Media Router, descrito como el primer router de generación de medios «optimizado según las preferencias». En lugar de elegir manualmente un modelo para cada petición, el usuario define una sola vez qué significa «mejor» —coste, calidad o latencia— y el router selecciona automáticamente el modelo de vídeo, imagen o audio apropiado.

La funcionalidad está disponible desde ahora en Runway Dev, la plataforma para desarrolladores lanzada en paralelo. Es una pieza de infraestructura más que un nuevo modelo: se dirige a los equipos de producto que orquestan varios modelos generativos de terceros y buscan automatizar el arbitraje coste/calidad/latencia, un enfoque cercano a los routers LLM (OpenRouter y similares) pero aplicado a los medios generativos.

🔗 Anuncio en X


HeyGen transforma HyperFrames en un agente de creación de vídeo

23 de julio — HeyGen hace pasar HyperFrames —hasta ahora conocido sobre todo por el gran público gracias a su serie creativa diaria— del estado de simple motor de renderizado HTML al de producto central: Video Agent, integrado directamente en HeyGen. El principio: el usuario describe lo que quiere, y el agente construye el vídeo completo de principio a fin —avatar, gráficos, subtítulos y música, todo presentado como «infinitamente personalizable».

El lanzamiento va acompañado de una operación de crecimiento viral (un mes gratis de HeyGen a cambio de interactuar con la publicación) que generó más de 1,1 millones de visualizaciones, 810 respuestas y 788 republicaciones en unas horas, con diferencia la publicación más vista de toda la ventana de análisis en el segmento de los medios generativos.

Dato notable para los desarrolladores: en paralelo al producto para el gran público, HeyGen open-source HyperFrames en GitHub (repositorio heygen-com/hyperframes, descrito como «Escribe HTML. Genera un vídeo. Diseñado para agentes.»), lo que permite a agentes de terceros generar vídeo a partir de HTML incluso fuera de la propia app de HeyGen. El mismo hilo anuncia también una nueva API de traducción de vídeo a gran escala (ver Breves). Es, por tanto, un doble movimiento de producto y plataforma para desarrolladores en un solo día para HeyGen.

🔗 Anuncio principal


Cognition adquiere Poke, el agente que vive en tus mensajes

23 de julio — Cognition (Devin) anuncia la adquisición de The Interaction Company of California, la editora de Poke, un agente personal conversacional que vive directamente en los mensajes del usuario. Según la entrada firmada por Scott Wu, CEO y cofundador de Cognition, él mismo y Walden (cofundador de Cognition) fueron inversores ángeles tempranos de Interaction, y ambos equipos ya compartían la misma apuesta tecnológica: los agentes cloud «siempre activos».

Poke is a personal agent that lives in your texts. It messages you first, follows up with you, and feels less like software and more like a friend. People have exchanged more than 100 million messages with it in just the last three months, and it’s the only AI agent approved to text natively on Apple Messages.

🇪🇸 Poke es un agente personal que vive en tus mensajes. Te escribe primero, retoma la conversación y se parece menos a un software que a un amigo. Solo en estos tres últimos meses se han intercambiado con él más de 100 millones de mensajes, y es el único agente de IA autorizado para enviar mensajes de forma nativa en Apple Messages.Scott Wu en el blog de Cognition

Para los usuarios, no cambia nada de inmediato: Poke sigue funcionando como antes, pero Cognition anuncia que quiere aportar sus modelos y su infraestructura para hacerlo «más rápido y más fiable». El acercamiento sitúa a Cognition más allá de su actividad principal histórica (el ingeniero de software autónomo Devin) hacia los agentes personales de consumo, un nuevo eje estratégico para la empresa.

🔗 Anuncio en X


Cognition se une a la Genesis Mission del Departamento de Energía

22 de julio — Cognition ha firmado un memorando de entendimiento (MOU) con el Departamento de Energía de EE. UU. (DOE) para unirse a la Genesis Mission, una iniciativa nacional lanzada por decreto presidencial en noviembre de 2025 y presentada como el «Proyecto Manhattan de Estados Unidos para la IA». Moviliza los 17 laboratorios nacionales estadounidenses, la industria y el mundo académico para conectar los superordenadores más potentes del país con los mayores conjuntos de datos científicos federales, con el objetivo declarado de duplicar la productividad de la investigación científica estadounidense en una década. Cognition se suma así a Google DeepMind, OpenAI y Arcee AI, cuya adhesión a la misma misión ya se había cubierto la víspera, el 22 de julio.

Eje de compromisoContribución de Devin (Cognition)
Seguridad de software y de datosEncontrar y corregir vulnerabilidades en codebases científicas
Modernización de código legadoDocumentación, pruebas y traducción de código antiguo (Fortran, C++, COBOL)
Expansión de la capacidad de investigaciónDelegar pipelines de datos, infraestructura y despliegue
Modernización en la nubeMigración de aplicaciones legacy a plataformas cloud-native

La entrada precisa que la plataforma de Cognition está en proceso de calificación FedRAMP Class D (High), que Devin Desktop y Devin CLI ya están certificados a ese nivel y cumplen ITAR/IL4-IL6, y que Devin ya es utilizado por el US Army, la US Navy y el Jet Propulsion Laboratory de la NASA. En el marco de su adhesión, Cognition ofrece análisis de seguridad de código e informes de remediación en especie para los laboratorios nacionales, así como compute complementario para los equipos seleccionados a través de las convocatorias de proyectos de la Genesis Mission.

🔗 Anuncio en el blog de Cognition


Las herramientas de código se aceleran

Cinco actualizaciones notables afectan esta semana a las herramientas de desarrollo asistido por IA, entre precios, funcionalidades y automatización de eventos.

Cursor duplica sus límites de uso

21 de julio — Cursor duplica los límites de uso incluidos en todos los planes individuales y Teams (excepto Enterprise, no mencionado). La medida se aplica a los modelos Grok (xAI) y Composer (modelo propietario de Cursor), así como a cualquier futuro modelo de Cursor, sin cambio de tarificación anunciado más allá del factor «duplicado». La publicación generó un gran engagement — alrededor de 1 000 reposts y 10 000 likes en pocas horas — señal de una acogida muy positiva por parte de la comunidad. Este anuncio es distinto de Cursor Router, publicado la víspera.

🔗 Anuncio en X

Replit reduce sus precios de alojamiento a más de la mitad

23 de julio — Replit anuncia una bajada tarifaria sustancial — más de 50 % — sobre el alojamiento de las aplicaciones publicadas a gran escala, efectiva a partir del 1 de agosto de 2026. Toda app publicada se ejecuta en Replit Cloud, con escalado automático según el uso, autenticación y base de datos seguras incluidas, analytics y SEO integrados. Las nuevas tarifas se aplican automáticamente a todos los usuarios desde su siguiente ciclo de facturación mensual, sin ninguna acción requerida por su parte.

🔗 Anuncio en X

Zed 1.12: Git Panel y selección múltiple

22 de julio — Zed publica la versión estable 1.12: el panel Git ofrece ahora secciones separadas «Staged» y «Unstaged», y hacer clic en una entrada de uno u otro grupo abre el multibuffer correspondiente. Tanto File Finder como Text Finder también gestionan la selección múltiple (cmd-clic en macOS, ctrl-clic en Linux/Windows, o tab) para abrir varios archivos de una vez. Un filtrado CSV mencionado inicialmente en el hilo fue finalmente retirado por corrección de Zed, que precisó que esa funcionalidad en realidad todavía no era pública.

🔗 Anuncio en X

v0: comandos slash, Shopify para todos, fiabilidad de Snowflake

21 de julio — v0 (Vercel) añade comandos slash: escribir / en el compositor abre un menú para adjuntar una competencia (skill) a través de skills.sh sin soltar el teclado. La integración Shopify, que genera una vitrina e-commerce leyendo productos, precios y stock en directo, ya está abierta a todos los usuarios. Una pasada de fiabilidad sobre Snowflake detecta los cambios de código desde el último despliegue y orienta las generaciones hacia la cuenta conectada en lugar de hacia datos ficticios.

🔗 Changelog v0

Amp: los orbs reaccionan a eventos externos

23 de julio — Los «orbs» de Amp (entornos aislados cloud para agentes remotos) ahora pueden despertarse ante eventos externos mediante una nueva API de webhooks (amp.createWebhook): fallo de CI en GitHub, nueva issue en Linear, alerta de monitorización, mensaje de Discord. Amp verifica la firma del proveedor y deduplica las entregas; el evento externo sigue siendo un dato no fiable, nunca interpretado como una instrucción directa al agente. Ejemplos de uso citados: investigar cada fallo de CI en la rama principal y publicar los resultados en Slack, o vigilar las nuevas versiones de dependencias para abrir automáticamente una pull request de actualización.

🔗 Anuncio de Amp


Ciberdefensa: Gemini y Hugging Face arman a los defensores

Dos anuncios distintos de la ventana convergen hacia la misma necesidad: equipar mejor la defensa frente a las vulnerabilidades de software.

Gemini 3.5 Flash Cyber detecta el 72 % de las vulnerabilidades

23 de julio — Tras el anuncio conjunto del 21 de julio (Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber), Google DeepMind publica un hilo dedicado con un benchmark cuantificado sobre Gemini 3.5 Flash Cyber, un modelo ligero especializado en la detección y corrección de vulnerabilidades.

Modelo probadoTasa de detección
Gemini 3.5 Flash Cyber72 %
Gemini 3.5 Flash (standard)55 %
Claude Opus 4.6 (Anthropic)54 %

La prueba — bautizada «Chrome Production Commit Scanning Pipeline» — se llevó a cabo sobre las codebases reales de Chrome y Android, donde el modelo detectó vulnerabilidades complejas que los modelos estándar habían pasado por alto. La disponibilidad sigue siendo un piloto de acceso limitado, reservado a gobiernos y socios de confianza, presentado por Google como un enfoque de «despliegue responsable».

🔗 Hilo @GoogleDeepMind

The Stack v3, el combustible open source de la ciberdefensa

23 de julio — Leandro von Werra, Head of Research en Hugging Face, anuncia The Stack v3, nueva generación del dataset de código de la organización HuggingFaceCode (origen de los modelos StarCoder): 5 000 mil millones de tokens listos para el entrenamiento, 120 TB de datos brutos, más de 700 lenguajes de programación, bajo licencia ODC-BY. El enfoque de comunicación es explícitamente defensivo — von Werra justifica la publicación por una necesidad urgente de «buenos modelos de código abiertos para la ciberdefensa», en eco al lanzamiento de Fugu-Cyber en Sakana AI la víspera.

🔗 Anuncio en X


Together AI y NVIDIA dotan de herramientas la inferencia y el fine-tuning

Together AI lanza una nueva generación de su plataforma de inferencia

23 de julio — Together AI anuncia Together Dedicated Model Inference, una refactorización de su plataforma de inferencia para modelos open-weight. En el menú: despliegues múltiples detrás de un endpoint estable, rollouts seguros (canary, blue-green, rolling con rollback automático), pruebas A/B y «shadow traffic» sobre tráfico real, arranques aproximadamente 4 veces más rápidos gracias a una nueva capa de caché (modelos MoE frontera como Kimi K2.7, MiniMax M3 o GLM 5.2 desplegados en 7 a 14 minutos), y una beta cerrada de fine-tuning custom (RL full-weight, LoRA, SFT) con despliegue directo de checkpoints en producción. Se anuncia un webinar de presentación para el 6 de agosto.

🔗 Anuncio en X

NVIDIA: un fine-tuning RL por menos de 5 dólares

23 de julio — NVIDIA destaca una demostración de fine-tuning mediante aprendizaje por refuerzo alojado en Nemotron 3 Nano, realizada con Prime Intellect Lab: precisión pasada del 22 % al 91 % en una tarea de matemáticas, por un coste inferior a $5. El flujo completo — baseline, entrenamiento hasta la convergencia de la recompensa, re-test de validación — termina con un adaptador LoRA descargable, trasladable a Nemotron 3 Super y Ultra cambiando una sola línea de configuración.

🔗 Anuncio en X


Gemini Notebook organiza tus notebooks con Collections

20 de julio — Gemini Notebook (antes NotebookLM) lanza Collections, una nueva pestaña para organizar sus notebooks al estilo de álbumes de fotos o playlists en lugar de mediante una estructura clásica de carpetas: cero estructura rígida, y un mismo notebook puede pertenecer a tantas collections como se desee, o a ninguna.

Es una funcionalidad entregada — una nueva pestaña visible en el producto — no un simple teaser. Fechado la víspera de la ventana estricta de este rastreo, este tweet respondía no obstante a una petición recurrente de los usuarios que había permanecido sin respuesta hasta ahora.

🔗 Tweet fijado @Gemini_Notebook


xAI y Qwen amplían sus ofertas

Grok 4.5 disponible en todas las superficies de consumo

22 de julio — xAI anuncia que Grok 4.5 equipa ahora Grok en todas sus superficies de consumo: grok.com, X, y las aplicaciones iOS y Android. El modelo sigue también accesible desde Word, Excel, PowerPoint y Outlook a través de los complementos Microsoft 365 de xAI. No se trata de un modelo nuevo: su lanzamiento flagship ya fue cubierto el 8 de julio, y su disponibilidad completa en Europa el 16 de julio — este anuncio es el último eslabón del despliegue, la transición efectiva en móvil y en el sitio de consumo.

🔗 Anuncio oficial

Grok llega a Microsoft Outlook

21 de julio — xAI amplía la integración de Grok a Microsoft 365 con Grok para Outlook: un agente que resume hilos de conversación largos, redacta respuestas en el estilo del usuario, archiva las conversaciones terminadas y señala lo que espera una respuesta — nada se envía sin validación explícita. Disponible desde hoy para los suscriptores de pago X y SuperGrok a través de Microsoft Marketplace, este módulo se suma a los ya ofrecidos para Word, Excel y PowerPoint.

🔗 Anuncio oficial

Qwen Cloud lanza el Token Plan Individual

21 de julio — Qwen Cloud lanza el Token Plan Individual, una oferta de suscripción a partir de $6 al mes que da acceso a un pool de créditos unificado para la familia Qwen así como para GLM y DeepSeek, con acceso anticipado a Qwen3.8-Max-Preview (modelo ya cubierto el 19 de julio). La infografía promocional detalla tres niveles tarifarios (Lite / Standard / Pro), descuentos en horas valle y un pool capaz de alimentar hasta 8 agentes simultáneamente.

🔗 Anuncio en X


Anthropic invierte 200 millones de dólares en los futuros económicos de la IA

22 de julio — Anthropic presenta la agenda de investigación de su Economic Futures Research Fund, dotado con 200 millones de dólares para financiar investigaciones externas ambiciosas sobre intervenciones destinadas a preparar a la sociedad para los impactos económicos de la IA. Cinco ejes prioritarios: impacto sobre los trabajadores, acompañamiento de las transiciones profesionales, modernización de los dispositivos de apoyo a la renta, mecanismos de reparto del crecimiento ligado a la IA (cuentas de capital pre-distributivo), y nuevos datos sobre la inversión pública.

Anthropic prevé financiar principalmente proyectos entre 5 y 30 millones de dólares, abiertos a universidades, institutos de investigación independientes y organizaciones sin ánimo de lucro — no a investigadores individuales. Este fondo hace evolucionar el programa «Economic Futures» lanzado un año antes, reorientado hacia un número más reducido de subvenciones ambiciosas en lugar de muchas pequeñas subvenciones.

🔗 Anuncio oficial


Breves

  • Anthropic duplica su apoyo a Public First Action (20 millones de dólares adicionales) — apoyo total elevado a 40 millones de dólares para esta organización no partidista de educación del público sobre los retos de la IA; estas donaciones financian exclusivamente la misión de educación y política pública, sin apoyo electoral posible. 🔗 Fuente
  • Claude Code: guía sobre los bucles de verificación construidos con skills — cómo transformar verificaciones manuales en skills de Claude Code para que Claude complete por sí mismo su propia verificación. 🔗 Fuente
  • Caso de estudio Outtake: agente de investigación cyber construido sobre Claude — cómo Outtake lleva a cabo sesiones de varias horas para cartografiar redes de ataque. 🔗 Fuente
  • Cognition — DeepWiki supera los 500 000 repositorios indexados — herramienta de documentación de código generada por IA, gratuita; meetup con LangChain anunciado para el 28 de julio en San Francisco. 🔗 Fuente
  • Replit destaca la integración de Firecrawl — contexto web con un clic para las apps, con 10 000 créditos ofrecidos a los primeros usuarios. 🔗 Fuente
  • Hugging Face integra nativamente Nunchaku (SVDQuant) en Diffusers — los checkpoints cuantificados 4-bit (pesos y activaciones) se cargan ahora a través de from_pretrained(), sin librería de inferencia separada. 🔗 Fuente
  • Together AI alojará Kimi K3 (Moonshot AI) desde su lanzamiento el 27 de julio — inferencia disponible «day zero», benchmarks comunicados después del lanzamiento efectivo. 🔗 Fuente
  • Gemini CLI v0.52.0 — servicios de triage y de egress, elusión de la corrección LLM para JSON/IPYNB en write_file/replace, actualización de google-auth-library a la versión 10.9.0. 🔗 Fuente
  • GitHub — campos de selección múltiple para Projects e Issues — un campo personalizado ahora puede contener varias valores a la vez (equipos, módulos, categorías). 🔗 Fuente
  • HeyGen — API de traducción de vídeo a escala — duplicar una cadena de vídeo completa en 10 versiones localizadas en menos de 24 horas, con procesamiento por lotes. 🔗 Fuente
  • Codex Sites Analytics pasa a prueba pública — métricas básicas de rendimiento para los sitios publicados con Codex. 🔗 Fuente
  • OpenAI lanza el programa «ChatGPT para las pequeñas empresas» — webinars ChatGPT Work, AI academies en Estados Unidos, alianzas con Dropbox, Shopify, Intuit, Slack, Atlassian y Wix. 🔗 Fuente
  • David Vélez (Nubank) y Robin Vince (BNY) se incorporan a los consejos de administración de OpenAI — la OpenAI Foundation y OpenAI Group PBC dan la bienvenida a ambos directivos. 🔗 Fuente
  • Cohere anuncia una alianza con HUMAIN para la IA árabe — continuación del éxito de Cohere Transcribe Arabic, sin producto ni fecha precisados por ahora. 🔗 Fuente

Lo que esto significa

La voz se instala como interfaz de pilotaje de pleno derecho, el mismo día, en dos actores distintos. ChatGPT Voice llega a escritorio para dirigir Chat, Work y Codex sin teclado, impulsado por GPT-Live; Claude, por su parte, hace funcionar su modo de voz sobre sus modelos más potentes y le da acceso a las herramientas conectadas durante la conversación. Los dos anuncios son independientes, pero la coincidencia de fechas probablemente no sea casualidad: traduce una misma apuesta: la conversación oral se convierte en un canal de trabajo de pleno derecho, capaz de desencadenar acciones reales mediante agentes o herramientas conectadas, en lugar de un simple artilugio de asistente que se limita a responder preguntas.

Enmarcar a los agentes se convierte en un tema por derecho propio, distinto del simple hecho de hacerlos funcionar. GitHub introduce aprobaciones, una puntuación de confianza y una justificación para los cambios que sus agentes aplican por sí solos a los Issues —precisando al mismo tiempo que no es «un control de seguridad», sino solo una comodidad de flujo de trabajo. Runway, por su parte, añade una capa de arbitraje automático (coste, calidad, latencia) entre modelos generativos rivales. El punto en común: a medida que los agentes ganan autonomía, los editores añaden capas de gobernanza y pilotaje en lugar de limitarse a apilar capacidades —un movimiento que también se encuentra en los proyectos de múltiples carpetas de Codex, pensados para que los agentes trabajen en un perímetro más amplio sin perder la noción de raíz de verdad, la carpeta Git primaria.

La ciberdefensa se afirma como un eje explícito de competencia entre grandes actores de la IA. Gemini 3.5 Flash Cyber reivindica un 72 % de detección de vulnerabilidades en las codebases reales de Chrome y Android, frente al 55 % de su propio modelo estándar y el 54 % de Claude Opus 4.6 citado nominalmente por Google —una comparación directa bastante rara como para merecer ser señalada. El mismo día, Hugging Face publica The Stack v3, un dataset de código de 5 000 mil millones de tokens, justificando explícitamente la publicación por la necesidad de «buenos modelos de código abiertos para la ciberdefensa». Estos dos anuncios independientes dibujan una inquietud compartida sobre la explotación de vulnerabilidades de software a gran escala, y una respuesta simétrica: modelos cerrados especializados por un lado, datos abiertos para entrenar otros por el otro.

Cognition amplía su terreno de juego en ambos sentidos en una sola semana. La adquisición de Poke, un agente personal que vive en los mensajes del usuario y ha intercambiado más de 100 millones de mensajes en tres meses, desplaza el centro de gravedad de la empresa más allá de Devin, su ingeniero de software autónomo, hacia los agentes para el público general. Al mismo tiempo, su protocolo de acuerdo con el Departamento de Energía de Estados Unidos para la Genesis Mission lo sitúa junto a Google DeepMind, OpenAI y Arcee AI —ya implicados en esta misma iniciativa desde el 22 de julio— en una carrera ahora a cuatro para implantarse en la investigación científica pública estadounidense. Dos movimientos, una misma lógica: consolidar una posición tanto en el gran público como en la infraestructura institucional, en lugar de quedar encasillado en un único segmento.


Fuentes