Rechercher

Health in ChatGPT, FLUX 3 unifie image et vidéo, ChatGPT Voice arrive sur desktop

Le 23 juillet 2026 concentre sept annonces majeures : OpenAI déploie Health in ChatGPT aux États-Unis et fait arriver ChatGPT Voice sur l’application desktop, Black Forest Labs unifie image, vidéo, audio et prédiction d’action dans FLUX 3, GitHub encadre pour la première fois ce que ses agents modifient seuls dans les Issues, HeyGen transforme son framework HyperFrames en agent de création vidéo complet, et Cognition élargit son empreinte avec l’acquisition de Poke puis un protocole d’accord avec le Département de l’Énergie américain. Autour de ces sept sujets gravitent dix-huit nouveautés notables — du mode vocal de Claude aux outils de code (Cursor, Replit, Zed, v0, Amp), en passant par la cyberdéfense chez Gemini et Hugging Face.


Health in ChatGPT arrive aux États-Unis

23 juillet — OpenAI déploie Health in ChatGPT auprès des utilisateurs américains connectés, à partir de 18 ans, sur web et iOS, pour les formules Free, Go, Plus et Pro. La fonctionnalité permet de connecter en toute sécurité Apple Health ainsi que des dossiers médicaux pris en charge (systèmes hospitaliers américains, One Medical, Function Health), pour que ChatGPT dispose du contexte santé de l’utilisateur — comparer un résultat d’analyse à des tests antérieurs, résumer ce qui a changé depuis un dernier rendez-vous, ou croiser sommeil et activité avec sa routine quotidienne.

OpenAI met en avant un chiffre : plus de 300 millions de personnes posent chaque semaine des questions liées à la santé à ChatGPT. L’entreprise indique travailler avec des centaines de médecins pour mesurer et améliorer précision, sécurité et reconnaissance des situations nécessitant une prise en charge professionnelle. Côté modèles, GPT-5.5 Instant (plan gratuit) apporte une base commune à tous les utilisateurs, tandis que GPT-5.6 Sol (plans payants) va plus loin sur les questions complexes ; sur HealthBench Professional, l’évaluation développée avec des médecins, tous les modèles GPT-5.6 surpassent GPT-5.5.

Sur la confidentialité, OpenAI insiste : les dossiers médicaux et données Apple Health connectés, ainsi que les conversations qui les utilisent, ne sont jamais utilisés pour entraîner les modèles ni pour cibler de la publicité, quel que soit le réglage d’entraînement choisi par ailleurs. Par défaut, ChatGPT demande la permission avant chaque usage de ces données ; la déconnexion d’un compte supprime les données synchronisées sous 30 jours. Point notable : Health n’est pas disponible dans Codex. Une première version, plus tôt cette année, cantonnait ces échanges à un espace dédié — mais plus de 70 % des conversations liées à la santé avaient lieu ailleurs, d’où l’intégration native dans l’ensemble des conversations.

🔗 Annonce officielle — OpenAI


FLUX 3 : Black Forest Labs unifie image, vidéo, audio et prédiction d’action

23 juillet — Black Forest Labs (BFL), les créateurs des modèles FLUX pour l’image, annoncent FLUX 3, présenté comme un modèle multimodal unique entraîné dans une architecture unifiée plutôt que comme des modèles séparés assemblés après coup. L’entreprise met en avant un rendu « plus fidèle à la réalité dans tous les styles » par rapport aux générations précédentes.

Modalité couverteStatut au 23 juillet
ImageDisponible
Vidéo (FLUX 3 Video)Accès anticipé, disponible dès aujourd’hui
AudioIntégré à l’architecture unifiée
Prédiction d’actionTravaux robotique avec mimic et Audi

Deux volets distinguent cette sortie. D’abord, FLUX 3 Video élargit le périmètre historique de BFL — jusqu’ici centré sur l’image fixe — vers la vidéo, un terrain jusque-là dominé par Runway, Luma, Kling ou Wan. Ensuite, BFL indique que l’architecture unifiée du modèle peut être étendue pour prédire des actions physiques, avec des travaux menés en collaboration avec mimic (spécialiste de la téléopération et de l’apprentissage robotique) et Audi — une dimension qui rapproche BFL du terrain de l’IA physique où NVIDIA investit massivement avec Cosmos et Isaac.

Le post d’annonce a rassemblé plus de 393 000 vues en quelques heures, avec un fil de suite montrant les premiers échantillons FLUX 3 Image. C’est le lancement de modèle le plus notable de la fenêtre sur le segment des médias génératifs, autant par son ambition — un seul modèle pour quatre modalités — que par son ouverture vers la robotique.

🔗 Annonce sur X


ChatGPT Voice pilote Chat, Work et Codex à la voix

23 juillet (21h43) — OpenAI annonce l’arrivée de ChatGPT Voice dans l’application desktop (macOS et Windows), pour les plans Plus, Pro, Business, Edu et Enterprise, en déploiement mondial dès aujourd’hui. Propulsée par GPT-Live, la fonctionnalité permet de contrôler son ordinateur et de diriger plusieurs agents — ChatGPT Work ou Codex — uniquement à la voix : le modèle parle, écoute et coordonne le travail dans l’application simultanément.

ChatGPT Voice is now in the desktop app. Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. It’s powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans.

🇫🇷 ChatGPT Voice est maintenant disponible dans l’application de bureau. Contrôlez votre ordinateur et dirigez plusieurs agents s’exécutant dans ChatGPT Work ou Codex, juste avec votre voix. C’est propulsé par GPT-Live, qui peut donc parler, écouter et coordonner le travail dans l’application en même temps. Déploiement mondial dès aujourd’hui sur macOS et Windows pour les plans Plus, Pro, Business, Edu et Enterprise.@OpenAI sur X

Le changelog officiel Codex (version 26.715) ajoute un détail absent du tweet : sur macOS, une option « Screen context » permet de partager avec ChatGPT une capture de la fenêtre au premier plan pendant une conversation vocale, pour que l’assistant voie ce que l’utilisateur regarde en travaillant à voix haute. Un tweet de suivi précise que ChatGPT Voice est aussi utilisable dans Codex depuis l’app iOS, via un accès distant appairé — le support Android est annoncé « à venir » sans date précisée.

🔗 Changelog Codex — version 26.715


Le mode vocal de Claude s’enrichit aussi

23 juillet — Anthropic met à jour le mode vocal de Claude, disponible sur toutes les formules. Il s’appuie désormais sur des modèles plus performants — Opus et Sonnet — plutôt qu’un modèle dédié plus léger, pour des échanges oraux plus approfondis.

Voice mode now runs on Claude’s more capable models and reaches the tools you’ve connected mid-conversation. Talk through the hard problems out loud, in many more languages.

🇫🇷 Le mode vocal fonctionne désormais avec les modèles les plus performants de Claude et peut atteindre les outils que vous avez connectés en cours de conversation. Réfléchissez à voix haute aux problèmes complexes, dans bien plus de langues.@claudeai sur X

Claude peut aussi désormais accéder en conversation aux outils déjà connectés au compte (messagerie, calendrier), sans l’interrompre. Le mode vocal gagne l’espagnol, le français, l’hindi et le japonais, en bêta publique dès aujourd’hui sur mobile, ordinateur et web.

🔗 Article de blog associé


Codex : des projets qui traversent plusieurs dossiers

23 juillet (22h31) — Dans la même livraison que ChatGPT Voice (changelog Codex 26.715), Codex introduit les projets locaux multi-dossiers dans l’app desktop ChatGPT. Un projet local peut désormais regrouper du code, de la documentation et des fichiers de référence répartis sur plusieurs dossiers ; Codex peut lire et écrire à travers l’ensemble, tandis qu’un dossier primaire reste la racine Git.

Depuis le menu d’un projet, l’option « Edit project » permet d’ajouter des dossiers et de désigner le dossier primaire. Les nouveaux chats, les opérations Git, la découverte automatique de AGENTS.md, les skills et le fichier config.toml utilisent tous le dossier primaire ; les dossiers secondaires restent accessibles en lecture et en écriture pour la recherche de fichiers.

🔗 Annonce sur X


GitHub encadre les agents qui modifient les Issues

23 juillet — GitHub a lancé en préversion publique un ensemble de contrôles destinés à encadrer les automatisations d’agents sur GitHub Issues. Le constat de départ : les agents (GitHub Agentic Workflows, Copilot cloud agent) étiquettent, typent, assignent et ferment de plus en plus d’issues automatiquement, sans que les équipes puissent toujours savoir pourquoi ni garder facilement la main dessus.

Capacité ajoutéeCe qu’elle fait
ApprobationsL’automatisation suggère plutôt qu’applique ; les changements attendent une validation, un par un ou en bloc
Score de confianceChaque action reçoit haute / moyenne / basse confiance ; seule la haute s’applique automatiquement
JustificationChaque action enregistre sa raison, appliquée ou en attente — piste d’audit consultable

La recherche has:suggestions retrouve les issues avec des changements en attente de revue ; les administrateurs configurent le seuil de confiance qui détermine ce qui s’applique automatiquement. Ces contrôles fonctionnent avec GitHub Agentic Workflows (en ajoutant issue-intents: true au frontmatter du workflow) et avec Copilot cloud agent (aucune mise à jour requise). Au lancement, les actions couvertes sont : labels, champs personnalisés, type, fermeture et assignation, via les API REST et GraphQL.

Point de vigilance formulé par GitHub lui-même : les approbations sont présentées comme « une commodité de workflow, pas un contrôle de sécurité » — elles n’imposent pas de barrière côté serveur, et un agent disposant des permissions nécessaires peut toujours appliquer un changement directement plutôt que le suggérer. Cas d’usage mis en avant : triage automatique, enrichissement de métadonnées, détection de spam avec justification.

🔗 Changelog GitHub


GitHub Mobile corrige vos échecs CI avec Copilot

23 juillet — GitHub étend à l’application mobile (iOS et Android) la fonctionnalité Fix with Copilot, déjà disponible sur les commentaires de pull request. Désormais, lorsqu’un check GitHub Actions échoue sur une pull request, un bouton Fix with Copilot apparaît directement sur le check en échec depuis GitHub Mobile.

En un geste, Copilot coding agent analyse l’échec, ouvre une nouvelle pull request par-dessus la pull request existante avec un correctif proposé, puis notifie l’utilisateur pour revue. L’objectif affiché est de permettre de réagir à des échecs de CI en déplacement, sans revenir à un poste de travail, pour garder les pull requests en mouvement même hors du clavier.

🔗 Changelog GitHub


Runway automatise le choix du modèle génératif

23 juillet — Runway lance Media Router, décrit comme le premier routeur de génération média « optimisé selon les préférences ». Plutôt que de choisir manuellement un modèle pour chaque requête, l’utilisateur définit une seule fois ce que « meilleur » signifie — coût, qualité ou latence — et le routeur sélectionne automatiquement le modèle vidéo, image ou audio approprié.

La fonctionnalité est disponible dès maintenant dans Runway Dev, la plateforme développeur lancée en parallèle. C’est une brique d’infrastructure plutôt qu’un nouveau modèle : elle s’adresse aux équipes produit qui orchestrent plusieurs modèles génératifs tiers et cherchent à automatiser l’arbitrage coût/qualité/latence — une approche proche des routeurs LLM (OpenRouter et consorts) mais appliquée aux médias génératifs.

🔗 Annonce sur X


HeyGen transforme HyperFrames en agent de création vidéo

23 juillet — HeyGen fait passer HyperFrames — jusqu’ici surtout connu du grand public via sa série créative quotidienne — du statut de simple moteur de rendu HTML à celui de produit central : Video Agent, directement intégré dans HeyGen. Le principe : l’utilisateur décrit ce qu’il veut, et l’agent construit la vidéo entière de bout en bout — avatar, graphismes, sous-titres et musique, le tout présenté comme « infiniment personnalisable ».

Le lancement s’accompagne d’une opération de croissance virale (un mois gratuit de HeyGen contre interaction sur le post) qui a généré plus de 1,1 million de vues, 810 réponses et 788 reposts en quelques heures — de loin le post le plus vu de toute la fenêtre de scan sur le segment des médias génératifs.

Fait notable pour les développeurs : en parallèle du produit grand public, HeyGen open-source HyperFrames lui-même sur GitHub (dépôt heygen-com/hyperframes, décrit comme « Écrivez du HTML. Générez une vidéo. Conçu pour les agents. »), ce qui permet à des agents tiers de générer de la vidéo à partir de HTML en dehors même de l’app HeyGen. Le même fil annonce aussi une nouvelle API de traduction vidéo à l’échelle (voir Brèves). C’est donc un double mouvement produit et plateforme développeur en une seule journée pour HeyGen.

🔗 Annonce principale


Cognition acquiert Poke, l’agent qui vit dans vos messages

23 juillet — Cognition (Devin) annonce l’acquisition de The Interaction Company of California, l’éditeur de Poke, un agent personnel conversationnel qui vit directement dans les messages de l’utilisateur. Selon le billet signé par Scott Wu, PDG et cofondateur de Cognition, lui-même et Walden (cofondateur de Cognition) étaient des investisseurs providentiels précoces d’Interaction, et les deux équipes partageaient déjà le même pari technologique : les agents cloud « toujours actifs ».

Poke is a personal agent that lives in your texts. It messages you first, follows up with you, and feels less like software and more like a friend. People have exchanged more than 100 million messages with it in just the last three months, and it’s the only AI agent approved to text natively on Apple Messages.

🇫🇷 Poke est un agent personnel qui vit dans vos messages. Il vous écrit en premier, relance la conversation, et ressemble moins à un logiciel qu’à un ami. Plus de 100 millions de messages ont été échangés avec lui rien que ces trois derniers mois, et c’est le seul agent IA autorisé à envoyer des messages nativement sur Apple Messages.Scott Wu sur le blog Cognition

Pour les utilisateurs, rien ne change dans l’immédiat — Poke continue de fonctionner comme avant — mais Cognition annonce vouloir apporter ses modèles et son infrastructure pour le rendre « plus rapide et plus fiable ». Le rapprochement positionne Cognition au-delà de son cœur de métier historique (l’ingénieur logiciel autonome Devin) vers les agents personnels grand public, un axe stratégique nouveau pour l’entreprise.

🔗 Annonce sur X


Cognition rejoint la Genesis Mission du Département de l’Énergie

22 juillet — Cognition a signé un protocole d’accord (MOU) avec le Département de l’Énergie américain (DOE) pour rejoindre la Genesis Mission, une initiative nationale lancée par décret présidentiel en novembre 2025 et présentée comme le « Projet Manhattan de l’Amérique pour l’IA ». Elle mobilise les 17 laboratoires nationaux américains, l’industrie et le monde académique pour connecter les supercalculateurs les plus puissants du pays aux plus grands jeux de données scientifiques fédéraux, avec un objectif affiché de doubler la productivité de la recherche scientifique américaine en une décennie. Cognition rejoint ainsi Google DeepMind, OpenAI et Arcee AI, dont l’adhésion à la même mission a déjà été couverte la veille, le 22 juillet.

Axe d’engagementContribution de Devin (Cognition)
Sécurité logicielle et des donnéesTrouver et corriger les vulnérabilités dans des codebases scientifiques
Modernisation du code legacyDocumentation, tests et traduction de code ancien (Fortran, C++, COBOL)
Extension de la capacité de rechercheDéléguer pipelines de données, infrastructure et déploiement
Modernisation cloudMigration d’applications legacy vers des plateformes cloud-natives

Le billet précise que la plateforme Cognition est en cours de qualification FedRAMP Class D (High), que Devin Desktop et Devin CLI sont déjà certifiés à ce niveau et conformes ITAR/IL4-IL6, et que Devin est déjà utilisé par l’US Army, l’US Navy et le Jet Propulsion Laboratory de la NASA. Dans le cadre de son adhésion, Cognition propose des scans de sécurité de code et des rapports de remédiation en nature pour les laboratoires nationaux, ainsi que du compute complémentaire pour les équipes sélectionnées via les appels à projets de la Genesis Mission.

🔗 Annonce sur le blog Cognition


Les outils de code accélèrent

Cinq mises à jour notables touchent les outils de développement assisté par IA cette semaine, entre tarification, fonctionnalités et automatisation événementielle.

Cursor double ses limites d’usage

21 juillet — Cursor double les limites d’usage incluses sur l’ensemble des plans individuels et Teams (hors Enterprise, non mentionné). La mesure s’applique aux modèles Grok (xAI) et Composer (modèle propriétaire de Cursor), ainsi qu’à tout futur modèle Cursor, sans changement de tarification annoncé au-delà du facteur « doublé ». Le post a généré un engagement important — environ 1 000 reposts et 10 000 likes en quelques heures — signe d’un accueil très positif de la communauté. Cette annonce est distincte de Cursor Router, publié la veille.

🔗 Annonce sur X

Replit réduit ses prix d’hébergement de plus de moitié

23 juillet — Replit annonce une baisse tarifaire substantielle — plus de 50 % — sur l’hébergement des applications publiées à grande échelle, effective à partir du 1er août 2026. Toute app publiée tourne sur Replit Cloud, avec scaling automatique selon l’usage, authentification et base de données sécurisées incluses, analytics et SEO intégrés. Les nouveaux tarifs s’appliquent automatiquement à tous les utilisateurs dès leur prochain cycle de facturation mensuel, sans action requise de leur part.

🔗 Annonce sur X

Zed 1.12 : Git Panel et sélection multiple

22 juillet — Zed publie la version stable 1.12 : le panneau Git propose désormais des sections séparées « Staged » et « Unstaged », et cliquer sur une entrée dans l’un ou l’autre groupe ouvre le multibuffer correspondant. Le File Finder comme le Text Finder gèrent aussi la sélection multiple (cmd-clic sur macOS, ctrl-clic sur Linux/Windows, ou tab) pour ouvrir plusieurs fichiers d’un coup. Un filtrage CSV mentionné initialement dans le fil a finalement été retiré par correction de Zed, qui a précisé que cette fonctionnalité n’était en réalité pas encore publique.

🔗 Annonce sur X

v0 : commandes slash, Shopify pour tous, fiabilité Snowflake

21 juillet — v0 (Vercel) ajoute des commandes slash : taper / dans le compositeur ouvre un menu pour attacher une compétence (skill) via skills.sh sans lâcher le clavier. L’intégration Shopify, qui génère une vitrine e-commerce lisant produits, prix et stock en direct, est désormais ouverte à tous les utilisateurs. Une passe de fiabilité sur Snowflake détecte les changements de code depuis le dernier déploiement et oriente les générations vers le compte connecté plutôt que vers des données factices.

🔗 Changelog v0

Amp : les orbs réagissent aux événements externes

23 juillet — Les « orbs » d’Amp (bacs à sable cloud pour agents distants) peuvent désormais se réveiller sur des événements externes via une nouvelle API de webhooks (amp.createWebhook) : échec CI sur GitHub, nouvelle issue Linear, alerte de monitoring, message Discord. Amp vérifie la signature du fournisseur et déduplique les livraisons ; l’événement externe reste une donnée non fiable, jamais interprétée comme une instruction directe à l’agent. Exemples d’usage cités : investiguer chaque échec CI sur la branche principale et poster les résultats sur Slack, ou surveiller les nouvelles versions de dépendances pour ouvrir automatiquement une pull request de mise à jour.

🔗 Annonce Amp


Cyberdéfense : Gemini et Hugging Face arment les défenseurs

Deux annonces distinctes de la fenêtre convergent vers le même besoin : mieux outiller la défense face aux vulnérabilités logicielles.

Gemini 3.5 Flash Cyber détecte 72 % des vulnérabilités

23 juillet — Après l’annonce groupée du 21 juillet (Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber), Google DeepMind publie un thread dédié avec un benchmark chiffré sur Gemini 3.5 Flash Cyber, modèle léger spécialisé dans le repérage et la correction de vulnérabilités.

Modèle testéTaux de détection
Gemini 3.5 Flash Cyber72 %
Gemini 3.5 Flash (standard)55 %
Claude Opus 4.6 (Anthropic)54 %

Le test — baptisé « Chrome Production Commit Scanning Pipeline » — a été mené sur les codebases réelles de Chrome et Android, où le modèle a détecté des vulnérabilités complexes ratées par les modèles standards. La disponibilité reste un pilote à accès limité, réservé aux gouvernements et partenaires de confiance, présenté par Google comme une démarche de « déploiement responsable ».

🔗 Thread @GoogleDeepMind

The Stack v3, le carburant open source de la cyberdéfense

23 juillet — Leandro von Werra, Head of Research chez Hugging Face, annonce The Stack v3, nouvelle génération du dataset de code de l’organisation HuggingFaceCode (à l’origine des modèles StarCoder) : 5 000 milliards de tokens prêts à l’entraînement, 120 To de données brutes, plus de 700 langages de programmation, sous licence ODC-BY. L’angle de communication est explicitement défensif — von Werra justifie la publication par un besoin urgent de « bons modèles de code ouverts pour la cyberdéfense », en écho à la sortie de Fugu-Cyber chez Sakana AI la veille.

🔗 Annonce sur X


Together AI et NVIDIA outillent l’inférence et le fine-tuning

Together AI lance une nouvelle génération de sa plateforme d’inférence

23 juillet — Together AI annonce Together Dedicated Model Inference, une refonte de sa plateforme d’inférence pour modèles open-weight. Au menu : déploiements multiples derrière un endpoint stable, rollouts sécurisés (canary, blue-green, rolling avec rollback automatique), tests A/B et « shadow traffic » sur trafic réel, démarrages environ 4 fois plus rapides grâce à une nouvelle couche de cache (modèles MoE frontière comme Kimi K2.7, MiniMax M3 ou GLM 5.2 déployés en 7 à 14 minutes), et une bêta fermée de fine-tuning custom (RL full-weight, LoRA, SFT) avec déploiement direct des checkpoints en production. Un webinaire de présentation est annoncé pour le 6 août.

🔗 Annonce sur X

NVIDIA : un fine-tuning RL à moins de 5 dollars

23 juillet — NVIDIA met en avant une démonstration de fine-tuning par apprentissage par renforcement hébergé sur Nemotron 3 Nano, réalisée avec Prime Intellect Lab : précision passée de 22 % à 91 % sur une tâche de mathématiques, pour un coût inférieur à $5. Le flux complet — baseline, entraînement jusqu’à convergence de la récompense, re-test de validation — se termine par un adaptateur LoRA téléchargeable, transposable à Nemotron 3 Super et Ultra en changeant une seule ligne de configuration.

🔗 Annonce sur X


Gemini Notebook range vos notebooks avec Collections

20 juillet — Gemini Notebook (ex-NotebookLM) lance Collections, un nouvel onglet pour organiser ses notebooks façon albums photo ou playlists plutôt que par une arborescence de dossiers classique : zéro structure rigide, et un même notebook peut appartenir à autant de collections que souhaité, ou à aucune.

C’est une fonctionnalité livrée — un nouvel onglet visible dans le produit — pas un simple teaser. Daté de la veille de la fenêtre stricte de ce scan, ce tweet répondait néanmoins à une demande récurrente des utilisateurs restée sans réponse jusqu’ici.

🔗 Tweet épinglé @Gemini_Notebook


xAI et Qwen élargissent leurs offres

Grok 4.5 disponible sur toutes les surfaces grand public

22 juillet — xAI annonce que Grok 4.5 équipe désormais Grok sur l’ensemble de ses surfaces grand public : grok.com, X, et les applications iOS et Android. Le modèle reste aussi accessible depuis Word, Excel, PowerPoint et Outlook via les modules complémentaires Microsoft 365 de xAI. Il ne s’agit pas d’un nouveau modèle : son lancement flagship a déjà été couvert le 8 juillet, et sa disponibilité complète en Europe le 16 juillet — cette annonce est le dernier maillon du déploiement, la bascule effective sur mobile et le site grand public.

🔗 Annonce officielle

Grok débarque dans Microsoft Outlook

21 juillet — xAI étend l’intégration de Grok à Microsoft 365 avec Grok pour Outlook : un agent qui résume les longs fils de discussion, rédige des réponses dans le style de l’utilisateur, archive les conversations terminées et signale ce qui attend une réponse — rien n’est envoyé sans validation explicite. Disponible dès aujourd’hui pour les abonnés payants X et SuperGrok via le Microsoft Marketplace, ce module rejoint ceux déjà proposés pour Word, Excel et PowerPoint.

🔗 Annonce officielle

Qwen Cloud lance le Token Plan Individual

21 juillet — Qwen Cloud lance le Token Plan Individual, une offre d’abonnement à partir de $6 par mois donnant accès à un pool de crédits unifié pour la famille Qwen ainsi que pour GLM et DeepSeek, avec un accès anticipé à Qwen3.8-Max-Preview (modèle déjà couvert le 19 juillet). L’infographie promotionnelle détaille trois paliers tarifaires (Lite / Standard / Pro), des réductions en heures creuses et un pool pouvant alimenter jusqu’à 8 agents simultanément.

🔗 Annonce sur X


Anthropic investit 200 millions de dollars dans les futurs économiques de l’IA

22 juillet — Anthropic dévoile l’agenda de recherche de son Economic Futures Research Fund, doté de 200 millions de dollars pour financer des recherches externes ambitieuses sur les interventions permettant de préparer la société aux impacts économiques de l’IA. Cinq axes prioritaires : impact sur les travailleurs, accompagnement des transitions professionnelles, modernisation des dispositifs de soutien au revenu, mécanismes de partage de la croissance liée à l’IA (comptes de capital pré-distributif), et nouvelles données sur l’investissement public.

Anthropic prévoit de financer principalement des projets entre 5 et 30 millions de dollars, ouverts aux universités, instituts de recherche indépendants et organisations à but non lucratif — pas aux chercheurs individuels. Ce fonds fait évoluer le programme « Economic Futures » lancé un an plus tôt, recentré sur un nombre plus restreint de subventions ambitieuses plutôt que de nombreuses petites subventions.

🔗 Annonce officielle


Brèves

  • Anthropic double son soutien à Public First Action (20 millions de dollars supplémentaires) — soutien total porté à 40 millions de dollars pour cette organisation non partisane d’éducation du public aux enjeux de l’IA ; ces dons financent exclusivement la mission d’éducation et de politique publique, sans soutien électoral possible. 🔗 Source
  • Claude Code : guide sur les boucles de vérification construites avec des skills — comment transformer des vérifications manuelles en skills Claude Code pour que Claude boucle lui-même sa propre vérification. 🔗 Source
  • Étude de cas Outtake : agent d’investigation cyber construit sur Claude — comment Outtake mène des sessions de plusieurs heures pour cartographier des réseaux d’attaque. 🔗 Source
  • Cognition — DeepWiki dépasse 500 000 dépôts indexés — outil de documentation de code généré par IA, gratuit ; meetup avec LangChain annoncé pour le 28 juillet à San Francisco. 🔗 Source
  • Replit met en avant l’intégration Firecrawl — contexte web en un clic pour les apps, avec 10 000 crédits offerts aux premiers utilisateurs. 🔗 Source
  • Hugging Face intègre Nunchaku (SVDQuant) nativement dans Diffusers — les checkpoints quantifiés 4-bit (poids et activations) se chargent désormais via from_pretrained(), sans librairie d’inférence séparée. 🔗 Source
  • Together AI hébergera Kimi K3 (Moonshot AI) dès son lancement le 27 juillet — inférence disponible « day zero », benchmarks communiqués après le lancement effectif. 🔗 Source
  • Gemini CLI v0.52.0 — services de triage et d’égress, contournement de la correction LLM pour JSON/IPYNB dans write_file/replace, mise à jour de google-auth-library vers la version 10.9.0. 🔗 Source
  • GitHub — champs à sélection multiple pour Projects et Issues — un champ personnalisé peut désormais contenir plusieurs valeurs à la fois (équipes, modules, catégories). 🔗 Source
  • HeyGen — API de traduction vidéo à l’échelle — dupliquer une chaîne vidéo entière en 10 versions localisées en moins de 24 heures, avec traitement par lot. 🔗 Source
  • Codex Sites Analytics passe en test public — métriques de performance de base pour les sites publiés avec Codex. 🔗 Source
  • OpenAI lance le programme « ChatGPT pour les petites entreprises » — webinaires ChatGPT Work, AI academies aux États-Unis, partenariats avec Dropbox, Shopify, Intuit, Slack, Atlassian et Wix. 🔗 Source
  • David Vélez (Nubank) et Robin Vince (BNY) rejoignent les conseils d’administration d’OpenAI — l’OpenAI Foundation et OpenAI Group PBC accueillent les deux dirigeants. 🔗 Source
  • Cohere annonce un partenariat avec HUMAIN pour l’IA arabe — suite du succès de Cohere Transcribe Arabic, sans produit ni date précisés pour l’instant. 🔗 Source

Ce que ça signifie

La voix s’installe comme interface de pilotage à part entière, le même jour, chez deux acteurs différents. ChatGPT Voice arrive sur desktop pour diriger Chat, Work et Codex sans clavier, propulsé par GPT-Live ; Claude, de son côté, fait tourner son mode vocal sur ses modèles les plus performants et lui donne accès aux outils connectés en cours de conversation. Les deux annonces sont indépendantes, mais la convergence de date n’est probablement pas un hasard : elle traduit un même pari — la conversation orale devient un canal de travail à part entière, capable de déclencher des actions réelles via des agents ou des outils connectés, plutôt qu’un simple gadget d’assistant qui se contente de répondre à des questions.

Encadrer les agents devient un sujet à part entière, distinct du seul fait de les faire tourner. GitHub introduit des approbations, un score de confiance et une justification pour les changements que ses agents appliquent seuls aux Issues — tout en précisant lui-même que ce n’est « pas un contrôle de sécurité », juste une commodité de workflow. Runway, de son côté, ajoute une couche d’arbitrage automatique (coût, qualité, latence) entre modèles génératifs concurrents. Le point commun : à mesure que les agents gagnent en autonomie, les éditeurs ajoutent des couches de gouvernance et de pilotage plutôt que de se contenter d’empiler des capacités — un mouvement qu’on retrouve aussi dans les projets multi-dossiers de Codex, pensés pour que les agents travaillent sur un périmètre plus large sans perdre la notion de racine de vérité, le dossier Git primaire.

La cyberdéfense s’affirme comme un axe de compétition explicite entre grands acteurs de l’IA. Gemini 3.5 Flash Cyber revendique 72 % de détection de vulnérabilités sur les codebases réelles de Chrome et Android, contre 55 % pour son propre modèle standard et 54 % pour Claude Opus 4.6 cité nommément par Google — une comparaison directe assez rare pour être notée. Le même jour, Hugging Face publie The Stack v3, un dataset de code de 5 000 milliards de tokens, en justifiant explicitement la publication par le besoin de « bons modèles de code ouverts pour la cyberdéfense ». Ces deux annonces indépendantes dessinent une inquiétude partagée sur l’exploitation de vulnérabilités logicielles à grande échelle, et une réponse symétrique : des modèles fermés spécialisés d’un côté, des données ouvertes pour en entraîner d’autres de l’autre.

Cognition élargit son terrain de jeu dans les deux sens en une seule semaine. L’acquisition de Poke, un agent personnel qui vit dans les messages de l’utilisateur et a échangé plus de 100 millions de messages en trois mois, déplace le centre de gravité de l’entreprise au-delà de Devin, son ingénieur logiciel autonome, vers les agents grand public. Au même moment, son protocole d’accord avec le Département de l’Énergie américain pour la Genesis Mission l’installe aux côtés de Google DeepMind, OpenAI et Arcee AI — déjà engagés sur cette même initiative depuis le 22 juillet — dans une course désormais à quatre pour s’implanter dans la recherche scientifique publique américaine. Deux mouvements, une même logique : consolider une position à la fois sur le grand public et sur l’infrastructure institutionnelle, plutôt que de rester cantonné à un seul segment.


Sources