検索

Health in ChatGPT、FLUX 3が画像と動画を統合、ChatGPT Voiceがデスクトップに登場

Health in ChatGPT、FLUX 3が画像と動画を統合、ChatGPT Voiceがデスクトップに登場

ai-powered-markdown-translator

fr から ja に翻訳された記事、gpt-5.4-mini を使用。

GitHub でプロジェクトを見る ↗

2026年7月23日は主要発表が7件集中した日だった。OpenAIは米国でHealth in ChatGPTを展開し、ChatGPT Voiceをデスクトップアプリに導入。Black Forest LabsはFLUX 3で画像、動画、音声、行動予測を統合し、GitHubはIssues上でエージェントが単独で変更する内容を初めて制御。HeyGenはHyperFramesを完全な動画作成エージェントへ進化させ、CognitionはPokeを買収したうえで、米エネルギー省のGenesis Missionとも協定を結んだ。これら7件の周囲では、Claudeの音声モードから、GeminiやHugging Faceにおけるサイバー防御まで、計18件の注目すべき新情報が動いた。


Health in ChatGPTが米国で提供開始

7月23日 — OpenAIは、18歳以上の米国のログイン済みユーザー向けに、WebとiOSでHealth in ChatGPTの提供を開始した。Free、Go、Plus、Proの各プランで利用できる。この機能により、Apple Healthや対応する医療記録(米国の病院システム、One Medical、Function Health)を安全に接続でき、ChatGPTがユーザーの健康コンテキストを把握できるようになる。たとえば、検査結果を過去の検査と比較したり、前回の診察以降に何が変わったかを要約したり、睡眠と活動量を日々の習慣と照らし合わせたりできる。

OpenAIは1つの数字を強調している。毎週300万人以上がChatGPTに健康関連の質問をしているという。さらに同社は、精度、安全性、そして専門的対応が必要な状況の認識を測定・改善するために、数百人の医師と協力していると説明した。モデル面では、GPT-5.5 Instant(無料プラン)がすべてのユーザーに共通の基盤を提供し、GPT-5.6 Sol(有料プラン)は複雑な質問でさらに踏み込んだ応答を行う。医師と共同で開発された評価指標であるHealthBench Professionalでは、GPT-5.6の全モデルがGPT-5.5を上回っている。

プライバシーについてOpenAIは明確にしている。接続された医療記録とApple Healthデータ、そしてそれらを使った会話は、モデルの学習にも広告のターゲティングにも一切使われない。これは、他で選んだ学習設定にかかわらず同じだ。既定では、ChatGPTはこれらのデータを使う前に毎回許可を求める。アカウントを切断すると、同期されたデータは30日以内に削除される。特筆すべき点として、HealthはCodexでは利用できない。今年初めの初期版では、この種のやり取りは専用スペースに限定されていたが、健康関連の会話の70%以上が別の場所で行われていたため、会話全体に自然に統合された。

🔗 OpenAI公式発表


FLUX 3:Black Forest Labsが画像、動画、音声、行動予測を統合

7月23日 — 画像モデルFLUXの開発元であるBlack Forest Labs(BFL)は、FLUX 3を発表した。これは個別のモデルを後から組み合わせるのではなく、統合アーキテクチャで学習された単一のマルチモーダルモデルとして位置づけられている。同社は、従来世代と比べて「すべてのスタイルで、より現実に忠実な」描画を実現すると強調している。

対応モダリティ7月23日時点の状況
画像利用可能
動画(FLUX 3 Video)アーリーアクセス、本日より利用可能
音声統合アーキテクチャに組み込み
行動予測mimicおよびAudiとのロボティクス研究

このリリースには2つの際立った点がある。まず、FLUX 3 Videoによって、これまで静止画中心だったBFLの歴史的な領域が動画へと広がる。動画分野では、これまでRunway、Luma、Kling、Wanが主導してきた。次に、BFLは統合アーキテクチャを物理行動の予測へ拡張できると説明している。これは、テレオペレーションとロボティック学習の専門企業であるmimic、そしてAudiとの共同研究によるものだ。こうした方向性は、CosmosやIsaacに大規模投資しているNVIDIAの物理AI領域に、BFLを近づけるものでもある。

発表ポストは数時間で39万3,000回以上表示され、続くスレッドではFLUX 3 Imageの初期サンプルも公開された。単一モデルで4モダリティを扱うという野心に加え、ロボティクスへの広がりも含め、生成メディア分野のこの期間で最も注目すべきモデル発表となった。

🔗 Xでの発表


ChatGPT VoiceがChat、Work、Codexを音声で操作

7月23日(21:43) — OpenAIは、ChatGPT Voiceのデスクトップアプリ(macOSとWindows)への登場を発表した。Plus、Pro、Business、Edu、Enterpriseプラン向けで、本日から世界展開が始まる。GPT-Liveによって動作し、この機能ではコンピュータの操作や複数エージェント――ChatGPT WorkやCodex――への指示を、音声だけで行える。モデルは話し、聞き、アプリ内で同時に作業を調整する。

ChatGPT Voice is now in the desktop app. Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. It’s powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans.

🇯🇵 ChatGPT Voice がデスクトップアプリで利用できるようになりました。音声だけで、あなたのコンピュータを操作し、ChatGPT Work や Codex で動作する複数のエージェントを指示できます。GPT-Live によって動作しているため、アプリ内で同時に話し、聞き、作業を調整できます。本日から macOS と Windows で、Plus、Pro、Business、Edu、Enterprise プラン向けに世界展開します。@OpenAI のX投稿

Codexの公式変更履歴(バージョン26.715)には、ツイートにはない詳細がある。macOSでは、「Screen context」オプションを使うと、音声会話中に最前面ウィンドウのスクリーンショットをChatGPTと共有できるため、ユーザーが音声で作業している内容をアシスタントが確認できる。さらに追補のツイートでは、ChatGPT VoiceはiOSアプリ内のCodexでも、ペアリングされたリモートアクセス経由で使えるとされている。Android対応は「近日対応予定」とだけ案内され、日付は示されていない。

🔗 Codexの変更履歴 — バージョン26.715


Claudeの音声モードも強化

7月23日 — AnthropicはClaudeの音声モードを更新し、すべてのプランで利用可能にした。これまでの軽量な専用モデルではなく、より高性能なOpusとSonnetを使うようになり、音声対話をより深く行える。

Voice mode now runs on Claude’s more capable models and reaches the tools you’ve connected mid-conversation. Talk through the hard problems out loud, in many more languages.

🇯🇵 音声モードは、これからClaudeの最も高性能なモデルで動作し、会話の途中で接続済みのツールにもアクセスできます。複雑な問題について、これまでよりずっと多くの言語で、声に出して考えましょう。@claudeai のX投稿

Claudeは、すでに接続されているアカウント内のツール(メッセージ、カレンダー)にも会話中にアクセスでき、会話を中断しない。音声モードはスペイン語、フランス語、ヒンディー語、日本語に対応し、本日からモバイル、デスクトップ、Webでパブリックベータとして利用可能になった。

🔗 関連ブログ記事


Codex:複数フォルダをまたぐプロジェクト

7月23日(22:31) — ChatGPT Voiceと同じリリース(Codex 26.715)で、CodexはChatGPTデスクトップアプリに複数フォルダ対応のローカルプロジェクトを導入した。これにより、ローカルプロジェクトは複数のフォルダにまたがるコード、ドキュメント、参考ファイルをまとめられるようになった。Codexは全体を通して読み書きできる一方、主要フォルダはGitのルートとして維持される。

プロジェクトのメニューからは、**「Edit project」**オプションでフォルダを追加し、主要フォルダを指定できる。新しいチャット、Git操作、AGENTS.mdの自動検出、skills、config.tomlファイルはすべて主要フォルダを使う。副次フォルダは、ファイル検索のために読み書き可能なまま残る。

🔗 Xでの発表


GitHubがIssuesを変更するエージェントを制御

7月23日 — GitHubは、GitHub Issues上でのエージェント自動化を制御するための一連のコントロールをパブリックプレビューで公開した。出発点となったのは、GitHub Agentic WorkflowsやCopilot cloud agentのようなエージェントが、issueのラベル付け、型指定、割り当て、クローズをますます自動で行っている一方で、チーム側がその理由を把握しづらく、簡単に主導権を保ちにくいという状況だった。

追加機能内容
承認自動化は実行ではなく 提案 にとどまり、変更は1件ずつまたは一括で承認待ちになる
信頼スコア各アクションに高・中・低の信頼度が付与され、高信頼度のみが自動適用される
理由各アクションは、適用済みか保留中かにかかわらず理由を記録し、確認可能な監査ログとなる

検索has:suggestionsでは、レビュー待ちの変更があるissueを見つけられる。管理者は、自動適用される内容を決める信頼度のしきい値を設定する。これらのコントロールは、GitHub Agentic Workflows(ワークフローのfrontmatterにissue-intents: trueを追加)と、Copilot cloud agent(更新不要)の両方で機能する。初期対応範囲は、REST APIとGraphQL APIを通じたラベル、カスタムフィールド、タイプ、クローズ、割り当てである。

GitHub自身が示した注意点として、承認は「ワークフローの利便性であり、セキュリティ制御ではない」とされる。つまり、サーバー側の障壁ではなく、必要な権限を持つエージェントであれば、提案ではなく直接変更を適用できる。GitHubが想定する活用例は、自動トリアージ、メタデータ強化、理由付きスパム検出などだ。

🔗 GitHubの変更履歴


GitHub MobileがCopilotでCI失敗を修正

7月23日 — GitHubは、すでにプルリクエストのコメントで利用できたFix with Copilot機能を、モバイルアプリ(iOSとAndroid)にも拡張した。これにより、GitHub Actionsのチェックがプルリクエスト上で失敗すると、GitHub Mobileから失敗したチェックに直接Fix with Copilotボタンが表示される。

ワンタップで、Copilot coding agentが失敗を解析し、既存のプルリクエストの上に修正案付きの新しいプルリクエストを開き、その後ユーザーにレビューを通知する。狙いは、作業環境に戻らなくても外出先でCI失敗に対応し、キーボードの前にいなくてもプルリクエストを前に進められるようにすることだ。

🔗 GitHubの変更履歴


Runwayが生成モデルの選択を自動化

7月23日 — Runwayは、Media Routerを公開した。これは「好みに最適化された」初のメディア生成ルーターだと説明されている。毎回どのモデルを使うか手動で選ぶ代わりに、ユーザーは一度だけ「最適」が意味するもの――コスト、品質、レイテンシ――を定義すればよく、ルーターが適切な動画・画像・音声モデルを自動で選択する。

この機能は、並行して公開されたRunway Devで今すぐ利用できる。これは新しいモデルではなくインフラの一部であり、複数のサードパーティ生成モデルをオーケストレーションし、コスト/品質/レイテンシの調整を自動化したい製品チームを対象としている。OpenRouterのようなLLMルーターに近い発想だが、対象が生成メディアになったものだ。

🔗 Xでの発表


HeyGenがHyperFramesを動画作成エージェントへ変える

7月23日 — HeyGenは、HyperFramesを、これまで一般には日次クリエイティブシリーズで知られていたものから、単なるHTMLレンダリングエンジンではなく中核製品へと押し上げた。新たにVideo AgentとしてHeyGenに直接統合されたのだ。仕組みは、ユーザーが作りたいものを説明すると、エージェントがアバター、グラフィック、字幕、音楽を含む動画全体を最初から最後まで構築し、しかも「無限にカスタマイズ可能」とされる。

この発表には、投稿への反応でHeyGenを1か月無料にする成長施策も伴い、数時間で110万回超の閲覧、810件の返信、788件のリポストを記録した。生成メディア分野のスキャン期間全体でも、群を抜いて最も多く見られた投稿だった。

開発者にとって注目すべき点として、HeyGenは消費者向け製品と並行して、HyperFrames自体をGitHubでオープンソース化した(リポジトリheygen-com/hyperframes、「HTMLを書け。動画を生成せよ。エージェント向けに設計。」と説明)。これにより、サードパーティのエージェントがHeyGenアプリの外でもHTMLから動画を生成できる。同じスレッドでは、新しい大規模動画翻訳APIも発表された(短報を参照)。つまり、HeyGenにとっては製品と開発者プラットフォームの両面で、1日で二重の動きがあったことになる。

🔗 主な発表


Cognitionが、メッセージの中で生きるエージェントPokeを買収

7月23日 — Cognition(Devin)は、The Interaction Company of Californiaの買収を発表した。同社は、ユーザーのメッセージ内に直接常駐する会話型パーソナルエージェントPokeの開発元だ。Cognitionの共同創業者兼CEOスコット・ウーが署名したブログ記事によると、彼自身とWalden(Cognitionの共同創業者)はInteractionの初期のエンジェル投資家であり、両チームはすでに同じ技術的賭け、すなわち「常時稼働」のクラウドエージェントを共有していた。

Poke is a personal agent that lives in your texts. It messages you first, follows up with you, and feels less like software and more like a friend. People have exchanged more than 100 million messages with it in just the last three months, and it’s the only AI agent approved to text natively on Apple Messages.

🇯🇵 Poke は、あなたのメッセージの中で生きるパーソナルエージェントです。最初に話しかけ、会話をつなぎ、ソフトウェアというより友人のように感じられます。この3か月だけで1億件を超えるメッセージがやり取りされ、Apple Messages でネイティブにメッセージ送信できる唯一のAIエージェントです。CognitionブログのScott Wu

ユーザーにとって当面は何も変わらない。Pokeはこれまで通り動作を続けるが、Cognitionは自社のモデルとインフラを投入して、Pokeを「より高速で、より信頼できるもの」にしたいとしている。この提携により、Cognitionは歴史的な中核事業である自律ソフトウェアエンジニアDevinを超え、一般消費者向けのパーソナルエージェントへと領域を広げることになる。これは同社にとって新たな戦略的軸だ。

🔗 Xでの発表


Cognitionがエネルギー省のGenesis Missionに参加

7月22日 — Cognitionは、米国エネルギー省(DOE)と覚書(MOU)を締結し、Genesis Mission に参加しました。これは2025年11月に大統領令で立ち上げられた国家イニシアチブで、「AIのためのアメリカ版マンハッタン計画」と位置づけられています。米国の17の国立研究所、産業界、学術界を結集し、国内で最も強力なスーパーコンピューターと連邦政府の最大規模の科学データセットを接続することで、10年で米国の科学研究生産性を倍増させることを掲げています。これによりCognitionは、Google DeepMind、OpenAI、Arcee AIに続く参加企業となりました。これらの同ミッションへの参加は、すでに前日の7月22日に報じられています。

取り組みの軸Devin(Cognition)の貢献
ソフトウェアとデータの安全性科学系コードベースの脆弱性を見つけて修正する
レガシーコードのモダナイゼーション古いコード(Fortran、C++、COBOL)の文書化、テスト、翻訳
研究能力の拡張データパイプライン、インフラ、デプロイを委任する
クラウドのモダナイゼーションレガシーアプリケーションをクラウドネイティブなプラットフォームへ移行する

記事によると、Cognitionのプラットフォームは現在 FedRAMP Class D(High) の認証取得中であり、Devin Desktop と Devin CLI はすでにこの水準で認証済みかつ ITAR/IL4-IL6 準拠です。また、Devin はすでに米陸軍、米海軍、NASAのジェット推進研究所で使用されています。参加の一環として、Cognitionは国立研究所向けにコードのセキュリティスキャンと是正レポートを無償提供し、さらにGenesis Missionの公募を通じて選定されたチームに対して追加のコンピュートも提供するとしています。

🔗 Cognitionブログでの発表


コードツールが加速

今週は、AI支援開発ツールに関して、価格、機能、イベント駆動の自動化にまたがる5件の注目すべき更新がありました。

Cursorが利用上限を倍増

7月21日 — Cursorは、個人向けおよびTeams向けの全プランに含まれる利用上限を倍増しました(Enterpriseは対象外で、言及なし)。この変更は Grok(xAI)と Composer(Cursorの独自モデル)、および今後登場するすべてのCursorモデルに適用され、料金の変更は「倍増」以外には発表されていません。投稿は大きな反応を呼び、数時間で約1,000件のリポストと1万件のいいねを記録しました。コミュニティの非常に好意的な受け止めを示すものです。この発表は、前日に公開された Cursor Router とは別のものです。

🔗 Xでの発表

Replitがホスティング価格を半額超に引き下げ

7月23日 — Replitは、大規模公開アプリのホスティング価格を50%超引き下げる大幅な価格改定を発表しました。適用開始は2026年8月1日です。公開済みアプリはすべて Replit Cloud 上で動作し、利用量に応じた自動スケーリング、認証、安全なデータベース、内蔵の分析とSEOが含まれます。新料金は、ユーザー側の対応なしに、次回の月次請求サイクルから自動的に全ユーザーへ適用されます。

🔗 Xでの発表

Zed 1.12:Git Panelと複数選択

7月22日 — Zedは安定版 1.12 をリリースしました。Gitパネルには「Staged」と「Unstaged」の独立したセクションが追加され、どちらかのグループ内の項目をクリックすると対応するマルチバッファが開きます。File Finder と Text Finder でも複数選択が可能になり、macOSでは cmd-クリック、Linux/Windowsでは ctrl-クリック、または tab を使って複数ファイルを一度に開けます。最初にスレッドで言及されていたCSVフィルタリングは、Zedの修正により最終的に削除されました。同機能は実際にはまだ公開されていないと明言されています。

🔗 Xでの発表

v0:スラッシュコマンド、Shopifyを全員に、Snowflakeの信頼性

7月21日 — v0(Vercel)は スラッシュコマンド を追加しました。コンポーザーで / と入力すると、skills.sh を通じてキーボードから手を離さずにスキル(skill)を追加するメニューが開きます。Shopify 連携は、商品、価格、在庫をリアルタイムで読み取るECストアフロントを生成でき、現在は全ユーザーに開放されています。Snowflake 向けの信頼性改善では、直近のデプロイ以降のコード変更を検出し、生成結果をフェイクデータではなく接続済みアカウントへ誘導します。

🔗 v0の変更履歴

Amp:orbが外部イベントに反応

7月23日 — Ampの「orbs」(遠隔エージェント向けのクラウドサンドボックス)は、新しい webhook API(amp.createWebhook)を通じて外部イベントで起動できるようになりました。GitHubでのCI失敗、Linearの新規issue、監視アラート、Discordメッセージなどが対象です。Ampは提供元の署名を検証し、配信を重複排除します。外部イベントは信頼できないデータとして扱われ、エージェントへの直接命令として解釈されることはありません。挙げられている使用例としては、mainブランチ上のCI失敗をすべて調査して結果をSlackに投稿する、または依存関係の新バージョンを監視して更新用のpull requestを自動で開く、などがあります。

🔗 Ampの発表


サイバー防御:GeminiとHugging Faceが防御側を強化

この期間の2件の別々の発表はいずれも、ソフトウェア脆弱性に対して防御側のツールをより強化する必要性に収束しています。

Gemini 3.5 Flash Cyberは脆弱性の72%を検出

7月23日 — 7月21日のまとめ発表(Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber)に続き、Google DeepMindは Gemini 3.5 Flash Cyber に特化したスレッドを公開し、脆弱性の発見と修正に特化した軽量モデルについて数値ベンチマークを示しました。

テスト対象モデル検出率
Gemini 3.5 Flash Cyber72 %
Gemini 3.5 Flash(標準)55 %
Claude Opus 4.6 (Anthropic)54 %

このテストは「Chrome Production Commit Scanning Pipeline」と名付けられ、ChromeAndroid の実際のコードベースで実施されました。そこでは、標準モデルが見逃した複雑な脆弱性をこのモデルが検出しています。利用可能性は引き続き限定アクセスのパイロットであり、政府および信頼できるパートナーに限られます。Googleはこれを「責任ある展開」の一環として位置づけています。

🔗 @GoogleDeepMind のスレッド

The Stack v3、サイバー防御のためのオープンソース燃料

7月23日 — Hugging Face の Research責任者 Leandro von Werra は、組織 HuggingFaceCode のコードデータセットの新世代である The Stack v3 を発表しました(StarCoderモデルの元になったものです)。5,000億トークン が学習可能な状態で提供され、120TBの生データ、700以上のプログラミング言語、ODC-BYライセンスの下で公開されます。発信のトーンは明確に防御志向で、von Werra は「サイバー防御のための良質なオープンコードモデル」が緊急に必要だとして公開を正当化し、前日にSakana AIが発表した Fugu-Cyber に呼応する形となっています。

🔗 Xでの発表


Together AIとNVIDIAが推論とfine-tuningを支援

Together AIが推論プラットフォームの新世代を発表

7月23日 — Together AI は、オープンウェイトモデル向け推論プラットフォームを再設計した Together Dedicated Model Inference を発表しました。内容は、安定したエンドポイントの背後での複数デプロイ、セキュアなロールアウト(canary、blue-green、rolling と自動 rollback)、実運用トラフィックでのA/Bテストと「shadow traffic」、新しいキャッシュ層によるおよそ4倍高速な起動(Kimi K2.7、MiniMax M3、GLM 5.2 のような境界MoEモデルは7〜14分でデプロイ)、そして production への checkpoint 直結デプロイを伴うカスタム fine-tuning のクローズドβ(RL full-weight、LoRA、SFT)です。紹介ウェビナーは8月6日に予定されています。

🔗 Xでの発表

NVIDIA:5ドル未満のRL fine-tuning

7月23日 — NVIDIAは、Prime Intellect Lab と共同で実施した Nemotron 3 Nano 上の強化学習による fine-tuning のデモを紹介しました。数学タスクで精度が22%から91%へ向上し、費用は5ドル未満でした。ベースライン、報酬が収束するまでの学習、検証の再テストという完全なフローの最後には、ダウンロード可能な LoRA アダプタが生成され、設定ファイルの1行を変えるだけで Nemotron 3 Super と Ultra にも適用できます。

🔗 Xでの発表


Gemini NotebookがCollectionsでノートブックを整理

7月20日 — Gemini Notebook(旧NotebookLM)は、フォトアルバムやプレイリストのようにノートブックを整理するための新しいタブ Collections を導入しました。従来のフォルダ階層ではなく、固定的な構造はありません。1つのノートブックを好きなだけ多くのコレクションに属させることも、どれにも属させないこともできます。

これは実際にリリースされた機能であり、製品内で見える新しいタブです。単なる予告ではありません。この投稿は厳密なスキャン期間の前日付ですが、それまで未回答だったユーザーからの継続的な要望に応えるものでした。

🔗 @Gemini_Notebook の固定投稿


xAIとQwenが提供範囲を拡大

Grok 4.5が一般向けの全画面で利用可能に

7月22日 — xAIは、Grok 4.5 が Grok の一般向けの全画面で利用可能になったと発表しました。対象は grok.com、X、iOSおよびAndroidアプリです。モデルは引き続き、xAIのMicrosoft 365アドインを通じて Word、Excel、PowerPoint、Outlook からも利用できます。これは新モデルの発表ではありません。旗艦ローンチはすでに7月8日に報じられており、ヨーロッパでの完全提供は7月16日に報じられていました。今回の発表は展開の最終段階であり、モバイルと一般向けサイトへの実装切り替えです。

🔗 公式発表

GrokがMicrosoft Outlookに登場

7月21日 — xAIは、Grok for Outlook により Grok の Microsoft 365 連携を拡張しました。これは長いスレッドを要約し、ユーザーの文体に合わせて返信を下書きし、完了した会話をアーカイブし、返信待ちのものを示すエージェントです。明示的な確認なしに送信されることはありません。本日より、Xの有料会員と SuperGrok の契約者は Microsoft Marketplace を通じて利用できます。このモジュールは、すでに提供されている Word、Excel、PowerPoint 向けのものに加わります。

🔗 公式発表

Qwen CloudがToken Plan Individualを開始

7月21日 — Qwen Cloud は、Token Plan Individual を開始しました。月額6ドルからのサブスクリプションで、Qwenファミリーに加え GLM と DeepSeek にも使える統合クレジットプールにアクセスでき、Qwen3.8-Max-Preview への先行アクセスも含まれます(このモデルは7月19日にすでに報じられています)。プロモーション用インフォグラフィックでは、3段階の価格帯(Lite / Standard / Pro)、オフピーク時間帯の割引、最大8体のエージェントを同時に稼働させられるプールが詳しく示されています。

🔗 Xでの発表


AnthropicがAIの経済的未来に2億ドルを投資

7月22日 — Anthropicは、AIがもたらす経済的影響に社会を備えさせる介入策について、野心的な外部研究を資金支援するための2億ドル規模の Economic Futures Research Fund の研究アジェンダを公開しました。優先される5つの軸は、労働者への影響、職業移行支援、所得補填制度の近代化、AI関連成長の共有メカニズム(事前分配型の資本口座)、および公共投資に関する新しいデータです。

Anthropicは主として500万〜3,000万ドル規模のプロジェクトを支援する予定で、対象は大学、独立系研究機関、非営利組織であり、個人研究者は対象外です。この基金は、1年前に始まった「Economic Futures」プログラムを発展させたもので、多数の小規模助成ではなく、より少数の大型助成に焦点を移しています。

🔗 公式発表


短報

  • AnthropicがPublic First Actionへの支援を倍増(追加2,000万ドル) — AI課題に関する公共教育を行うこの非党派組織への総支援額は4,000万ドルに拡大。これらの寄付は教育と公共政策のミッションのみに使われ、選挙支援には使われません。🔗 出典
  • Claude Code:skillsで構築する検証ループのガイド — 手動チェックをClaude Codeのskillsに変換し、Claude自身に検証をループさせる方法。🔗 出典
  • Outtakeの事例研究:Claude上に構築したサイバー調査エージェント — Outtakeが数時間にわたるセッションで攻撃ネットワークをマッピングする方法。🔗 出典
  • Cognition — DeepWikiの索引済みリポジトリ数が50万を突破 — AI生成のコード文書化ツール、無料。LangChainとのミートアップが7月28日にサンフランシスコで予定されています。🔗 出典
  • ReplitがFirecrawl連携を強調 — アプリ向けのWebコンテキストをワンクリックで取得でき、最初のユーザーには1万クレジットが提供されます。🔗 出典
  • Hugging FaceがNunchaku(SVDQuant)をDiffusersにネイティブ統合 — 4bit量子化チェックポイント(重みと活性化)は、今後 from_pretrained() 経由で読み込まれ、別の推論ライブラリは不要になります。🔗 出典
  • Together AIがKimi K3(Moonshot AI)を7月27日のローンチ当日からホスト予定 — 推論は「day zero」で利用可能で、ベンチマークは実際の公開後に発表されます。🔗 出典
  • Gemini CLI v0.52.0 — triage と egress のサービス、write_file/replace における JSON/IPYNB のLLM修正回避、google-auth-library を10.9.0へ更新。🔗 出典
  • GitHub — ProjectsとIssuesの複数選択フィールド — カスタムフィールドに一度に複数の値(チーム、モジュール、カテゴリ)を入れられるようになりました。🔗 出典
  • HeyGen — 大規模動画翻訳API — 1本の動画シリーズを24時間未満で10言語版に複製でき、バッチ処理に対応。🔗 出典
  • Codex Sites Analyticsがパブリックテストへ — Codexで公開されたサイト向けの基本的なパフォーマンス指標。🔗 出典
  • OpenAIが「ChatGPT for small businesses」プログラムを開始 — ChatGPT Workのウェビナー、米国のAI academies、Dropbox、Shopify、Intuit、Slack、Atlassian、Wixとの提携。🔗 出典
  • David Vélez(Nubank)とRobin Vince(BNY)がOpenAIの取締役会に参加 — OpenAI Foundation と OpenAI Group PBC がこの2人の幹部を迎えます。🔗 出典
  • Cohereがアラビア語AIに向けてHUMAINとの提携を発表 — Cohere Transcribe Arabic の成功を受けたものですが、現時点で製品名や日程はまだ明示されていません。🔗 出典

それが意味するもの

音声は、同じ日に、別々の2つの企業で、完全な操作インターフェースとして定着しつつある。ChatGPT Voice はデスクトップに登場し、GPT-Live によって、キーボードなしで Chat、Work、Codex を操作できるようになる。一方 Claude は、最も高性能なモデル上で音声モードを稼働させ、会話の途中で接続済みツールにアクセスできるようにする。これら2つの発表は独立しているが、日付が重なったのはおそらく偶然ではない。それは同じ賭けを示している――音声会話が、質問に答えるだけの単なるアシスタント機能ではなく、エージェントや接続ツールを通じて実際のアクションを引き起こせる、完全な仕事のチャネルになるという賭けだ。

エージェントをどう囲い込むかは、それを動かすこととは別の、独立した重要テーマになりつつある。GitHub は、Issues に対してエージェントが自律的に適用する変更に、承認、信頼スコア、そして理由付けを導入した――ただし同社自身が、これを「セキュリティ制御ではない」と明言し、あくまでワークフロー上の利便性だと位置づけている。Runway は一方で、競合する生成モデル間に自動的な裁定レイヤー(コスト、品質、レイテンシー)を追加した。共通点は、エージェントの自律性が高まるほど、各社は能力を積み上げるだけでなく、ガバナンスと制御の層を追加していることだ。これは Codex のマルチディレクトリ・プロジェクトにも見られる動きで、エージェントがより広い範囲で作業しつつも、正本となるルート――つまり主要な Git ディレクトリ――の概念を失わないように設計されている。

サイバー防御は、大手 AI プレイヤー同士の明確な競争軸として打ち出されている。Gemini 3.5 Flash Cyber は、Chrome と Android の実運用コードベースに対して 72% の脆弱性検出率をうたっており、自社の標準モデルの 55%、そして Google が名指しした Claude Opus 4.6 の 54% を上回る――このような直接比較はかなり珍しく、注目に値する。同じ日、Hugging Face は 5 兆トークン規模のコードデータセット The Stack v3 を公開し、その理由として「サイバー防御のための良いオープンコードモデルが必要だから」と明示した。これら2つの独立した発表は、ソフトウェア脆弱性が大規模に悪用されることへの共通の懸念と、それに対する対称的な応答――片方では専門特化したクローズドモデル、もう片方ではそれを訓練するためのオープンデータ――を示している。

Cognition は、たった1週間で活動領域を両方向に広げた。Poke の買収により、ユーザーのメッセージ内で動作し、3か月で1億件超のメッセージをやり取りした個人向けエージェントを取り込み、同社の重心は、自律型ソフトウェアエンジニアである Devin だけでなく、一般向けエージェントへと移った。同時に、米国エネルギー省との Genesis Mission に関する覚書により、同社は Google DeepMind、OpenAI、Arcee AI――いずれも7月22日以降この同じ инициативに関与している――と並び、米国の公共科学研究に食い込むべく、今や4者競争の一角に加わった。2つの動きに共通するのは、単一セグメントにとどまるのではなく、一般向け市場と制度的インフラの両方で地位を固めるという同じ論理だ。


ソース