ai-powered-markdown-translatorgpt-5.4-mini로 fr에서 ko로 번역된 기사.
2026년 7월 23일에는 OpenAI가 미국에서 ChatGPT의 Health를 배포하고 데스크톱 애플리케이션에 ChatGPT Voice를 도입했으며, Black Forest Labs가 FLUX 3에서 이미지, 비디오, 오디오, 행동 예측을 통합했고, GitHub는 Issues에서 에이전트가 단독으로 무엇을 수정하는지 처음으로 제어하기 시작했으며, HeyGen은 HyperFrames 프레임워크를 완전한 비디오 제작 에이전트로 바꾸었고, Cognition은 Poke 인수와 미국 에너지부와의 양해각서를 통해 영향력을 넓혔습니다. 이 일곱 가지 주제를 둘러싸고 Claude의 음성 모드부터 Gemini와 Hugging Face의 사이버 방어에 이르기까지, 코드 도구(Cursor, Replit, Zed, v0, Amp)와 관련된 것들을 포함한 18개의 주목할 만한 소식이 이어집니다.
Health in ChatGPT가 미국에 도착
7월 23일 — OpenAI가 Health in ChatGPT를 미국 내 연결된 사용자에게 배포합니다. 대상은 18세 이상이며, 웹과 iOS에서 Free, Go, Plus, Pro 요금제에 제공됩니다. 이 기능은 Apple Health와 지원되는 의료 기록(미국 병원 시스템, One Medical, Function Health)을 안전하게 연결할 수 있게 하며, 이를 통해 ChatGPT가 사용자 건강 맥락을 파악합니다. 예를 들어 검사 결과를 이전 검사와 비교하거나, 마지막 진료 이후 무엇이 달라졌는지 요약하거나, 수면과 활동을 일상 루틴과 함께 교차해 볼 수 있습니다.
OpenAI는 한 가지 수치를 강조합니다. 매주 3억 명이 넘는 사람들이 ChatGPT에 건강 관련 질문을 한다는 것입니다. 회사는 정밀도, 안전성, 그리고 전문 진료가 필요한 상황의 인식을 측정하고 개선하기 위해 수백 명의 의사와 협력하고 있다고 밝힙니다. 모델 측면에서는 무료 플랜용 GPT-5.5 Instant가 모든 사용자에게 공통 기반을 제공하고, 유료 플랜용 GPT-5.6 Sol은 복잡한 질문에서 더 나은 성능을 보입니다. 의사들과 함께 개발한 평가인 HealthBench Professional에서 모든 GPT-5.6 모델은 GPT-5.5를 능가합니다.
개인정보 보호에 대해 OpenAI는 분명히 밝힙니다. 연결된 의료 기록과 Apple Health 데이터, 그리고 이를 사용하는 대화는 모델 학습이나 광고 타기팅에 절대 사용되지 않으며, 다른 학습 설정이 무엇이든 동일합니다. 기본적으로 ChatGPT는 이러한 데이터의 사용마다 허가를 요청하며, 계정을 연결 해제하면 동기화된 데이터는 30일 이내에 삭제됩니다. 주목할 점은 Health가 Codex에서는 제공되지 않는다는 것입니다. 올해 초의 첫 버전은 이런 교류를 전용 공간에만 국한했지만, 건강 관련 대화의 70% 이상이 다른 곳에서 이루어졌기 때문에 전체 대화 환경에 네이티브로 통합되었습니다.
FLUX 3: Black Forest Labs가 이미지, 비디오, 오디오, 행동 예측을 통합
7월 23일 — 이미지 모델로 알려진 FLUX의 제작사 Black Forest Labs(BFL)가 FLUX 3를 발표했습니다. 이번 모델은 나중에 따로 조립한 개별 모델이 아니라, 통합된 아키텍처에서 학습된 단일 멀티모달 모델로 소개됩니다. 회사는 이전 세대에 비해 모든 스타일에서 “현실에 더 충실한” 렌더링을 강조합니다.
| 포함된 모달리티 | 7월 23일 기준 상태 |
|---|---|
| 이미지 | 사용 가능 |
| 비디오 (FLUX 3 Video) | 조기 액세스, 오늘부터 사용 가능 |
| 오디오 | 통합 아키텍처에 포함 |
| 행동 예측 | mimic 및 Audi와 함께 로봇 작업 진행 중 |
이번 출시를 구분 짓는 요소는 두 가지입니다. 첫째, FLUX 3 Video는 BFL의 역사적 범위를 기존의 정지 이미지 중심에서 비디오로 확장합니다. 이는 지금까지 Runway, Luma, Kling, Wan 등이 주도하던 영역입니다. 둘째, BFL은 모델의 통합 아키텍처를 물리적 행동 예측으로 확장할 수 있다고 밝혔으며, mimic(원격조작 및 로봇 학습 전문 기업)과 Audi와의 협업으로 관련 작업을 진행 중이라고 전했습니다. 이는 BFL을 NVIDIA가 Cosmos와 Isaac에 대규모로 투자하며 밀고 있는 물리 AI 분야에 한층 더 가깝게 만듭니다.
발표 게시물은 몇 시간 만에 39만 3천 회가 넘는 조회수를 기록했으며, 후속 스레드에서는 최초의 FLUX 3 Image 샘플이 공개되었습니다. 하나의 모델로 네 가지 모달리티를 처리하고 로봇공학까지 향하는 이 출시는, 생성 미디어 분야에서 이번 기간 가장 눈에 띄는 모델 런칭입니다.
🔗 X의 발표
ChatGPT Voice가 Chat, Work, Codex를 음성으로 제어
7월 23일(21:43) — OpenAI가 ChatGPT Voice의 데스크톱 애플리케이션(macOS 및 Windows) 출시를 발표했습니다. 대상은 Plus, Pro, Business, Edu, Enterprise 요금제이며, 오늘부터 전 세계에 배포됩니다. GPT-Live로 구동되는 이 기능은 오직 음성만으로 컴퓨터를 제어하고 여러 에이전트 — ChatGPT Work 또는 Codex — 를 지시할 수 있게 합니다. 모델은 말하고, 듣고, 애플리케이션 안에서 작업을 동시에 조율합니다.
ChatGPT Voice is now in the desktop app. Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. It’s powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans.
🇰🇷 이제 ChatGPT Voice를 데스크톱 애플리케이션에서 사용할 수 있습니다. 컴퓨터를 제어하고 ChatGPT Work 또는 Codex에서 실행 중인 여러 에이전트를 오직 음성만으로 지시하세요. 이는 GPT-Live로 구동되며, GPT-Live는 애플리케이션 안에서 동시에 말하고, 듣고, 작업을 조율할 수 있습니다. 오늘부터 macOS와 Windows에서 Plus, Pro, Business, Edu, Enterprise 요금제에 전 세계적으로 배포됩니다. — @OpenAI X에서
공식 Codex 변경 로그(26.715 버전)에는 트윗에 없는 세부 사항이 하나 더 있습니다. macOS에서는 “Screen context” 옵션을 통해 음성 대화 중에 최전면 창의 스크린샷을 ChatGPT와 공유할 수 있어, 사용자가 말로 작업할 때 어시스턴트가 무엇을 보고 있는지 알 수 있습니다. 후속 트윗에서는 ChatGPT Voice가 iOS 앱의 Codex에서도 페어링된 원격 접속을 통해 사용 가능하며, Android 지원은 날짜 없이 “추후 제공”이라고 밝혔습니다.
Claude의 음성 모드도 강화되다
7월 23일 — Anthropic이 모든 요금제에서 사용할 수 있는 Claude의 음성 모드를 업데이트합니다. 이제 더 가벼운 전용 모델이 아니라 Opus와 Sonnet 같은 더 강력한 모델을 기반으로 하여, 음성 대화를 더 깊이 있게 이어갈 수 있습니다.
Voice mode now runs on Claude’s more capable models and reaches the tools you’ve connected mid-conversation. Talk through the hard problems out loud, in many more languages.
🇰🇷 이제 음성 모드는 Claude의 가장 강력한 모델로 작동하며, 대화 도중 연결한 도구에도 접근할 수 있습니다. 훨씬 더 많은 언어로 복잡한 문제를 말로 정리해 보세요. — @claudeai X에서
이제 Claude는 대화를 방해하지 않고 계정에 이미 연결된 도구(메시징, 캘린더 등)에도 접근할 수 있습니다. 음성 모드는 스페인어, 프랑스어, 힌디어, 일본어를 지원하며, 오늘부터 모바일, 컴퓨터, 웹에서 공개 베타로 제공됩니다.
🔗 관련 블로그 글
Codex: 여러 폴더를 가로지르는 프로젝트
7월 23일(22:31) — ChatGPT Voice와 같은 릴리스에 포함된 Codex 변경 로그 26.715에서, Codex는 ChatGPT 데스크톱 앱에 다중 폴더 로컬 프로젝트를 도입합니다. 이제 로컬 프로젝트는 여러 폴더에 분산된 코드, 문서, 참조 파일을 하나로 묶을 수 있으며, Codex는 전체를 가로질러 읽고 쓸 수 있습니다. 한편 기본 폴더는 Git 루트로 유지됩니다.
프로젝트 메뉴에서 “Edit project” 옵션을 통해 폴더를 추가하고 기본 폴더를 지정할 수 있습니다. 새 채팅, Git 작업, AGENTS.md 자동 검색, skills, 그리고 config.toml 파일은 모두 기본 폴더를 사용하며, 보조 폴더는 파일 검색을 위해 읽기와 쓰기 모두 가능합니다.
🔗 X의 발표
GitHub가 Issues를 수정하는 에이전트를 관리한다
7월 23일 — GitHub가 GitHub Issues에서 에이전트 자동화를 관리하기 위한 제어 기능 모음을 공개 프리뷰로 출시했습니다. 출발점은 다음과 같습니다. GitHub Agentic Workflows와 Copilot cloud agent 같은 에이전트가 이슈에 자동으로 라벨을 붙이고, 유형을 지정하고, 할당하고, 닫는 일이 점점 늘고 있지만, 팀은 왜 그런 일이 일어났는지 항상 알 수 없고 이를 쉽게 통제하지도 못한다는 점입니다.
| 추가된 기능 | 하는 일 |
|---|---|
| 승인 | 자동화가 적용하지 않고 제안만 하며, 변경 사항은 하나씩 또는 일괄로 검토 승인을 기다림 |
| 신뢰도 점수 | 각 작업에 높음 / 보통 / 낮음 신뢰도가 부여되며, 높음만 자동 적용됨 |
| 근거 | 각 작업의 이유가 적용 또는 대기 상태로 기록되어 검토 가능한 감사 추적 제공 |
has:suggestions 검색은 검토 대기 중인 변경 사항이 있는 이슈를 찾습니다. 관리자는 자동 적용 대상을 결정하는 신뢰도 임계값을 설정할 수 있습니다. 이 제어 기능은 GitHub Agentic Workflows(issue-intents: true를 workflow frontmatter에 추가)와 Copilot cloud agent(업데이트 불필요) 모두에서 작동합니다. 출시 시점에 포함되는 작업은 라벨, 사용자 정의 필드, 유형, 닫기, 할당이며, REST 및 GraphQL API를 통해 제공됩니다.
GitHub가 직접 밝힌 주의점도 있습니다. 승인 기능은 “보안 통제가 아니라 워크플로 편의 기능”으로 제시되며, 서버 측 장벽을 강제하지 않기 때문에 필요한 권한을 가진 에이전트는 여전히 제안을 건너뛰고 직접 변경을 적용할 수 있습니다. 강조된 사용 사례는 자동 분류, 메타데이터 보강, 근거가 포함된 스팸 탐지입니다.
GitHub Mobile이 Copilot으로 CI 실패를 수정한다
7월 23일 — GitHub가 이미 pull request 댓글에서 제공되던 Fix with Copilot 기능을 모바일 애플리케이션(iOS 및 Android)으로 확장합니다. 이제 GitHub Actions 체크가 pull request에서 실패하면, GitHub Mobile의 실패한 체크에 바로 Fix with Copilot 버튼이 나타납니다.
한 번의 조작으로 Copilot coding agent가 실패를 분석하고, 기존 pull request 위에 제안된 수정 사항이 담긴 새 pull request를 열며, 검토를 위해 사용자에게 알립니다. 목표는 이동 중에도 CI 실패에 대응하고, 책상으로 돌아가지 않아도 pull request가 계속 진행되도록 하는 것입니다.
Runway가 생성 모델 선택을 자동화하다
7월 23일 — Runway가 선호도에 맞춰 최적화된 최초의 미디어 생성 라우터라고 설명하는 Media Router를 출시합니다. 요청마다 모델을 수동으로 고르는 대신, 사용자는 한 번만 “최적”의 의미를 비용, 품질, 지연 시간 중에서 정의하면 라우터가 적절한 비디오, 이미지 또는 오디오 모델을 자동으로 선택합니다.
이 기능은 병행 출시된 개발자 플랫폼 Runway Dev에서 지금 바로 사용할 수 있습니다. 이는 새로운 모델이라기보다 인프라 구성 요소에 가깝습니다. 여러 타사 생성 모델을 조율하고 비용/품질/지연 시간의 절충을 자동화하려는 제품 팀을 겨냥하며, 생성 미디어에 적용된 LLM 라우터(OpenRouter 계열)와 유사한 접근입니다.
🔗 X의 발표
HeyGen이 HyperFrames를 비디오 제작 에이전트로 바꾸다
7월 23일 — HeyGen이 대중에게는 일일 창작 시리즈로 더 잘 알려진 HyperFrames를 단순한 HTML 렌더링 엔진에서 핵심 제품으로 끌어올려, HeyGen에 직접 통합된 Video Agent로 전환합니다. 원리는 간단합니다. 사용자가 원하는 내용을 설명하면, 에이전트가 아바타, 그래픽, 자막, 음악까지 포함한 전체 비디오를 처음부터 끝까지 구성하며, 모두 “무한히 커스터마이즈 가능”하다고 소개됩니다.
출시와 함께 진행된 바이럴 성장 캠페인(게시물에 반응하면 HeyGen 한 달 무료 제공)은 몇 시간 만에 110만 회 이상의 조회수, 810개의 답글, 788회의 재게시를 기록했으며, 생성 미디어 분야의 이번 스캔 기간 전체를 통틀어 가장 많이 본 게시물이 되었습니다.
개발자에게 흥미로운 점은, 소비자용 제품과 병행해 HeyGen이 GitHub에 HyperFrames 자체를 오픈소스로 공개했다는 사실입니다(저장소 heygen-com/hyperframes, 설명: “HTML을 작성하세요. 비디오를 생성하세요. 에이전트를 위해 설계되었습니다.”). 이를 통해 제3자 에이전트가 HeyGen 앱 밖에서도 HTML로부터 비디오를 생성할 수 있습니다. 같은 스레드에서는 대규모 비디오 번역 API도 발표되었습니다(브리프 참조). 즉, HeyGen은 하루 만에 제품과 개발자 플랫폼 양쪽 모두를 움직인 셈입니다.
🔗 주요 발표
Cognition이 메시지 속에서 살아가는 에이전트 Poke를 인수하다
7월 23일 — Cognition(Devin)이 사용자 메시지 안에서 직접 작동하는 대화형 개인 에이전트 Poke의 배포사인 The Interaction Company of California 인수를 발표합니다. Cognition의 CEO이자 공동창업자인 Scott Wu가 서명한 글에 따르면, 그와 Walden(Cognition 공동창업자)은 Interaction의 초기 엔젤 투자자였고, 두 팀은 이미 동일한 기술적 전제 — 항상 켜져 있는 클라우드 에이전트 — 를 공유하고 있었습니다.
Poke is a personal agent that lives in your texts. It messages you first, follows up with you, and feels less like software and more like a friend. People have exchanged more than 100 million messages with it in just the last three months, and it’s the only AI agent approved to text natively on Apple Messages.
🇰🇷 Poke는 여러분의 메시지 안에서 살아가는 개인 에이전트입니다. 먼저 말을 걸고, 대화를 이어가며, 소프트웨어라기보다 친구처럼 느껴집니다. 지난 3개월 동안에만 1억 회가 넘는 메시지가 오갔고, Apple Messages에서 기본적으로 메시지를 보낼 수 있도록 허용된 유일한 AI 에이전트입니다. — Cognition 블로그의 Scott Wu
사용자 입장에서는 당장 달라지는 점이 없습니다. Poke는 이전과 같이 계속 작동하지만, Cognition은 자사의 모델과 인프라를 적용해 Poke를 “더 빠르고 더 안정적”으로 만들겠다고 밝혔습니다. 이번 결합은 Cognition을 역사적 핵심 사업인 자율 소프트웨어 엔지니어 Devin을 넘어, 일반 소비자용 개인 에이전트 영역으로까지 확장하며, 회사에 새로운 전략 축을 제시합니다.
🔗 X의 발표
Cognition이 에너지부의 Genesis Mission에 합류
7월 22일 — Cognition은 미국 에너지부(DOE)와 양해각서(MOU)를 체결하고 Genesis Mission에 합류했다. 이 이니셔티브는 2025년 11월 대통령 행정명령으로 출범한 국가적 사업으로, “AI를 위한 미국의 맨해튼 프로젝트”로 소개된다. 이는 미국의 17개 국립연구소, 산업계, 학계를 동원해 국내에서 가장 강력한 슈퍼컴퓨터를 연방 과학 데이터셋과 연결하고, 10년 안에 미국 과학 연구 생산성을 두 배로 끌어올리겠다는 목표를 내세운다. Cognition은 이렇게 Google DeepMind, OpenAI, Arcee AI에 합류했으며, 이들 역시 같은 미션 참여가 전날인 7월 22일 이미 보도된 바 있다.
| 참여 축 | Devin(Cognition)의 기여 |
|---|---|
| 소프트웨어 및 데이터 보안 | 과학 코드베이스의 취약점을 찾아 수정 |
| 레거시 코드 현대화 | 문서화, 테스트, 오래된 코드(Fortran, C++, COBOL) 번역 |
| 연구 역량 확장 | 데이터 पाइ프라인, 인프라, 배포 위임 |
| 클라우드 현대화 | 레거시 애플리케이션을 클라우드 네이티브 플랫폼으로 마이그레이션 |
게시물에 따르면 Cognition의 플랫폼은 현재 FedRAMP Class D(High) 인증 절차를 진행 중이며, Devin Desktop과 Devin CLI는 이미 이 수준으로 인증되었고 ITAR/IL4-IL6을 준수한다. 또한 Devin은 이미 미 육군, 미 해군, NASA 제트추진연구소에서 사용되고 있다. 참여의 일환으로 Cognition은 국립연구소를 위해 코드 보안 스캔과 시정 보고서를 무상으로 제공하고, Genesis Mission의 프로젝트 공모를 통해 선정된 팀에는 추가 컴퓨트도 제공한다.
코드 도구가 가속화되고 있다
이번 주에는 AI 지원 개발 도구 전반에 걸쳐 가격, 기능, 이벤트 자동화와 관련된 다섯 가지 주목할 만한 업데이트가 있었다.
Cursor가 사용 한도를 두 배로 늘린다
7월 21일 — Cursor는 Enterprise를 제외한 모든 개인 및 Teams 요금제의 포함 사용 한도를 두 배로 늘린다. 이 조치는 Grok(xAI)과 Composer(Cursor의 자체 모델) 모델은 물론 향후 출시될 모든 Cursor 모델에 적용되며, 추가 요금 인상 없이 단순히 “두 배”로만 조정된다. 해당 게시물은 큰 반응을 얻어 몇 시간 만에 약 1,000회 리포스트와 10,000개의 좋아요를 기록했으며, 커뮤니티의 매우 긍정적인 반응을 시사한다. 이번 발표는 전날 공개된 Cursor Router와는 별개의 내용이다.
🔗 X에서 공지
Replit, 호스팅 가격을 절반 이상 인하
7월 23일 — Replit은 대규모로 게시된 애플리케이션 호스팅 가격을 2026년 8월 1일부터 50% 이상 인하한다고 발표했다. 게시된 모든 앱은 Replit Cloud에서 실행되며, 사용량에 따른 자동 스케일링, 인증, 보안 데이터베이스가 포함되고 분석 및 SEO도 내장된다. 새로운 요금은 다음 월 청구 주기부터 모든 사용자에게 자동 적용되며, 별도 조치는 필요 없다.
🔗 X에서 공지
Zed 1.12: Git Panel과 다중 선택
7월 22일 — Zed가 안정 버전 1.12를 출시했다. Git 패널에는 이제 “Staged”와 “Unstaged”가 분리된 섹션으로 표시되며, 어느 쪽 그룹의 항목을 클릭해도 해당 multibuffer가 열린다. File Finder와 Text Finder도 다중 선택을 지원한다(macOS에서는 cmd-클릭, Linux/Windows에서는 ctrl-클릭, 또는 tab 사용)해 한 번에 여러 파일을 열 수 있다. 원래 스레드에서 언급된 CSV 필터링은 이후 Zed의 수정으로 삭제되었으며, 해당 기능은 실제로 아직 공개되지 않았다고 설명했다.
🔗 X에서 공지
v0: 슬래시 명령어, Shopify 전체 공개, Snowflake 신뢰성
7월 21일 — v0(Vercel)가 슬래시 명령어를 추가했다. 즉, 컴포저에서 /을 입력하면 키보드를 놓지 않고도 skills.sh를 통해 스킬(skill)을 연결할 수 있는 메뉴가 열린다. 제품 설명, 가격, 재고를 실시간으로 읽어오는 전자상거래 쇼케이스를 생성하는 Shopify 통합도 이제 모든 사용자에게 열렸다. Snowflake에 대한 신뢰성 패스는 마지막 배포 이후의 코드 변경을 감지하고, 생성 결과가 더미 데이터가 아니라 연결된 계정을 향하도록 유도한다.
🔗 v0 변경 로그
Amp: 오브가 외부 이벤트에 반응한다
7월 23일 — Amp의 “orbs”(원격 에이전트를 위한 클라우드 샌드박스)는 이제 새로운 웹훅 API(amp.createWebhook)를 통해 외부 이벤트에 반응해 깨어날 수 있다. 예: GitHub CI 실패, 새로운 Linear 이슈, 모니터링 알림, Discord 메시지. Amp는 공급자의 서명을 검증하고 전달을 중복 제거한다. 외부 이벤트는 신뢰할 수 없는 데이터로 취급되며, 에이전트에 대한 직접 지시로 해석되지 않는다. 언급된 사용 사례로는 메인 브랜치의 모든 CI 실패를 조사해 결과를 Slack에 게시하거나, 의존성의 새 버전을 감시해 자동으로 업데이트 pull request를 여는 것이 있다.
🔗 Amp 공지
사이버방어: Gemini와 Hugging Face가 방어 측을 무장시키다
이번 기간의 서로 다른 두 발표는 동일한 필요로 수렴한다. 즉, 소프트웨어 취약성에 맞서 방어 측 도구를 더 잘 갖추는 것이다.
Gemini 3.5 Flash Cyber, 취약점 72% 탐지
7월 23일 — 7월 21일의 묶음 발표(Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber) 이후, Google DeepMind는 Gemini 3.5 Flash Cyber에 대한 전용 스레드를 공개하며 수치화된 벤치마크를 게시했다. 이 모델은 취약점 탐지 및 수정에 특화된 경량 모델이다.
| 테스트 모델 | 탐지율 |
|---|---|
| Gemini 3.5 Flash Cyber | 72 % |
| Gemini 3.5 Flash(표준) | 55 % |
| Claude Opus 4.6(Anthropic) | 54 % |
“Chrome Production Commit Scanning Pipeline”이라는 이름의 이 테스트는 Chrome과 Android의 실제 코드베이스에서 수행되었으며, 모델은 표준 모델들이 놓친 복잡한 취약점을 찾아냈다. 제공은 여전히 제한된 접근의 파일럿 형태로, 정부와 신뢰할 수 있는 파트너에게만 제공되며, Google은 이를 “책임 있는 배포” 접근 방식으로 소개한다.
The Stack v3, 사이버방어를 위한 오픈소스 연료
7월 23일 — Hugging Face의 Head of Research인 Leandro von Werra가 조직의 코드 데이터셋 차세대 버전인 The Stack v3를 발표했다(HuggingFaceCode은 StarCoder 모델의 기원이기도 하다). 이는 훈련에 바로 사용할 수 있는 5조 개의 토큰, 120TB의 원시 데이터, 700개 이상의 프로그래밍 언어, 그리고 ODC-BY 라이선스를 갖춘 데이터셋이다. 메시지의 방향은 명시적으로 방어 중심이며, von Werra는 Sakana AI의 Fugu-Cyber 출시를 언급하며 “사이버방어를 위한 좋은 오픈 코드 모델”에 대한 긴급한 필요를 이유로 공개를 정당화했다.
🔗 X에서 공지
Together AI와 NVIDIA, 추론과 파인튜닝을 지원하다
Together AI, 추론 플랫폼의 새 세대를 출시
7월 23일 — Together AI가 오픈 웨이트 모델을 위한 추론 플랫폼을 재구성한 Together Dedicated Model Inference를 발표했다. 주요 내용은 다음과 같다. 안정적인 엔드포인트 뒤의 다중 배포, 안전한 롤아웃(canary, blue-green, 자동 롤백이 포함된 rolling), 실제 트래픽에 대한 A/B 테스트와 “shadow traffic”, 새 캐시 계층을 통한 약 4배 빠른 시작 시간(MoE 프런티어 모델인 Kimi K2.7, MiniMax M3, GLM 5.2는 7~14분 내 배포), 그리고 프로덕션에 체크포인트를 직접 배포할 수 있는 커스텀 파인튜닝(RL full-weight, LoRA, SFT) 폐쇄 베타다. 소개 웹세미나는 8월 6일로 예정되어 있다.
🔗 X에서 공지
NVIDIA: 5달러 미만의 RL 파인튜닝
7월 23일 — NVIDIA는 Prime Intellect Lab과 함께 Nemotron 3 Nano에서 수행한 강화학습 기반 파인튜닝 데모를 강조했다. 수학 과제에서 정확도가 22%에서 91%로 향상되었으며, 비용은 $5 미만이었다. 전체 흐름은 baseline, 보상 수렴까지의 훈련, 검증 재테스트로 이어지며, 마지막에는 다운로드 가능한 LoRA 어댑터가 생성되고, 구성 파일 한 줄만 바꾸면 Nemotron 3 Super와 Ultra에도 적용할 수 있다.
🔗 X에서 공지
Gemini Notebook, Collections로 노트북을 정리하다
7월 20일 — Gemini Notebook(구 NotebookLM)이 Collections를 출시했다. 이는 폴더의 전형적인 트리 구조 대신 사진 앨범이나 재생목록처럼 노트북을 정리할 수 있는 새 탭이다. 엄격한 구조는 없으며, 하나의 노트북은 원하는 만큼의 컬렉션에 속할 수 있고, 아무 컬렉션에도 속하지 않을 수도 있다.
이 기능은 실제로 제품 안에 보이는 새 탭으로 제공되는 배포된 기능이지, 단순한 예고편이 아니다. 이번 스캔의 엄격한 기간보다 하루 앞선 시점의 트윗이지만, 지금까지 답을 얻지 못했던 사용자들의 반복적인 요청에 대한 응답이었다.
xAI와 Qwen이 제품군을 확장하다
Grok 4.5, 모든 일반 사용자 표면에서 사용 가능
7월 22일 — xAI는 Grok 4.5가 이제 Grok의 모든 일반 사용자용 표면에서 동작한다고 발표했다. 대상은 grok.com, X, iOS 및 Android 앱이다. 이 모델은 xAI의 Microsoft 365 추가 기능을 통해 Word, Excel, PowerPoint, Outlook에서도 계속 사용할 수 있다. 이는 새로운 모델이 아니며, 플래그십 출시는 이미 7월 8일에, 유럽 전면 제공은 7월 16일에 다뤄졌다. 이번 발표는 배포의 마지막 연결고리로, 모바일과 일반 웹사이트로의 실제 전환을 의미한다.
🔗 공식 공지
Grok이 Microsoft Outlook에 들어오다
7월 21일 — xAI가 Grok for Outlook을 통해 Grok 통합을 Microsoft 365로 확장했다. 이 에이전트는 긴 스레드를 요약하고, 사용자의 스타일로 답장을 작성하며, 종료된 대화를 보관하고, 응답이 필요한 항목을 표시한다. 아무 것도 명시적 확인 없이 전송되지 않는다. 오늘부터 X와 SuperGrok 유료 구독자는 Microsoft Marketplace를 통해 사용할 수 있으며, 이 모듈은 이미 제공되던 Word, Excel, PowerPoint용 모듈에 합류한다.
🔗 공식 공지
Qwen Cloud, Token Plan Individual 출시
7월 21일 — Qwen Cloud가 월 $6부터 시작하는 구독형 요금제 Token Plan Individual을 출시했다. 이 요금제는 Qwen 패밀리뿐 아니라 GLM과 DeepSeek에도 사용할 수 있는 통합 크레딧 풀을 제공하며, Qwen3.8-Max-Preview에 대한 선공개 접근도 포함한다(이 모델은 이미 7월 19일에 다뤄진 바 있다). 홍보 인포그래픽은 세 가지 요금 단계(Lite / Standard / Pro), 비혼잡 시간대 할인, 최대 8개 에이전트를 동시에 지원할 수 있는 풀을 상세히 보여준다.
🔗 X에서 공지
Anthropic, AI의 경제적 미래에 2억 달러를 투자하다
7월 22일 — Anthropic은 AI의 경제적 영향에 사회가 대비할 수 있도록 하는 개입 방안을 연구하는 야심찬 외부 연구를 지원하기 위해 2억 달러 규모의 Economic Futures Research Fund 연구 의제를 공개했다. 우선순위는 다섯 가지다. 노동자에 대한 영향, 직업 전환 지원, 소득 지원 제도 현대화, AI 관련 성장 공유 메커니즘(사전 분배형 자본 계좌), 공공 투자에 대한 새로운 데이터다.
Anthropic은 주로 500만 달러에서 3,000만 달러 사이의 프로젝트를 지원할 계획이며, 대학, 독립 연구기관, 비영리단체에만 열려 있고 개인 연구자는 대상이 아니다. 이 기금은 1년 전에 시작된 “Economic Futures” 프로그램을 더 적은 수의 대규모 보조금에 집중하도록 발전시킨 것이다.
🔗 공식 공지
간단 소식
- Anthropic이 Public First Action에 대한 지원을 2천만 달러 추가로 두 배로 확대 — AI 이슈에 대한 대중 교육을 수행하는 초당파적 단체에 대한 총 지원이 4천만 달러로 늘었다. 이 기부금은 선거 지원이 아닌 교육 및 공공정책 사명에만 사용된다. 🔗 출처
- Claude Code: skills로 구성한 검증 루프 가이드 — 수동 검사를 Claude Code skills로 바꿔 Claude가 스스로 검증을 반복하도록 만드는 방법. 🔗 출처
- Outtake 사례 연구: Claude로 구축한 사이버 조사 에이전트 — Outtake가 여러 시간에 걸친 세션을 통해 공격 네트워크를 어떻게 매핑하는지. 🔗 출처
- Cognition — DeepWiki, 50만 개 이상의 저장소 인덱싱 돌파 — AI가 생성한 코드 문서화 도구, 무료 제공; 7월 28일 샌프란시스코에서 LangChain과의 밋업 예정. 🔗 출처
- Replit이 Firecrawl 통합을 강조 — 앱을 위한 원클릭 웹 컨텍스트, 초기 사용자에게 10,000 크레딧 제공. 🔗 출처
- Hugging Face가 Nunchaku(SVDQuant)를 Diffusers에 네이티브로 통합 — 4비트 양자화 체크포인트(가중치와 활성화)가 이제 별도의 추론 라이브러리 없이
from_pretrained()을 통해 로드된다. 🔗 출처 - Together AI가 7월 27일 출시와 동시에 Kimi K3(Moonshot AI)를 호스팅할 예정 — 추론은 “day zero”부터 제공되며, 벤치마크는 실제 출시 후 공개된다. 🔗 출처
- Gemini CLI v0.52.0 — triage 및 egress 서비스,
write_file/replace에서 JSON/IPYNB에 대한 LLM 수정 우회,google-auth-library를 10.9.0으로 업데이트. 🔗 출처 - GitHub — Projects와 Issues의 다중 선택 필드 — 이제 하나의 사용자 정의 필드에 여러 값을 동시에 담을 수 있다(팀, 모듈, 카테고리). 🔗 출처
- HeyGen — 대규모 비디오 번역 API — 전체 비디오 채널을 10개의 현지화 버전으로 24시간 이내에 복제, 일괄 처리 지원. 🔗 출처
- Codex Sites Analytics가 공개 테스트로 전환 — Codex로 게시된 사이트를 위한 기본 성능 지표. 🔗 출처
- OpenAI, “소규모 비즈니스를 위한 ChatGPT” 프로그램 출시 — ChatGPT Work 웹세미나, 미국 내 AI 아카데미, Dropbox, Shopify, Intuit, Slack, Atlassian, Wix와의 파트너십. 🔗 출처
- David Vélez(Nubank)와 Robin Vince(BNY), OpenAI 이사회 합류 — OpenAI Foundation과 OpenAI Group PBC가 두 경영진을 맞이한다. 🔗 출처
- Cohere가 아랍어 AI를 위해 HUMAIN과의 파트너십 발표 — Cohere Transcribe Arabic의 성공에 이은 후속 조치이며, 아직 구체적 제품이나 날짜는 공개되지 않았다. 🔗 출처
의미하는 바
음성은 같은 날 두 개의 서로 다른 주체에서, 하나의 완전한 조종 인터페이스로 자리 잡고 있다. ChatGPT Voice는 데스크톱으로 들어와 GPT-Live를 기반으로 키보드 없이 Chat, Work, Codex를 제어할 수 있게 하고, Claude는 자사에서 가장 성능이 뛰어난 모델들 위에서 음성 모드를 구동하며 대화 중 연결된 도구들에 대한 접근을 제공한다. 두 발표는 서로 독립적이지만, 날짜가 겹친 것은 우연이 아닐 가능성이 크다. 이는 하나의 동일한 베팅을 보여준다. 즉, 음성 대화가 단순히 질문에 답하는 어시스턴트의 장난감이 아니라, 에이전트나 연결된 도구를 통해 실제 행동을 촉발할 수 있는 완전한 작업 채널이 되고 있다는 것이다.
에이전트를 어떻게 둘러싸고 통제할지는, 단순히 에이전트를 돌리는 것과는 별개의 핵심 주제가 되고 있다. GitHub는 자사 에이전트가 Issues에 대해 자동으로 적용하는 변경 사항에 대해 승인, 신뢰 점수, 그리고 정당화 근거를 도입하면서도, 이것이 “보안 통제는 아니다”라고 스스로 분명히 밝히고 있으며, 단지 워크플로 편의 기능일 뿐이라고 설명한다. Runway는 한편으로 경쟁하는 생성 모델들 사이에 자동 중재 계층(비용, 품질, 지연 시간)을 추가한다. 공통점은 명확하다. 에이전트의 자율성이 커질수록, 공급자들은 기능을 단순히 쌓아 올리기보다 거버넌스와 조종의 층을 덧붙이고 있다. 이는 Codex의 다중 디렉터리 프로젝트에서도 드러나는 흐름으로, 에이전트가 진실의 기준점인 루트, 즉 기본 Git 디렉터리를 잃지 않으면서 더 넓은 범위에서 작업할 수 있도록 설계되어 있다.
사이버 방어는 대형 AI 플레이어들 사이의 명시적인 경쟁 축으로 자리 잡고 있다. Gemini 3.5 Flash Cyber는 Chrome과 Android의 실제 codebase에서 72%의 취약점 탐지율을 주장하며, 자사 표준 모델의 55%와 Google이 명시적으로 언급한 Claude Opus 4.6의 54%를 앞선다고 말한다. 직접 비교를 이렇게 노골적으로 제시하는 경우는 드물어 눈에 띈다. 같은 날 Hugging Face는 5,000억 토큰 규모의 코드 데이터셋 The Stack v3를 공개하며, “사이버 방어를 위한 좋은 오픈 코드 모델”이 필요하다는 이유를 명시적으로 들었다. 이 두 독립 발표는 대규모 소프트웨어 취약점 악용에 대한 공통된 우려와, 이에 대한 대칭적 대응을 보여준다. 한쪽에는 특화된 폐쇄형 모델, 다른 쪽에는 그것들을 훈련시키기 위한 개방형 데이터가 있다.
Cognition은 단 일주일 만에 양쪽 방향으로 무대를 넓힌다. 사용자 메시지 안에서 살아가며 3개월 동안 1억 건이 넘는 메시지를 주고받은 개인용 에이전트 Poke의 인수는, 회사의 중심축을 자율 소프트웨어 엔지니어 Devin을 넘어 대중용 에이전트로 이동시킨다. 동시에 미국 에너지부와의 Genesis Mission 관련 양해각서는, 이미 7월 22일부터 같은 이니셔티브에 참여해 온 Google DeepMind, OpenAI, Arcee AI와 함께 Cognition을 배치하며, 이제는 네 개 주체가 미국 공공 과학 연구에 자리 잡기 위한 경쟁에 뛰어들게 한다. 두 가지 움직임은 하나의 논리를 공유한다. 대중 시장과 제도적 인프라 양쪽에서 동시에 입지를 굳히는 것이지, 하나의 세그먼트에만 머무르지 않는다는 것이다.
출처
- ChatGPT의 건강
- FLUX 3 — Black Forest Labs
- ChatGPT Voice 데스크톱
- Codex 변경 로그 26.715
- Claude 음성 모드
- Anthropic 블로그 — 음성 모드
- Codex — 다중 디렉터리 프로젝트
- GitHub — Issues에서의 에이전트 제어
- GitHub Mobile — Fix with Copilot
- Runway Media Router
- HeyGen Video Agent
- Cognition이 Poke를 인수
- Cognition — X 발표
- Cognition — Genesis Mission DOE
- Cursor — 한도 두 배 확대
- Replit — 호스팅 가격
- Zed 1.12
- v0 — 변경 로그
- Amp — 이벤트 오브
- Gemini 3.5 Flash Cyber
- The Stack v3 — Hugging Face
- Together AI — 추론 플랫폼
- NVIDIA — Nemotron 미세조정
- Gemini Notebook — 컬렉션
- Grok 4.5 — 어디서나
- Outlook용 Grok
- Qwen Token Plan Individual
- Anthropic — Economic Futures Research Fund
- Anthropic — Public First Action 기부
- Claude Code — 검증 루프
- Outtake 사례 연구
- Cognition — DeepWiki
- Replit — Firecrawl
- Hugging Face — Nunchaku Diffusers
- Together AI — Kimi K3
- Gemini CLI — 변경 로그
- GitHub — 다중 선택 필드
- HeyGen — Video Translation API
- Codex Sites Analytics
- OpenAI — 소기업 프로그램
- OpenAI — 새로운 관리자들
- Cohere — HUMAIN 파트너십