Pesquisar

Claude Opus 5, Midjourney compra Co-Star, Jensen Huang defende modelos abertos

ai-powered-markdown-translator

Artigo traduzido do fr para o pt com gpt-5.4-mini.

Ver projeto no GitHub ↗

24 de julho de 2026 é dominado por um único evento estruturante: a Anthropic lança Claude Opus 5, adotado no mesmo dia por Cursor, Devin, v0 e GitHub Copilot — o ciclo entre o lançamento de um modelo e sua adoção em ferramentas de código agora é praticamente instantâneo. No mesmo dia, a Midjourney anuncia sua primeira aquisição (Co-Star), Jensen Huang (NVIDIA) publica sua primeira mensagem pessoal no X para defender os modelos abertos, e a xAI acrescenta a orquestração de centenas de agentes em paralelo ao Grok Build. Em torno desses quatro assuntos gravitam quinze novidades notáveis — do ecossistema de ferramentas de código à expansão Enterprise da Genspark — e nove anúncios menores.


Claude Opus 5 : novo modelo da Anthropic, adotado no mesmo dia por Cursor, Devin, v0 e GitHub Copilot

24 de julho — A Anthropic lança Claude Opus 5, novo modelo da família Claude 5 ao lado de Sonnet 5 e Fable 5. Posicionamento oficial: um modelo “reflexivo e proativo” que se aproxima da inteligência de fronteira de Claude Fable 5 — o modelo mais capaz da Anthropic — pela metade do preço. Ele está disponível a partir de hoje em todos os planos pagos e via API (identificador claude-opus-5), pelo mesmo preço que Opus 4.8: $5 por milhão de tokens de entrada, $25 por milhão na saída. Um modo Fast, cerca de 2,5× mais rápido, é cobrado pelo dobro da tarifa básica. Opus 5 torna-se o modelo padrão no Claude Max e o mais capaz oferecido no Claude Pro.

BenchmarkResultado do Opus 5
Frontier-Bench v0.1Supera todos os modelos, mais que o dobro da pontuação do Opus 4.8, a menor custo por tarefa
CursorBench (esforço máximo)A 0,5 ponto da melhor pontuação do Fable 5, pela metade do preço
ARC-AGI 3 (problemas inéditos)Pontuação cerca de três vezes superior à do melhor concorrente
OSWorld 2.0 (uso de computador)Supera o melhor resultado do Fable 5 por cerca de um terço do custo

A Anthropic também relata avanços em ciências da vida: +10,2 pontos em química orgânica (inferência de estruturas moleculares) e +7,7 pontos na previsão de efeitos de variações de sequências proteicas, em relação ao Opus 4.8. Nuance importante: esses resultados de “estado da arte” dizem respeito ao código e ao trabalho do conhecimento — em cibersegurança ofensiva, o Opus 5 permanece deliberadamente atrás do Mythos 5 (modelo com acesso restrito): seus classificadores de segurança bloqueiam o scan de vulnerabilidades por método binário, os testes de intrusão e a geração de exploits, ao mesmo tempo em que autorizam a detecção de vulnerabilidades no código-fonte. A Anthropic estima que esses classificadores intervirão cerca de 85% menos frequentemente do que no Fable 5.

No alinhamento, a Anthropic indica que o Opus 5 é, segundo seu auditor comportamental automatizado interno, o modelo mais alinhado até hoje (pontuação de 2,3 no comportamento globalmente desalinhado, a mais baixa entre seus modelos recentes). No Claude Code, ele pode ser usado imediatamente via /model claude-opus-5 ou via /claude-api migrate para alternar cargas de trabalho existentes, e inicia por padrão em esforço elevado.

🔗 Anúncio oficial — Anthropic

It’s a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

🇵🇹 É um modelo reflexivo e proativo que se aproxima da inteligência de fronteira do Fable 5, pela metade do preço.@claudeai no X

Adoção no day-one nas ferramentas de código. Em menos de meia hora, três ferramentas de código anunciam a integração com poucos minutos de diferença, seguidas no mesmo dia pelo GitHub Copilot:

Ferramenta integradoraHora do anúncio (24 de julho)Diferencial
Cursor19h03Igual ao Fable 5 no CursorBench (66,7 vs 66,5 no esforço padrão), metade do preço, compatível com Zero Data Retention
Devin (Cognition)19h07“Aproxima-se” do nível do Fable 5 no FrontierCode 1.1, pela metade do custo
v0 (Vercel)19h29Disponível imediatamente via v0.app/?opus5
GitHub CopilotMesmo diaVS Code, Visual Studio, Copilot CLI, cloud agent, JetBrains, Xcode… para Pro+/Max/Business/Enterprise

O Cursor é o mais preciso, com números exatos e uma vantagem adicional: a compatibilidade com Zero Data Retention, que o Fable 5 não oferece. No GitHub, o Copilot destaca bons resultados em fluxos de trabalho de codificação agentiva — modificações autônomas, verificação de não regressão, coordenação de várias ferramentas — mas avisa que o modelo inclui proteções que podem bloquear algumas solicitações ligadas à cibersegurança, com recomendação de reformular ou escolher outro modelo em caso de bloqueio. O rollout do Copilot é gradual; administradores Enterprise e Business devem ativar a política Claude Opus 5 para dar acesso às suas equipes.

🔗 Cursor anuncia a integração

🔗 Devin anuncia a integração — @cognition

🔗 v0 anuncia a integração

🔗 GitHub Copilot — changelog oficial


Midjourney adquire Co-Star, primeira aquisição de sua história

23 de julho — A Midjourney anuncia sua primeira aquisição: Co-Star, o aplicativo de astrologia personalizada conhecido por seu tom direto e suas notificações virais. Sua fundadora, Banu Guler, entra na Midjourney no cargo recém-criado de Chief Design Officer, responsável por construir uma organização transversal Produto/Design/Frontend para todos os projetos da empresa. Co-Star continua a operar de forma autônoma, inteiramente sob seu controle e direção.

A publicação oficial, em tom muito pessoal, insere essa aquisição em uma trajetória mais ampla: menciona Midjourney Medical como o início de um “laboratório de pesquisa incomum” e anuncia meia dúzia de projetos igualmente ambiciosos nos próximos seis meses. A Midjourney, até aqui concentrada na geração de imagens e vídeos, sinaliza assim uma diversificação estratégica explícita além de seu núcleo histórico de atuação. O post no X, publicado no dia seguinte, reuniu mais de 426 mil visualizações, 1.300 “curtidas” e 226 reposts em poucas horas.

🔗 Post no X — 426 mil visualizações em poucas horas

“As an adult I find myself in the unusual position of having everything I wanted and two questions come to mind next: How can I use this opportunity to make baby David proud?”

🇵🇹 Na vida adulta, me encontro na posição incomum de ter tudo o que eu queria, e então me vêm duas perguntas: como usar essa oportunidade para fazer o pequeno David orgulhoso?Midjourney, changelog oficial


NVIDIA : Jensen Huang publica seu primeiro post no X, uma carta aberta em defesa dos modelos abertos

24 de julho — Jensen Huang, fundador e CEO da NVIDIA, publica sua primeira mensagem pessoal no X: uma carta aberta assinada pela NVIDIA, intitulada “Open Weights and American AI Leadership”, sobre a importância dos modelos abertos (open models). Nela, afirma que a IA “vai transformar cada indústria, alimentar cada empresa e ser construída por cada país”, e que os modelos abertos fortalecem a segurança e a cibersegurança, aceleram a inovação e permitem soberania — uma posição que alinha explicitamente a NVIDIA, por meio de sua própria linha Nemotron publicada em pesos abertos, com o ecossistema open-weight, em contraste com laboratórios fechados como OpenAI, Anthropic ou Google.

O post gerou um engajamento fora da curva para uma primeira mensagem pessoal: mais de 23,6 milhões de visualizações, 98 mil “curtidas” e 23,7 mil reposts em poucas horas. Vários atores da IA open-weight, entre eles a MiniMax, agradeceram publicamente a Jensen Huang por essa tomada de posição na sequência.

“Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models.”

🇵🇹 Os modelos abertos fortalecem a segurança e a cibersegurança, aceleram a inovação e sua difusão, e permitem a soberania. O mundo precisa tanto de modelos de fronteira fechados quanto de modelos de fronteira abertos.@JensenHuang no X


Workflows no Grok Build : xAI orquestra centenas de agentes em paralelo

23 de julho — A xAI lança os workflows no Grok Build, seu agente de codificação em linha de comando (equivalente ao Claude Code ou Codex). O usuário descreve uma tarefa complexa em linguagem natural; o Grok planeja automaticamente um script de orquestração — as fases de trabalho, os agentes atribuídos a cada uma, a forma como seus resultados sobem — e depois o executa em segundo plano enquanto a sessão continua disponível para outra coisa.

Parâmetro técnicoValor medido
Agentes por padrão128
Agentes máximos (tarefas grandes)1024
Demonstração destacadaRevisão de pull request GitHub em 4 fases (Context → Review → Verify → Synthesize)
Acompanhamento em tempo realComando /workflows

Os revisores especializados da demonstração veem suas conclusões verificadas de forma adversarial por “céticos” independentes antes de chegarem ao relatório final. O progresso é salvo continuamente — pausar e retomar nunca obriga a refazer o trabalho já feito. Os workflows podem ser salvos e reutilizados: os colocados em .grok/workflows/ são compartilhados com a equipe, os de ~/.grok/workflows/ acompanham o usuário em qualquer lugar, e cada workflow salvo torna-se seu próprio slash command parametrizável (por exemplo /pr-review 5137). A funcionalidade /deep-research, que divide uma questão de pesquisa entre vários investigadores em paralelo e verifica cada afirmação contra suas fontes, está incluída nativamente.

Casos de uso destacados pela xAI: revisar cada funcionalidade de uma grande pull request, triagem dos 100 últimos tickets Linear para extrair uma lista de ações, ou auditar cada route handler de uma base de código em busca de controles de autenticação ausentes.

🔗 Anúncio oficial — xAI


O ecossistema do código : menos prompt, mais agentes

Claude Code : Anthropic remove 80% do system prompt para os modelos Claude 5

24 de julho — Thariq (@trq212), da equipe Anthropic, publica um artigo detalhando a evolução da context engineering do Claude Code: a Anthropic removeu mais de 80% do system prompt do Claude Code para os modelos Claude 5 como Opus 5 e Fable 5, sem perda mensurável nas avaliações de código. Os antigos system prompts impunham regras rígidas — por exemplo, nunca escrever comentários em várias linhas — que se tornaram desnecessárias, já que os modelos recentes dispõem de melhor discernimento para resolver instruções contraditórias conforme o contexto. O artigo formaliza seis mudanças de doutrina, entre elas: dar regras rígidas → deixar o Claude julgar; colocar tudo antecipadamente no prompt → divulgação progressiva. A Anthropic disponibiliza essas práticas por meio de um novo comando, /doctor, que ajuda a auditar e redimensionar as skills e os arquivos CLAUDE.md de um projeto.

🔗 Thread completa — @trq212

v0 transforma um arquivo Figma completo em aplicativo

24 de julho — O v0 (Vercel) amplia sua integração com Figma, até aqui mais centrada na importação de componentes isolados: a partir de um simples link, o agente explora automaticamente todas as páginas e frames do arquivo, seleciona os elementos relevantes — tokens de design, cores, layout, texto, ícones — e então monta as telas identificadas em um único aplicativo coerente, sem seleção manual frame por frame. A documentação oficial detalha o conjunto de dados extraídos na página dedicada do v0 Docs.

🔗 Anúncio — @v0

Copilot cloud agent for Linear passa a disponibilidade geral

23 de julho — O GitHub leva a atribuição de issues do Linear ao Copilot cloud agent para disponibilidade geral: uma vez atribuída, a agente analisa a issue, abre uma pull request em draft em um ambiente efêmero movido por GitHub Actions, faz subir seu progresso na timeline do Linear e depois solicita revisão. Novidade em relação à prévia: escolha do modelo e do agente personalizado diretamente pelo Linear, definição dos branches-alvo e controle da sessão por simples comentário. Disponível nas modalidades Copilot Pro, Pro+, Business e Enterprise.

🔗 Changelog oficial

GitHub MCP Server antecipa a próxima especificação MCP

23 de julho — O protocolo MCP (Model Context Protocol) torna-se sem estado (stateless) a partir de 28 de julho de 2026, e o GitHub MCP Server já oferece suporte a essa nova especificação antes de sua publicação oficial. Resultado: remoção das sessões Redis, conexões mais rápidas sem a etapa initialize, e uma implementação de elicitation atualizada para requisições HTTP separadas. Como os SDKs de nível 1 mantêm retrocompatibilidade, nenhuma ação é necessária do lado dos clientes existentes.

🔗 Changelog oficial

Sakana AI publica Fugu-Ultra v1.1 e uma interface compatível com Claude Code

24 de julho — A Sakana AI publica uma atualização de seu motor de orquestração multi-modelos Fugu-Ultra (v1.1), com ganhos de até 7,9 pontos em relação ao v1.0, particularmente fortes no ProgramBench e no Terminal Bench 2.1. A Sakana reivindica melhor desempenho do que o Fable 5 em codificação complexa e raciocínio, sem sequer incluir este último em seu pool de modelos orquestrados. Em paralelo, a Sakana expõe endpoints compatíveis com Claude Code para usar a inteligência multiagente do Fugu diretamente desse cliente em vez de depender de um único modelo.

🔗 Anúncio oficial — Sakana AI


Google / Gemini : extensão do Spark, correção de segurança para o Gemini CLI

Gemini Spark estendido aos assinantes do Google AI Pro nos Estados Unidos

23 de julhoGemini Spark, o agente de IA pessoal do Google que trabalha em segundo plano 24/7 para realizar tarefas sob a direção do usuário, dá um passo em sua expansão: depois dos assinantes do Google AI Ultra, ele começa a ser disponibilizado aos assinantes do plano Google AI Pro, significativamente mais amplo, inicialmente nos Estados Unidos. O Google anuncia uma expansão para mais países « em breve ». Não se trata, a rigor, de uma nova funcionalidade, mas de uma mudança de público que aproxima um agente autônomo de tipo premium do grande público pagante.

🔗 Anúncio — @GeminiApp

Gemini CLI v0.53.0-preview.0 corrige uma falha de RCE

22 de julho — Nova versão preview do Gemini CLI (ainda não listada no changelog oficial estável), com dois corretivos de segurança: reforço do isolamento das tarefas e da confiança do espaço de trabalho no servidor Agent-to-Agent para impedir uma execução arbitrária de código (RCE), e mitigação de loops de injeção de prompt e dos loops ReAct infinitos. Soma-se a isso um orquestrador de triagem baseado em LLM e um endurecimento dos perfis Seatbelt no macOS para um modelo deny-by-default.

🔗 Release no GitHub v0.53.0-preview.0


OpenAI: ChatGPT Work se conecta a sites protegidos, um diagnóstico corrigido graças ao ChatGPT

ChatGPT Work agora pode se conectar a sites que exigem autenticação

24 de julho — O agente ChatGPT Work agora pode usar sites que exigem login: o usuário assume o controle do navegador na nuvem pelo tempo necessário para se autenticar e, depois, deixa o agente retomar a tarefa automaticamente. Ponto-chave: o login persiste de uma sessão para outra, bastando uma única autenticação para as tarefas seguintes nesse mesmo site — uma limitação clássica dos agentes de navegação web que agora é superada. Essa evolução amplia o escopo das tarefas automatizáveis para ferramentas internas de empresa e SaaS protegidos por credenciais.

🔗 Anúncio — @OpenAIDevs

Como o ChatGPT ajudou a corrigir um diagnóstico de câncer

24 de julho — O OpenAI Newsroom conta como o marido de Kiley, diagnosticada aos 18 anos com um glioblastoma de prognóstico de poucos meses e ainda viva cinco anos depois sem explicação clara, usou o ChatGPT para decifrar um laudo recente de radiologia. Essa leitura remeteu aos resultados da biópsia inicial, onde o ChatGPT ajudou a destacar um detalhe que passara despercebido: uma mutação IDH1. Em conjunto com o neuro-oncologista de Kiley, esse detalhe permitiu reclassificar o diagnóstico como astrocitoma com mutação IDH — ainda grave, mas com prognóstico muito mais favorável.

🔗 Depoimento — @OpenAINewsroom


NVIDIA e vídeo generativo: infraestrutura mais rápida, agentes mais colaborativos

NVIDIA reduz de 8 minutos para menos de 2 minutos a inicialização do DeepSeek-V4 Pro

24 de julho — A NVIDIA detalha uma otimização de infraestrutura de inferência: o tempo de inicialização de uma implantação do DeepSeek-V4 Pro cai de 8 minutos para menos de 2 minutos, encaminhando os pesos do modelo para a memória da GPU pelo caminho mais rápido via RDMA GPU-a-GPU. O mecanismo se baseia no NVIDIA ModelExpress, o serviço de distribuição e de gerenciamento de cache dos pesos integrado ao NVIDIA Dynamo, sua plataforma de inferência distribuída. A NVIDIA especifica que a mesma abordagem também acelera o pós-treinamento por reforço.

🔗 Anúncio — @NVIDIAAI

Runway adiciona Workflows em linguagem natural ao seu agente

24 de julho — A Runway adiciona o recurso Workflows ao Runway Agent: passa a ser possível construir, executar ou modificar fluxos de trabalho baseados em nós (node-based workflows) diretamente em linguagem natural, em vez de pela manipulação manual de um editor visual. Diferente do Media Router lançado na véspera — que gerencia a seleção automática de modelos generativos conforme custo, qualidade e latência —, o Workflows atua na orquestração das próprias etapas de produção.

🔗 Anúncio — @runwayml

HeyGen — Companion mode: dirigir o vídeo em vez de encomendá-lo

22 de julho — A HeyGen introduz o companion mode para seu Video Agent: em vez de encomendar um vídeo por meio de um único prompt, o usuário o conduz de forma iterativa — o agente propõe cinco ângulos criativos, apresenta um storyboard para validação e, em seguida, esboça as imagens-chave para revisão antes da geração final. O usuário mantém o controle em cada etapa e só inicia a produção completa após aprovação. Essa funcionalidade responde a uma crítica frequente aos geradores de vídeo « de uma só vez » — resultado imprevisível, iterações caras em tempo e créditos —, aproximando a experiência da colaboração com um diretor humano.

🔗 Anúncio — @HeyGen


Genspark: parceria com a Microsoft e investimento de 100 milhões de dólares no Japão

SecondBrain se integra ao Outlook, Teams e Microsoft Agent 365

24 de julho — Durante o lançamento do Genspark 6.0 em Seul, a Genspark detalha uma parceria estratégica com a Microsoft: SecondBrain, a camada de memória persistente de seus agentes, agora se integra diretamente ao Outlook, Office, Teams, bem como ao Microsoft Agent 365 — do qual a Genspark afirma ter sido parceira de lançamento global. O conjunto roda na Azure, apresentada como garantia da robustez esperada em ambiente corporativo. O post agradece nominalmente a Satya Nadella (CEO da Microsoft), Judson Althoff e Rodrigo Kede. Esse ponto não aparecia na publicação de lançamento inicial de 20 de julho.

🔗 Anúncio — @genspark_ai

Genspark investe 100 milhões de dólares em 3 anos no Japão

24 de julho — Na sequência de um evento realizado em Tóquio em 21 de julho diante de clientes corporativos, parceiros industriais e influenciadores japoneses — o segundo da Genspark no país —, a empresa anuncia um investimento de $100 milhões ao longo dos próximos três anos no Japão, apenas seis meses após a abertura de sua operação local. Três prioridades: residência de dados para clientes elegíveis (instituições financeiras, órgãos governamentais, grandes empresas), parcerias de ponta a ponta com revendedores e integradores, e fortalecimento das equipes em campo, na língua e no fuso horário dos clientes.

🔗 Anúncio — @genspark_ai


Grok chega ao Google Workspace

24 de julho — A xAI lança um complemento gratuito que integra o Grok diretamente ao Sheets, Slides e Docs, instalável a partir do Google Workspace Marketplace. No Sheets, o Grok responde perguntas citando as células usadas e escreve fórmulas; no Slides, transforma um esboço em apresentação respeitando o tema existente; no Docs, redige e corrige no próprio ponto de escrita, com acesso a e-mails e arquivos recentes do Drive se os conectores estiverem ativados. Essa integração completa a suíte já disponível no lado do Microsoft 365 (Word, Excel, PowerPoint, Outlook), lançada entre junho e julho.

🔗 Anúncio oficial — xAI


Resumo

  • A Replit resume suas novidades do mês — agente de voz, criação a partir do Claude ou do Slack, memória persistente da stack; pelo menos uma das capacidades citadas parece corresponder a uma integração já publicada em 17 de junho. 🔗 Fonte
  • Kimi K3 quase empatado com Claude Fable 5 no DeepSWE — pass@1 com diferença de 1,4 ponto, mas à frente em pass@2/pass@4, a um custo 2,8× menor por tarefa resolvida (Together AI). 🔗 Fonte
  • Declaração coletiva sobre a abertura dos modelos como caminho para a segurança da IA — coalizão de cerca de quinze organizações, incluindo Hugging Face, Meta, Mistral AI, NVIDIA e Microsoft, repostada pela conta oficial @huggingface. 🔗 Fonte
  • HeyGen lança uma API Audio to Video — voz e imagem para vídeo em uma única chamada, com processamento em lote (ex.: 100 narrações sobre a mesma imagem). 🔗 Fonte
  • ElevenLabs publica um post sobre voz IA e proteção das eleições — posicionamento institucional na aproximação de grandes datas eleitorais. 🔗 Fonte
  • HeyGen — HyperFrames, dia 18 de 30 — novo episódio da série diária, dedicado ao seu uso no Video Agent. 🔗 Fonte
  • Zvec 0.6.0, mecanismo de busca vetorial do Tongyi Lab (Alibaba) — pesquisa Group-By, mais de 50 pontos de recall ganhos com quantização INT4, suporte estendido a 34 idiomas. 🔗 Fonte
  • xAI multiplica os plugins de terceiros no Grok Build — Tavily e Exa para busca na web, Grok STT disponível no OpenRouter a $0,10 por hora de áudio. 🔗 Fonte
  • ChatGPT Pet torna-se compartilhável entre usuários — link compartilhável nas configurações de Personalização na web, para que outro usuário adote o pet. 🔗 Fonte

O que isso significa

O lançamento do Opus 5 ilustra uma mudança estrutural na forma como os modelos de fronteira chegam aos seus usuários: Cursor, Devin e v0 o integram em menos de meia hora; o GitHub Copilot, no mesmo dia. O ciclo lançamento → adoção, que ainda há pouco era medido em semanas, agora é quase nulo para as ferramentas de código melhor conectadas ao ecossistema Anthropic — uma dinâmica que encurta tanto a janela de diferenciação entre laboratórios quanto desloca a competição para a velocidade de integração tanto quanto para o desempenho bruto dos modelos.

No mesmo dia, um contraponto se expressa com a mesma intensidade. Jensen Huang publica sua primeira manifestação pessoal no X para defender os modelos abertos como caminho para a segurança e a soberania; uma coalizão de cerca de quinze organizações, incluindo Hugging Face e Meta, apresenta uma declaração semelhante; e a Sakana AI afirma superar o Fable 5 ao orquestrar vários modelos sem sequer incluí-lo em seu pool. Duas visões da segurança da IA — uma baseada no controle proprietário, outra na transparência dos pesos — se enfrentam publicamente no mesmo dia, sem que uma aparentemente se imponha sobre a outra.

A cibersegurança continua, além disso, a funcionar como um marcador de prudência deliberada em vez de desempenho bruto. A Anthropic posiciona intencionalmente o Opus 5 atrás do Mythos 5 em tarefas ofensivas, com classificadores dedicados que bloqueiam varredura de vulnerabilidades, testes de intrusão e geração de exploits. Ao mesmo tempo, o Google corrige no Gemini CLI uma falha de execução arbitrária de código no lado do servidor agent-to-agent — um lembrete de que as próprias ferramentas agênticas, e não apenas os modelos que incorporam, continuam sendo uma superfície de ataque a ser protegida continuamente.


Fontes