AI Tech News
By H.O.

Claude Sonnet 5 e o Summer Refresh: O que está sendo lançado esta semana

Claude Sonnet 5 e o Summer Refresh: O que está sendo lançado esta semana

O Ritmo de Lançamentos Mudou

O Claude Sonnet 5 da Anthropic, lançado em 30 de junho de 2026 , marca o lançamento de modelo frontier mais significativo do início do verão. Mas não está sozinho. Os últimos 10 dias viram Claude Sonnet 5 da Anthropic como o modelo frontier mais recente rastreado com data de lançamento de 30 de junho de 2026 , além de GPT-5.6 em três camadas—Sol (flagship), Terra (balanceado) e Luna (rápido, acessível)—apresentadas em 26 de junho de 2026 , e Grok 4.5 revelado em beta privado em 28 de junho sem data de lançamento público ainda . Isso importa porque o período de verão costumava ser tranquilo para anúncios de IA, com laboratórios guardando grandes revelações para conferências de outono e eventos de fim de ano, mas esse padrão desapareceu .

A lógica de negócios é simples: com centenas de ciclos de compra empresarial rodando em cronogramas trimestrais, laboratórios que lançam em julho capturam orçamento do Q3 . O que isso significa para times técnicos é que decisões tomadas agora moldam o gasto de infraestrutura do Q3.

Claude Sonnet 5: O Recurso que Você Realmente Usa Diariamente

Aqui está o que foi lançado: Lançado em 30 de junho, o Claude Sonnet 5 é o Sonnet mais agnóstico da Anthropic até agora e agora é o modelo padrão nos planos Claude grátis e Pro . A métrica crítica para trabalho com código: em codificação agnóstica ele atingiu 63,2% no SWE-Bench Pro, acima dos 58,1% do Sonnet 4.6 e fechando rapidamente nos 69,2% do Opus 4.8, e em trabalho de conhecimento ele realmente supera o Opus 4.8 .

A história da janela de contexto importa. Ele vem com uma janela de contexto nativa de 1 milhão de tokens como padrão . Isso não é uma nota de rodapé—muda o que você pode fazer sem engenharia de prompt. Testadores consistentemente descrevem o mesmo comportamento: ele conclui tarefas complexas de múltiplas etapas que Sonnets anteriores falharam, e verifica sua própria saída sem ser solicitado .

O preço é onde as coisas ficam interessantes. O preço introdutório da API é $2/$10 por milhão de tokens até 31 de agosto de 2026, subindo para $3/$15 depois disso . Para times corporativos avaliando Claude vs concorrentes em base por tarefa, isso importa. Ele salta aproximadamente 223 pontos GDPval-AA Elo sobre Sonnet 4.6 (que havia 1.643) para liderar o benchmark de escrita profissional da Artificial Analysis à frente de Opus 4.8 e GPT-5.5 .

GPT-5.6: Disponível Apenas Se Você Estiver na Lista de Acesso

GPT-5.6 é a família de modelos de próxima geração da OpenAI, apresentada em 26 de junho de 2026: Sol é o flagship, Terra é o modelo balanceado do dia a dia, e Luna é a camada rápida e acessível. Por enquanto, você provavelmente não consegue usá-lo—é o primeiro lançamento frontier dos EUA fechado atrás de acesso governamental, disponível apenas através da API OpenAI e Codex para aproximadamente 20 organizações confiáveis após a OpenAI compartilhar os modelos e planos de lançamento com o governo dos EUA .

O que é diferente aqui: isto não é um beta fechado para testadores. É fechado atrás de acesso governamental, disponível apenas para aproximadamente 20 organizações confiáveis após a OpenAI compartilhar modelos e planos de lançamento com o governo dos EUA, com disponibilidade geral planejada para "as próximas semanas", e Sol lançando no Cerebras com até 750 tokens por segundo em julho . Quando abrir, o preço anunciado é Sol $5 / $30, Terra $2,50 / $15, e Luna $1 / $6 por milhão de tokens .

O recurso para observar: Sol define um novo SOTA no Terminal-Bench 2.1, Terra entrega desempenho competitivo com GPT-5.5 a 2x menor custo, Luna é o mais rápido e mais barato . Para times que não estão na lista de acesso, GPT-5.5 permanece o flagship de lançamento da OpenAI .

O Padrão Mais Amplo: A Compressão de Custo Vence

Em todos os lançamentos, a compressão de custo está acelerando, com quase todos os laboratórios principais lançando uma opção de inferência mais acessível este mês, e as razões preço-desempenho para modelos de ponta tendo aproximadamente triplicado em comparação com doze meses atrás . O desempenho agnóstico é o principal campo de batalha, com laboratórios competindo mais duramente no uso de ferramentas de múltiplas etapas, gerenciamento de memória e confiabilidade de planejamento, refletindo onde a demanda empresarial está se concentrando—em sistemas de IA que podem completar fluxos de trabalho de múltiplas etapas sem intervenção humana constante .

Modelo Data de Lançamento Métrica Principal Preço da API (Entrada/Saída) Status
Claude Sonnet 5 30 de junho de 2026 63,2% SWE-Bench Pro; contexto de 1M tokens $2/$10 (intro); $3/$15 após 31 de ago Disponibilidade geral
GPT-5.6 Sol/Terra/Luna 26 de junho de 2026 (prévia) Sol: novo SOTA Terminal-Bench; Terra: redução de custo 2x Sol: $5/$30; Terra: $2,50/$15; Luna: $1/$6 Acesso fechado (~20 orgs)
Grok 4.5 28 de junho de 2026 (beta privado) 1,5 trilhão de parâmetros; fundação V9 Ainda não público Apenas beta privado
Gemini 3.5 Pro Julho de 2026 (esperado) Sucessor do Gemini 3.1 Pro TBD Disponibilidade geral agendada

O Que Isso Significa para Seu Time Agora

Três ações, classificadas por impacto:

  • Se você usa Claude em APIs de produção: O preço do Claude Sonnet 5 é introdutório em $2/$10 até 31 de agosto de 2026, subindo para $3/$15 após isso . Se sua carga de trabalho se adequa à especificação do Sonnet (tarefas agnósticas, raciocínio de contexto longo, escrita), configure uma linha de base de custo antes do aumento. O salto de $2 para $3 por milhão de tokens de entrada escala rapidamente em volume.
  • Se você está avaliando fluxos de trabalho de múltiplas etapas: Os laboratórios estão competindo mais duramente no uso de ferramentas de múltiplas etapas, gerenciamento de memória e confiabilidade de planejamento . A melhoria do Sonnet 5 em autocorreção (verificar seu próprio trabalho) e conclusão sustentada de tarefas é mensurável. Execute-o contra seu modelo atual em 10 tarefas representativas.
  • Se você está esperando pelo GPT-5.6: Você ainda não está na lista de acesso. Construa em GPT-5.5 ou Claude Sonnet 5 hoje; não retenha capacidade de computação esperando por um lançamento fechado. Quando a disponibilidade geral chegar (esperada em poucas semanas), você pode avaliar custo de migração vs benefício com dados de volume real.

O ciclo de lançamento agora é mensal na fronteira. O que foi lançado esta semana ficará obsoleto em agosto. Mas a mudança subjacente—custo caindo mais rápido do que ganhos de capacidade—significa que suas decisões de infraestrutura estão ficando mais flexíveis, não menos. Construa para a tarefa, não para a marca. Faça benchmark em volume real. Tranche as vitórias agora, antes do preço redefinir novamente.

Nossos dados rastreados

Índice de Inteligência de IA (3 Modelos de Ponta)

01632476305-1706-0106-0807-0607-1307-2007-2708-0308-1008-17Claude Opus 4.7 (Adaptive Reasoning, Max Effort) — Anthropic: 57 (2026-05-17)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-01)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-08)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 56 (2026-07-06)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 60 (2026-07-13)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 59.9 (2026-07-20)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-07-27)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-08-03)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-10)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-17)63GPT-5.5 (xhigh) — OpenAI: 60 (2026-05-17)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-01)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-08)GPT-5.5 (xhigh) — OpenAI: 55 (2026-07-06)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-13)GPT-5.6 Sol (max) — OpenAI: 58.9 (2026-07-20)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-27)GPT-5.6 Sol (max) — OpenAI: 59 (2026-08-03)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-10)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-17)61Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-05-17)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-01)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-08)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-06)Gemini 3.5 Flash (high) — Google DeepMind: 55 (2026-07-13)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-20)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-07-27)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-08-03)Gemini 3.6 Flash (high) — Google DeepMind: 52 (2026-08-10)Gemini 3.7 Flash (high) — Google DeepMind: 56 (2026-08-17)56
  • Anthropic
  • OpenAI
  • Google DeepMind

Intelligence Index — Trend

Passe o cursor sobre cada ponto para ver a versão específica do modelo naquela data.

Última atualização: 2026-08-17 · 10 pontos de dados · artificialanalysis.ai

Coletados semanalmente pela nossa equipe editorial a partir de fontes primárias.

Ver o conjunto de dados completo