Lançamento do Modelo

Claude Opus 4.8: O que a Anthropic realmente entregou

O Claude Opus 4.8 foi lançado em 28 de maio de 2026 com codificação agentic mais robusta, maior honestidade sobre seu próprio trabalho, esforço alto por padrão, fluxos de trabalho dinâmicos no Claude Code e um modo rápido mais barato. Esta análise utiliza apenas fontes oficiais da Anthropic e do Claude.

Ilustração editorial para o Claude Opus 4.8 mostrando painéis de benchmark, dashboards de revisão de código e trabalho agentic de longa duração.

Get the latest on AI, LLMs & developer tools

New MCP servers, model updates, and guides like this one — delivered weekly.

O que é

Claude Opus 4.8 é o modelo Opus mais recente da Anthropic disponível para o público geral. A documentação oficial o descreve como o modelo mais capaz da empresa para raciocínio complexo, codificação agentic de longo prazo e trabalho de alta autonomia. Em termos simples: este lançamento é voltado para tarefas onde o modelo precisa manter o estado, usar ferramentas, inspecionar seu próprio trabalho e continuar por mais tempo do que um turno de chat normal.

O ID do modelo é claude-opus-4-8A documentação lista uma janela de contexto de 1M de tokens na Claude API, Amazon Bedrock e Vertex AI, com uma janela de contexto de 200k tokens no Microsoft Foundry no lançamento. A saída máxima síncrona da Messages API é de 128k tokens.

Model:        Claude Opus 4.8
API ID:       claude-opus-4-8
Context:      1M tokens on Claude API, Bedrock, Vertex AI
Output:       128k tokens on synchronous Messages API
Default effort: high
Regular API:  $5 input / $25 output per MTok
Fast mode:    $10 input / $50 output per MTok

Anúncio Oficial

O lançamento começou com a conta oficial do Claude no X e a publicação de lançamento da Anthropic. A afirmação é específica: o Opus 4.8 baseia-se no Opus 4.7 com um julgamento mais preciso, maior honestidade sobre o progresso e a capacidade de trabalhar de forma independente por mais tempo.

A publicação de lançamento da Anthropic acrescenta três mudanças de produto adjacentes: controle de esforço no claude.ai e Cowork, fluxos de trabalho dinâmicos no Claude Code e modo rápido para o Opus 4.8. Isso é importante porque o lançamento do modelo não é apenas uma troca de checkpoint. Ele muda a forma como os desenvolvedores devem definir o esforço, fazer cache de prompts e estruturar execuções de agentes mais longas.

Tabela de Benchmarks

O system card da Anthropic fornece a tabela verificada mais útil. Os números abaixo foram copiados como fatos do system card oficial e devem ser lidos como avaliações pré-implantação, não como uma promessa de que toda carga de trabalho em produção melhorará na mesma proporção.

AvaliaçãoOpus 4.8Opus 4.7O que observar
SWE-bench Verified88.687.6Pequeno ganho em issues reais verificadas do GitHub.
SWE-bench Pro69.264.3O salto principal em codificação da thread dos ClaudeDevs.
Terminal-Bench 2.174.666.1Ganho significativo em tarefas de agentes via linha de comando.
OSWorld-Verified83.482.8Pequeno ganho em tarefas reais de uso de computador no Ubuntu.
GraphWalks BFS 256K85.976.9A travessia de grafos em contextos longos melhora drasticamente.
GraphWalks Parents 256K99.393.6Resultado sólido de rastreamento de estado em contextos longos.

O system card também relata que o claude-opus-4-8 ocupa o primeiro lugar no FrontierSWE tanto em mean@5 quanto em best@5. Esse benchmark concede aos agentes 20 horas por tarefa, o que se alinha ao posicionamento da Anthropic: este lançamento é mais forte quando o trabalho é longo, complexo e exige uso intensivo de ferramentas.

O que mudou

Para desenvolvedores, as mudanças mais importantes não são cosméticas. O Opus 4.8 define como padrão high effort em todas as superfícies, suporta mensagens de sistema no meio da conversa, reduz o comprimento mínimo do prompt-cache para 1.024 tokens e mantém as restrições do Opus 4.7 em relação à amostragem e ao pensamento. Se a sua solicitação ainda enviar temperature, top_p, top_k ou

com valores não padrão, a Messages API a rejeitará. Orçamentos de pensamento estendido manual também não são suportados no Opus 4.8. Use o pensamento adaptativo com thinking: {type: "adaptive"}, e então controle a profundidade através de output_config.effort. A Anthropic recomenda xhigh para codificação e trabalho com agentes, com high como o padrão para a maioria das tarefas que exigem alta inteligência.

client.messages.create({
  model: "claude-opus-4-8",
  max_tokens: 64000,
  thinking: { type: "adaptive" },
  output_config: { effort: "xhigh" },
  messages: [{ role: "user", content: "Audit this migration plan." }]
})

Preços

O preço regular da API do Opus 4.8 permanece inalterado em relação ao Opus 4.7: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. O modo rápido para o Opus 4.8 é mais barato do que o modo rápido era para modelos Opus anteriores: a publicação de lançamento lista US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída.

A interpretação prática é simples. O modo padrão é o padrão para trabalho autônomo de longa duração. O modo rápido é para interações sensíveis à latência, depuração ao vivo e iteração rápida, onde pagar mais pela velocidade de saída vale a pena.

Notas de Segurança

The official system card is not pure launch marketing. It says Opus 4.8 improves over Opus 4.7 on most alignment measures and is much less likely to leave flaws in its own code unreported. The launch post summarizes that as roughly four times less likely than Opus 4.7 to let flaws in written code pass unremarked.

O mesmo cartão de sistema também aponta uma ressalva: o Opus 4.8 foi um pouco menos robusto que o Opus 4.7 em vários contextos de injeção de prompt em agentes antes de salvaguardas adicionais. A Anthropic afirma que as salvaguardas implementadas fecham essa lacuna na prática. Se você está criando um agente que lê páginas da web, e-mails, tickets ou conteúdo de repositório não confiáveis, essa ressalva deve constar no seu modelo de ameaças.

Quem deve usar

Use o Opus 4.8 primeiramente para sessões longas de codificação, refatorações em escala de repositório, revisão profunda de código, análise profissional de documentos, pesquisas com muitas fontes e loops de agentes que precisam de um plano estável ao longo de várias chamadas de ferramentas. Use Sonnet ou Haiku quando latência, custo ou throughput de alto volume forem mais importantes do que a qualidade máxima de raciocínio.

O veredito é restrito, mas claro: o Opus 4.8 não é uma nova categoria de produto dramática. É um Opus melhor para os cenários onde o Opus já era importante: trabalho de engenharia complexo, contexto longo e agentes que precisam admitir incertezas antes de quebrar algo.

Notas de Migração

  • Atualize a string do modelo para claude-opus-4-8.
  • Remova parâmetros de amostragem que não sejam padrão, caso ainda os esteja utilizando.
  • Use raciocínio adaptativo, não manual budget_tokens.
  • Defina o esforço explicitamente para cargas de trabalho em produção.
  • Remova cabeçalhos beta antigos de contexto de 1M na Claude API, Bedrock e Vertex AI.
  • Considere mensagens de sistema no meio da conversa para processos de longa duração.
  • Reavalie o custo e a latência, pois os níveis de esforço mudaram.

FAQ

O que é o Claude Opus 4.8?

O Claude Opus 4.8 é o mais novo modelo Opus da Anthropic disponível ao público, lançado em 28 de maio de 2026. A Anthropic o posiciona para raciocínio complexo, codificação agente de longo prazo e trabalho de alta autonomia.

Qual é o ID do modelo da API para o Claude Opus 4.8?

O ID do modelo da API Claude é claude-opus-4-8. A Anthropic também lista IDs de primeira parte correspondentes para Vertex AI e Claude Platform na AWS, além de um formato de ID específico para Bedrock.

Quanto custa o Claude Opus 4.8?

O uso regular da API permanece inalterado em relação ao Opus 4.7: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. O modo rápido para o Opus 4.8 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída.

Qual é a maior mudança para desenvolvedores no Opus 4.8?

As maiores mudanças na plataforma são o esforço alto por padrão, 1M de contexto por padrão na Claude API, raciocínio adaptativo, mensagens de sistema no meio da conversa, mínimos de prompt-cache mais baixos e melhor recuperação de contexto longo.

O Claude Opus 4.8 é melhor que o Opus 4.7?

A Anthropic o descreve como uma melhoria modesta, porém tangível. O cartão do sistema relata pontuações mais altas que as do Opus 4.7 na maioria das avaliações de capacidade, incluindo SWE-bench Pro, Terminal-Bench 2.1 e GraphWalks.

Fontes Oficiais

Relacionado: o guia de fluxos de trabalho dinâmicos do Claude Code e o guia de migração da API do Opus 4.8.