AI News
News 13 de agosto de 2026

Claude 4 da Anthropic supera GPT-5 em testes de raciocínio

Novo modelo da Anthropic supera concorrentes em benchmarks de raciocínio matemático e análise de documentos longos.

Por Redação IA News · Fonte: The Verge
Rede neural abstrata em violeta e âmbar com nós luminosos sobre fundo preto, simbolizando IA segura e avançada da Anthropic

A Anthropic lançou o Claude 4, que segundo testes independentes supera o GPT-5 em raciocínio matemático, análise de documentos extensos e tarefas de programação.

Os benchmarks mostram:

  • 92% no MMLU (vs 89% do GPT-5)
  • 88% no GSM8K (raciocínio matemático)
  • 95% no HumanEval (programação)
  • Capacidade de analisar 500k tokens

O Claude 4 está disponível via API e na interface web, com preços competitivos.

Tags

ClaudeAnthropicbenchmark