A Claude Opus 5 lidera o Benchmark de Inteligência com uma pontuação de 61 pontos, a um custo 26% inferior ao da Fable 5

De acordo com o mais recente benchmark da Artificial Analysis, Claude Opus 5 atingiu uma pontuação de 61 no Índice de Inteligência, ultrapassando por pouco a pontuação de 60 do Fable 5. O GPT-5.6 Sol obteve 59, e o Kimi K3 marcou 57.

O Opus 5 tem uma média de 2,03 dólares por tarefa, 26% abaixo dos 2,75 dólares do Fable 5. O modelo liderou as avaliações nos testes GDPval-AA v2 e AA-Briefcase para trabalho de conhecimento, e ficou em primeiro lugar no índice de agentes de programação quando emparelhado com Claude Code. Conseguiu 89% no Terminal-Bench v2.1, ficando muito perto do desempenho do GPT-5.6 Sol.

Aviso legal: As informações contidas nesta página podem provir de fontes externas e têm caráter meramente informativo. Não refletem os pontos de vista nem as opiniões da Gate e não constituem qualquer tipo de aconselhamento financeiro, de investimento ou jurídico. A negociação de ativos virtuais envolve um risco elevado. Não se baseie exclusivamente nas informações contidas nesta página ao tomar decisões. Para mais detalhes, consulte o Aviso legal.
Comentar
0/400
Nenhum comentário