O AGENTICO
Voltar
Terminal-Bench 4.0
produto · 2 menções
Menções

GPT-6 Astra atingiu 57,9% no Terminal-Bench 4.0, superando GPT-5.6 Sol (37,3%) e Claude Fable 5.1 (55,8%), com custo menor por tarefa.
Indica eficiência em tarefas de terminal, um dos principais usos práticos para desenvolvedores.

O Fable 5.1 tem desempenho superior ao Fable 5 nos benchmarks mais difíceis, como matemática de competição e questões de pós-graduação em engenharia e ciências.
Esse dado demonstra o avanço técnico do modelo em relação à versão anterior, o que é crucial para usuários que exigem alta precisão.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.