Quinta-feira, 24 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltar

Terminal-Bench 4.0

produto · 2 menções

Menções

  • GPT-6 Astra atingiu 57,9% no Terminal-Bench 4.0, superando GPT-5.6 Sol (37,3%) e Claude Fable 5.1 (55,8%), com custo menor por tarefa.

    Indica eficiência em tarefas de terminal, um dos principais usos práticos para desenvolvedores.

    ver evento

  • O Fable 5.1 tem desempenho superior ao Fable 5 nos benchmarks mais difíceis, como matemática de competição e questões de pós-graduação em engenharia e ciências.

    Esse dado demonstra o avanço técnico do modelo em relação à versão anterior, o que é crucial para usuários que exigem alta precisão.

    ver evento

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →