O AGENTICO
GPT-OSS 120B
modelo · 4 menções
O que as fontes disseram sobre GPT-OSS 120B
As fontes relataram que o GPT-OSS 120B é um dos modelos abertos utilizados nos testes do chip Jalapeño, o primeiro chip de inferência personalizado da OpenAI, desenvolvido em colaboração com a Broadcom. No benchmark InferenceX da SemiAnalysis, esse chip, testado com o GPT-OSS 120B, o DeepSeek R1 e o Kimi K2.5 1T, entregou de 1,5 a 1,9 vezes mais trabalho de IA por watt e de 1,7 a 3,6 vezes menor latência de ponta a ponta do que sistemas Nvidia Blackwell. O desempenho foi consistente tanto em modelos desenvolvidos internamente quanto externamente.
Menções

O chip Jalapeño é um ASIC de inferência de propósito geral, co-desenvolvido com a Broadcom, e os testes foram realizados com modelos abertos como GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
O chip foi projetado para ser versátil, funcionando bem com modelos da própria OpenAI e de terceiros, o que amplia sua aplicação.

O chip Jalapeño da OpenAI foi testado com os modelos GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T, mostrando desempenho consistente em modelos desenvolvidos tanto interna quanto externamente.
A compatibilidade com modelos de diferentes origens demonstra a versatilidade do chip, que não é otimizado apenas para os modelos da OpenAI.

Os testes do chip Jalapeño foram realizados com os modelos GPT-OSS 120B, DeepSeek R1 670B e Kimi K2.5 1T, todos modelos abertos.
O artigo 8 especifica que os modelos testados são abertos, um detalhe que não aparece em todas as fontes, indicando que o chip não é otimizado apenas para modelos proprietários.

A OpenAI divulgou os primeiros resultados do Jalapeño, seu primeiro chip de inferência personalizado desenvolvido em colaboração com a Broadcom, que, no benchmark InferenceX da SemiAnalysis, entregou de 1,5 a 1,9 vezes mais trabalho de IA por watt e de 1,7 a 3,6 vezes menor latência de ponta a ponta do que sistemas Nvidia Blackwell, nos modelos GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
Os números indicam que a OpenAI pode reduzir custos e melhorar a experiência de usuários em inferência de IA, pressionando a Nvidia no mercado de chips para data centers.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.