O AGENTICO
DeepSeek R1
modelo · 3 menções
O que as fontes disseram sobre DeepSeek R1
De acordo com as fontes, o DeepSeek R1 foi um dos modelos utilizados nos testes do chip Jalapeño, primeiro chip de inferência personalizado da OpenAI desenvolvido em colaboração com a Broadcom. Nos benchmarks InferenceX da SemiAnalysis, o chip entregou de 1,5 a 1,9 vezes mais trabalho de IA por watt e de 1,7 a 3,6 vezes menor latência de ponta a ponta do que sistemas Nvidia Blackwell ao rodar modelos como o DeepSeek R1. O DeepSeek R1 também foi citado entre os modelos abertos testados, com desempenho consistente em modelos desenvolvidos tanto interna quanto externamente.
Menções

O chip Jalapeño é um ASIC de inferência de propósito geral, co-desenvolvido com a Broadcom, e os testes foram realizados com modelos abertos como GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
O chip foi projetado para ser versátil, funcionando bem com modelos da própria OpenAI e de terceiros, o que amplia sua aplicação.

O chip Jalapeño da OpenAI foi testado com os modelos GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T, mostrando desempenho consistente em modelos desenvolvidos tanto interna quanto externamente.
A compatibilidade com modelos de diferentes origens demonstra a versatilidade do chip, que não é otimizado apenas para os modelos da OpenAI.

A OpenAI divulgou os primeiros resultados do Jalapeño, seu primeiro chip de inferência personalizado desenvolvido em colaboração com a Broadcom, que, no benchmark InferenceX da SemiAnalysis, entregou de 1,5 a 1,9 vezes mais trabalho de IA por watt e de 1,7 a 3,6 vezes menor latência de ponta a ponta do que sistemas Nvidia Blackwell, nos modelos GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
Os números indicam que a OpenAI pode reduzir custos e melhorar a experiência de usuários em inferência de IA, pressionando a Nvidia no mercado de chips para data centers.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.