Sábado, 29 de agosto de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltar

Nvidia anuncia produção do acelerador Groq 3 LPX e destaca desempenho em benchmark

3 fontesdesde 24 de agosto de 20263 artigos

A Nvidia apresentou o acelerador de inferência Groq 3 LPX no Hot Chips 2026, já em produção, com base no chip LP30. Um benchmark da Artificial Analysis mostrou 3.431 tokens por segundo em uma carga de trabalho específica, cerca de quatro vezes mais rápido que concorrentes, mas especialistas questionam a comparação devido ao uso de múltiplos chips.

Resumo

  • O Groq 3 LPX foi apresentado para estender a capacidade da plataforma, servindo modelos com alto interactividade e contexto longo.

    Ele é apresentado como um componente-chave para workloads de agentic e interações em tempo real da nova plataforma.

  • A Nvidia iniciou a produção em massa do chip Groq 3 LPX, fabricado pela Samsung Foundry.

    Confirma que o chip de inferência da Nvidia, baseado na tecnologia Groq, já está em produção em larga escala.

  • Em benchmark da Artificial Analysis, o sistema Groq 3 LPX atingiu 3.431 tokens por segundo em uma carga de trabalho Gemma 4 31B com contexto de 100K.

    O desempenho medido por terceiros confirma a alta velocidade do sistema em cenários de raciocínio com contexto longo.

  • O desempenho do Groq 3 LPX é cerca de quatro vezes maior que o do próximo endpoint público mais rápido, que registrou 870 tokens por segundo.

    A comparação de velocidade coloca o sistema da Nvidia muito à frente da concorrência em inferência de baixa latência.

  • A Nvidia pagou US$ 20 bilhões pela licença da Groq e contratou o fundador Jonathan Ross e a presidente Sunny Madra em dezembro de 2025.

    O valor e os termos do acordo com a Groq são essenciais para entender a estratégia da Nvidia no mercado de inferência.

  • A Nvidia iniciou a produção em massa do acelerador de inferência Groq 3 LPX, baseado no chip LP30.

    O chip foi apresentado no evento Hot Chips 2026 e já está em produção, conforme declaração de Igor Arsovski, VP de hardware da Nvidia.

  • O benchmark da Artificial Analysis mediu 3.431 tokens por segundo no Groq 3 LPX com modelo Gemma 4 31B e contexto de 100K, cerca de quatro vezes mais rápido que o endpoint público mais veloz.

    O teste terceirizado mostrou desempenho superior, mas especialistas apontam que a comparação favorece a Nvidia, pois o sistema usa pelo menos 64 chips, enquanto concorrentes usam um ou dois.

Citações

  • Artificial Analysis measured it at 3,431 output tokens per second on a 100K-context Gemma 4 31B reasoning workload

    Igor Arsovski, VP de hardware da Nvidia

  • Arsovski said the rack is already in production, built on the LP30 chip Nvidia obtained through its $20 billion Groq deal in December 2025

    Igor Arsovski, VP de hardware da Nvidia

  • Artificial Analysis measured it at 3,431 output tokens per second on a 100K-context Gemma 4 31B reasoning workload, roughly four times the 870 tokens per second of the next-fastest public endpoint.

    Igor Arsovski, VP de hardware da Nvidia

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →