DeepSeek lança V4.1 Flash com arquitetura inovadora

10 de setembro de 2026 · 2 fontes independentes

A DeepSeek lançou o modelo V4.1 Flash, que usa uma nova arquitetura Causal-Encoder-Decoder e supera o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes.

Mostra a capacidade da DeepSeek de inovar e competir no mercado de IA, mesmo com restrições de chips.

O V4.1 Flash tem 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, usando design de Mistura de Especialistas (MoE).

Essa ativação seletiva reduz o poder computacional necessário por requisição, tornando o modelo mais eficiente.

O V4.1 Flash reduz drasticamente o uso de memória para contextos longos, encolhendo o KV cache para cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash.

Menor uso de memória reduz custos operacionais para aplicações com agentes que processam longas sequências.

No Terminal-Bench 2.1, o V4.1 Flash obteve 90,6 pontos, superando o GPT-5.6 Sol da OpenAI (88,8) e o Kimi K3 da Moonshot AI.

Indica que o modelo é competitivo com líderes de mercado em tarefas práticas de computação.

O modelo V4.1 Flash é multimodal e consegue processar contextos de até um milhão de tokens.

Isso o torna adequado para tarefas de agentes que exigem compreensão de grandes volumes de texto.

Confirmado por

  • South China Morning Post
  • The Decoder
Ler no O agêntico