Quarta-feira, 23 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltarver como story →

DeepSeek lança V4.1 Flash com arquitetura inovadora

2 fontesdesde 10 de setembro de 20262 artigos

A DeepSeek anunciou o lançamento do modelo V4.1 Flash, que afirma superar seu antecessor em benchmarks de programação, segurança cibernética e tarefas de agentes autônomos, ao mesmo tempo em que reduz custos de inferência e melhora a velocidade. O modelo usa arquitetura Causal-Encoder-Decoder com 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, graças à mistura de especialistas (MoE). A novidade também reduz drasticamente o uso de memória para contextos longos, cortando o KV cache para cerca de um quarto do espaço usado pelo antecessor.

Resumo

  • A DeepSeek lançou o modelo V4.1 Flash, que usa uma nova arquitetura Causal-Encoder-Decoder e supera o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes.

    Mostra a capacidade da DeepSeek de inovar e competir no mercado de IA, mesmo com restrições de chips.

  • O V4.1 Flash tem 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, usando design de Mistura de Especialistas (MoE).

    Essa ativação seletiva reduz o poder computacional necessário por requisição, tornando o modelo mais eficiente.

  • O V4.1 Flash reduz drasticamente o uso de memória para contextos longos, encolhendo o KV cache para cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash.

    Menor uso de memória reduz custos operacionais para aplicações com agentes que processam longas sequências.

  • No Terminal-Bench 2.1, o V4.1 Flash obteve 90,6 pontos, superando o GPT-5.6 Sol da OpenAI (88,8) e o Kimi K3 da Moonshot AI.

    Indica que o modelo é competitivo com líderes de mercado em tarefas práticas de computação.

  • O modelo V4.1 Flash é multimodal e consegue processar contextos de até um milhão de tokens.

    Isso o torna adequado para tarefas de agentes que exigem compreensão de grandes volumes de texto.

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →