O AGENTICO
DeepSeek lança V4.1 Flash com arquitetura inovadora
2 fontesdesde 10 de setembro de 20262 artigos
A DeepSeek anunciou o lançamento do modelo V4.1 Flash, que afirma superar seu antecessor em benchmarks de programação, segurança cibernética e tarefas de agentes autônomos, ao mesmo tempo em que reduz custos de inferência e melhora a velocidade. O modelo usa arquitetura Causal-Encoder-Decoder com 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, graças à mistura de especialistas (MoE). A novidade também reduz drasticamente o uso de memória para contextos longos, cortando o KV cache para cerca de um quarto do espaço usado pelo antecessor.


Resumo
A DeepSeek lançou o modelo V4.1 Flash, que usa uma nova arquitetura Causal-Encoder-Decoder e supera o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes.
Mostra a capacidade da DeepSeek de inovar e competir no mercado de IA, mesmo com restrições de chips.
O V4.1 Flash tem 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, usando design de Mistura de Especialistas (MoE).
Essa ativação seletiva reduz o poder computacional necessário por requisição, tornando o modelo mais eficiente.
O V4.1 Flash reduz drasticamente o uso de memória para contextos longos, encolhendo o KV cache para cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash.
Menor uso de memória reduz custos operacionais para aplicações com agentes que processam longas sequências.
No Terminal-Bench 2.1, o V4.1 Flash obteve 90,6 pontos, superando o GPT-5.6 Sol da OpenAI (88,8) e o Kimi K3 da Moonshot AI.
Indica que o modelo é competitivo com líderes de mercado em tarefas práticas de computação.
O modelo V4.1 Flash é multimodal e consegue processar contextos de até um milhão de tokens.
Isso o torna adequado para tarefas de agentes que exigem compreensão de grandes volumes de texto.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.