O AGENTICO
V4.1 Flash
produto · 9 menções
O que as fontes disseram sobre V4.1 Flash
O V4.1 Flash é um modelo multimodal da DeepSeek com 552 bilhões de parâmetros e arquitetura MoE, ativando 8 bilhões para entrada e 16 bilhões para saída, superando o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes. Ele reduz o KV cache a cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash, suportando contextos de até um milhão de tokens. A partir de 14 de setembro, as requisições ao V4-Pro serão respondidas pelo V4.1-Flash e cobradas pela taxa do modelo menor, e a empresa planeja substituir modelos anteriores por ele.
Menções

A empresa está se preparando para uma oferta pública inicial no mercado STAR, em Xangai, e substituirá modelos anteriores pelo V4.1-Flash.
O lançamento ocorre em meio a planos de abertura de capital, indicando expansão da startup.

O V4.1-Flash usa um design misto de especialistas com 552 bilhões de parâmetros, mantendo apenas 8 bilhões ativos durante o processamento e 16 bilhões na geração de respostas.
Essa eficiência é central para a promessa de menor custo e maior velocidade.

A partir de 14 de setembro, as requisições ao V4-Pro serão respondidas pelo V4.1-Flash e cobradas pela taxa do modelo menor.
Isso mostra a integração do novo modelo na infraestrutura de API da empresa, com impacto direto para usuários.

O modelo supera o V4-Pro em desempenho, custo, velocidade e tempo total de execução, segundo testes de múltiplas partes.
Isso indica uma melhoria significativa sobre o modelo flagship anterior, apesar de ser menor.

A DeepSeek lançou o V4.1-Flash, o menor modelo da nova família, com 552 bilhões de parâmetros e capacidade de processamento visual.
O lançamento define a nova arquitetura da empresa, focada em eficiência e multimodalidade.

O modelo V4.1 Flash é multimodal e consegue processar contextos de até um milhão de tokens.
Isso o torna adequado para tarefas de agentes que exigem compreensão de grandes volumes de texto.

O V4.1 Flash reduz drasticamente o uso de memória para contextos longos, encolhendo o KV cache para cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash.
Menor uso de memória reduz custos operacionais para aplicações com agentes que processam longas sequências.

O V4.1 Flash tem 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, usando design de Mistura de Especialistas (MoE).
Essa ativação seletiva reduz o poder computacional necessário por requisição, tornando o modelo mais eficiente.

A DeepSeek lançou o modelo V4.1 Flash, que usa uma nova arquitetura Causal-Encoder-Decoder e supera o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes.
Mostra a capacidade da DeepSeek de inovar e competir no mercado de IA, mesmo com restrições de chips.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.