Quinta-feira, 24 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltar

V4.1 Flash

produto · 9 menções

O que as fontes disseram sobre V4.1 Flash

O V4.1 Flash é um modelo multimodal da DeepSeek com 552 bilhões de parâmetros e arquitetura MoE, ativando 8 bilhões para entrada e 16 bilhões para saída, superando o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes. Ele reduz o KV cache a cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash, suportando contextos de até um milhão de tokens. A partir de 14 de setembro, as requisições ao V4-Pro serão respondidas pelo V4.1-Flash e cobradas pela taxa do modelo menor, e a empresa planeja substituir modelos anteriores por ele.

Menções

  • A empresa está se preparando para uma oferta pública inicial no mercado STAR, em Xangai, e substituirá modelos anteriores pelo V4.1-Flash.

    O lançamento ocorre em meio a planos de abertura de capital, indicando expansão da startup.

    ver evento

  • O V4.1-Flash usa um design misto de especialistas com 552 bilhões de parâmetros, mantendo apenas 8 bilhões ativos durante o processamento e 16 bilhões na geração de respostas.

    Essa eficiência é central para a promessa de menor custo e maior velocidade.

    ver evento

  • A partir de 14 de setembro, as requisições ao V4-Pro serão respondidas pelo V4.1-Flash e cobradas pela taxa do modelo menor.

    Isso mostra a integração do novo modelo na infraestrutura de API da empresa, com impacto direto para usuários.

    ver evento

  • O modelo supera o V4-Pro em desempenho, custo, velocidade e tempo total de execução, segundo testes de múltiplas partes.

    Isso indica uma melhoria significativa sobre o modelo flagship anterior, apesar de ser menor.

    ver evento

  • A DeepSeek lançou o V4.1-Flash, o menor modelo da nova família, com 552 bilhões de parâmetros e capacidade de processamento visual.

    O lançamento define a nova arquitetura da empresa, focada em eficiência e multimodalidade.

    ver evento

  • O modelo V4.1 Flash é multimodal e consegue processar contextos de até um milhão de tokens.

    Isso o torna adequado para tarefas de agentes que exigem compreensão de grandes volumes de texto.

    ver evento

  • O V4.1 Flash reduz drasticamente o uso de memória para contextos longos, encolhendo o KV cache para cerca de um quarto do espaço usado pelo DeepSeek-V4-Flash.

    Menor uso de memória reduz custos operacionais para aplicações com agentes que processam longas sequências.

    ver evento

  • O V4.1 Flash tem 552 bilhões de parâmetros, mas ativa apenas 8 bilhões para processar entradas e 16 bilhões para gerar respostas, usando design de Mistura de Especialistas (MoE).

    Essa ativação seletiva reduz o poder computacional necessário por requisição, tornando o modelo mais eficiente.

    ver evento

  • A DeepSeek lançou o modelo V4.1 Flash, que usa uma nova arquitetura Causal-Encoder-Decoder e supera o V4 Pro em benchmarks de codificação, segurança cibernética e tarefas de agentes.

    Mostra a capacidade da DeepSeek de inovar e competir no mercado de IA, mesmo com restrições de chips.

    ver evento

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →