DeepSeek lança V4 Flash Vision Exp com suporte a imagens

18 de agosto de 2026 · 4 fontes independentes

A DeepSeek lançou o DeepSeek-V4-Flash-Vision-Exp, um modelo experimental multimodal que adiciona processamento de imagens às capacidades de texto.

Isso marca a expansão da DeepSeek para modelos que entendem imagens, competindo diretamente com empresas como a Anthropic.

Segundo a DeepSeek, o desempenho do novo modelo em tarefas de agente fica próximo ao do Opus 4.8, da Anthropic.

Isso posiciona o modelo chinês como um concorrente forte no mercado de IA multimodal.

O modelo mantém as capacidades de texto da versão anterior, incluindo raciocínio lógico e conhecimento geral.

Isso significa que não há perda de desempenho em tarefas de texto ao adicionar a visão.

Os desenvolvedores podem enviar imagens ao modelo usando codificação Base64, URLs públicas ou a nova API de arquivos gratuita.

Essa flexibilidade facilita a integração do modelo em diferentes aplicações.

O modelo superou o Opus 4.8 da Anthropic em dois benchmarks visuais, chamados ALE e ZeroBench.

Embora seja rival em tarefas gerais, ele se destaca especificamente em análise de imagens.

Confirmado por

  • CoinCentral
  • Olhar Digital
  • SiliconANGLE (AI)
  • The Decoder
  • UOL Tecnologia
Ler no O agêntico