A DeepSeek lançou o DeepSeek-V4-Flash-Vision-Exp nesta sexta-feira (21). Além de textos, o novo modelo experimental de inteligência artificial (IA) consegue ler, interpretar e entender imagens. Segundo a empresa chinesa, o desempenho do novo modelo fica próximo ao do Opus 4.8, da concorrente americana Anthropic.
A IA da DeepSeek agora consegue “olhar” para fotos, capturas de tela e documentos para executar tarefas sem que o usuário precise dar instruções a cada passo. Os programadores podem usar essa novidade em seus projetos.
Novo modelo da DeepSeek: recursos visuais e disputa no mercado de IA
O novo modelo mantém as capacidades de texto da versão anterior, chamada DeepSeek-V4-Flash. Isso inclui o “raciocínio lógico”, o conhecimento geral e a capacidade de executar rotinas automatizadas. A diferença central é que o sistema agora processa dados de texto e imagem juntos.
Nos testes de desempenho focados em tarefas autônomas, chamadas de agentes, o modelo chinês chegou perto dos resultados do Opus 4.8, modelo avançado da Anthropic. Essa capacidade permite que a ferramenta observe uma imagem, entenda o contexto exibido na tela e tome decisões sozinha para concluir o trabalho solicitado.
Os programadores podem testar a novidade na plataforma da DeepSeek informando o nome do novo modelo no código de acesso. O envio das imagens para o sistema pode ser feito por meio de links da internet, códigos de arquivo ou pelo novo sistema de envio da própria empresa.
