A DeepSeek lançou o V4.1-Flash, novo modelo de IA da empresa chinesa. A tecnologia foi apresentada como a menor da nova família de modelos da startup e promete respostas mais rápidas, maior capacidade de processamento e custos menores.
O lançamento acontece enquanto a DeepSeek começa a se preparar para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo a Reuters. A empresa também está substituindo modelos anteriores pelo V4.1-Flash.
Modelo quer fazer mais gastando menos
Embora seja considerado o menor modelo da nova família, o V4.1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inteligência artificial para processar informações e produzir respostas.
A tecnologia consegue usar apenas uma parte desses recursos durante cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas.
Para o usuário, a ideia é fazer o modelo funcionar com mais velocidade e atender um volume maior de solicitações sem exigir tantos recursos. A DeepSeek também afirma que o sistema foi preparado para facilitar a criação de modelos maiores no futuro.
“Apresentamos o menor modelo da nossa nova família de arquitetura, com compreensão visual nativa.”
O V4.1-Flash também consegue interpretar informações visuais, como imagens. Segundo a DeepSeek, testes feitos por diferentes partes colocaram o novo modelo à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução.
