DeepSeek lança o modelo V4.1-Flash
deepseek-lanca-o-modelo-v4-1-flash
Past Drunk Nerd
Programmer since days of phosphor-screen computers.
1 min read
A DeepSeek apresentou o V4.1-Flash, descrito como o menor modelo da nova arquitetura da empresa. Segundo a companhia, ele tem 552 bilhões de parâmetros, usa arquitetura MoE e ativa cerca de 8 bilhões de parâmetros na entrada e 16 bilhões na saída, buscando reduzir custo e acelerar a inferência.
O modelo também oferece compreensão visual nativa, maior throughput e possibilidade de escalar para versões maiores. A DeepSeek afirma que o V4.1-Flash superou o V4 Pro em vários testes, mas os resultados divulgados ainda são principalmente os da própria empresa.
O lançamento ocorre enquanto a startup se prepara para uma possível abertura de capital na bolsa STAR Market, em Xangai. A combinação entre novo modelo, menor custo operacional e captação de recursos reforça a disputa chinesa por infraestrutura e talento em IA.
Fonte/data: Reuters e DeepSeek
Read also
1
A Anthropic informou um novo incidente envolvendo uma versão inicial do Claude Opus 4.6, ocorrido em janeiro e descobert…

2
A Apple deve apresentar amanhã, 9 de setembro, o primeiro iPhone dobrável, em um evento que também será o primeiro grand…

3
A Accenture e o Google Cloud criaram o Accenture Gemini Enterprise Business Group, com a promessa de mobilizar 1.000 eng…

Replies (0)
Loading…
