DeepSeek V4 estreia com 1,6 trilhão de parâmetros e 1M de contexto
A chinesa DeepSeek anunciou o lançamento oficial do modelo DeepSeek V4, agora disponível em código aberto. A empresa destaca que a nova versão oferece suporte a um contexto de até 1 milhão de tokens, uma capacidade que promete revolucionar aplicações de IA de grande escala. O lançamento inclui duas variantes: a Pro e a Flash, ambas acessíveis no site oficial da DeepSeek por meio de modos Instantâneo e Especialista. Além disso, a empresa atualizou sua API, que já está operacional desde hoje.
A principal diferença entre os modelos Pro e Flash não está apenas na capacidade de contexto, mas também no número total de parâmetros e parâmetros ativos. Enquanto a versão Pro conta com impressionantes 1,6 trilhões de parâmetros totais e 49 bilhões de parâmetros ativos, a Flash é mais enxuta, com 284 bilhões de parâmetros totais e 13 bilhões ativos. Essa discrepância reflete diretamente no desempenho e nos casos de uso recomendados para cada uma das variantes.
A DeepSeek afirma que o modelo Pro entrega capacidades avançadas de agentes autônomos, um vasto conhecimento geral que supera todos os modelos abertos atualmente disponíveis — inclusive o Gemini 3.1 Pro — e um raciocínio de nível mundial, superando concorrentes em tarefas de matemática, ciências exatas e programação. Além disso, o Pro rivaliza com os principais modelos proprietários do mercado, como o GPT-4 e o Claude 3.5 Sonnet.
Já a versão Flash, embora menos robusta, não fica para trás em termos de desempenho. Ela oferece capacidades de raciocínio próximas às do Pro em tarefas simples envolvendo agentes, além de apresentar uma relação custo-benefício mais atraente. Segundo a empresa, a Flash é ideal para desenvolvedores e empresas que buscam um equilíbrio entre performance e custo, sem abrir mão da qualidade.
Os preços da API refletem essa diferença de escala e complexidade. Para o modelo Flash, o custo de entrada é de apenas R$ 0,28 (ou R$ 1,40 em caso de falta de cache), enquanto a saída custa R$ 2,80. Já o Pro tem valores mais elevados: R$ 1,45 (cache hit) ou R$ 8,70 (cache miss) para entrada, e R$ 17,40 para saída. Esses valores demonstram que, embora o Pro seja mais caro, ele oferece um desempenho superior em tarefas complexas.
Para começar a usar os modelos, basta acessar o chat oficial no endereço https://chat.deepseek.com/. Quem deseja baixar os pesos abertos dos modelos pode conferir no repositório oficial da DeepSeek, enquanto aqueles interessados em detalhes técnicos podem acessar o relatório completo da empresa. A iniciativa reforça o compromisso da DeepSeek em democratizar o acesso a modelos de linguagem de grande porte, mesmo com custos elevados de infraestrutura.
O lançamento do DeepSeek V4 chega em um momento de intensa competição no mercado de IA, especialmente entre modelos abertos e proprietários. Enquanto empresas como a Mistral AI e a Meta já haviam lançado modelos com grande número de parâmetros, a DeepSeek se destaca ao oferecer uma alternativa competitiva em termos de custo e desempenho. A estratégia da empresa chinesa pode atrair desenvolvedores e empresas que buscam reduzir dependência de soluções fechadas, como as da OpenAI ou Google.
A comunidade de IA open source tem recebido bem o lançamento, embora alguns especialistas já comecem a questionar a viabilidade de modelos com mais de 1 trilhão de parâmetros, devido aos altos custos computacionais envolvidos. Ainda assim, a DeepSeek parece confiante em sua capacidade de escalar, graças a otimizações em sua arquitetura e à parceria com provedores de nuvem que oferecem infraestrutura especializada para IA.
Com esse lançamento, a DeepSeek não apenas desafia os gigantes do setor, mas também reafirma seu papel como uma das principais forças no desenvolvimento de modelos de linguagem avançados. A empresa já planeja futuras atualizações, incluindo versões ainda mais otimizadas e especializadas para domínios específicos, como saúde e direito. Enquanto isso, desenvolvedores ao redor do mundo já começam a experimentar o potencial do DeepSeek V4 em seus projetos.