A DeepSeek lançou oficialmente a série de pré-visualização V4 em 24 de abril, com o código aberto sob a licença MIT. Os pesos do modelo foram sincronizados e disponibilizados no Hugging Face e no ModelScope. De acordo com o relatório técnico da DeepSeek V4, o V4-Pro-Max (modo de maior intensidade de inferência) obteve 3206 pontos no benchmark do Codeforces, superando o GPT-5.4.

Especificações da arquitectura dos dois modelos MoE

De acordo com o relatório técnico da DeepSeek V4, a série V4 inclui dois modelos de mistura de especialistas (MoE):

V4-Pro: 1,6T parâmetros no total, 49B activados por token, suporta contexto de 1M tokens

V4-Flash: 284B parâmetros no total, 13B activados por token, suporta igualmente contexto de 1M tokens

De acordo com o relatório técnico, no contexto de 1M tokens, a FLOPs de inferência por token do V4-Pro é apenas 27% do V3.2; o cache KV desce para 10% do V3.2. Isto deve-se sobretudo às actualizações da arquitectura do mecanismo de atenção em mistura (CSA—Compressed Sparse Attention + HCA—Heavy Compressed Attention). O tamanho do conjunto de dados de pré-treino excede 32T tokens; o optimizador de treino foi actualizado para Muon.

Metodologia de pós-treino: a destilação de estratégia online substitui a aprendizagem por reforço de mistura

De acordo com o relatório técnico da DeepSeek V4, a principal actualização no pós-treino do V4 reside em substituir totalmente a fase de aprendizagem por reforço de mistura (mixed RL) do V3.2 por destilação de estratégia online (On-Policy Distillation, OPD). O novo processo divide-se em duas etapas: em primeiro lugar, treinar especialistas de domínio separadamente para domínios como matemática, código, Agent e seguimento de instruções (SFT + aprendizagem por reforço GRPO); em seguida, usar vários professores OPD para destilar as capacidades de mais de uma dúzia de especialistas para um único modelo unificado, alinhando via logit para evitar conflitos de capacidades comuns nos métodos tradicionais.

O relatório introduz também um modelo de recompensa gerativa (Generative Reward Model, GRM), para tarefas que são difíceis de validar com regras. Com poucos dados de anotações humanas diversificadas para treinar, o modelo assume simultaneamente funções de geração e avaliação.

Resultados dos testes de benchmark: liderança na codificação, ainda há diferenças na inferência de conhecimento

De acordo com o relatório técnico da DeepSeek V4, os resultados de comparação entre o V4-Pro-Max e Opus 4.6 Max, GPT-5.4 xHigh e Gemini 3.1 Pro High (excluindo o GPT-5.5 e o Opus 4.7 lançados recentemente):

Codeforces：3206（GPT-5.4：3168 / Gemini 3.1 Pro：3052）→ o mais alto no geral

LiveCodeBench：93.5 → o mais alto no geral

SWE Verified：80.6, atrás do Opus 4.6 de 80.8, menos 0.2 pontos percentuais

GPQA Diamond：90.1, atrás do Gemini 3.1 Pro de 94.3

SimpleQA-Verified：57.9, atrás do Gemini 3.1 Pro de 75.6

HLE：37.7, atrás do Gemini 3.1 Pro de 44.4

O relatório técnico aponta ainda que as comparações acima não incluem o GPT-5.5 e o Opus 4.7, lançados recentemente. A diferença entre o V4 e os modelos mais recentes fechados carece de validação através de testes de terceiros.

Perguntas frequentes

Quais são os termos de licença de código aberto do pré-visualização DeepSeek V4 e onde os posso obter?

De acordo com o anúncio oficial da DeepSeek de 24 de abril, a série V4 é de código aberto sob a licença MIT. Os pesos do modelo já foram disponibilizados no Hugging Face e no ModelScope, e aplicam-se a usos comerciais e académicos.

Qual é a diferença no tamanho dos parâmetros entre o DeepSeek V4-Pro e o V4-Flash?

De acordo com o relatório técnico da DeepSeek V4, o V4-Pro tem 1,6T parâmetros no total, com 49B activados por token; o V4-Flash tem 284B parâmetros no total, com 13B activados por token. Ambos suportam contexto de 1M tokens.

Quais são os resultados da comparação de benchmark entre o DeepSeek V4-Pro-Max e o GPT-5.4 e o Gemini 3.1 Pro?

De acordo com o relatório técnico da DeepSeek V4, o V4-Pro-Max superou o GPT-5.4 e o Gemini 3.1 Pro em dois benchmarks: Codeforces (3206 pontos) e LiveCodeBench (93.5). No entanto, em benchmarks intensivos em conhecimento (GPQA Diamond, SimpleQA-Verified, HLE) continua a ficar atrás do Gemini 3.1 Pro; o conjunto de comparação não inclui o GPT-5.5 e o Opus 4.7.

Isenção de responsabilidade: As informações contidas nesta página podem ser provenientes de terceiros e não representam os pontos de vista ou opiniões da Gate. O conteúdo apresentado nesta página é apenas para referência e não constitui qualquer aconselhamento financeiro, de investimento ou jurídico. A Gate não garante a exatidão ou o carácter exaustivo das informações e não poderá ser responsabilizada por quaisquer perdas resultantes da utilização destas informações. Os investimentos em ativos virtuais implicam riscos elevados e estão sujeitos a uma volatilidade de preços significativa. Pode perder todo o seu capital investido. Compreenda plenamente os riscos relevantes e tome decisões prudentes com base na sua própria situação financeira e tolerância ao risco. Para mais informações, consulte a Isenção de responsabilidade.

A Google Planeia Investir Até $40 Mil Milhões na Anthropic, Compromete 5+ Gigawatts de Poder de Computação

Notícias da indústria de IA

Mensagem da Gate News, 24 de Abril — De acordo com fontes do mercado, a Google planeia investir até $40 mil milhões na Anthropic. O investimento começará com um montante inicial de $10 mil milhões em numerário, seguido de até mais $30 mil milhões, condicionado ao cumprimento de marcos especificados. A Google também vai fornecer à Anthropic, no âmbito da parceria, pelo menos 5 gigawatts de poder de computação.

GateNews1h atrás

O regulador suíço FINMA alerta que a ferramenta de IA Mythos da Anthropic representa risco financeiro

Notícias da indústria de IA

Mensagem do Gate News, 24 de abril — a Autoridade de Supervisão dos Mercados Financeiros da Suíça (FINMA) afirmou que permitir que os bancos adoptem de forma rápida e conveniente a ferramenta de inteligência artificial da Anthropic Mythos representaria riscos sérios para o

GateNews1h atrás

DeepSeek V4 é lançado com uma janela de contexto de 1M; chips Huawei Ascend e Cambricon alcançam compatibilidade total

Notícias da indústria de IA

Gate News mensagem, 24 de abril — O DeepSeek V4-Pro e o DeepSeek V4-Flash foram oficialmente lançados e open-source em 24 de abril, com o comprimento de contexto de processamento significativamente expandido de 128K para 1M, representando um aumento de capacidade de quase 10 vezes. A Huawei Computing anunciou que os seus produtos de supernó Ascend

GateNews2h atrás

Fere AI conclui ronda de financiamento de $1,3M liderada pela Ethereal Ventures

Agente de IA Notícias da indústria de IA

Mensagem do Gate News, 24 de Abril — A Fere AI, uma plataforma de agentes de negociação de activos digitais com base em IA, anunciou a conclusão de uma ronda de financiamento de $1,3 milhões liderada pela Ethereal Ventures, com a participação da Galaxy Vision Hill e da Kosmos Ventures. A plataforma suporta redes cross-chain, incluindo a Ethereum,

GateNews2h atrás

A Anthropic reverte as alterações do Claude Code após quebra de qualidade; todas as correções concluídas

Notícias da indústria de IA

Mensagem de Gate News, 24 de abril — A Anthropic reconheceu uma recente quebra na qualidade do Claude Code e confirmou que todos os problemas relacionados foram resolvidos através de rollbacks e correções. Os problemas tiveram origem em três ajustes de produto e de prompts realizados entre o início e meados de abril. Em 4 de março, a

GateNews4h atrás

Cofundador da NeoSoul Kaelan: A Indústria de IA Deve Permitir que Existam Brinquedos; a Inovação Frequentemente Começa como Produtos Experimentais

Notícias da indústria de IA

Mensagem do Gate News, 24 de Abril — Num recente fórum em Hong Kong sobre finanças inteligentes encriptadas, o cofundador da NeoSoul, Kaelan, partilhou conhecimentos sobre como avaliar projectos de IA numa fase inicial, numa indústria de IA em rápida evolução. Para além de avaliar os produtos actuais, as equipas devem demonstrar a capacidade de acompanhar as capacidades dos modelos subjacentes, afirmou.

GateNews4h atrás

Comentar

0/400

Nenhum comentário