A DeepSeek lançou uma pré-visualização de código aberto da V4, com uma pontuação técnica de 3206, superando o GPT-5.4

DeepSeek V4開源預覽版

A DeepSeek lançou oficialmente a série de pré-visualização V4 em 24 de abril, com o código aberto sob a licença MIT. Os pesos do modelo foram sincronizados e disponibilizados no Hugging Face e no ModelScope. De acordo com o relatório técnico da DeepSeek V4, o V4-Pro-Max (modo de maior intensidade de inferência) obteve 3206 pontos no benchmark do Codeforces, superando o GPT-5.4.

Especificações da arquitectura dos dois modelos MoE

De acordo com o relatório técnico da DeepSeek V4, a série V4 inclui dois modelos de mistura de especialistas (MoE):

V4-Pro: 1,6T parâmetros no total, 49B activados por token, suporta contexto de 1M tokens

V4-Flash: 284B parâmetros no total, 13B activados por token, suporta igualmente contexto de 1M tokens

De acordo com o relatório técnico, no contexto de 1M tokens, a FLOPs de inferência por token do V4-Pro é apenas 27% do V3.2; o cache KV desce para 10% do V3.2. Isto deve-se sobretudo às actualizações da arquitectura do mecanismo de atenção em mistura (CSA—Compressed Sparse Attention + HCA—Heavy Compressed Attention). O tamanho do conjunto de dados de pré-treino excede 32T tokens; o optimizador de treino foi actualizado para Muon.

Metodologia de pós-treino: a destilação de estratégia online substitui a aprendizagem por reforço de mistura

De acordo com o relatório técnico da DeepSeek V4, a principal actualização no pós-treino do V4 reside em substituir totalmente a fase de aprendizagem por reforço de mistura (mixed RL) do V3.2 por destilação de estratégia online (On-Policy Distillation, OPD). O novo processo divide-se em duas etapas: em primeiro lugar, treinar especialistas de domínio separadamente para domínios como matemática, código, Agent e seguimento de instruções (SFT + aprendizagem por reforço GRPO); em seguida, usar vários professores OPD para destilar as capacidades de mais de uma dúzia de especialistas para um único modelo unificado, alinhando via logit para evitar conflitos de capacidades comuns nos métodos tradicionais.

O relatório introduz também um modelo de recompensa gerativa (Generative Reward Model, GRM), para tarefas que são difíceis de validar com regras. Com poucos dados de anotações humanas diversificadas para treinar, o modelo assume simultaneamente funções de geração e avaliação.

Resultados dos testes de benchmark: liderança na codificação, ainda há diferenças na inferência de conhecimento

De acordo com o relatório técnico da DeepSeek V4, os resultados de comparação entre o V4-Pro-Max e Opus 4.6 Max, GPT-5.4 xHigh e Gemini 3.1 Pro High (excluindo o GPT-5.5 e o Opus 4.7 lançados recentemente):

Codeforces:3206(GPT-5.4:3168 / Gemini 3.1 Pro:3052)→ o mais alto no geral

LiveCodeBench:93.5 → o mais alto no geral

SWE Verified:80.6, atrás do Opus 4.6 de 80.8, menos 0.2 pontos percentuais

GPQA Diamond:90.1, atrás do Gemini 3.1 Pro de 94.3

SimpleQA-Verified:57.9, atrás do Gemini 3.1 Pro de 75.6

HLE:37.7, atrás do Gemini 3.1 Pro de 44.4

O relatório técnico aponta ainda que as comparações acima não incluem o GPT-5.5 e o Opus 4.7, lançados recentemente. A diferença entre o V4 e os modelos mais recentes fechados carece de validação através de testes de terceiros.

Perguntas frequentes

Quais são os termos de licença de código aberto do pré-visualização DeepSeek V4 e onde os posso obter?

De acordo com o anúncio oficial da DeepSeek de 24 de abril, a série V4 é de código aberto sob a licença MIT. Os pesos do modelo já foram disponibilizados no Hugging Face e no ModelScope, e aplicam-se a usos comerciais e académicos.

Qual é a diferença no tamanho dos parâmetros entre o DeepSeek V4-Pro e o V4-Flash?

De acordo com o relatório técnico da DeepSeek V4, o V4-Pro tem 1,6T parâmetros no total, com 49B activados por token; o V4-Flash tem 284B parâmetros no total, com 13B activados por token. Ambos suportam contexto de 1M tokens.

Quais são os resultados da comparação de benchmark entre o DeepSeek V4-Pro-Max e o GPT-5.4 e o Gemini 3.1 Pro?

De acordo com o relatório técnico da DeepSeek V4, o V4-Pro-Max superou o GPT-5.4 e o Gemini 3.1 Pro em dois benchmarks: Codeforces (3206 pontos) e LiveCodeBench (93.5). No entanto, em benchmarks intensivos em conhecimento (GPQA Diamond, SimpleQA-Verified, HLE) continua a ficar atrás do Gemini 3.1 Pro; o conjunto de comparação não inclui o GPT-5.5 e o Opus 4.7.

Isenção de responsabilidade: As informações contidas nesta página podem ser provenientes de terceiros e não representam os pontos de vista ou opiniões da Gate. O conteúdo apresentado nesta página é apenas para referência e não constitui qualquer aconselhamento financeiro, de investimento ou jurídico. A Gate não garante a exatidão ou o carácter exaustivo das informações e não poderá ser responsabilizada por quaisquer perdas resultantes da utilização destas informações. Os investimentos em ativos virtuais implicam riscos elevados e estão sujeitos a uma volatilidade de preços significativa. Pode perder todo o seu capital investido. Compreenda plenamente os riscos relevantes e tome decisões prudentes com base na sua própria situação financeira e tolerância ao risco. Para mais informações, consulte a Isenção de responsabilidade.

Related Articles

A Anthropic prepara um assistente proactivo “Orbit” que liga seis ferramentas, incluindo GitHub e Figma

De acordo com os achados de código monitorizados pela Beating, a Anthropic está a preparar uma nova funcionalidade proactiva de assistente chamada Orbit que se liga ao Gmail, Slack, GitHub, Calendar, Drive e Figma. A funcionalidade utiliza um mecanismo de opt-in e gera briefings personalizados a partir das ferramentas de trabalho ligadas, enquanto

GateNews18m atrás

Vertex Ventures apoia a startup de IA de Singapura ReN3 com $5M a 5 de maio

De acordo com a Vertex Ventures Southeast Asia and India, a startup de IA empresarial ReN3, com sede em Singapura, angariou 5 milhões de dólares em financiamento de arranque (seed) a 5 de maio para expandir no Sudeste Asiático e investir no desenvolvimento de produto. A empresa planeia aprofundar a sua parceria com canais

GateNews36m atrás

A OpenAI lança o ChatGPT para a aplicação Intune com integração nativa da Microsoft

De acordo com o canal do Telegram Beating, a OpenAI lançou o ChatGPT for Intune, uma aplicação iOS autónoma concebida para organizações empresariais e educativas. A app integra-se nativamente com o Microsoft Intune, permitindo que os departamentos de TI gerirem a aplicação através do seu sistema unificado de gestão de pontos finais pr

GateNews38m atrás

A Palantir regista um aumento de 85% na receita do 1.º trimestre para 1,633 mil milhões de dólares, com pontuação da Rule of 40 a atingir 145%

De acordo com o relatório de resultados do 1.º trimestre de 2026 da Palantir, a receita do primeiro trimestre da empresa de software de análises de dados e IA atingiu 1,633 mil milhões de dólares, acima de 85% em termos homólogos, assinalando a sua maior taxa de crescimento de sempre. A pontuação da regra dos 40 da empresa—uma métrica que mede o crescimento e a rentabilidade combinados—disparou para

GateNews58m atrás

A Meta procura 13 mil milhões de dólares em financiamento para um centro de dados de IA no Texas, liderado pela Morgan Stanley e pelo JPMorgan

Segundo Beating, a Meta procura cerca de 13 mil milhões de dólares em financiamento para um centro de dados de inteligência artificial no Texas, com a Morgan Stanley e a JPMorgan a liderarem a iniciativa. A estrutura de financiamento consistirá sobretudo em dívida, ficando o restante em capital, segundo pessoas familiarizadas com a situação

GateNews1h atrás

A Lattice Semiconductor adquire a AMI por 1,65 mil milhões de dólares a 4 de maio, expandindo-se para software de infraestrutura de IA

Segundo a Reuters, a Lattice Semiconductor anunciou a 4 de maio que vai adquirir a AMI, uma empresa de software de firmware e infraestrutura, por 1,65 mil milhões de dólares, para expandir mais profundamente a gestão de sistemas de IA e a infraestrutura cloud. A AMI especializa-se em firmware BIOS e em software do Baseboard Management Controller (BMC)

GateNews1h atrás
Comentar
0/400
Nenhum comentário