Divulgação do desempenho do Vera Rubin pela primeira vez, desempenho significativamente aprimorado! Nvidia ofusca evento da AMD antes do início
A Nvidia intensificou seus anúncios antes da conferência anual da AMD: o desempenho do processador Vera CPU é quase o dobro dos chips x86, com latência reduzida em seis vezes, enquanto na prática o Vera Rubin NVL72 apresenta uma eficiência energética dez vezes maior que a geração anterior. OpenAI, Anthropic e SpaceX já receberam os primeiros lotes destes chips. Esse bombardeio de dados estrategicamente cronometrado não é apenas um ataque direto à AMD, mas também uma declaração de guerra da Nvidia ao entrar agressivamente no mercado de CPUs, de olho no mercado de 200 bilhões de dólares.
A Nvidia deu um golpe estratégico na véspera do evento anual de lançamentos de produtos de sua rival AMD, divulgando intensamente dados de desempenho práticos da nova geração da plataforma Vera Rubin e revelando oficialmente as especificações completas do seu processador CPU proprietário Vera.
Nesta terça-feira, a Nvidia revelou que a CPU Vera apresenta desempenho quase duas vezes superior aos processadores x86 em tarefas de IA baseada em agentes, além de uma redução de latência de até seis vezes. Ao mesmo tempo, testes preliminares de produção realizados pelo parceiro de computação em nuvem CoreWeave mostraram que a plataforma Vera Rubin NVL72, ao operar o modelo DeepSeek R1, atinge uma taxa de throughput de tokens por megawatt de processamento dez vezes maior comparada à geração anterior, baseada na arquitetura Blackwell, o GB200 NVL72.
O momento da divulgação desses dados é bastante estratégico. A AMD realizará nesta quinta-feira seu evento anual de lançamentos de produtos em São Francisco, chamado "Advancing AI", e a liberação concentrada dos dados de desempenho por parte da Nvidia é amplamente vista como uma jogada deliberada de marketing. Para as empresas de nuvem e clientes corporativos avaliando investimentos em infraestrutura de IA de próxima geração, esses dados influenciarão diretamente suas decisões de compra.
Ao mesmo tempo, a Nvidia também anunciou oficialmente que a CPU Vera já foi entregue a partir de junho, com clientes incluindo OpenAI, Anthropic e SpaceX. Isso marca a entrada formal da Nvidia no mercado de CPUs, representando um ataque direto ao território tradicional da AMD e da Intel.
Estreia da CPU Vera: Nvidia entra oficialmente no mercado de CPUs para servidores
Nesta terça-feira, a Nvidia revelou as especificações completas, resultados de benchmarks e informações de arquitetura do produto de CPU para datacenters Vera, dados essenciais para potenciais clientes avaliarem totalmente o chip. A empresa afirmou que as entregas do chip Vera começaram em junho para clientes como OpenAI, Anthropic e SpaceX.
Vera é o primeiro processador de servidor desenvolvido pela Nvidia "do núcleo", adotando uma microarquitetura personalizada chamada "Olympus core", em vez de utilizar projetos prontos fornecidos pela Arm.
Hannah Coutand, responsável de marketing da linha Vera na Nvidia, explicou que o foco do design deste chip está na velocidade por núcleo, alta largura de banda de memória e baixa latência, com o objetivo de "permitir que os agentes retornem o mais rápido possível ao GPU e mantenham o uso do GPU em nível máximo". Em termos de especificações de hardware, o consumo da Vera varia entre 250 e 450 watts, e cada chip suporta até 1,5 TB de memória de baixo consumo.
De acordo com os benchmarks mais recentes, a Nvidia demonstrou que o Vera apresenta desempenho 1,9 vez superior aos chips x86 nas tarefas de IA baseada em agentes, com redução de latência seis vezes maior. A Nvidia também destacou que, em alguns testes padrão da indústria, o Vera superou o processador topo de linha EPYC Turin, da AMD, em quase 100%. Anteriormente, a Nvidia também declarou que o Vera garante um desempenho geral 50% maior do que chips x86 em tarefas de IA baseada em agentes.
O lançamento do Vera é a mais recente etapa da estratégia de integração vertical da Nvidia. O Wolfe Research estima que o preço médio de cada chip Vera é de aproximadamente US$ 5.000, com expectativa de envio de até 1,3 milhão de unidades ainda este ano. Ian Buck, vice-presidente de computação de escala massiva da Nvidia, afirmou que a IA baseada em agentes torna as CPUs "ainda mais indispensáveis" e prevê um mercado potencial total de US$ 200 bilhões para processadores de servidor.
Teste real da Vera Rubin: Salto de 10 vezes na eficiência energética
Em junho deste ano, a CoreWeave realizou o primeiro deployment e validação do setor da Vera Rubin NVL72, cobrindo testes de energia, refrigeração, rede e computação em toda a pilha. Os dados recém-divulgados são os primeiros resultados práticos de desempenho do silício da Vera Rubin NVL72.
O teste usou o modelo DeepSeek R1 como referência, e com o mesmo objetivo de resposta interativa, a Vera Rubin NVL72 gera dez vezes mais tokens por megawatt por segundo do que o GB200 NVL72. A CoreWeave ressaltou que as otimizações feitas para a Vera Rubin também podem ser aplicadas retroativamente ao GB200 NVL72, proporcionando um aumento de mais de quatro vezes no throughput por megawatt em apenas três meses. A Nvidia informou que estes resultados foram validados em mais de 250 mil configurações independentes, totalizando mais de 1,4 milhão de horas de GPU testadas.
Em termos de arquitetura, o rack Vera Rubin NVL72 integra 72 GPUs Rubin e 36 CPUs Vera, conectados por meio da arquitetura NVLink 6 totalmente interconectada de 260 TB/s, com suporte nativo à precisão NVFP4. Segundo a CoreWeave, esse ganho de eficiência permite aos clientes processar mais requisições de inferência com o mesmo orçamento de energia, ou operar a mesma carga de trabalho com menos energia, reduzindo assim o custo por token.
A CoreWeave ainda divulgou cenários práticos de aplicação: uma empresa global de cibersegurança espera rodar detecção de ameaças com eficiência dez vezes maior por watt; uma companhia de agentes autônomos de programação planeja escalar tarefas de agente com custo de token significativamente reduzido; enquanto um mecanismo de busca nativo em IA espera expandir atendimento em tempo real para mais usuários, sem violar limites de tempo de resposta.
Otimização colaborativa de infraestrutura: integração hard+soft libera potencial ampliado
A Nvidia enfatizou que os ganhos de desempenho não se devem somente ao chip em si, mas sim ao resultado de uma estratégia integrada de design de hardware e software. Por meio da otimização dinâmica de toda a infraestrutura e stack energética, a Nvidia afirma ser capaz de implantar até 40% mais GPUs dentro do mesmo consumo de energia.
Em relação ao resfriamento, a Nvidia utiliza um sistema de refrigeração líquida em circuito fechado a 45°C, economizando cerca de 4 milhões de galões de água por megawatt por ano em comparação com métodos convencionais. Na camada de rede, a sexta geração da arquitetura NVLink 6 proporciona throughput de decodificação de grandes modelos de linguagem 2,3 vezes maior do que arquiteturas Ethernet; já a plataforma Spectrum-X oferece largura de banda RDMA remota 1,6 vez mais rápida, menos 1,7 vez switches, cinco vezes mais eficiência ótica e dez vezes mais confiabilidade.
A plataforma mais recente da Nvidia, Spectrum-6, já começou a ser entregue para clientes como CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. e Tesla. Atualmente, a Nvidia acelera as entregas para clientes e parceiros como Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI e CoreWeave.
Nvidia ainda é desafiadora no setor de CPUs
Apesar dos impressionantes dados de performance do Vera, a Nvidia ainda enfrenta desafios significativos de market share no segmento de CPUs. Segundo o analista da Gartner Kevin Knox, a AMD é atualmente a principal rival em CPUs para servidores AI. Relatórios indicam que a Intel detém aproximadamente 66,8% do mercado de CPUs para servidores, enquanto a AMD fica com cerca de 33%, participando de uma escalada de conquista de mercado e estabelecendo parcerias profundas com fornecedores de nuvem de escala massiva.
Impulsionadas pela crescente demanda por CPUs devido à ascensão da IA baseada em agentes, as ações da AMD e da Intel subiram 128% e 149% respectivamente neste ano, superando de longe o crescimento de cerca de 8% da Nvidia, tornando-se as ações de chips de melhor performance de 2026.
No momento, a lista de principais parceiros de nuvem da Nvidia inclui apenas a Oracle, ainda sem outros provedores cloud tradicionais. Hannah Coutand reconheceu que a Vera ainda está na "fase inicial de adoção", mas a OpenAI planeja iniciar a implantação em larga escala dos chips Vera ainda neste trimestre.
Karl Freund, fundador da Cambrian AI Research, resumiu a estratégia da Nvidia: "O objetivo deles é libertar os clientes da dependência de CPUs Intel ou AMD, objetivo no qual estão focados em maximizar a receita. Eles optaram por desenvolver um CPU único, diferente de qualquer outro atualmente disponível no mercado."
Aviso Legal: o conteúdo deste artigo reflete exclusivamente a opinião do autor e não representa a plataforma. Este artigo não deve servir como referência para a tomada de decisões de investimento.
Talvez também goste
O rendimento dos títulos do Tesouro dos EUA de 30 anos atinge o nível mais alto desde 2007, enquanto a emissão de títulos de grau de investimento nos EUA em agosto bate recorde histórico para o período.
Na segunda-feira, o rendimento dos títulos do Tesouro americano de 30 anos chegou a ultrapassar 5,31%. Empresas têm emitido grandes volumes de dívidas para sustentar o boom da IA, agravando o desequilíbrio entre oferta e demanda no mercado de títulos de longo prazo. Em agosto, a emissão de títulos americanos de grau de investimento atingiu US$ 145,2 bilhões, superando o recorde mensal anterior de US$ 136 bilhões estabelecido em agosto de 2020. Ao mesmo tempo, o déficit fiscal anual do governo dos EUA, próximo a US$ 2 trilhões, continua impulsionando a oferta de títulos públicos.

É ainda mais lucrativo que DRAM, será que SanDisk é realmente tão bom assim?

Nvidia investe US$ 1,5 bilhão na SB Energy, garantindo 8GW de poder computacional de IA; OpenAI será o único inquilino
A Nvidia está expandindo sua vantagem competitiva além de GPUs e servidores, alcançando terras, energia e construção de data centers de IA. A empresa está colaborando com a SB Energy para desenvolver um data center de IA em Ohio com capacidade ultraelevada de 8GW, investindo US$ 1,5 bilhão e fornecendo suporte de crédito para financiamento de infraestrutura, tendo a OpenAI como único locatário. Essa movimentação indica que a Nvidia está avançando de fornecedora de chips para organizadora da infraestrutura de IA, garantindo antecipadamente recursos LPS para assegurar a demanda por várias gerações futuras de GPUs.
