Os GPU Nvidia Blackwell custam o dobro, mas o custo da inferência por token desce 35x face ao Hopper

De acordo com a análise mais recente no blog da Nvidia, as GPUs Blackwell custam quase o dobro por hora em comparação com a geração Hopper, mas entregam custos de inferência por token 35 vezes mais baixos. Usando o modelo de teste DeepSeek-R1, a Blackwell (GB300 NVL72) é alugada a 2,65 USD por GPU por hora, face aos 1,41 USD da Hopper, mas o throughput de um único GPU salta de 90 para 6.000 tokens por segundo. Este ganho de throughput de 65x reduz os custos por milhão de tokens de 4,20 USD para 0,12 USD.

O valor de 0,12 USD assume optimização total de software, incluindo inferência com baixa precisão FP4 e previsão multi-token (MTP). Sem MTP activado, os custos por milhão de tokens atingem aproximadamente 2,35 USD, descendo para 0,11 USD com ele ativo, demonstrando um impacto de optimização de 21x apenas com essa funcionalidade.

Isenção de responsabilidade: As informações contidas nesta página podem ser provenientes de terceiros e não representam os pontos de vista ou opiniões da Gate. O conteúdo apresentado nesta página é apenas para referência e não constitui qualquer aconselhamento financeiro, de investimento ou jurídico. A Gate não garante a exatidão ou o carácter exaustivo das informações e não poderá ser responsabilizada por quaisquer perdas resultantes da utilização destas informações. Os investimentos em ativos virtuais implicam riscos elevados e estão sujeitos a uma volatilidade de preços significativa. Pode perder todo o seu capital investido. Compreenda plenamente os riscos relevantes e tome decisões prudentes com base na sua própria situação financeira e tolerância ao risco. Para mais informações, consulte a Isenção de responsabilidade.

Related Articles

Legisladores do Colorado propõem uma substituição da lei de IA para dar resposta às preocupações da indústria

Os legisladores do estado do Colorado estão a avançar no sentido de revogar e substituir a lei de inteligência artificial do estado para 2024, SB24-205, por novas regras que reduzem o âmbito da regulação da IA, ao mesmo tempo que respondem às preocupações da indústria quanto aos encargos de conformidade. A nova proposta, SB26-189, passaria a regulamentar os sistemas de IA utilizados em

CryptoFrontier1h atrás

R0AR Avança para a Ronda Final do Consensus 2026 PitchFest, falhando por pouco o Top 20

De acordo com a MetaversePost, R0AR avançou para a ronda final de seleção do CoinDesk's Consensus 2026 PitchFest a 4 de maio, falhando por pouco a entrada no top 20 das startups escolhidas para apresentações ao vivo. O inovador em Web3 e IA foi avaliado juntamente com startups de elevado potencial em todo o mundo num dos m

GateNews4h atrás

Musk Procura um Acordo de 150 mil milhões de dólares com a OpenAI antes do julgamento, as negociações falham

De acordo com um documento judicial, Elon Musk contactou o presidente da OpenAI, Greg Brockman, a 26 de abril, dois dias antes de o seu julgamento começar no tribunal federal de Oakland, para explorar um acordo de resolução do litígio. Quando Brockman sugeriu que ambas as partes desistissem das suas alegações, Musk respondeu com ameaças, dizendo a Brockman: «Até ao fim»

GateNews4h atrás

O Cursor aceita a proposta de aquisição da SpaceX de 60 mil milhões de dólares, mas não vai fazer parceria com a xAI em modelos de programação

Segundo a The Information, a Cursor aceitou uma oferta de aquisição condicional de 60 mil milhões de dólares da SpaceX, embora o acordo ainda não tenha sido finalizado. A empresa, neste momento, não tem planos para colaborar com a unidade de IA da SpaceX, xAI, no desenvolvimento de modelos de código. Em vez disso, a Cursor está focada em optimizá-lo

GateNews5h atrás

A Haun Ventures encerra um fundo de 1 mil milhões de dólares a 4 de maio, dividindo o capital entre investimentos cripto em fase inicial e em fase tardia

Segundo a Bloomberg, a Haun Ventures concluiu uma ronda de angariação de 1 mil milhões de dólares a 4 de maio, com 500 milhões de dólares destinados a investimentos em fase inicial e 500 milhões de dólares a investimentos em fase tardia. O fundo irá alocar capital nos próximos dois a três anos, com foco em startups de criptomoedas e de blockchain, enquanto expande

GateNews5h atrás

A OpenAI angaria $4 mil milhões para um empreendimento conjunto de implementação, no valor de 10 mil milhões de dólares

De acordo com a BlockBeats, a 4 de maio, a OpenAI levantou mais de $4 mil milhões para estabelecer uma nova joint venture focada em ajudar as empresas a adotar o seu software de inteligência artificial. A venture, chamada The Deployment Company, conta com o apoio de 19 investidores, incluindo TPG Inc., Brookfield Asset Management,

GateNews6h atrás
Comentar
0/400
Nenhum comentário