Infraestrutura de computação de IA, hardware de data center e equipamentos de rede: O uso de tokens continua impulsionando o crescimento dos gastos com IA e os preços de memória, enquanto os preços de locação de GPUs divergem
Os dados de agosto do JPMorgan mostram que o uso de tokens no OpenRouter aumentou 47% m/m, impulsionando uma alta de 7% m/m nos gastos; os preços spot de DRAM e NAND subiram significativamente. O desempenho das GPUs foi misto, com os preços da H100 se recuperando enquanto a B200 registrou sua primeira queda m/m em mais de seis meses.
Resumo
Os dados de agosto do JPMorgan mostram que o uso de tokens no OpenRouter aumentou 47% m/m, impulsionando uma alta de 7% m/m nos gastos; os preços spot de DRAM e NAND subiram significativamente. O desempenho das GPUs foi misto, com os preços da H100 se recuperando enquanto a B200 registrou sua primeira queda m/m em mais de seis meses.
- O uso de tokens em agosto aumentou 47% m/m e atingiu 28x a/a, enquanto os gastos com tokens cresceram 7% m/m e alcançaram 12x a/a.
- Descontos e a adoção de modelos de menor custo reduziram o preço de tokens ponderado por volume em 28% m/m e 56% a/a.
- Os preços de locação da H100 subiram 1,2% m/m, enquanto os preços da B200 caíram 1,5% m/m, marcando a primeira redução desta última em mais de seis meses.
- Os preços spot de DDR5 16Gb subiram para US$ 50,20, alta de 6% m/m e 880% a/a.
- Os preços spot de NAND 1Tb subiram para US$ 30,50, alta de 14% m/m e 470% a/a.
Interpretação do relatório
Visão geral
O relatório avalia a demanda por infraestrutura de IA em agosto usando amostras de uso e precificação de LLMs do OpenRouter, preços de locação de GPUs de provedores de nuvem não hyperscale e preços spot de DRAM e NAND. Conclui que as tendências gerais de demanda permanecem positivas: os gastos com tokens e os preços de memória continuam subindo, embora a precificação de locação de GPUs divirja por modelo.
Visões principais
O relatório primeiro avalia a demanda por infraestrutura de IA por meio da atividade de tokens de LLM. Seu rastreador coleta uma semana de dados por mês, cobrindo aproximadamente 300 LLMs na plataforma OpenRouter. O uso de tokens em agosto reacelerou após desacelerar em julho, aumentando 47% m/m, acima dos 18% de julho, mas abaixo dos 70% de junho; atingiu 28x a/a, em comparação com 21x e 20x em julho e junho, respectivamente. Os modelos de pesos fechados representaram 33% do uso total, acima dos 29% em julho e inalterado em relação aos 33% em junho; seu uso aumentou 66% m/m, contra 3% e 34% em julho e junho, respectivamente, e atingiu 14x a/a. O uso de modelos de pesos abertos aumentou 39% m/m, em comparação com 26% e 97% em julho e junho, respectivamente; atingiu 56x a/a, abaixo dos 63x de julho e 74x de junho. O crescimento do uso foi acompanhado por quedas de preços. O preço médio dos tokens caiu 5% m/m em agosto, ante uma queda de 3% em julho e uma alta de 7% em junho; aumentou 5% a/a, melhorando em relação a 2% em julho e -5% em junho. O preço ponderado por volume, que reflete melhor a composição real de modelos, caiu 28% m/m e 56% a/a, principalmente devido a um corte de preço de 50% para o GPT-5.6 Sol, um corte de 80% para o GPT-5.6 Luna e à ampla adoção de modelos de baixo custo. Tencent Hy3, DeepSeek v4 Flash-0731 e GPT-5.6 Luna contribuíram juntos com aproximadamente 99% do volume incremental de tokens m/m. O preço ponderado por volume dos modelos de pesos abertos caiu 17% m/m, em comparação com aumentos de 36% e 12% em julho e junho, respectivamente; ainda assim, subiu 60% a/a. O preço ponderado por volume dos modelos de pesos fechados caiu 37% m/m e 29% a/a, ambos substancialmente mais fracos do que nos meses anteriores. Apesar da queda dos preços, a forte expansão do uso continuou impulsionando o crescimento dos gastos com tokens. Os gastos totais aumentaram 7% m/m em agosto, inalterados em relação a julho e abaixo dos 70% de junho; atingiram 12x a/a, em comparação com 11x e 16x em julho e junho, respectivamente. Os modelos de pesos fechados representaram 78% dos gastos totais, abaixo dos 80% em julho e 88% em junho; seus gastos aumentaram 4% m/m e atingiram 10x a/a. Os gastos com modelos de pesos abertos aumentaram 16% m/m, desacelerando acentuadamente dos 71% em julho e 120% em junho, mas ainda atingiram 89x a/a. Isso indica que os modelos de pesos abertos contribuíram para uma expansão mais rápida do uso, enquanto os modelos de pesos fechados, de maior preço, continuaram respondendo pela ampla maioria dos gastos. Os rankings de modelos ilustram ainda mais a diferença entre a composição de uso e de receita. Por uso de tokens, os cinco principais modelos em agosto foram DeepSeek v4 Flash-0731, Tencent Hy3, MiMo v2.5, GPT-5.6 Luna e DeepSeek v4 Flash, representando juntos mais de 50% do uso total. Por gastos com tokens, os cinco principais foram Claude Opus 5, Kimi K3, Claude Opus 4.7, GPT-5.6 Sol e Claude Fable 5, representando juntos 48% dos gastos totais. Não houve sobreposição entre os dois grupos dos cinco principais, indicando que modelos de baixo custo dominam o uso, enquanto modelos de maior preço continuam dominando os gastos. Os preços de locação de GPUs divergiram por modelo. No mercado de provedores de nuvem não hyperscale, o preço médio de locação em agosto para a A100 foi de US$ 1,65 por hora de GPU, inalterado m/m, após aumentos de 0,9% e 6,4% em julho e junho, respectivamente. O preço da H100 foi de US$ 2,73 por hora de GPU, recuperando 1,2% m/m após cair 0,6% em julho e subir 3,5% em junho; a relação de preços H100/A100 foi de 1,65x, em comparação com 1,64x e 1,66x em julho e junho, respectivamente. O preço da B200 foi de US$ 5,63 por hora de GPU, queda de 1,5% m/m, sua primeira queda m/m em mais de seis meses, após aumentos de 7,2% e 2,7% em julho e junho, respectivamente. A relação de preços B200/H100 caiu para 2,06x, abaixo dos 2,12x de julho, mas acima dos 1,97x de junho, e substancialmente abaixo do nível de 2,58x em torno do lançamento do índice em setembro de 2025. Os preços de memória forneceram um sinal ascendente mais consistente. O preço spot de DDR5 16Gb subiu para US$ 50,20 em agosto, alta de 6% m/m em relação aos US$ 47,00 em julho e de 880% a/a em relação aos US$ 5,09 em agosto de 2025. Isso marcou o quinto aumento mensal consecutivo após modestos declínios m/m em fevereiro e março, que o relatório caracterizou como um aumento de mais de 8x a/a. O preço spot de NAND 1Tb subiu para US$ 30,50, alta de 14% m/m em relação aos US$ 26,90 em julho e de 470% a/a em relação aos US$ 5,29 em agosto de 2025. Foi o primeiro retorno ao crescimento após quatro meses consecutivos de quedas modestas, que o relatório caracterizou como um aumento de mais de 4x a/a. No geral, a expansão dos gastos com tokens e a alta dos preços de memória sustentam uma avaliação positiva da demanda por infraestrutura de IA, enquanto a queda nos preços de locação da B200 indica que o impulso de preços não é uniforme entre os produtos de computação.
Estrutura de análise
O relatório analisa sequencialmente a atividade de aplicações de IA, locações de capacidade computacional e preços de memória. Primeiro, decompõe os gastos com tokens em uso e preço, comparando variações m/m e a/a entre todos os modelos, modelos de pesos abertos e modelos de pesos fechados. Em seguida, examina o mercado de computação em nuvem não hyperscale usando preços de locação e relações de preços relativos entre modelos de GPU. Por fim, avalia as tendências de demanda e precificação de memória por meio dos preços spot de DRAM e NAND, combinando os três grupos de indicadores para avaliar o ambiente de demanda por infraestrutura de IA.
Notas metodológicas
Decomposição dos gastos com tokens em uso e preço
O relatório acompanha separadamente o uso de tokens, o preço médio, o preço ponderado por volume e os gastos totais para determinar se o crescimento dos gastos é impulsionado pela expansão do uso ou por mudanças na precificação unitária.
Sinais de oferta e demanda provenientes de locações de GPUs e preços spot de memória
O relatório usa preços de locação de GPUs e preços spot de DRAM e NAND como indicadores das condições de oferta e demanda nos mercados de computação e memória, comparando a direção e a magnitude das alterações de preços entre produtos.
Acompanhamento de instantâneo mensal de uma semana do OpenRouter
O rastreador coleta uma semana de dados por mês, cobrindo aproximadamente 300 LLMs no OpenRouter, para produzir um instantâneo mensal das tendências de uso e precificação. A amostra é enviesada para desenvolvedores, startups e tráfego de programação agêntica e exclui o uso de APIs próprias de provedores de modelos e plataformas de nuvem hyperscale.
Dados principais
- Uso de tokens em agosto+47% m/m, 28x a/aO crescimento m/m reacelerou de 18% em julho; o crescimento a/a aumentou de 21x em julho para 28x.
- Preço médio de tokens em agosto-5% m/m, +5% a/aO preço continuou caindo m/m, mas o crescimento a/a melhorou de 2% em julho.
- Preço de tokens ponderado por volume em agosto-28% m/m, -56% a/aAfetado principalmente por cortes substanciais nos preços dos modelos e pela maior adoção de modelos de menor custo.
- Gastos com tokens em agosto+7% m/m, 12x a/aA expansão do uso compensou a queda no preço ponderado por volume.
- Participação dos modelos de pesos fechados nos gastos78%Abaixo dos 80% em julho e 88% em junho.
- Preço médio de locação da A100US$ 1,65/hora de GPUInalterado m/m em agosto.
- Preço médio de locação da H100US$ 2,73/hora de GPUAlta de 1,2% m/m em agosto, com a relação de preços H100/A100 em 1,65x.
- Preço médio de locação da B200US$ 5,63/hora de GPUQueda de 1,5% m/m em agosto, marcando a primeira queda m/m em mais de seis meses; a relação de preços B200/H100 foi de 2,06x.
- Preço spot de DDR5 16GbUS$ 50,20Alta de 6% m/m e 880% a/a em agosto, marcando o quinto aumento mensal consecutivo.
- Preço spot de NAND 1TbUS$ 30,50Alta de 14% m/m e 470% a/a em agosto, encerrando quatro meses consecutivos de quedas m/m.
Impacto e implicações
O relatório acredita que a rápida expansão no uso de tokens é suficiente para continuar impulsionando o crescimento dos gastos apesar da queda dos preços, indicando uma demanda resiliente pelo uso de modelos de IA. Ao mesmo tempo, a alta dos preços spot de DRAM e NAND reforça os sinais de melhora na demanda por memória e nas condições de precificação. Contudo, a primeira queda m/m no preço de locação da B200 e a redução de seu prêmio sobre a H100 indicam que as tendências de precificação de GPUs variam conforme a geração do produto, o que significa que a melhora geral da demanda não deve ser equiparada a aumentos simultâneos de preços em todos os produtos de computação.
Riscos
- Os dados do OpenRouter são enviesados para desenvolvedores, startups e tráfego de programação agêntica e excluem o uso de APIs próprias, como OpenAI e Anthropic, bem como endpoints hospedados em plataformas de nuvem hyperscale. Portanto, a amostra não é representativa de todo o mercado de LLMs.
Pontos a observar
- Continuar monitorando se o crescimento do uso de tokens pode compensar as quedas nos preços médios e ponderados por volume, permitindo que os gastos totais com tokens continuem crescendo.
- Monitorar as mudanças nas participações de uso, precificação e gastos entre modelos de pesos abertos e fechados.
- Acompanhar se os preços de locação da B200 continuam caindo, bem como as mudanças nas relações de preços B200/H100 e H100/A100.
- Observar se a DRAM consegue sustentar aumentos mensais consecutivos e se a NAND consegue manter o crescimento após encerrar quatro meses de quedas.