a NVIDIA entrou na rodada de 2023 com a google, amazon, amd, intel, qualcomm, ibm e salesforce.

NVDA
NVDAUSDT
231.66
+0.37%

desde então, colocou o treino no DGX Cloud no site, depois seus contêineres de inferência, depois o cluster de treinamento como serviço em cima do marketplace da lepton que comprou em abril de 2025.

até meados de 2025, a nvidia era dona do processamento por baixo do hugging face e dos contêineres nele. ela não era dona do hugging face.

o hugging face está fazendo cerca de US$ 150 milhões por ano agora, então a US$ 12,9 bilhões a nvidia está pagando 86x a receita.

-- a rodada de 2023 foi de 129x receita quando as estimativas eram de cerca de US$ 35 milhões para aquele ano.

-- se eles estivessem perto de US$ 100 milhões quando disseram não, a nvidia ofereceu 70x de receita por uma participação minoritária e agora está pagando 86x pela empresa inteira.

-- então está pagando 23% a mais por dólar para ficar com tudo do que ofereceu por uma participação sem poder de decisão.

eu não acho que alguém mais estivesse fazendo oferta.

o hugging face executa um roteador chamado inference providers.

-- cada solicitação vai para um dos 18 parceiros e, por padrão, vai para quem for mais rápido, ou seja, quem entrega mais tokens por segundo.

-- cerebras, groq e sambanova estão nessa lista e nenhum deles executa chips da nvidia; então, quando um deles é o mais rápido para um modelo, é para lá que a solicitação vai.

-- o hugging face também escreve optimum-amd e optimum-neuron, então os mesmos modelos rodam na amd e no trainium sem cuda, e a amd e a amazon estão na cap table.

-- o hugging face chama isso de zero vendor lock-in, e um detentor minoritário de US$ 500 milhões (o que a nvidia ofereceu no fim de 2025) não consegue mudar um padrão de roteamento.

modelos chineses foram 41% dos downloads no hugging face no ano passado, mais do que os americanos. há mais de 113.000 modelos criados a partir do qwen no site, e o qwen já havia ultrapassado um bilhão de downloads até março. a nvidia não consegue vender seus chips topo de linha para a china.

a receita foi de cerca de US$ 100 milhões por ano em junho para US$ 150 milhões em agosto, e isso é pago por computação, armazenamento e assinaturas.

eu observaria se a AMD, a Amazon e o Google aceitam e saem, e se o padrão mais rápido continua lá depois que o acordo for concluído.

e se o qwen e o deepseek continuam lançando novidades em um site de propriedade da empresa cujos chips topo de linha eles não conseguem comprar.

GOOGL
GOOGLUSDT
339.71
+0.05%
AMZN
AMZNUSDT
259.58
+0.03%