Nebius (NBIS.US) adquire a startup israelense Inferize para fortalecer negócios de inferência em IA; valor da transação pode chegar a US$ 150 milhões
A fornecedora de infraestrutura em nuvem de IA Nebius anunciou a aquisição da startup israelense de inteligência artificial Inferize, fortalecendo ainda mais suas capacidades de infraestrutura para processamento de IA.
O aplicativo financeiro Zhihui Finance informou que a provedora de serviços de infraestrutura em nuvem para IA, Nebius (NBIS.US), anunciou a aquisição da startup israelense de inteligência artificial Inferize, visando fortalecer ainda mais sua capacidade de infraestrutura para inferência de IA. Inferize especializa-se em reduzir o tempo ocioso das GPUs (unidades de processamento gráfico) e acelerar o processo de implantação de grandes modelos de IA. Segundo o portal tecnológico israelense Calcalist, o valor da transação está entre US$ 100 milhões e US$ 150 milhões, porém a Nebius não divulgou os termos financeiros específicos.
O foco principal desta aquisição é aumentar a eficiência no uso de recursos de GPU, especialmente em situações de rápida mudança na demanda por inferência de IA, ajudando a Nebius a alocar recursos computacionais de maneira mais ágil e a reduzir o tempo ocioso de equipamentos de computação caros.
Focando no gargalo de eficiência da inferência de IA e reduzindo o tempo ocioso das GPUs
A tecnologia central da Inferize é voltada principalmente para o problema do “cold start” durante o processo de implantação de modelos de IA. O cold start refere-se ao processo necessário de carregar modelos e inicializar recursos antes que o modelo de IA possa começar a processar solicitações dos usuários. Quando uma nova instância de inferência é iniciada, a GPU pode ter que aguardar a conclusão do carregamento do modelo antes de realmente começar a operar, resultando em um período breve de recursos ociosos.
Esse problema é especialmente evidente quando ocorre um súbito aumento na demanda por inferência de IA. À medida que a quantidade de solicitações de usuários cresce, provedores de nuvem precisam iniciar rapidamente mais instâncias de inferência. Contudo, se o carregamento do modelo for demorado, os novos recursos de GPU não poderão ser utilizados imediatamente, afetando tanto a velocidade de resposta do serviço quanto a eficiência geral de utilização de poder computacional.
A tecnologia da Inferize visa reduzir esse tempo de espera, permitindo que novos recursos de inferência entrem em operação mais rapidamente, tornando a expansão de poder computacional mais alinhada com a variação real da demanda.
Para a Nebius, isso significa que a empresa pode atender às demandas dos clientes de forma mais flexível e eficiente, sem precisar manter grandes quantidades de GPUs ociosas como recurso reserva, otimizando assim o uso de sua infraestrutura existente.
Danila Shtan, CTO da Nebius, afirmou que operar serviços de inferência de IA de forma eficiente não depende apenas de GPUs mais rápidas ou modelos otimizados, mas todo o sistema precisa ser capaz de responder rapidamente às variações na demanda, inclusive fornecendo capacidade computacional extra quando necessário. Ele ressaltou que o Inferize traz não só a tecnologia para acelerar esse processo, mas também uma equipe de engenheiros experientes em sistemas de GPU.
A Nebius planeja incorporar os engenheiros da Inferize em sua equipe de negócios focada em inferência, integrando sua tecnologia à plataforma de inferência de IA Token Factory, para fortalecer a capacidade da plataforma em responder às demandas dos clientes e permitir que a infraestrutura existente assuma mais tarefas computacionais reais.
Shtan afirmou ainda que a contribuição futura da equipe do Inferize vai além desta integração inicial de tecnologia.
Reduzindo custos de capacidade reserva e aumentando a eficiência operacional da infraestrutura de IA
Guy Bortnikov, cofundador e CEO da Inferize, apontou que, para responder rapidamente às solicitações dos clientes, provedores de nuvem geralmente precisam manter uma certa quantidade de GPUs em reserva; contudo, tais equipamentos de computação em stand-by representam custos extras. Ele comentou que o objetivo da Inferize é justamente reduzir esse tipo de despesa, e que ao se unir à Nebius, essa tecnologia poderá ser aplicada diretamente em plataformas de nuvem para IA em operação real.
No negócio de inferência de IA, a eficiência de alocação de recursos computacionais está diretamente ligada ao custo operacional da infraestrutura. Como os dispositivos de GPU são caros, se as empresas precisarem manter grande quantidade de capacidade ociosa para possíveis picos de demanda, isso pode afetar o retorno total sobre o investimento.
Reduzindo o tempo de inicialização dos modelos e acelerando o uso dos recursos de computação, a Nebius pode tanto aumentar a elasticidade do serviço quanto diminuir a dependência de estoque reserva de GPUs.
Vale notar que Bortnikov foi também cofundador da empresa de otimização de infraestrutura computacional Granulate. A empresa desenvolveu tecnologias para melhorar o desempenho de recursos de computação e foi adquirida pela Intel (INTC.US) em 2022. Esse histórico reforça a experiência da equipe Inferize em otimizar infraestrutura de computação.
Aquisições consecutivas de empresas de tecnologia em IA: Nebius segue fortalecendo sua plataforma de inferência
A aquisição da Inferize faz parte de uma série de operações recentes da Nebius focadas em inferência de IA e otimização de modelos. Anteriormente, a Nebius já havia adquirido a Eigen AI por US$ 643 milhões. Além disso, a empresa comprou recentemente a Clarifai, também de tecnologia em IA, mas sem divulgar o valor do negócio.
Todas essas aquisições têm como objetivo fortalecer as capacidades da Nebius em inferência de IA e otimização de modelos, aperfeiçoando ainda mais seus serviços de infraestrutura de IA.
Diferente dos investimentos em infraestrutura dedicados principalmente ao poder computacional necessário para treinamento de modelos de IA, a inferência de IA foca mais na eficiência operacional dos modelos em uso real, incluindo velocidade de processamento de solicitações, alocação de recursos computacionais, implantação de modelos e custo por unidade de poder computacional.
Com a contínua integração dessas tecnologias, a Nebius está expandindo sua atuação, passando da simples oferta de recursos computacionais de GPU para a prestação de serviços e tecnologias que aumentam a eficiência operacional dos modelos de IA em uso prático.
A aquisição da Inferize vai complementar ainda mais as capacidades da Nebius em alocação dinâmica de poder computacional e implantação rápida de modelos. Entretanto, a magnitude real das economias de custo e ganhos de eficiência trazidas por essa integração tecnológica ainda precisa ser comprovada nas futuras operações.
Aviso Legal: o conteúdo deste artigo reflete exclusivamente a opinião do autor e não representa a plataforma. Este artigo não deve servir como referência para a tomada de decisões de investimento.
Talvez também goste
JP Morgan: O risco oculto nas ações americanas: a alavancagem está de volta
Em setembro, o número de demissões corporativas nos EUA atingiu o nível mais baixo para o período em quatro anos, mas a disposição para contratar caiu para o ponto mais baixo em quinze anos para o mesmo período.
De acordo com relatório da Challenger, Gray & Christmas, o número de demissões anunciadas pelas empresas dos EUA em setembro caiu quase 20% em relação ao ano anterior, enquanto as demissões no setor de tecnologia aumentaram 77% em relação ao mês anterior. O número de novas contratações intencionadas pelas empresas em setembro diminuiu 23% em comparação ao ano passado. No mesmo dia, foi divulgado que o número de pedidos iniciais de seguro-desemprego nos EUA na semana passada caiu para 197 mil, aproximando-se do menor nível desde 1969.

A escassez de fornecimento de NAND pode continuar até 2028! O Citi está otimista com a demanda de IA impulsionando o aumento de preços dos chips de armazenamento e reafirma a recomendação de "compra" para o SanDisk (SNDK.US)
A pesquisa do Citigroup indica que os resultados do quarto trimestre fiscal recém-divulgados pela Micron Technology confirmam ainda mais a tendência de oferta apertada no mercado de memória NAND. Espera-se que esse cenário de restrição entre oferta e demanda na indústria possa persistir até 2028, sustentando os preços dos chips de armazenamento.

Relatório financeiro da Micron surpreende, mas o preço das ações permanece “inabalável”! Wall Street ainda está otimista, com o preço-alvo máximo chegando a 1625 dólares
O desempenho e as orientações da Micron foram ambos sólidos, mas como o preço das ações já subiu 237% este ano, a reação no pré-mercado foi discreta. Gigantes de Wall Street como Deutsche Bank, Bank of America, Goldman Sachs e JPMorgan continuam otimistas – 26 contratos estratégicos de longo prazo com clientes garantem alta visibilidade nos lucros. O UBS chegou a definir um preço-alvo máximo de US$1.625, demonstrando confiança na capacidade de lucratividade da empresa ao longo dos ciclos e em seu sólido potencial de valorização.
