NVIDIA busca superar um dos maiores desafios da computação em IA

Novo projeto da NVIDIA visa enfrentar um dos principais obstáculos na computação de IA.
07/03/2025 às 14:32 | Atualizado há 1 ano
Patente da NVIDIA

A Patente da NVIDIA busca solucionar um dos maiores desafios da computação de inteligência artificial: como construir GPUs cada vez mais poderosas sem sacrificar a velocidade. A solução envolve seções distintas de uma GPU trabalhando localmente para armazenar e acessar dados, além de realizar computações, reduzindo atrasos inerentes ao acesso a recursos computacionais distantes. Essa inovação promete acelerar as computações baseadas em GPU, impulsionando aplicações de IA.

A NVIDIA, líder no mercado de GPUs, continua a inovar para manter sua posição de destaque na área de inteligência artificial. A empresa recentemente registrou uma nova patente que visa otimizar o desempenho das GPUs, especialmente em aplicações de IA.

Para saber mais sobre o tema, você pode conferir este artigo sobre A Democratização da Inteligência Artificial na Ponta.

## Detalhes da Nova Patente da NVIDIA

A NVIDIA protocolou uma nova patente, sob o número US20250078199A1, em 6 de março de 2025. A patente propõe que diferentes seções de uma GPU operem de forma independente, armazenando e acessando dados localmente, e realizando cálculos para minimizar os atrasos que ocorrem ao acessar recursos computacionais remotos. A implementação desta patente tem o potencial de acelerar significativamente os cálculos realizados pelas GPUs, permitindo o desenvolvimento de aplicações de IA mais robustas e eficientes.

Esta abordagem inovadora pode representar um avanço importante, especialmente considerando os desafios de performance que surgem com o aumento da complexidade das tarefas de inteligência artificial.

A nova patente da NVIDIA foca em três componentes principais para alcançar essa localização:

* Unidade de Mapeamento de Endereços AMAP: Fornece uma visão alternativa da memória localizada, permitindo o remapeamento da memória física para a DRAM local associada a uma determinada uGPU (micro GPU).
* Sistema de Máscara de Afinidade de Cluster de Processamento Gráfico (GPC): Permite a alocação de um programa de computação a GPCs específicos, limitando sua execução a um nó uGPU vinculado.
* Um Gerenciador de Recursos de GPU.

## Como Funciona a Localização da GPU Idealizada pela NVIDIA

Em termos práticos, como essa localização de GPU funcionaria? Uma aplicação de IA informa ao driver CUDA sua intenção de se conectar a um nó uGPU através da máscara de afinidade. O driver CUDA, então, coordena com o Gerenciador de Recursos para aplicar o mapeamento localizado.

Simultaneamente, a memória alinhada com um determinado nó uGPU é sub-alocada a esse nó. Posteriormente, o driver CUDA aloca o trabalho computacional para os GPCs controlados pelo nó uGPU designado. Além disso, os threads CTA acessam a memória usando o mapeamento de endereços localizados, enquanto as solicitações de memória são confinadas à DRAM local de um determinado uGPU.

Essa arquitetura, conforme detalhado na aplicação de patente da NVIDIA, promete mitigar consideravelmente os problemas de latência relacionados ao acesso à memória, aprimorar a eficiência do cache ao eliminar o armazenamento redundante de dados, resolver os problemas de latência inerentes à comunicação entre diferentes dies e proporcionar às aplicações um controle mais preciso sobre a alocação e utilização dos recursos da GPU.

Para saber mais sobre o tema, confira este artigo sobre a Nova IA do Google e seu impacto na busca na internet.

## Benefícios da Patente da NVIDIA

A **Patente da NVIDIA** pode ser vista como uma forma de superar as limitações impostas pela Lei de Moore, focando na localização em vez da miniaturização para acelerar os cálculos. Essa abordagem permite que a empresa continue a melhorar o desempenho de suas GPUs, mesmo diante dos desafios tecnológicos e físicos que limitam a redução do tamanho dos componentes.

Em certos aspectos, essa estratégia se assemelha àquela adotada pela DeepSeek. A startup chinesa de IA conseguiu desbloquear capacidades adicionais das GPUs de geração mais antiga da NVIDIA para impulsionar uma melhoria significativa nos recursos computacionais disponíveis. Essa semelhança sugere que a abordagem de localização e otimização de recursos pode ser uma tendência crescente no campo da computação de IA.

Com essa patente, a NVIDIA não só busca aprimorar o desempenho de suas GPUs, mas também oferecer soluções mais eficientes e flexíveis para as demandas crescentes do setor de inteligência artificial.

Este conteúdo foi auxiliado por Inteligência Artificial, mas escrito e revisado por um humano.

Os artigos assinados por nossa Redação, são artigos colaborativos entre redatores, colaboradores e/por nossa inteligência artificial (IA).
Jornalbits.com.br - Todos os direitos reservados