Nova arquitectura permite às GPUs aceder directamente a unidades SSD, reduzindo a dependência da memória DRAM
Tecnologia poderá diminuir custos dos centros de dados e aumentar a capacidade de processamento de modelos de inteligência artificial
A NVIDIA apresentou uma nova abordagem para infra-estruturas de inteligência artificial que permitirá aos seus aceleradores gráficos (GPU) aceder directamente a unidades SSD baseadas em memória NAND Flash, reduzindo a dependência da memória DRAM e aumentando a capacidade disponível para aplicações de IA. A iniciativa procura responder ao crescimento da procura por memória de elevada capacidade nos centros de dados.
A tecnologia baseia-se na abertura da interface cuFile, integrada no ecossistema GPUDirect Storage, permitindo que as GPUs comuniquem directamente com os dispositivos de armazenamento, sem necessidade de intermediação da CPU. Segundo a NVIDIA, esta arquitectura elimina parte dos actuais estrangulamentos no acesso aos dados e melhora a eficiência do processamento.
Para desenvolver a nova solução, a empresa juntou-se a parceiros como a Google, Intel e Meta, no âmbito do grupo XIO-SIG, que pretende criar uma camada de software aberta e interoperável para armazenamento de alto desempenho. A arquitectura possibilita que uma GPU execute milhares de pedidos simultâneos ao armazenamento, obtendo apenas a informação necessária para cada tarefa.
Embora os SSD continuem a apresentar maior latência e menor largura de banda do que a memória HBM (High Bandwidth Memory), a NVIDIA considera que estes dispositivos podem funcionar como uma camada complementar para armazenar grandes volumes de dados, incluindo cache KV, memória persistente para agentes de IA e bases de dados que não necessitam de permanecer continuamente na memória de alta velocidade.
A empresa revelou ainda a arquitectura SCADA (Scaled, Accelerated Data Access), concebida para permitir o acesso selectivo aos dados armazenados nos SSD sem necessidade de transferir ficheiros completos. O sistema separa a execução das aplicações de um componente privilegiado responsável pela gestão das permissões de acesso, preservando os mecanismos de segurança do sistema operativo Linux.
Segundo a NVIDIA, a combinação entre GPUs e armazenamento directo poderá reduzir os custos associados à expansão da memória nos centros de dados, uma vez que a memória NAND é significativamente mais económica do que a DRAM ou a HBM. A solução também permitirá construir modelos de inteligência artificial com contextos maiores sem depender exclusivamente de memórias de elevado custo.
Analistas do sector consideram que esta evolução poderá alterar a forma como são concebidos os centros de dados dedicados à inteligência artificial. Contudo, o aumento da utilização de memória NAND por sistemas de IA também levanta preocupações sobre uma eventual pressão na cadeia de fornecimento mundial de SSD empresariais.
Ao aproximar directamente as GPUs do armazenamento em SSD, a NVIDIA pretende ultrapassar uma das principais limitações da inteligência artificial moderna: a capacidade de memória disponível para processar modelos cada vez maiores e mais complexos.





