A NVIDIA deu início à distribuição em larga escala do Vera, o seu primeiro processador central (CPU) concebido especificamente para suportar a crescente procura da inteligência artificial agentiva. Ian Buck, vice-presidente de computação de alto desempenho e hiperescala da empresa, tem liderado pessoalmente a entrega destes sistemas a parceiros estratégicos. A iniciativa marca um passo significativo na estratégia da fabricante, que procura otimizar a infraestrutura necessária para modelos que não apenas respondem a perguntas, mas que executam tarefas complexas de forma autónoma.

O Vera destaca-se por integrar 88 núcleos personalizados, designados pela NVIDIA como Olympus, e oferece uma largura de banda de memória de 1,2 TB/s. Segundo a empresa, este hardware foi desenvolvido para superar as limitações dos designs tradicionais focados na densidade de núcleos, permitindo um desempenho até 1,8 vezes superior por núcleo em cargas de trabalho de IA agentiva. Esta arquitetura visa responder a exigências de processamento em tempo real, como a orquestração de ferramentas, a recuperação de contextos longos e a execução de código Python necessário para o raciocínio dos modelos.

A Amazon Web Services (AWS) foi a mais recente entidade a receber o novo hardware, consolidando uma colaboração de 16 anos entre as duas empresas. A entrega, realizada em Seattle, incluiu servidores equipados com o CPU Vera e a GPU Vera Rubin. Esta integração faz parte de um plano de expansão que prevê a implementação de dois milhões de GPUs adicionais, reforçando a capacidade da AWS para suportar a próxima geração de infraestruturas de IA, onde a eficiência no processamento de tarefas concorrentes é crítica.

Antes da AWS, a NVIDIA já tinha iniciado a entrega do Vera a outros intervenientes chave do ecossistema tecnológico, incluindo a Oracle Cloud Infrastructure (OCI) e laboratórios de investigação como a OpenAI, a Anthropic e a SpaceXAI. A OCI, em particular, planeia implementar centenas de milhares de unidades Vera ao longo de 2026. Karan Batta, responsável pela gestão de produto na Oracle, sublinhou que a arquitetura do processador é ideal para cargas de trabalho de raciocínio de alto débito, permitindo a densidade e a eficiência necessárias para o setor empresarial.

A adoção do Vera reflete uma mudança na forma como a indústria encara o hardware para IA. Enquanto as GPUs continuam a ser fundamentais para o treino e inferência, a NVIDIA argumenta que a execução de agentes exige um CPU capaz de gerir um fluxo constante de tarefas operacionais. Ao colocar o Vera no centro destas operações, a empresa pretende eliminar estrangulamentos, permitindo que os utilizadores completem processos de compilação, análise de dados e simulações com maior rapidez, aumentando assim a produtividade global da chamada fábrica de IA.

Porque importa

A transição de modelos de IA que apenas respondem para modelos que executam ações exige uma infraestrutura de processamento central mais robusta. O lançamento do Vera pela NVIDIA sinaliza que a indústria está a adaptar o hardware para suportar a complexidade da orquestração de agentes, o que poderá acelerar a adoção de soluções de IA autónoma em ambientes empresariais e de computação na nuvem.

Fontes

Delivering Vera: NVIDIA’s First CPU Built for Agents Is Shipping NowNVIDIA ↗