A NVIDIA aproveitou a edição de 2026 da IFA para apresentar uma estratégia renovada de descentralização da inteligência artificial, focando-se na execução local de modelos complexos. Em colaboração com a Microsoft e diversos parceiros de hardware, a empresa revelou os novos computadores NVIDIA RTX Spark, uma linha de máquinas compactas com sistema operativo Windows que chegará ao mercado em outubro. Estes equipamentos visam oferecer aos entusiastas, criadores e programadores uma plataforma robusta para operar agentes de IA de forma privada e segura, sem a dependência constante de serviços baseados na nuvem.

Um dos pilares deste anúncio é a introdução do NVIDIA PAIR, ou Personal AI Router, uma ferramenta desenhada para distribuir inteligentemente as tarefas de inferência entre vários computadores RTX ligados à mesma rede local. Esta funcionalidade permite que o poder de processamento seja otimizado de forma dinâmica, facilitando a execução de modelos que, de outra forma, exigiriam hardware de nível empresarial. Paralelamente, a empresa reportou ganhos significativos de desempenho, com otimizações nas bibliotecas llama.cpp e vLLM que permitem uma inferência local até 1,9 vezes mais rápida em sistemas equipados com GPUs NVIDIA.

A experiência de utilização também foi alvo de simplificação. A configuração de agentes locais, que anteriormente exigia conhecimentos técnicos avançados na seleção de modelos e ajustes de quantização, será agora facilitada através de novas integrações em aplicações como Hermes Agent, OpenClaw e Perplexity Portable Computer. Estas plataformas passarão a oferecer uma configuração de um clique, detetando automaticamente a GPU NVIDIA disponível e aplicando as otimizações necessárias para garantir um funcionamento imediato e eficiente, reduzindo drasticamente a fricção técnica para o utilizador final.

No que toca ao ecossistema de modelos, o mês de agosto foi particularmente produtivo, com o lançamento de diversas soluções otimizadas para o hardware da NVIDIA. Entre os destaques encontram-se o Nemotron 3.5 Lightning, um modelo de 30 mil milhões de parâmetros, e o Qwen3.8-Flash-Next, um modelo multimodal de pesos abertos. Além disso, a LTX introduziu o LTX 2.5, focado na geração de vídeo, enquanto a DeepSeek apresentou o v4 Flash, um modelo de mistura de especialistas com 284 mil milhões de parâmetros, capaz de ser executado localmente em clusters específicos de DGX Spark.

A aposta da NVIDIA estende-se ainda ao setor do entretenimento, com editoras como a Electronic Arts, Embark e Ubisoft a integrarem os seus títulos nos novos sistemas RTX Spark. Esta convergência entre hardware de alto desempenho e software simplificado marca uma mudança clara na indústria, onde a inteligência artificial deixa de ser um serviço remoto para se tornar uma funcionalidade integrada no quotidiano dos computadores pessoais, mantendo os dados sensíveis sob controlo direto do utilizador e eliminando custos de subscrição associados a consultas na nuvem.

Porque importa

A transição da inteligência artificial da nuvem para o hardware local é um passo crítico para a privacidade e a eficiência. Ao reduzir a latência e permitir que dados sensíveis permaneçam no dispositivo do utilizador, a NVIDIA está a criar um ecossistema onde agentes autónomos podem operar de forma contínua e segura, democratizando o acesso a capacidades de processamento que antes estavam reservadas a centros de dados.

Fontes

Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026NVIDIA ↗