A NVIDIA anunciou a expansão da sua família de modelos abertos Nemotron com o lançamento do Nemotron 3.5 Lightning. Este novo modelo, que conta com 30 mil milhões de parâmetros e utiliza uma arquitetura de mistura de especialistas, foi desenhado para responder à procura por sistemas de agentes autónomos. Numa altura em que o mercado transita de interfaces de conversação para agentes capazes de executar tarefas complexas de forma contínua, a empresa procura oferecer uma solução que combina eficiência operacional com desempenho em cargas de trabalho especializadas.
Segundo os dados divulgados pela fabricante, o Nemotron 3.5 Lightning apresenta uma velocidade de processamento de dados até quatro vezes superior, o que resulta numa conclusão de tarefas 30% mais rápida do que outros modelos da mesma categoria. A NVIDIA sublinha que este modelo é personalizável, permitindo que as organizações realizem treinos adicionais com os seus próprios dados, ferramentas e fluxos de trabalho. Esta flexibilidade é apresentada como um fator para melhorar a precisão em domínios técnicos, como a cibersegurança, o desenvolvimento de software e os serviços jurídicos.
Para complementar o novo modelo, a NVIDIA introduziu o NeMo Switchyard, uma biblioteca de código aberto destinada ao encaminhamento inteligente de pedidos dentro de sistemas de agentes. Esta tecnologia permite que os programadores criem routers personalizados que direcionam automaticamente cada solicitação para o modelo mais adequado, equilibrando critérios de qualidade, latência e custos operacionais. A empresa afirma que, ao utilizar esta abordagem de orquestração, as empresas podem manter níveis de precisão elevados, reduzindo simultaneamente os custos de execução de tarefas para cerca de um terço.
A estratégia da NVIDIA passa por permitir que os utilizadores mantenham o controlo sobre a implementação da inteligência artificial, seja em computadores pessoais com placas RTX, estações de trabalho profissionais, centros de dados ou ambientes de computação na nuvem. Ao disponibilizar o modelo para execução local, a empresa pretende responder às preocupações com a privacidade e a soberania dos dados, permitindo que as empresas maximizem o investimento na sua infraestrutura existente sem depender exclusivamente de serviços remotos para tarefas de alto volume.
O desenvolvimento do Nemotron 3.5 Lightning contou com a colaboração da Nemotron Coalition, que forneceu metodologias de avaliação e conjuntos de dados para o refinamento do modelo. Além disso, a NVIDIA disponibilizou o conjunto de dados Nemotron-RL-Agentic-Terminal-Pivot, focado na aprendizagem por reforço para agentes de codificação. Com estas iniciativas, a empresa reforça a sua posição no ecossistema de modelos abertos, promovendo a rastreabilidade e a auditoria, elementos que considera vitais para a adoção empresarial de tecnologias de agentes autónomos.
Porque importa
A transição para sistemas de agentes autónomos exige uma orquestração eficiente de modelos especializados. A solução da NVIDIA permite que as empresas otimizem custos e desempenho ao combinar modelos de raciocínio geral com modelos leves e rápidos, mantendo a soberania sobre os dados e a infraestrutura de computação, essencial para a adoção de IA em ambientes corporativos.