A IBM anunciou oficialmente a chegada da família Granite 4.2, marcando uma evolução na sua oferta de modelos de linguagem de grande escala. Esta nova geração, composta por três variantes com 3 mil milhões, 8 mil milhões e 30 mil milhões de parâmetros, foi desenhada para tarefas que exigem raciocínio complexo. Ao contrário das iterações anteriores, que se focavam predominantemente na assistência à instrução, a série 4.2 introduz capacidades de raciocínio explícito, permitindo que os modelos gerem cadeias de pensamento antes de fornecerem uma resposta final.
A arquitetura subjacente destes modelos baseia-se num design de transformador denso, apenas descodificador, que incorpora tecnologias como Grouped Query Attention e embeddings de posição rotativos. O processo de pré-treino foi realizado do zero, utilizando cerca de 15 biliões de tokens ao longo de cinco fases distintas. Este método permitiu à IBM expandir a janela de contexto dos modelos até aos 512 mil tokens, garantindo uma maior capacidade de processamento de informação em documentos extensos ou fluxos de trabalho complexos.
Um dos diferenciais técnicos desta versão é a implementação de um pipeline de aprendizagem por reforço multi-etapa. Enquanto todos os modelos beneficiam de um ajuste fino supervisionado focado em trajetórias de raciocínio e uso de ferramentas, as versões de 8B e 30B foram submetidas a um treino adicional de aprendizagem por reforço agente. Este treino permite que os modelos operem em ambientes reais, executando código, pesquisando na web e interagindo com terminais, elevando a sua utilidade em cenários de engenharia de software.
A versatilidade operacional é assegurada por um sistema de comutação que permite alternar entre modos de pensamento e não-pensamento. Os utilizadores podem optar por um modo de baixo esforço para questões simples, poupando recursos computacionais, ou ativar o raciocínio profundo para problemas mais exigentes. Além disso, a integração é facilitada pelo suporte nativo a chamadas de ferramentas, compatível com o formato de funções da OpenAI, o que permite a sua implementação imediata em infraestruturas existentes sem a necessidade de camadas adicionais de adaptação.
Disponibilizados sob a licença Apache 2.0, os modelos Granite 4.2 representam um compromisso da IBM com a transparência e a acessibilidade no desenvolvimento de inteligência artificial. A empresa disponibilizou documentação técnica detalhada e repositórios no GitHub para apoiar a adoção por parte da comunidade de programadores. Com suporte em frameworks como vLLM e SGLang, a IBM posiciona esta família como uma solução para empresas que procuram integrar capacidades de agentes autónomos nos seus fluxos de trabalho digitais.
Porque importa
A série Granite 4.2 é relevante por integrar capacidades de raciocínio e autonomia agente em modelos densos, facilitando a sua implementação em ambientes empresariais que exigem precisão e interação direta com ferramentas externas, tudo sob uma licença aberta que promove a adoção tecnológica.