• 2 minuti
  • Pubblicato

IBM presenta Granite 4.2: nuovi modelli LLM open-weight per il deployment locale

Giuseppe Attardi Autore di tecnologia e AI QWERTYmag

Scritto da Giuseppe Attardi

IBM presenta Granite 4.2: nuovi modelli LLM open-weight per il deployment locale QWERTYmag © www.qwertymag.it
IBM presenta Granite 4.2: nuovi modelli LLM open-weight per il deployment locale © www.qwertymag.it

IBM ha annunciato Granite 4.2, una nuova famiglia di modelli linguistici open-weight progettati per il deployment locale, con capacità di ragionamento avanzate e supporto ampliato all'uso di strumenti esterni. Disponibili in versioni da 3B, 8B e 30B parametri, i modelli puntano a offrire soluzioni affidabili per aziende e sviluppatori che cercano alternative ai servizi cloud.

IBM ha lanciato Granite 4.2, la nuova generazione della sua famiglia di modelli linguistici open-weight pensati per essere scaricati e gestiti localmente. Le nuove versioni sono disponibili con 3, 8 e 30 miliardi di parametri, mantenendo l'approccio decoder-only già visto nelle precedenti release.

Caratteristiche tecniche e novità di Granite 4.2

Granite 4.2 introduce una finestra di contesto nativa da 128.000 token, offrendo così maggiore flessibilità nell'elaborazione di testi lunghi. Le varianti da 8B e 30B parametri sono state sottoposte a un blocco di reinforcement learning agentico, che ne amplia le capacità operative: possono interagire con terminali, effettuare ricerche web e utilizzare strumenti esterni. Anche il modello da 3B supporta tool esterni, seppur senza lo stesso livello di addestramento specifico.

Focus sul ragionamento e applicazioni pratiche

Questa release si distingue per l'attenzione al "ragionamento funzionale", come sottolineato da IBM stessa: Granite 4.2 è la versione della famiglia focalizzata sulle capacità di ragionamento. In ambito AI, ciò si traduce nella gestione di processi "chain-of-thought" e nella capacità di portare avanti risultati intermedi su più passaggi, migliorando la precisione delle risposte, anche se a scapito di tempi di risposta più lunghi e maggiori richieste computazionali.

Soluzioni locali per aziende e sviluppatori

Granite 4.2 si rivolge soprattutto a chi cerca modelli affidabili e prevedibili per il deployment locale, in un contesto in cui cresce l'interesse verso alternative ai grandi modelli cloud come quelli di Anthropic o OpenAI. L'attenzione di IBM è rivolta a garantire stabilità e prevedibilità, aspetti particolarmente apprezzati in ambito enterprise. Inoltre, la possibilità di utilizzare questi modelli senza costi per token e su hardware locale li rende interessanti anche per ricercatori, sviluppatori indipendenti e appassionati.

Il ruolo dei router di modelli e il contesto di mercato

L'aumento della domanda di modelli locali ha favorito anche la diffusione di router di modelli AI, strumenti che indirizzano i prompt verso il modello più adatto per bilanciare prestazioni, velocità e costi. In questo scenario, Granite 4.2 si posiziona come una soluzione solida per chi desidera autonomia e controllo, senza dipendere dai servizi cloud e dalle relative tariffe.

Articoli correlati