(Adnkronos) – NVIDIA ha presentato l'estensione della propria famiglia di modelli con il lancio di Nemotron 3.5 Lightning, una soluzione open source basata su architettura Mixture-of-Experts (MoE) da 30 miliardi di parametri progettata per l'esecuzione di agenti intelligenti su dispositivi locali. Il modello offre una velocità nella generazione di token fino a quattro volte superiore e tempi di completamento delle attività ridotti del 30% rispetto alle soluzioni concorrenti di pari categoria. Per agevolare l'implementazione nei sistemi locali, sono state attivate collaborazioni con piattaforme come vLLM, Ollama, llama.cpp, LM Studio e Unsloth, garantendo il supporto nativo per i formati quantizzati NVFP4 e GGUF attraverso Unsloth Studio. La compatibilità hardware spazia dai personal computer dotati di schede RTX fino ai sistemi industriali NVIDIA Jetson, espandendosi verso workstation professionali, datacenter e infrastrutture cloud distribuite dai principali partner hardware. Le risorse tecniche e le guide applicative sono state rese disponibili sui blog dedicati a Nemotron 3.5 Lightning, a NeMo Switchyard e all'ambiente Jetson AI, oltre alla distribuzione del modello tramite le API di build.nvidia.com sotto forma di microservizio NIM e sulla piattaforma OpenRouter.