NVIDIA Nemotron 3.5 Lightning er nu tilgængelig via Ollama og kan køre lokalt på egen hardware. Modellen har 30 milliarder parametre i alt, hvoraf 3 milliarder er aktive pr. token, i en hybrid mixture-of-experts-arkitektur. Den er bygget til agentopgaver som at læse filer, kalde værktøjer, sortere resultater og gentage trin der fejler. Modellen kører på NVIDIA RTX-pc'er, RTX PRO-arbejdsstationer, DGX Spark og DGX Station samt i datacentre og skyen. Konteksten går op til 1 million tokens. Til inferens bruges speculative decoding med multi-token prediction, kaldet DFlash eller DSpark, hvilket ifølge NVIDIA giver op til 4 gange højere gennemløb end sammenlignelige åbne modeller. Modellen er udviklet sammen med Nemotron Coalition og er trænet på åbne datasæt, så den kan efter-trænes til specifikke opgaver. Der findes også en udgave til Apple silicon, nemotron-3.5-lightning:30b-mlx. Modellen startes med kommandoen ollama run nemotron-3.5-lightning.
NVIDIA Nemotron 3.5 Lightning kan køre lokalt via Ollama
Artikel11. august 2026 kl. 02.00 Martin S. Nielsen

Foto: Ollama
NVIDIA Nemotron 3.5 Lightning er nu tilgængelig via Ollama og kan køre lokalt på egen hardware.
Kilde: Ollama
AI-genereret indhold
Annonceplads
300 x 250
Relaterede artikler
- NVIDIA udgiver åben AI-model Nemotron 3.5 Lightning og NeMo SwitchyardNVIDIA har udgivet Nemotron 3.5 Lightning, en åben sprogmodel med 30 milliarder parametre bygget som en mixtur...
- NVIDIA udgiver Nemotron 3.5 Lightning til eksekveringslaget i AI-agenterNVIDIA har udgivet Nemotron 3.5 Lightning, en åben sprogmodel opbygget som mixture-of-experts (MoE) med i alt ...
- NVIDIA Nemotron 3 Ultra tilgængelig som åben model via OllamaNVIDIA har gjort sprogmodellen Nemotron 3 Ultra tilgængelig på Ollamas cloud-tjeneste.
- Kubernetes gør rootless mode (KubeletInUserNamespace) til beta i v1.37Kubernetes 1.37 løfter feature-gaten KubeletInUserNamespace, også kaldet rootless mode, fra alpha til beta.