Ollama har offentliggjort ydelsestal for NVIDIA DGX Spark, testet med firmware 580.95.05 og Ollama version 0.12.6. Maskinen er udstyret med en GB10 Grace Blackwell Superchip og 120 GB VRAM, hvilket gør det muligt at køre hele modellen gpt-oss 120B i MXFP4-kvantisering, som opnåede 1.169k tokens i sekundet i prefill og 41,14 tokens i sekundet i decode. Den mindre gpt-oss 20B nåede 3.224k tokens i sekundet i prefill og 58,27 i decode. Andre testede modeller omfatter gemma3 i 12B og 27B, llama3.1 i 8B og 70B, deepseek-r1 14B samt qwen3 32B, hver i flere kvantiseringer. Ollama oplyser desuden, at OpenAIs Codex kan køre mod DGX Spark lokalt via kommandoen codex --oss --model gpt-oss, herunder også den 120 milliarder parametre store udgave.
Ollama offentliggør ydelsestal for NVIDIA DGX Spark
Artikel23. oktober 2025 kl. 02.00 Martin S. Nielsen

Foto: Ollama
Ollama har offentliggjort ydelsestal for NVIDIA DGX Spark, testet med firmware 580.95.05 og Ollama version 0.12.6.
Kilde: Ollama
AI-genereret indhold
Annonceplads
300 x 250
Relaterede artikler
- NVIDIA DGX Spark får understøttelse i OllamaNVIDIA DGX Spark er en ny maskine drevet af NVIDIA GB10 Grace Blackwell Superchip, der ifølge Ollama leverer 1...
- Kubernetes gør rootless mode (KubeletInUserNamespace) til beta i v1.37Kubernetes 1.37 løfter feature-gaten KubeletInUserNamespace, også kaldet rootless mode, fra alpha til beta.
- Raspberry Pi kan nu vise splash screens tidligt i boot på SPI og I2C skærmeRaspberry Pi har udviklet en funktion, der gør det muligt at vise et brugerdefineret opstartsbillede meget tid...
- NVIDIA RTX Spark-pc'er fra Lenovo og Acer klar i oktoberNVIDIA har vist nye Windows-pc'er med RTX Spark-platformen på IFA 2026.