Ollama 0.30 giver hurtigere ydelse på Nvidia-hardware og Vulkan som standard

Artikel5. juni 2026 kl. 02.00 Martin S. Nielsen
Ollama 0.30 giver hurtigere ydelse på Nvidia-hardware og Vulkan som standard
Foto: Ollama

Ollama har udgivet version 0.30 med forbedret ydelse og bredere understøttelse af GGUF-modeller gennem llama.cpp.

Ollama har udgivet version 0.30 med forbedret ydelse og bredere understøttelse af GGUF-modeller gennem llama.cpp. Opdateringen supplerer Ollamas MLX-motor på Apple silicon og udvider understøttelsen til flere modeller på et bredere udvalg af hardware. På Nvidia-hardware er gennemløbet nu op til 20 procent hurtigere. Fremskridtet er testet med modellen Gemma 4 26B kørt på et RTX 5090-grafikkort med Q4_K_M-kvantisering. Vulkan er nu aktiveret som standard, hvilket udvider Ollamas GPU-acceleration til flere enheder, herunder fra AMD og Intel, uden at kræve installation af producentspecifikke biblioteker. Version 0.30 udvider desuden kompatibiliteten med GGUF-økosystemet, så flere modelfamilier kører uden videre, blandt andet LFM og Prism samt finjusterede modeller udgivet af Unsloth. GGUF-modeller kan hentes direkte fra Hugging Face og køres via en Modelfile med FROM-kommandoen.

AI-genereret indhold
Annonceplads

300 x 250

Relaterede artikler