Ollama har udgivet version 0.30 med forbedret ydelse og bredere understøttelse af GGUF-modeller gennem llama.cpp. Opdateringen supplerer Ollamas MLX-motor på Apple silicon og udvider understøttelsen til flere modeller på et bredere udvalg af hardware. På Nvidia-hardware er gennemløbet nu op til 20 procent hurtigere. Fremskridtet er testet med modellen Gemma 4 26B kørt på et RTX 5090-grafikkort med Q4_K_M-kvantisering. Vulkan er nu aktiveret som standard, hvilket udvider Ollamas GPU-acceleration til flere enheder, herunder fra AMD og Intel, uden at kræve installation af producentspecifikke biblioteker. Version 0.30 udvider desuden kompatibiliteten med GGUF-økosystemet, så flere modelfamilier kører uden videre, blandt andet LFM og Prism samt finjusterede modeller udgivet af Unsloth. GGUF-modeller kan hentes direkte fra Hugging Face og køres via en Modelfile med FROM-kommandoen.
Ollama 0.30 giver hurtigere ydelse på Nvidia-hardware og Vulkan som standard
Artikel5. juni 2026 kl. 02.00 Martin S. Nielsen

Foto: Ollama
Ollama har udgivet version 0.30 med forbedret ydelse og bredere understøttelse af GGUF-modeller gennem llama.cpp.
Kilde: Ollama
AI-genereret indhold
Annonceplads
300 x 250
Relaterede artikler
- Kubernetes gør rootless mode (KubeletInUserNamespace) til beta i v1.37Kubernetes 1.37 løfter feature-gaten KubeletInUserNamespace, også kaldet rootless mode, fra alpha til beta.
- Raspberry Pi kan nu vise splash screens tidligt i boot på SPI og I2C skærmeRaspberry Pi har udviklet en funktion, der gør det muligt at vise et brugerdefineret opstartsbillede meget tid...
- NVIDIA RTX Spark-pc'er fra Lenovo og Acer klar i oktoberNVIDIA har vist nye Windows-pc'er med RTX Spark-platformen på IFA 2026.
- Nye open source-modeller udnytter Framework Desktops 32GB- og 64GB-hukommelse bedreFramework Desktop fås i tre hukommelseskonfigurationer bygget omkring AMD's Ryzen AI Max-processor, kodenavn S...