Søgning
5 briefing-resultat(er) for »vulkan«
Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX
Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …
VoxGen: Rust-baseret TTS optimeret til AMD
Ny inferensmotor for VoxCPM2 bruger Vulkan compute. Ingen Python-afhængighed, men kun Windows binaries pt.
Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split
… Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen 17. august](/archive/2026-08-17)
Status på 1-bit og ternære modeller: Bonsai, Hy-MT1.5, Maple-Preview og flere
En omfattende opdatering dækker nye PRs for CUDA/Vulkan og optimeringer, der giver 15-40% hastighedsforøgelse.
ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M
… Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE-modeller klarer sig bedre på Vulkan.