Søgning
5 briefing-resultat(er) for »rocm«
Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX
Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …
Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split
… Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen 17. august](/archive/2026-08-17)
Opfølgning: Qwen3.8 Flash Quants – 20-30 GB mindre end Unsloth Q4
… Inkluderer en separat ROCmFP4-build til AMD/Strix Halo. [briefingen 26. august](/archive/2026-08-26)
ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M
Opgraderingen til ROCm 7.14 tilføjer officiel understøttelse af Radeon 780M iGPU. Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE …
Ling 3.0 Flash overgår Qwen-122b på Strix Halo i vLLM
På AMD Strix Halo med vLLM ROCm/HiP og 4-bit komprimering slår Ling 3.0 Flash Qwen-122b i hastighed. Tool calling virker …