News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »rocm«

Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX

Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …

lørdag 5. september 2026 · Værktøjer & produkter qwen3.8-27bollamarocmvulkan

Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split

… Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen 17. august](/archive/2026-08-17)

mandag 31. august 2026 · Værktøjer & produkter llama.cppdual-gputensor-splitqwen-3.8

Opfølgning: Qwen3.8 Flash Quants – 20-30 GB mindre end Unsloth Q4

… Inkluderer en separat ROCmFP4-build til AMD/Strix Halo. [briefingen 26. august](/archive/2026-08-26)

søndag 30. august 2026 · Nye modeller qwen-3.8ggufquantizationlocal-llm

ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M

Opgraderingen til ROCm 7.14 tilføjer officiel understøttelse af Radeon 780M iGPU. Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE …

mandag 17. august 2026 · Værktøjer & produkter llama.cpprocmradeon-780mvulkan

Ling 3.0 Flash overgår Qwen-122b på Strix Halo i vLLM

På AMD Strix Halo med vLLM ROCm/HiP og 4-bit komprimering slår Ling 3.0 Flash Qwen-122b i hastighed. Tool calling virker …

tirsdag 11. august 2026 · Nye modeller ling-3.0-flashstrix-halovllmperformance