News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »vulkan«

Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX

Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …

lørdag 5. september 2026 · Værktøjer & produkter qwen3.8-27bollamarocmvulkan

VoxGen: Rust-baseret TTS optimeret til AMD

Ny inferensmotor for VoxCPM2 bruger Vulkan compute. Ingen Python-afhængighed, men kun Windows binaries pt.

torsdag 3. september 2026 · Værktøjer & produkter voxgenttsamdvoxcpm2

Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split

… Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen 17. august](/archive/2026-08-17)

mandag 31. august 2026 · Værktøjer & produkter llama.cppdual-gputensor-splitqwen-3.8

Status på 1-bit og ternære modeller: Bonsai, Hy-MT1.5, Maple-Preview og flere

En omfattende opdatering dækker nye PRs for CUDA/Vulkan og optimeringer, der giver 15-40% hastighedsforøgelse.

onsdag 19. august 2026 · Forskning & arkitektur bitnetternarybonsaiquantization

ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M

… Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE-modeller klarer sig bedre på Vulkan.

mandag 17. august 2026 · Værktøjer & produkter llama.cpprocmradeon-780mvulkan