Søgning
3 briefing-resultat(er) for »dual-gpu«
Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split
Nyt værktøj beregner præcis `--override-tensor` for at maksimere kontekstlængde på to GPU'er. Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen …
Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne
Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB …
Opfølgning: Dual 3090-opsætning firedobler prompt-hastigheden i llama.cpp
Ved at flytte prompt processing til GPU'erne steg ydeevnen fra 400 til 1600 tokens/s på Qwen 3.6 27B. En konkret gevinst …