News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »mmproj«

Gammel GPU kan speede mmproj op til 10x med llama.cpp

Ét flag – `--mmdev CUDA1` – kan lade en sekundær, langsom GPU håndtere vision mmproj og frigøre VRAM til inferens. Praktisk hack til lokal multi-GPU.

lørdag 12. september 2026 · Værktøjer & produkter llama.cppmmprojgpu-offloadinglocal-llm

16 GB VRAM-skærsilden: deling af konfigurationer til Qwen3.8

Brugere deler tips til at køre Qwen3.8-27B på 16 GB VRAM med Q4_XS, CPU-mmproj og begrænset kontekst. [Se tidligere dækning …

lørdag 22. august 2026 · Nye modeller qwen3.8-27b16gb-vramggufoptimization