Søgning
6 briefing-resultat(er) for »model-management«
Opfølgning: Brugere søger pi.dev-plugin til konteksthåndtering
En Qwen3.8 27B-bruger på RTX 5080 kæmper med komprimering, der fejler og afslutter modellen tidligt. Se [briefingen 30. august](/archive/2026-08 …
Opfølgning: Ny forskning adskiller offentlige og private kapaciteter i åbne vægte
To nye papirer foreslår metoder til at kontrollere sensitive kapaciteter i open-weight-modeller uden at forhindre forskning. [briefingen 29. august](/archive/2026-08 …
Hvor meget VRAM til lokalt dokumentmanagement?
… rækker 8-12 GB VRAM til paperless-ai, når man vil stille spørgsmål til egne dokumenter? Fællesskabet peger på 6-10 GB-modeller som …
llama.cpp Windows Manager: visuel hub til flere lokale modeller
Open-source-appen håndterer flere llama.cpp-runtime, launch-profiler og samtidige modeller bag en fælles OpenAI-kompatibel gateway. Tre måneder efter debuten er …
Opfølgning: Alibaba lægger billetindtægtsmodel for Qwen – store kunder skal betale
Alibaba planlægger at kræve en omsætningsandel fra store erhvervskunder, der bruger deres open-weight-model Qwen3.8-Max, efter forbillede fra Moonshots Kimi K3 …
Brugererfaring: Bonsai-Ternary-27B på 4060Ti 16GB
En bruger deler erfaringer med at køre Bonsai-Ternary-27B på et relativt beskedent setup med 4060Ti 16GB til knowledge management og produktivitetsopgaver. Modellen …