News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »cpu-only«

hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting

… Muligt på langsommere CPU-only opsætninger med nok system-RAM [8][12] ## Kun bragt af enkelte medier **Minimax M2.5** nævnes kun på Reddit …

fredag 7. august 2026 · research

3 briefing-resultat(er) for »cpu-only«

Opfølgning: Qwen3.8 Flash Next testet fra CPU til 96 GB VRAM – 109 tok/s

… 109 tok/s på 96 GB VRAM og 8,34 tok/s CPU-only. Læs baggrunden i [briefingen 30. august](/archive/2026-08-30).

tirsdag 1. september 2026 · Nye modeller qwen-3.8performancellama.cppvram

Opfølgning: C-baseret BitNet-inference når 36 tok/s på Xeon CPU

… Viser potentialet for CPU-only inferens. Se [briefingen 3. august](/archive/2026-08-03).

søndag 9. august 2026 · Forskning & arkitektur bitnet1.58-bitcpu-inferencec-engine

Spørgsmål: Kan Inkling køre med llama.cpp på CPU og RAM alene?

En bruger efterspørger launch-script til at køre Inkling uden GPU.

søndag 19. juli 2026 · Værktøjer & produkter inklingllama.cppcpu-onlylocal-llm