News-Tracker

Søgning

AI & LLM · daglig briefing


3 briefing-resultat(er) for »nvme«

Opfølgning: 181 tok/s på Qwen3.8 Flash Next på 2× DGX Spark

… PLE-tabel mmap’et fra NVMe og madvise(MADV_RANDOM) [se briefingen 21. august](/archive/2026-08-21).

lørdag 29. august 2026 · Værktøjer & produkter dgx-sparkqwen3.8-flash-nextmulti-nodethroughput

Intel Optane som tredje lagerlag til MoE-modeller diskuteres

En bruger spekulerer i, om udgået Intel Optane-teknologi kan bruges som en tredje hukommelseslag til nestede MoE-modeller mellem RAM og NVMe.

søndag 9. august 2026 · Værktøjer & produkter intel-optanememory-hierarchymoelocal-inference

Opfølgning: Kimi K3 kører på én CPU med 8 GB RAM – 33 sekunder per token

En C99-inference engine streamer eksperter fra NVMe. 176 KB binary, ingen GPU. Ikke praktisk, men imponerende ingeniørarbejde. [Se tidligere briefingen 30. juli](/archive …

mandag 3. august 2026 · Forskning & arkitektur kimi-k3cpu-inferencenvme