News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »multi-node«

Opfølgning: 181 tok/s på Qwen3.8 Flash Next på 2× DGX Spark

En bruger opnår 181 tokens/s aggregeret på tværs af 9 samtidige agentsessioner på to forbundne DGX Spark. Hemmeligheden: PLE-tabel mmap’et fra …

lørdag 29. august 2026 · Værktøjer & produkter dgx-sparkqwen3.8-flash-nextmulti-nodethroughput

Billig multi-node GPU: 30 tok/s på Laguna med to 4060'ere og USB-ethernet

… Trafikken ligger på 30-70 MB/s – langt under hvad mange tror er nødvendigt for multi-node-inference.

torsdag 23. juli 2026 · Værktøjer & produkter llama.cppmulti-nodelocal-inferencelaguna