News-Tracker

Søgning

AI & LLM · daglig briefing


1 briefing-resultat(er) for »nvidia-gb300«

Qwen 3.8 2.4T kører 288.000 tokens/sekund på Nvidia GB300 NVL72

Den enorme MoE-model opnår over 4.000 tokens/sekund per GPU i FP8-præcision på Nvidias 72-GPU-superchip. Det svarer til 350 …

mandag 17. august 2026 · Nye modeller qwen-3.82.4tnvidia-gb300inference