Søgning
8 briefing-resultat(er) for »2.4t«
Opfølgning: Qwen 3.8 9B på vej – mindre søskende til den store MoE
Efter Qwen 3.8-2.4T og 27B spekulerer miljøet nu i en 9B-variant. En mindre model ville gøre Qwen 3.8-familien …
Qwen 3.8 2.4T kører 288.000 tokens/sekund på Nvidia GB300 NVL72
Den enorme MoE-model opnår over 4.000 tokens/sekund per GPU i FP8-præcision på Nvidias 72-GPU-superchip. Det svarer til 350 …
Opfølgning: Qwen 3.8-distillationer dukker op – mindre modeller fra den store
Distillerede varianter af Qwen 3.8-2.4T er begyndt at cirkulere, hvilket lover godt for lokale kørsler. Se [briefingen 13. august](/archive/2026 …
Opfølgning: Alibaba frigiver Qwen3.8-2.4T – DeepSeek svarer med V4-Pro
Alibaba har nu frigivet vægtene til Qwen3.8-Max med 2,4 billioner parametre, mens DeepSeek lancerer V4-Pro og hæver API-priser. De …
Opfølgning: Nedtællingen til Qwen3.8-27B er i gang
… Communityet venter spændt på en mindre, men kapabel søskende til 2.4T-modellen. Se [briefingen 12. august](/archive/2026-08-12).
1-bit Qwen 3.8 2.4T kører på Mac Ultra – 508 GB RAM i brug
En bruger tester Unsloths 1-bit kvantisering af Qwen 3.8 2.4T på en Mac Ultra 512 GB. Modellen bruger 508 GB RAM …
Opfølgning: Qwen 3.8-2.4T-A95B udgivet – 2,4 trillion parameter MoE-model
Alibaba har stille frigivet Qwen3.8-2.4T-A95B på Hugging Face, en massiv MoE-model med 95B aktive parametre. Udgivelsen bekræfter Qwen-familiens …
Opfølgning: Alibaba svarer igen med Qwen3.8-Max på 2,4 billioner parametre
Dage efter Kimi K3 præsenterer Alibaba Qwen3.8-Max-Preview, en åben MoE-model på 2,4T parametre. Prisen er 10% af normalen, men …