Søgning
3 research-rapport(er) for »model-size«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… 1B to 1T Explained | Iternal](https://iternal.ai/llm-parameter-size-guide) 4. [NVIDIA Just Released a 120B Model That Only Uses 12B. Here …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Ifølge [12] scorer modellen 77,2% på SWE-bench Verified og matcher Claude 4.5 Opus på Terminal-Bench, samtidig med at den kan …
Qwen 3.8 27b
… Ifølge [2] (Hugging Face, officiel modelkort) udgav Alibaba/Qwen den 22. april 2026 Qwen3.6-27B som ”the first open-weight variant of Qwen3 …
4 briefing-resultat(er) for »model-size«
DeepSeek V4.1 Flash er 748B parametre – ikke 284B
Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.
Opfølgning: Flere Qwen 3.8-størrelser på vej – fællesskabet venter spændt
… Samtidig viser en case study, at kvantisering skader viden ikke-lineært, hvilket gør valg af modelstørrelse og præcision afgørende for praktisk brug.
Fællesskabet efterlyser mindre Qwen-modeller i stedet for trillion-parametre-giganter
… at Qwen3.8 i størrelser som 27B og 35B ville gavne fællesskabet mere end de uopnåelige 2T+ modeller, som kun store virksomheder kan køre.
Brugerne håber på en mindre variant af Qwen 3.8
… En Reddit-bruger ønsker sig en sub-0,5B-model som alternativ, og peger på Minimax M3 som eksempel.