Søgning
24 briefing-resultat(er) for »glm-5.3«
Opfølgning: LayerStoRm – open source expert-streaming kører 186 GiB MoE på 96 GB VRAM
Ny MIT-licenseret inferensmotor streamer eksperter fra RAM og opnår 24,5 tok/s ved 1M kontekst på fire RTX 50-serie GPU'er …
Expert expansion med llama.cpp – ny branch til MoE-modeller
En bruger har bygget en custom branch af llama.cpp, der understøtter expert expansion, testet med GLM 5.3 Flash på Metal.
Opfølgning: DeepSeek V4 Flash vs GLM 5.3 Flash på to GX10
Opfølgning på [briefingen 30. august](/archive/2026-08-30). Bruger rapporterer GLM vinder på skrivekvalitet og vision, DeepSeek på tokenhastighed.
Opfølgning: GLM 5.3 Flash over DSV4 Flash?
Opfølgning på [briefingen 30. august](/archive/2026-08-30). Reddit-bruger på M3 Ultra 256GB overvejer skifte. GLM nævnes som benchmark-bedre.
Opfølgning: Status for open source LLM'er 31. august 2026
En ny tråd på r/LocalLLaMA opsummerer ugens udviklinger inden for open source-modeller, herunder opfølgning på GLM-5.3. Læs baggrunden i [briefingen …
GLM 5.3 Flash slår DeepSeek V4 Flash på HumanEval på 2x DGX Spark
En bruger benchmarkede GLM 5.3 Flash (NVFP4) mod DeepSeek V4 Flash 0731 på to DGX Spark: GLM vandt med 97,0% mod 94 …
To kinesiske AI-labs lander uafhængigt på samme arkitektur
Z.ai (GLM-5.3-Flash) og Qwen (Qwen3.8-Flash-Next) har begge sendt næsten identiske modeller: 3:1 lineære hybrider, komprimerede indexere …
GLM-5.3 nærmer sig Anthropic på cybersikkerhedsbenchmark
Zhipu AI's GLM-5.3 opnåede 84,5% mod Anthropics Mythos 5's 83,8% på CyberGym-testen. Med åbne vægte og en …
Opfølgning: GLM-5.3 nu open-weight – 50% bedre kode og state-of-the-art på cyberexploits
ZAI har frigivet GLM-5.3 som åbne vægte: samme basismodel som 5.2, men post-træning giver markant bedre kodning og en uventet …
Opfølgning: Zhipu afslører Ox Alpha som GLM-5.3-Flash og udgiver vægte
Det anonyme Ox Alpha viste sig at være Zhipus GLM-5.3-Flash med 320 mia. parametre (18 mia. aktive) – den første native multimodale …
Opfølgning: Z.ai bekræfter, at Ox Alpha er GLM-5.3-Flash – open-sourcer modellen
Det kinesiske laboratorium Z.ai afslørede sig som skaberen af den mystiske Ox Alpha-model og udgav den som GLM-5.3-Flash med …
GLM-5.3-Flash: 320B parametre, 1M kontekst og hybrid attention
Den officielle megatråd bekræfter, at modellen har 320B parametre (18B aktive), 1M tokens kontekstvindue og en ny hybrid sparse/linear attention. Den er trænet …
Opfølgning: Benchmark-kaos – GLM-5.3 resultater diskuteres
Reddit-bruger påpeger, at benchmark-scoren for GLM-5.3 er ude af proportioner. [briefingen 19. august](/archive/2026-08-19).
Opfølgning: Z.AI's GLM-5.3 overgår amerikanske modeller i cybersikkerhed – udgivelse forsinket
Det kinesiske open-weight-model GLM-5.3 slår benchmarks, men udgivelsen er udskudt efter uventede hacking-evner. [briefingen 11. august](/archive/2026-08 …
Opfølgning: GLM-5.3 benchmarkresultater offentliggjort – konkurrencedygtig med topmodeller
Artificial Analysis viser, at GLM-5.3 præsterer stærkt på tværs af standardtest. [briefingen 18. august](/archive/2026-08-18)
Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene
… 3.8 27B scorer 52 på Artificial Analysis Intelligence Index, samme score som GPT-5.6 Luna (max) og kun ét point efter GLM …
Opfølgning: GLM-5.3 lanceret med 50% bedre kodning og cyber-capabilities
Z.ai's nye open-weight model GLM-5.3 hævdes at være "den hidtil dygtigste" til cybersecurity-opgaver, med 50% forbedring i kodning …
Opfølgning: GLM-5.3 lanceret som 743-milliarder-parameter open-weights-model
Z.ai har lanceret GLM-5.3, en 743-milliarder-parameter open-weights-kodemodel, og vægtene kommer snart på Hugging Face. Udfordringen til de …
GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning
Z.ai udgav GLM-5.3 uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE …
Nathan Lambert: Sådan holder kinesiske laboratorier trit med fronten
Nathan Lambert analyserer, hvorfor kinesiske AI-labs som Z.ai forbliver konkurrencedygtige: aggressiv post-træning og benchmark-testning driver fremskridtet.
Opfølgning: Er ældre modeller som GLM 5.2 og Kimi 2.7 stadig relevante?
Med ankomsten af Kimi K3, Qwen 3.8 Max og DeepSeek V4 Pro spørger community, om tidligere topmodeller stadig duer til langvarig kodning. [briefingen …
Qwen 3.8-Max lanceret – Alibaba sætter ny standard med 2,4 billioner parametre
… Samtidig viser brugerrapporter, at DeepSeek V4 Flash i fuld præcision nærmer sig GLM 5.2-niveau, men at kvantisering rammer modellen hårdt.
Open source-accelerationen truer Anthropic og OpenAI's forretningsmodel
En debattråd på r/LocalLLaMA argumenterer for, at open source-modeller som Kimi K3, Minimax 3 Pro og GLM 5.3 tvinger de store …