Søgning
4 research-rapport(er) for »qwen3.7«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… 86,7% på LiveCodeBench mod Qwen3.6-27B-MTP Q4_K_M's 53,3% — en markant forskel på 25 ud af 75 opgaver …
Qwen 3.8 27b
… På benchmarks opnår Qwen3.6-27B 77,2% på SWE-bench Verified, hvilket slår den tidligere flagskibsmodel Qwen3.5-397B-A17B MoE's 76 …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Kilden angiver, at Qwen3.6-27B opnår **77,2% på SWE-bench Verified**, mens Gemma 4 26B A4B kun opnår **17,4%** – en forskel …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… Flere modeller som Polestar 2 og VW ID.7 byder på flere varianter inden for budgettet. Oversigten er baseret på officielle danske prislister og …
13 briefing-resultat(er) for »qwen3.7«
Strix Halo: Alternativer til llama.cpp giver op til 60 tok/s decode
… Forks som halogen-flash-server og strix-llama.cpp når 75-90 % af teorien.
Opfølgning: Qwen3.5 0.8B kører 2,9× hurtigere på CPU med custom engine
En bruger har bygget et C++-engine og 4-bit-format, der giver 2,9× prefill og 1,7× batch-16 throughput mod llama …
Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX
Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …
Tenstorrent QuietBox 2 benchmarket med Qwen 3.7 27B
En medarbejder har benchmarked Qwen 3.7 27B på Tenstorrents QuietBox 2 med to p300c-kort. Tallene er endnu ikke offentlige i detaljer, men …
Opfølgning: State-of-the-art GGUFs til Qwen3.8-27B – 2,5-3,0 bpw
… 2,75 bpw (9,3 GB) matcher endda BF16 i gennemsnit på flere benchmarks [se briefingen 20. august](/archive/2026-08-20).
Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet
QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.
Fra LM Studio til vLLM: 143 tok/s på Qwen3.8 med to RTX 3090’er
En bruger deler sin opgradering, der gjorde Qwen3.8’s reasoning tålelig, og GPU-temperaturerne faldt fra 70°C til 35°C. [Se tidligere …
Qwen3.8’s low-preset slår Qwen 3.7 Plus – forskellige tænkeniveauer testet
Selv det laveste reasoning-preset er bedre end Qwen 3.7 Plus eller Qwen3.6-27B’s reasoning. [Se tidligere dækning](/archive/2026-08 …
Opfølgning: Unsloth udgiver forbedrede GGUFs til Qwen3.8-27B
Dynamic v3 giver 10 % højere nøjagtighed for samme størrelse, og 1-bit quants bevarer 77 % nøjagtighed. Modellen kan nu køre på 8 GB RAM …
Opfølgning: Qwen3.8-23B-Mini-Me – dybdebeskæring fjerner lag uden at ødelægge ræsonnement
En Reddit-bruger pruned Qwen3.8-27B til 22.7B ved at fjerne lag strategisk. Ingen finjustering, men kode og agentiske opgaver fungerer stadig …
Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden
Qwen3.8-27B præsterer på niveau med Claude 4.6 fra februar, men halter bag Opus 4.7/4.8 og Mythos. En 27B …
Opfølgning: Lokal realtids-stack til stemmeinteraktion med Ollama
En bruger har sammensat Parakeet STT, Qwen 2.5 7B og Qwen3-TTS til lokal stemmestyring. Bygger videre på tidligere lokale AI-projekter. Se …
Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling
Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.