News-Tracker

Søgning

AI & LLM · daglig briefing


4 research-rapport(er) for »qwen3.7«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… 86,7% på LiveCodeBench mod Qwen3.6-27B-MTP Q4_K_M's 53,3% — en markant forskel på 25 ud af 75 opgaver …

fredag 7. august 2026 · research

Qwen 3.8 27b

… På benchmarks opnår Qwen3.6-27B 77,2% på SWE-bench Verified, hvilket slår den tidligere flagskibsmodel Qwen3.5-397B-A17B MoE's 76

mandag 3. august 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Kilden angiver, at Qwen3.6-27B opnår **77,2% på SWE-bench Verified**, mens Gemma 4 26B A4B kun opnår **17,4%** – en forskel …

torsdag 30. juli 2026 · research

elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links

… Flere modeller som Polestar 2 og VW ID.7 byder på flere varianter inden for budgettet. Oversigten er baseret på officielle danske prislister og …

lørdag 18. juli 2026 · research

13 briefing-resultat(er) for »qwen3.7«

Strix Halo: Alternativer til llama.cpp giver op til 60 tok/s decode

… Forks som halogen-flash-server og strix-llama.cpp når 75-90 % af teorien.

tirsdag 8. september 2026 · Værktøjer & produkter strix-halollama.cppqwen3.8-flash-nextinference

Opfølgning: Qwen3.5 0.8B kører 2,9× hurtigere på CPU med custom engine

En bruger har bygget et C++-engine og 4-bit-format, der giver 2,9× prefill og 1,7× batch-16 throughput mod llama …

tirsdag 8. september 2026 · Forskning & arkitektur qwen-3.5cpu-inferencequantizationcustom-engine

Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX

Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …

lørdag 5. september 2026 · Værktøjer & produkter qwen3.8-27bollamarocmvulkan

Tenstorrent QuietBox 2 benchmarket med Qwen 3.7 27B

En medarbejder har benchmarked Qwen 3.7 27B på Tenstorrents QuietBox 2 med to p300c-kort. Tallene er endnu ikke offentlige i detaljer, men …

søndag 30. august 2026 · Værktøjer & produkter tenstorrentqwen3.7benchmarkhardware

Opfølgning: State-of-the-art GGUFs til Qwen3.8-27B – 2,5-3,0 bpw

… 2,75 bpw (9,3 GB) matcher endda BF16 i gennemsnit på flere benchmarks [se briefingen 20. august](/archive/2026-08-20).

lørdag 29. august 2026 · Værktøjer & produkter ggufqwen3.8-27bgsq-rcoquantization

Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet

QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.

onsdag 26. august 2026 · Nye modeller qwen3.8-27bmxfp4quasarquantization

Fra LM Studio til vLLM: 143 tok/s på Qwen3.8 med to RTX 3090’er

En bruger deler sin opgradering, der gjorde Qwen3.8’s reasoning tålelig, og GPU-temperaturerne faldt fra 70°C til 35°C. [Se tidligere …

lørdag 22. august 2026 · Værktøjer & produkter vllmqwen3.8-27brtx-3090inference-speed

Qwen3.8’s low-preset slår Qwen 3.7 Plus – forskellige tænkeniveauer testet

Selv det laveste reasoning-preset er bedre end Qwen 3.7 Plus eller Qwen3.6-27B’s reasoning. [Se tidligere dækning](/archive/2026-08 …

lørdag 22. august 2026 · Nye modeller qwen3.8-27breasoning-levelslow-presetqwen3.7

Opfølgning: Unsloth udgiver forbedrede GGUFs til Qwen3.8-27B

Dynamic v3 giver 10 % højere nøjagtighed for samme størrelse, og 1-bit quants bevarer 77 % nøjagtighed. Modellen kan nu køre på 8 GB RAM …

torsdag 20. august 2026 · Nye modeller qwen-3.8unslothggufquantization

Opfølgning: Qwen3.8-23B-Mini-Me – dybdebeskæring fjerner lag uden at ødelægge ræsonnement

En Reddit-bruger pruned Qwen3.8-27B til 22.7B ved at fjerne lag strategisk. Ingen finjustering, men kode og agentiske opgaver fungerer stadig …

torsdag 20. august 2026 · Nye modeller qwen-3.8depth-pruningmini-meopen-weights

Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden

Qwen3.8-27B præsterer på niveau med Claude 4.6 fra februar, men halter bag Opus 4.7/4.8 og Mythos. En 27B …

søndag 16. august 2026 · Nye modeller qwen3.8-27bopen-weightsclaude-opusbenchmark

Opfølgning: Lokal realtids-stack til stemmeinteraktion med Ollama

En bruger har sammensat Parakeet STT, Qwen 2.5 7B og Qwen3-TTS til lokal stemmestyring. Bygger videre på tidligere lokale AI-projekter. Se …

søndag 9. august 2026 · Værktøjer & produkter ollamavoice-stacksttttslocal-ai

Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling

Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.

søndag 19. juli 2026 · Forskning & arkitektur thinking-machines-labtinkerqwen3-235bfine-tuninginkling