Søgning
5 research-rapport(er) for »qwen3.8-27b«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… The Measured Numbers](https://kie.ai/blog/qwen-3-6-27b-deep-dive-benchmarks-quantization) 8. [Qwen3.6-27B: 27B Model Beats 397B on …
Qwen 3.8 27b
## Kort resumé Qwen3.8-27B er en kommende open-weight model fra Alibaba, der blev annonceret i juli-august 2026, men selve vægtene var …
Qwen 3.8 27b
## Hvad der skete Ifølge [1] (Reddit, r/LocalLLaMA) efterlyser en bruger Qwen3.8 i størrelserne 27B, 35B, 122B og 397B. Brugeren skriver, at ”the …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… 16,8 GB VRAM – hvilket passer i et RTX 4080 16GB-kort. Ifølge [10] (Hugging Face, udgivet 22. april 2026) er Qwen3.6-27B …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… comments/1uyz9n2/bonsai_27b_runs_locally_on_an_iphone_a_27b_model/) (brief-arkiv) 30. [Gemma4-31b slår Qwen3.6-27b som kodningsagent i …
50 briefing-resultat(er) for »qwen3.8-27b«
Opfølgning: Qwen3.8 27b bygger spil på 5 timer – open source på RTX 3090
En bruger tester Qwen3.8 27b's maksimale ydeevne ved at lade modellen bygge et helt spil på fem timer. Projektet bliver open source …
Agnes-3.0-Flash: Benchmark-hit med uklar historie
33B-modellen hævdes at slå Qwen3.8 27B på AA-indekset, men HF-udgaven er "Preview" og ikke samme model som evalueret.
Opfølgning: Brugere søger pi.dev-plugin til konteksthåndtering
En Qwen3.8 27B-bruger på RTX 5080 kæmper med komprimering, der fejler og afslutter modellen tidligt. Se [briefingen 30. august](/archive/2026-08 …
Task-aware kvantisering: 99 % af BF16-ræsonnering til 15 % af størrelsen
En bruger har bygget TAK, en task-specifik kvantiseringspipeline, der med Qwen3.8-27B scorer 82,81 % i ræsonnering mod BF16's 83,59 …
Udvikler: Modellerne er fine, værktøjerne er problemet
… Han mener, at modeller som Qwen3.8-27B er gode nok, men værktøjerne halter.
Bruger beder om benchmark: Qwen3.8-27B Q8 vs Flash Q4
En bruger vil have svar på, om Qwen3.8-Next-Flash er det ekstra kvantiseringsformat værd. Indtil videre ingen definitive tal.
Qwen 3.8 27B "afhackede" en brugeres PC
En r/LocalLLaMA-bruger fik en RAT installeret via et ondsindet site og brugte Qwen 3.8 27B til at rense maskinen. Lokale modeller …
Opfølgning: 21 kvantvarianter af Qwen3.8 27B benchmarket på 16 GB VRAM
Bartowski IQ4_XS var bedst samlet, huihui-ai abliterated bedst uncensored; KLD-målingerne viser stor kvalitetsspredning mellem kvants. Valg af kvant betyder mere end …
Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX
Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …
Opfølgning: Hvordan fordeler man GGUF-model og kontekst over to GPU'er?
Bruger spørger, om konteksten skal ligge på det andet 16 GB-kort, eller om højere kvants med tensor-parallelisme er bedre; modelkort angiver sjældent …
Opfølgning: 280 tok/s på Qwen3.8 27B med to R9700’ere og 940K KV-cache
Udvikler opnår rekordhastighed med MXFP4-kerner og DFlash2, hvilket presser hardwaren til det yderste. [Se tidligere briefingen](/archive/2026-08-24).
Opfølgning: Kaitchup benchmarker Qwen3.8 27B-kvanter fra Q4 til Q1
Resultater viser, at UD Q3_K_XL med 12,8GB giver 100% nøjagtighed og er ideel til 16GB-kort. [Se tidligere briefingen](/archive/2026 …
Opfølgning: Flash Next vs. 27B – hurtigere, men med ny fejltype
Flash Next er hurtigere og fejlfri på JSON og injection, men 27B vinder på symbolsk ræsonnement. Flash Next har en ny fejl: den lover …
Opfølgning: Dual-GPU tuner til llama.cpp optimerer tensor-split
… Testet med Qwen3.8-27B på ROCm og Vulkan. [briefingen 17. august](/archive/2026-08-17)
Opfølgning: Qwen 3.8 27B overgår GPT-5.6 på tysk oversættelse
Brugere rapporterer at Qwen 3.8 27B leverer idiomatisk, nuanceret tysk langt bedre end frontier-modeller. Særligt tegnsætning og ordvalg roses. [briefingen 20. august …
Qwen3.8-27B-UD-IQ3XXS: End-to-end pipeline fra prompt til video
En bruger demonstrerer en fuld workflow: byg app, prompt flow, test til billede, billede til video og sammensyning – alt styret af Qwen 3.8.
Opfølgning: Qwen 3.8 27B kører 1M kontekst på to RTX 5090'er via NInfer fork
En bruger forked NInfer og tilføjede tensor-parallel og YaRN ×4 rope scaling, så Qwen3.8-27B NVFP4 kører 1.048.576 tokens kontekst …
Opfølgning: Er Qwen3.8 Flash Next værd at køre på 4x3090?
Bruger frustreret over 27B-modellens ubeslutsomhed overvejer Flash Next på 4x3090 med n-gram på SSD. Spørger om arkitekturen er klar nok til local …
Opfølgning: State-of-the-art GGUFs til Qwen3.8-27B – 2,5-3,0 bpw
Nye GSQ-RCO-kvanter slår alle eksisterende kvanters nøjagtighed ved samme filstørrelse. 2,75 bpw (9,3 GB) matcher endda BF16 i gennemsnit på …
Ensemble af Qwen3.8-27B-modeller matcher Fable-5 på kodning
Et nyt papir viser, at flere Qwen3.8-27B-modeller sammen kan matche Fable-5 på LiveCodeBench Hard – til en femtedel af prisen. Metoden …
Opfølgning: Bruger flytter kodningsarbejde fra Claude til lokal Qwen via MCP
En bruger deler et MCP-setup, der lader Claude Code sende specificerede opgaver til en lokal Qwen3.8-27B-model for at spare tokens …
Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet
QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.
Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090
Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.
Bærbar datacenter-rig kører Qwen3.8-27B BF16 med 262K kontekst
FormD T1 med RTX Pro 6000 Blackwell og 96 GB RAM håndterer 175K tokens prefill på 102 sekunder. Brugeren foretrækker BF16 frem for kvantisering …
Kvantiseret Qwen3.8-27B skriver korrekt fysik-simulering på 16 GB GPU
27B-model i IQ3_XXS (10,93 GB) implementerer coherent transfer-matrix-metoden korrekt efter 100 minutter og 108K output-tokens på en Quadro …
Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter
Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. [briefingen 25. august …
JetBrains satser på lokal AI med Qwen3.6 27B
JetBrains optimerer deres IDE til lokal AI og har valgt Qwen3.6 27B frem for Qwen3.8 på grund af behovet for tænkning.
Opfølgning: $100 benchmark af Qwen3.8-27B quants
En bruger planlægger at bruge $100 på cloud-GPU'er for at teste kvantiseringsniveauer, KV-cache-præcision og kontekst-afvejninger på Qwen3.8-27B.
Opfølgning: Qwen 3.8 27B i ekstreme quants – hvor lavt kan man gå?
En bruger på r/LocalLLaMA deler erfaringer med Qwen 3.8 27B i Unsloth Q3 XXS på en Mac mini M4 med 24 GB …
Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes
En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans …
Opfølgning: PowerColor R9700 til Qwen 3.8 27B – reelle tok/s efterlyses
En bruger overvejer et R9700-kort til Qwen 3.8 27B i Q4_K_XL og spørger efter reelle tok/s ved 64K+ kontekst …
Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne
En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som …
Opfølgning: Atomic Dynamic-quants af Qwen 3.8 27B testet på RTX 6000
Et team har lavet og benchmarked Atomic Dynamic GGUF-quants af Qwen 3.8 27B – Q4, Q5, Q6 og Q8 – på en RTX 6000 …
Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port
En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML/three …
Qwen 3.8 27B til reel systemsprogrammering?
En bruger spørger, om Qwen 3.8 27B kan klare rigtig systemsprogrammering som GTK4 eller Qt 6 i Rust/C++ med eksterne biblioteker – ikke …
Opfølgning: Qwen 3.8 27B er "en game changer" – overgår Gemini 3.5 Flash Lite til OCR
Udviklere rapporterer, at Qwen 3.8 27B kørende lokalt leverer OCR-kvalitet bedre end Gemini 3.5 Flash Lite. Modellen matcher frontier-modeller fra …
Kan 64k kontekst føles som 300k med rekursive lokale agenter?
En bruger spørger, om man med Qwen 3.8 27B på én GPU kan få en 64k-agent til at håndtere 300k-opgaver via …
Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning
Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …
Opfølgning: Hvilken harness til lange autonome opgaver?
En bruger efterspørger den bedste harness til lange autonome opgaver med auto-kompaktion og hukommelsessystem – inspireret af posts om Qwen 3.8 27B, der …
Opfølgning: DFlash 2 benchmarkes – 2,26x på rigtige kodeprompts, op til 8x i syntetisk test
Tre dages benchmarking viser DFlash 2 alene giver 2,26x speedup på LiveCodeBench, 4,68x med ét n-gram lookup. N-gram hjælper på …
Qwen 3.8 Low og Medium knuser benchmarks – over-tænkning var ikke nødvendig
Artificial Analysis viser, at de lavere reasoning-presets leverer konkurrencedygtige scores, hvilket bekræfter, at modellens styrke ikke kun skyldes over-tænkning. [Se tidligere dækning …
Qwen3.8-27B Q6 kører 20 timers agentisk kode uden stop
På en RTX 3090 + RTX 3060 holdt modellen 60–63 tokens/s gennem et helt døgns målrettet arbejde. [Se tidligere dækning](/archive/2026-08 …
Fra LM Studio til vLLM: 143 tok/s på Qwen3.8 med to RTX 3090’er
En bruger deler sin opgradering, der gjorde Qwen3.8’s reasoning tålelig, og GPU-temperaturerne faldt fra 70°C til 35°C. [Se tidligere …
Strix Halo-guide: Qwen3.8-27B i Q8 med 256K kontekst og vision
En detaljeret guide til at opsætte et LLM API-endpoint på AMD Strix Halo med opskrifter til kvalitet, balance og hastighed – bygget med pi …
PI Agent overgår OpenCode med Qwen3.8 27B – færre tokens, færre fejl
I en direkte sammenligning brugte PI Agent mindre kontekst, frøs ikke og komprimerede senere end OpenCode. Vision-modul anbefales. [Se tidligere dækning](/archive/2026 …
OpenCode + Qwen3.8-27B Q6_K_XL: kun fiasko indtil videre
Brugeren får ingen respons efter lang tænkning, mens Qwen3.6-35B-A3B fungerer fint. Fejlsøgning pågår. [Se tidligere dækning](/archive/2026-08-17)
Qwen3.8 27B i 3bit på MacBook Air: 63 timer – men flysimulatoren virkede
En bruger fik agentisk kode til at producere en flysimulator på en M2 med 24 GB. Google AI Studio klarede det på 20 minutter …
16 GB VRAM-skærsilden: deling af konfigurationer til Qwen3.8
Brugere deler tips til at køre Qwen3.8-27B på 16 GB VRAM med Q4_XS, CPU-mmproj og begrænset kontekst. [Se tidligere dækning …
Qwen3.8’s low-preset slår Qwen 3.7 Plus – forskellige tænkeniveauer testet
Selv det laveste reasoning-preset er bedre end Qwen 3.7 Plus eller Qwen3.6-27B’s reasoning. [Se tidligere dækning](/archive/2026-08 …
Håber på en ny 2-måneders-gap mellem QwQ og Qwen3
Brugeren spekulerer i, om Qwen3.8 er 2026’s QwQ – imponerende men krævende – og om en mere effektiv efterfølger er på vej. [Se tidligere …