Søgning
6 research-rapport(er) for »qwen-3.6«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
# Qwen 3.6 27B sammenlignet med Gemma 4 og Laguna 2.1 til lokal kørsel ## Hvad kilderne siger Qwen 3.6 27B fremhæves bredt …
Qwen 3.8 27b
… Qwen3.6 27B - API Pricing & Benchmarks](https://openrouter.ai/qwen/qwen3.6-27b) 3. [Qwen (@Alibaba_Qwen) on X](https://x.com/Alibaba_Qwen …
Qwen 3.8 27b
… At Qwen3.6-27B og 35B blev udgivet lige før afskedigelserne, og at dette muligvis var ”the last straw”. At brugeren ønsker Qwen3.8 …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Qwen 3.6 27B vs. Gemma 4 – lokal kodegenerering ## Hvad der skete Flere kilder sammenligner Alibabas Qwen 3.6 27B-model med Googles Gemma …
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… enheder, mellemstørrelsen 32B sigter mod balance mellem ydelse og hukommelse, og de store (72B, 110B) er til virksomheds‑ og forskningsbrug [6]. Qwen 2.5 …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… 30. [Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis](https://www.reddit.com/r/LocalLLaMA/comments/1uz8532/gemma431b_better_than_qwen3627b/) (brief …
45 briefing-resultat(er) for »qwen-3.6«
Qwen 3.8 27B kører på RTX 3060 med 10-20 tokens/sekund
En bruger får Qwen 3.8 27B til at køre på en enkelt RTX 3060 med IQ3-kvantisering og opnår 10-20 t/s …
Opfølgning: Tips til draft acceptance med MTP i llama.cpp
Bruger deler konfiguration for at optimere speculative decoding med Qwen3.6-35B-A3B-MTP. [briefingen 30. august](/archive/2026-08-30).
2x R9700 og 64 GB DDR5 – en "beast" til lokal inferens
Bruger rapporterer gode resultater med Qwen 3.8 27B og Flash Next på et ASUS ProArt-kort med to Radeon AI Pro R9700.
Modeltsunami: Ti nye modeller fra Google, OpenAI, Alibaba og Anthropic
… Gemini 3.8 Flash, Qwen3.8-serien, GPT-6 Astra og Claude 5.1. Markedet har fået flere generationsskift på få uger.
Opfølgning: Ollama ROCm matcher næsten llama.cpp Vulkan på RX 7900 XTX
Qwen3.8 27B Q4_K_M gav 34,4 tok/s i Ollama mod 35,8 i llama.cpp; Ollama var bedst til prompt …
Perplexity open-sourcer Mac-inferens til Qwen 3.6
Perplexity udgiver "lily" – en inferensserver optimeret til Apple Silicon.
Opfølgning: Qwen 3.8 er en god koder, men en dårlig samarbejdspartner
Brugere oplever, at 3.8 overkomplicerer ændringer og ignorerer eksisterende kodestil, hvor 3.6 var mere præcis til små rettelser. [Se tidligere briefingen](/archive …
Opfølgning: Qwen 3.8 27B overgår GPT-5.6 på tysk oversættelse
Brugere rapporterer at Qwen 3.8 27B leverer idiomatisk, nuanceret tysk langt bedre end frontier-modeller. Særligt tegnsætning og ordvalg roses. [briefingen 20. august …
Opfølgning: Qwen 3.8 27B kører 1M kontekst på to RTX 5090'er via NInfer fork
En bruger forked NInfer og tilføjede tensor-parallel og YaRN ×4 rope scaling, så Qwen3.8-27B NVFP4 kører 1.048.576 tokens kontekst …
Opfølgning: Qwen 3.8 27B QAT Q2 kører i kun 13-14 GB RAM med minimal kvalitetsnedgang
… Qwen 3.8 27B i Q2 med DFlash og Q5 KV-cache bruger 13-14 GB RAM og stadig matcher Sonnet 4.6. Ekstrem …
Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter
Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. [briefingen 25. august …
FreeToken: Kør frontlinje-MoE på din gaming-PC
FreeToken muliggør 39 tok/s med Qwen3.6 35B på en RTX 4060 laptop og 22-25 tok/s med DeepSeek-V4-Flash 284B …
Opfølgning: Qwen 3.6 bygger C-compiler autonomt
En bruger fik Qwen 3.6 27B til at kode en C99-compiler via et specialbygget harness med subagenter – en test af grænserne for …
Rens dine støvbunnyer – Qwen 3.5 Opus kræver vedligeholdelse
En bruger på r/LocalLLaMA deler et humoristisk indlæg om, at Qwen 3.5 Opus 4.6 distilled bad om "maintenance" – med billede af …
Opfølgning: PowerColor R9700 til Qwen 3.8 27B – reelle tok/s efterlyses
En bruger overvejer et R9700-kort til Qwen 3.8 27B i Q4_K_XL og spørger efter reelle tok/s ved 64K+ kontekst …
Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?
… Qwen 3.8 27B er for langsom.
Opfølgning: Atomic Dynamic-quants af Qwen 3.8 27B testet på RTX 6000
Et team har lavet og benchmarked Atomic Dynamic GGUF-quants af Qwen 3.8 27B – Q4, Q5, Q6 og Q8 – på en RTX 6000 …
Qwen 3.8 27B til reel systemsprogrammering?
En bruger spørger, om Qwen 3.8 27B kan klare rigtig systemsprogrammering som GTK4 eller Qt 6 i Rust/C++ med eksterne biblioteker – ikke …
Kan 64k kontekst føles som 300k med rekursive lokale agenter?
En bruger spørger, om man med Qwen 3.8 27B på én GPU kan få en 64k-agent til at håndtere 300k-opgaver via …
Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning
Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …
Qwen3.8-27B Q6 kører 20 timers agentisk kode uden stop
På en RTX 3090 + RTX 3060 holdt modellen 60–63 tokens/s gennem et helt døgns målrettet arbejde. [Se tidligere dækning](/archive/2026-08 …
OpenCode + Qwen3.8-27B Q6_K_XL: kun fiasko indtil videre
Brugeren får ingen respons efter lang tænkning, mens Qwen3.6-35B-A3B fungerer fint. Fejlsøgning pågår. [Se tidligere dækning](/archive/2026-08-17)
Qwen3.8 27B i 3bit på MacBook Air: 63 timer – men flysimulatoren virkede
En bruger fik agentisk kode til at producere en flysimulator på en M2 med 24 GB. Google AI Studio klarede det på 20 minutter …
Qwen3.8’s low-preset slår Qwen 3.7 Plus – forskellige tænkeniveauer testet
Selv det laveste reasoning-preset er bedre end Qwen 3.7 Plus eller Qwen3.6-27B’s reasoning. [Se tidligere dækning](/archive/2026-08 …
Qwen3.8-27B klarer sig dårligt på SlopCodeBench – god som copilot, ikke alene
Modellen scorer kun 17,6 % på strenge checkpoints og 13,3 % på sværere delmængder. Den kan løse problemer med klar retning, men ikke styre …
Qwen3.8-27B løser fluid-simulering efter to forsøg – på 16 GB GPU
Med IQ3_XXS og 96K kontekst byggede modellen en fungerende fluid-simulering på 42 minutter og 62 værktøjskald. Første forsøg fejlede, men modellen rettede …
Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene
Qwen 3.8 27B scorer 52 på Artificial Analysis Intelligence Index, samme score som GPT-5.6 Luna (max) og kun ét point efter …
Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest
En bruger-test med rekursiv trætegning i Python viser en "kæmpe" kvalitetsforskel mellem Qwen 3.6 og 3.8. Den nye model forstår komplekse …
Opfølgning: Qwen 3.8 27B kører 82 tps på en enkelt RTX 3090
En bruger har optimeret inference til 82 tokens/sekund på en 3090 med W4A16-kvantisering og fp8 KV-cache – op til 672 tps peak …
Qwen 3.8 27B Q2 vs Q3 vs MoE på 12 GB VRAM – MoE vinder på fart
Test på en RTX 5070 Ti laptop viser, at Qwen 3.6 35B-A3B MoE (Q4) giver 59 t/s og 6/6 korrekte …
Opfølgning: Qwen3.8-27B mestrer ray-tracer i BASIC – 3.6 gav op
I en agentisk BASIC-ray-tracer-test klarede 3.8 opgaven på egen hånd, hvor 3.6 krævede ekstra prompting. Det er et konkret …
Lokal ucensureret Qwen 3.8-27B – "Opus 4.6 derhjemme"
En "heretic"-version af modellen fjerner alle afvisninger og sikkerhedsforanstaltninger, hvilket giver en kraftfuld, men ubeskyttet lokal model.
Qwen 30B MoE kører med 30 tps på en RTX 3050 med 6 GB VRAM
En bruger i LocalLLaMA deler, at Qwen 30B MoE opnår 30-35 tokens/sek på en gammel RTX 3050 med 90k kontekst. Bevis på …
1-bit Qwen 3.8 2.4T kører på Mac Ultra – 508 GB RAM i brug
… Qwen 3.8 2.4T på en Mac Ultra 512 GB. Modellen bruger 508 GB RAM og opnår ~50 PP og 9,6 tgen …
Opfølgning: Muse Glimmer 30B slår Qwen 3.6 27B på flere områder – men halter på kode
Tidlige brugerbenchmarks viser, at Muse Glimmer 30B er mere effektiv til agent-opgaver og har bedre trivia-viden end Qwen 3.6 27B, men …
35B BigBang-v1 påstår at matche modeller op til 1,6T parametre
En ny finetune baseret på Qwen 3.5 hævder aggregatperformance mellem DeepSeek Flash og Pro, men per-benchmark-scorerne er ujævne. Benchmark-kontamination er …
Sammenligning af 4-bit kvanttyper på MLX i gang
Brugeren efterlyser erfaringer med OptiQ, Unsloth Dynamic 2.0, oQ og DWQ til Qwen3.6 og Gemma4 på MLX – hvilken kvant bevarer bedst kvalitet?
Opfølgning: Dual 3090-opsætning firedobler prompt-hastigheden i llama.cpp
Ved at flytte prompt processing til GPU'erne steg ydeevnen fra 400 til 1600 tokens/s på Qwen 3.6 27B. En konkret gevinst …
Lokal LLM styrer robotarm i smartphone-batteritest
En YouTuber bruger Qwen3.6 27B og 35B-A3B lokalt på en RTX PRO 6000 til at give sin batteritest-robot en "sjæl". Cloud …
Opfølgning: Qwen 3.6 35B MoE kører på en Xiaomi 12 Pro med kun 12 GB RAM
En modificeret Xiaomi-telefon kører en 35B MoE-model lokalt med 2,4 tok/s. Konteksten er begrænset til 8k tokens, men det viser …
Opfølgning: Debat om KV-cache-kvantisering på Qwen 3.6
På r/LocalLLaMA diskuteres afvejningen mellem VRAM-besparelser og kvalitetstab ved kvantisering af KV-cache under Q8. Se [briefingen 19. juli](/archive/2026-07 …
Opfølgning: Qwen 3.6 føles mindre intelligent end Gemma 4 trods bedre benchmarks
Brugere oplever, at Gemma 4 26a4B (QAT) er mere sammenhængende i praksis. Se [briefingen 18. juli](/archive/2026-07-18).
Hvilke oversete lokale modeller bruger du dagligt?
En tråd på r/LocalLLaMA samler anbefalinger af modeller uden for mainstream som Qwen 3.6 og Gemma 4. Tråden afslører flere skjulte perler …
Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis
En bruger skiftede fra Qwen3.6-27b til Gemma4-31b som primær kodningsagent og løste på én dag bugs, der havde stået på i …
Bonsai 27B kører lokalt på iPhone i kun 3,9GB
PrismML har bygget Bonsai ved at kvantisere Qwen3.6-27B ned til 1-bit, hvilket reducerer størrelsen fra ~54GB til 3,9GB. Modellen bevarer …