Nye modeller
Qwen 3.8 27B imponerer – men over-tænker alt som standard
Alibabas nye 27B-model er fremragende på papiret, men dens standard-indstilling "xhigh" for reasoning-effort får den til at overanalysere selv simple spørgsmål og kører langsomt på forbrugerhardware. Sænk effort til "low" eller "medium" for brugbar ydelse.
Kilder: Simon Willison · r/LocalLLaMA · r/LocalLLaMA · medium.com · r/LocalLLaMA · r/LocalLLaMA
Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest
En bruger-test med rekursiv trætegning i Python viser en "kæmpe" kvalitetsforskel mellem Qwen 3.6 og 3.8. Den nye model forstår komplekse instruktioner markant bedre.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.8 9B på vej – mindre søskende til den store MoE
Efter Qwen 3.8-2.4T og 27B spekulerer miljøet nu i en 9B-variant. En mindre model ville gøre Qwen 3.8-familien tilgængelig på endnu svagere hardware. Se briefingen 13. august.
Kilder: r/LocalLLaMA
Qwen 3.8 27B Q2 vs Q3 vs MoE på 12 GB VRAM – MoE vinder på fart
Test på en RTX 5070 Ti laptop viser, at Qwen 3.6 35B-A3B MoE (Q4) giver 59 t/s og 6/6 korrekte svar, mens Qwen 3.8 27B Q3 kun giver 7,5 t/s. Q2-kvantiseringen fejler simple logikopgaver.
Kilder: r/LocalLLaMA
Qwen 3.8 2.4T kører 288.000 tokens/sekund på Nvidia GB300 NVL72
Den enorme MoE-model opnår over 4.000 tokens/sekund per GPU i FP8-præcision på Nvidias 72-GPU-superchip. Det svarer til 350 tokens/sekund per bruger – dag 0-ydeevne uden yderligere optimering.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.8-distillationer dukker op – mindre modeller fra den store
Distillerede varianter af Qwen 3.8-2.4T er begyndt at cirkulere, hvilket lover godt for lokale kørsler. Se briefingen 13. august.
Kilder: r/LocalLLaMA
Forskning & arkitektur
Lokal AI når GPT-4-niveau i 2027 – en forudsigelse baseret på acceleration
En analyse af frontier-to-local-tidslinjen forudsiger, at en ~30B open-weight-model vil matche GPT-4's evner allerede i januar 2027. Mønsteret viser, at lokale modeller halter 1-2 år bag frontier.
Kilder: r/LocalLLaMA
Værktøjer & produkter
audio.cpp 0.6: 49 model-familier, native WebUI og MiniMax-H3
Den open-source lydramme understøtter nu MiniMax-H3 til tekst-til-audio og musikgenerering, inklusive voice cloning og multi-speaker-demoer. DiT-modeller kan endda generere videorammer – alt sammen uden besværlig opsætning.
Kilder: r/LocalLLaMA
ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M
Opgraderingen til ROCm 7.14 tilføjer officiel understøttelse af Radeon 780M iGPU. Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE-modeller klarer sig bedre på Vulkan.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.8 27B kører 82 tps på en enkelt RTX 3090
En bruger har optimeret inference til 82 tokens/sekund på en 3090 med W4A16-kvantisering og fp8 KV-cache – op til 672 tps peak med 64 samtidige requests. Se briefingen 14. august.
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Nye EU-regler om AI-mærkning risikerer at gøre deepfakes sværere at opdage
EU's AI Act påbyder obligatorisk mærkning af AI-genereret indhold med bøder op til €15 millioner, men reglerne gælder ikke for private brugere. Det kan skabe falsk tryghed og gøre det sværere at identificere deepfakes fra ondsindede aktører.
Kilder: theconversation.com · home.nzcity.co.nz
🗣️ Stemmer
Dario Amodei: AI-virksomheder har ikke leveret – tillid vindes ved resultater, ikke spin
Anthropic-chefen afviser at offentlighedens AI-skepsis skyldes advarsler om risici; den skyldes en decideret tillidskrise. Løsningen er at levere reelle resultater som at kurere kræft, ikke glittede kampagner.
Kilder: Simon Willison · businessinsider.com
Opfølgning: Hinton advarer om massearbejdsløshed – men mange ansatte vælger allerede AI fra
Geoffrey Hinton gentager sin forudsigelse om massiv jobløshed, samtidig med at en canadisk undersøgelse viser, at mange arbejdstagere aktivt fravælger AI-værktøjer. Paradokset understreger kløften mellem teknologiske fremskrivninger og virkelighedens adoption. Se briefingen 9. august.
Kilder: digitaljournal.com · fortune.com · ico-optics.org · mundodeportivo.com
Dario Amodei: Open weights decentraliserer ikke magt – kræver pre-launch-vetting
Amodei forsvarer sine politiske forslag og advarer om, at open-weight-modeller ikke automatisk spreder magten. Han støtter i stedet forhåndsgodkendelse før udgivelse og understreger, at reel tillid kun kommer af konkrete resultater.
Kilder: r/LocalLLaMA
Branche & politik
Nvidia skruer ned for milliardgaranti til OpenAIs datacentre
Nvidia reducerer markant sin garanti for OpenAIs $250 milliarder datacenter-finansiering, hvilket signalerer øget forsigtighed omkring AI-infrastruktur-investeringer. Samtidig bekymrer obligationsmarkedet sig over $70 milliarder i skyggekredit.
Kilder: Hacker News · business-standard.com
Microsoft skyder skylden på AI for forsinket Exchange-opdatering
Microsoft kan ikke give en ny dato for den lovede Exchange-abonnementsopdatering og forklarer, at AI-genererede bugs har skabt en uoverskuelig backlog. Det rejser spørgsmål om AI's påvirkning af softwarekvalitet.
Kilder: The Register AI
Kina-krise truer robotindustrien – fysisk AI-kapløb intensiveres
En tænketank advarer om et nyt "China shock" i robotteknologi, da Beijing mobiliserer hele nationen til at dominere avanceret robotik. Det kan true vestlige positioner i fysisk AI.
Kilder: asia.nikkei.com
Dagens signal: Qwen 3.8-familien dominerer dagen med alt fra 2,4 trillioner parametre på supercomputere til kvantiseringskampe på 12 GB laptops – open-weight AI bliver både større og mere tilgængelig på én gang.
Modeller
Ny i HF-trending
- sand-ai/MAGI-2-preview er ny i Hugging Faces trending (score 38). hf.co/sand-ai/MAGI-2-preview
- peculiar-ragdoll/Qwen-Sharp-Chat-Templates er ny i Hugging Faces trending (score 35). hf.co/peculiar-ragdoll/Qwen-Sharp-Chat-Templates