News-Tracker

mandag 17. august 2026

AI & LLM · daglig briefing


hent mp3
Manuskript
Godmorgen, her er dagens AI-overblik for torsdag 14. august 2026.

Vi starter med en stribe nye modeller, og det er nærmest en Qwen 3.8-fest i dag. Alibabas nye 27B-model imponerer på papiret, men dens standardindstilling for reasoning-effort, kaldet xhigh, får den til at overanalysere selv simple spørgsmål og kører langsomt på forbrugerhardware. Ifølge brugerdiskussioner på Reddit bør man sænke effort til low eller medium for at få brugbar ydelse. En anden test med rekursiv trætegning i Python viser en kæmpe kvalitetsforskel mellem Qwen 3.6 og 3.8 den nye model forstår komplekse instruktioner markant bedre. Efter Qwen 3.8-2.4T og 27B spekulerer miljøet nu i en 9B-variant, som ville gøre familien tilgængelig på endnu svagere hardware. Test på en RTX 5070 Ti laptop viser, at Qwen 3.6 35B-A3B MoE i Q4 giver 59 tokens per sekund og seks ud af seks korrekte svar, mens Qwen 3.8 27B i Q3 kun giver 7,5 tokens per sekund. Q2-kvantiseringen fejler simple logikopgaver. Den enorme MoE-model Qwen 3.8 2.4T opnår over 288.000 tokens per sekund på Nvidias GB300 NVL72 med 72 GPU'er i FP8-præcision det svarer til 350 tokens per sekund per bruger helt uden yderligere optimering. Og så er distillerede varianter af Qwen 3.8-2.4T begyndt at cirkulere, hvilket lover godt for lokale kørsler.

Kort nyt om modellerne: flere af historierne er blevet bredt delt på sociale medier, men de stammer alle fra de samme få brugerrapporter på Reddit.

Videre til forskning og arkitektur. En analyse af tidslinjen fra frontier-modeller til lokale modeller forudsiger, at en cirka 30 milliarder parametre stor open-weight-model vil matche GPT-4's evner allerede i januar 2027. Mønsteret viser, at lokale modeller halter et til to år bag frontier.

Og så til værktøjerne. Audio.cpp version 0.6 understøtter nu 49 model-familier, har et native WebUI og tilføjer MiniMax-H3 til tekst-til-audio og musikgenerering, inklusive voice cloning og multi-speaker-demoer. DiT-modeller kan endda generere videorammer alt sammen uden besværlig opsætning. Opgraderingen til ROCm 7.14 i llama.cpp giver 50 procent hurtigere prompt-processing på Radeon 780M iGPU. Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE-modeller klarer sig bedre på Vulkan. En bruger har optimeret inference til 82 tokens per sekund på en enkelt RTX 3090 med W4A16-kvantisering og fp8 KV-cache op til 672 tokens per sekund peak med 64 samtidige requests.

Kort nyt om værktøjer: også her er historierne blevet bredt delt, men de bygger på enkelte brugeres benchmarks.

Nu til EU og Europa. Nye EU-regler om AI-mærkning risikerer at gøre deepfakes sværere at opdage. EU's AI Act påbyder obligatorisk mærkning af AI-genereret indhold med bøder op til 15 millioner euro, men reglerne gælder ikke for private brugere. Det kan skabe falsk tryghed og gøre det sværere at identificere deepfakes fra ondsindede aktører, ifølge The Conversation.

Så til stemmerne. Anthropic-chefen Dario Amodei afviser, at offentlighedens AI-skepsis skyldes advarsler om risici den skyldes en decideret tillidskrise. Løsningen er at levere reelle resultater som at kurere kræft, ikke glittede kampagner, siger han til Business Insider. Amodei forsvarer også sine politiske forslag og advarer om, at open-weight-modeller ikke automatisk spreder magten. Han støtter i stedet forhåndsgodkendelse før udgivelse og understreger, at reel tillid kun kommer af konkrete resultater. Geoffrey Hinton gentager sin forudsigelse om massiv jobløshed, samtidig med at en canadisk undersøgelse viser, at mange arbejdstagere aktivt fravælger AI-værktøjer. Paradokset understreger kløften mellem teknologiske fremskrivninger og virkelighedens adoption.

Kort nyt om stemmerne: flere medier har bragt historierne, men de bygger på de samme få interviews.

Og til sidst branche og politik. Nvidia skruer ned for sin milliardgaranti til OpenAIs datacentre, hvilket signalerer øget forsigtighed omkring AI-infrastruktur-investeringer. Samtidig bekymrer obligationsmarkedet sig over 70 milliarder dollars i skyggekredit. Microsoft skyder skylden på AI for forsinket Exchange-opdatering AI-genererede bugs har skabt en uoverskuelig backlog, ifølge The Register. En tænketank advarer om et nyt China shock i robotteknologi, da Beijing mobiliserer hele nationen til at dominere avanceret robotik, hvilket kan true vestlige positioner i fysisk AI. Og så er der en blog om AI's mærkelige økonomi, som også er blevet dækket af Hindustan Times.

Dagens signal: Qwen 3.8-familien dominerer dagen med alt fra 2,4 trillioner parametre på supercomputere til kvantiseringskampe på 12 GB laptops open-weight AI bliver både større og mere tilgængelig på én gang.

Det var alt for i dag.

Nye modeller

Qwen 3.8 27B imponerer – men over-tænker alt som standard

opfølgning på 8. august

Alibabas nye 27B-model er fremragende på papiret, men dens standard-indstilling "xhigh" for reasoning-effort får den til at overanalysere selv simple spørgsmål og kører langsomt på forbrugerhardware. Sænk effort til "low" eller "medium" for brugbar ydelse.

Kilder: Simon Willison · r/LocalLLaMA · r/LocalLLaMA · medium.com · r/LocalLLaMA · r/LocalLLaMA

qwen-3.827breasoning-effortlocal-llm

Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest

En bruger-test med rekursiv trætegning i Python viser en "kæmpe" kvalitetsforskel mellem Qwen 3.6 og 3.8. Den nye model forstår komplekse instruktioner markant bedre.

Kilder: r/LocalLLaMA

qwen-3.827bqwen-3.6coding

Opfølgning: Qwen 3.8 9B på vej – mindre søskende til den store MoE

opfølgning på 13. august

Efter Qwen 3.8-2.4T og 27B spekulerer miljøet nu i en 9B-variant. En mindre model ville gøre Qwen 3.8-familien tilgængelig på endnu svagere hardware. Se briefingen 13. august.

Kilder: r/LocalLLaMA

qwen-3.89bdistillation

Qwen 3.8 27B Q2 vs Q3 vs MoE på 12 GB VRAM – MoE vinder på fart

Test på en RTX 5070 Ti laptop viser, at Qwen 3.6 35B-A3B MoE (Q4) giver 59 t/s og 6/6 korrekte svar, mens Qwen 3.8 27B Q3 kun giver 7,5 t/s. Q2-kvantiseringen fejler simple logikopgaver.

Kilder: r/LocalLLaMA

qwen-3.827bquantization12gb-vram

Qwen 3.8 2.4T kører 288.000 tokens/sekund på Nvidia GB300 NVL72

Den enorme MoE-model opnår over 4.000 tokens/sekund per GPU i FP8-præcision på Nvidias 72-GPU-superchip. Det svarer til 350 tokens/sekund per bruger – dag 0-ydeevne uden yderligere optimering.

Kilder: r/LocalLLaMA

qwen-3.82.4tnvidia-gb300inference

Opfølgning: Qwen 3.8-distillationer dukker op – mindre modeller fra den store

opfølgning på 13. august

Distillerede varianter af Qwen 3.8-2.4T er begyndt at cirkulere, hvilket lover godt for lokale kørsler. Se briefingen 13. august.

Kilder: r/LocalLLaMA

qwen-3.8distillationopen-weights

Forskning & arkitektur

Lokal AI når GPT-4-niveau i 2027 – en forudsigelse baseret på acceleration

En analyse af frontier-to-local-tidslinjen forudsiger, at en ~30B open-weight-model vil matche GPT-4's evner allerede i januar 2027. Mønsteret viser, at lokale modeller halter 1-2 år bag frontier.

Kilder: r/LocalLLaMA

local-llmfrontier-modelstrajectorypredictions

Værktøjer & produkter

audio.cpp 0.6: 49 model-familier, native WebUI og MiniMax-H3

Den open-source lydramme understøtter nu MiniMax-H3 til tekst-til-audio og musikgenerering, inklusive voice cloning og multi-speaker-demoer. DiT-modeller kan endda generere videorammer – alt sammen uden besværlig opsætning.

Kilder: r/LocalLLaMA

audio.cppminimax-m3ttsmusic-generation

ROCm 7.14 i llama.cpp giver 50% hurtigere prompt-processing på Radeon 780M

opfølgning på 9. august

Opgraderingen til ROCm 7.14 tilføjer officiel understøttelse af Radeon 780M iGPU. Benchmarks viser markant forbedring for tætte modeller sammenlignet med Vulkan, men MoE-modeller klarer sig bedre på Vulkan.

Kilder: r/LocalLLaMA

llama.cpprocmradeon-780mvulkan

Opfølgning: Qwen 3.8 27B kører 82 tps på en enkelt RTX 3090

opfølgning på 14. august

En bruger har optimeret inference til 82 tokens/sekund på en 3090 med W4A16-kvantisering og fp8 KV-cache – op til 672 tps peak med 64 samtidige requests. Se briefingen 14. august.

Kilder: r/LocalLLaMA

qwen-3.8rtx-3090vllmoptimization

🇪🇺 EU & Europa

Nye EU-regler om AI-mærkning risikerer at gøre deepfakes sværere at opdage

opfølgning på 5. august

EU's AI Act påbyder obligatorisk mærkning af AI-genereret indhold med bøder op til €15 millioner, men reglerne gælder ikke for private brugere. Det kan skabe falsk tryghed og gøre det sværere at identificere deepfakes fra ondsindede aktører.

Kilder: theconversation.com · home.nzcity.co.nz

eu-ai-actdeepfakescontent-labelingregulation

🗣️ Stemmer

Dario Amodei: AI-virksomheder har ikke leveret – tillid vindes ved resultater, ikke spin

opfølgning på 7. august

Anthropic-chefen afviser at offentlighedens AI-skepsis skyldes advarsler om risici; den skyldes en decideret tillidskrise. Løsningen er at levere reelle resultater som at kurere kræft, ikke glittede kampagner.

Kilder: Simon Willison · businessinsider.com

dario-amodeianthropictrustopen-weights

Opfølgning: Hinton advarer om massearbejdsløshed – men mange ansatte vælger allerede AI fra

opfølgning på 9. august

Geoffrey Hinton gentager sin forudsigelse om massiv jobløshed, samtidig med at en canadisk undersøgelse viser, at mange arbejdstagere aktivt fravælger AI-værktøjer. Paradokset understreger kløften mellem teknologiske fremskrivninger og virkelighedens adoption. Se briefingen 9. august.

Kilder: digitaljournal.com · fortune.com · ico-optics.org · mundodeportivo.com

geoffrey-hintonunemploymentcanadaworkplace

Dario Amodei: Open weights decentraliserer ikke magt – kræver pre-launch-vetting

Amodei forsvarer sine politiske forslag og advarer om, at open-weight-modeller ikke automatisk spreder magten. Han støtter i stedet forhåndsgodkendelse før udgivelse og understreger, at reel tillid kun kommer af konkrete resultater.

Kilder: r/LocalLLaMA

dario-amodeiopen-weightspolicypre-launch-vetting

Branche & politik

Nvidia skruer ned for milliardgaranti til OpenAIs datacentre

Nvidia reducerer markant sin garanti for OpenAIs $250 milliarder datacenter-finansiering, hvilket signalerer øget forsigtighed omkring AI-infrastruktur-investeringer. Samtidig bekymrer obligationsmarkedet sig over $70 milliarder i skyggekredit.

Kilder: Hacker News · business-standard.com

nvidiaopenaidata-centerinfrastructure

Microsoft skyder skylden på AI for forsinket Exchange-opdatering

Microsoft kan ikke give en ny dato for den lovede Exchange-abonnementsopdatering og forklarer, at AI-genererede bugs har skabt en uoverskuelig backlog. Det rejser spørgsmål om AI's påvirkning af softwarekvalitet.

Kilder: The Register AI

microsoftexchangeai-bugssoftware-quality

Kina-krise truer robotindustrien – fysisk AI-kapløb intensiveres

En tænketank advarer om et nyt "China shock" i robotteknologi, da Beijing mobiliserer hele nationen til at dominere avanceret robotik. Det kan true vestlige positioner i fysisk AI.

Kilder: asia.nikkei.com

chinaroboticsphysical-aigeopolitics

The Strange Economics of Artificial Intelligence - Andrew Blumhardt's Blog

opfølgning på 12. august

Kilder: techchat.blog · hindustantimes.com

Dagens signal: Qwen 3.8-familien dominerer dagen med alt fra 2,4 trillioner parametre på supercomputere til kvantiseringskampe på 12 GB laptops – open-weight AI bliver både større og mere tilgængelig på én gang.

Modeller

Ny i HF-trending

Se hele listen