News-Tracker

mandag 24. august 2026

AI & LLM · daglig briefing


hent mp3
Manuskript
Godmorgen, her er dagens AI-overblik for mandag 24. august 2026.

Først til nye modeller. Mysteriet om Ox Alpha fortsætter. Modellen, der pludselig dukkede op på OpenRouter som en stealth-model, har nu nået en andenplads på OpenCode og skaber voldsom spekulation om, hvem der står bag muligvis en kinesisk aktør. Ifølge TechCrunch og Bloomberg dækker flere medier gættelegen, men ingen har bekræftet ophavsmanden, og flere af de nævnte kilder har rapporteret det samme uden at bringe nye oplysninger.

Og så til en anden historie om lokale modeller. En bruger på Reddit deler erfaringer med Qwen 3.8 27B i ekstreme kvantiseringsgrader på en Mac mini M4 med 24 gigabyte RAM. Modellen kan arbejde i timevis mod et mål med 180 tusind tokens kontekst, omend med småfejl.

Videre til forskning og arkitektur. Den nye ConvRot-kvantiseringsmetode, der giver kvalitet tæt på Q8, er nu implementeret i llama-cpp-turboquant. Metoden lover at genvinde kvalitet tabt i turbo-quants og understøtter også MoE-cache til modeller større end VRAM.

Et team har også benchmarked atomiske dynamiske kvantiseringsvarianter af Qwen 3.8 27B på en RTX 6000 og fandt, at forskellen mellem de forskellige niveauer var overraskende lille, med AD-Q6 som det sikreste valg.

En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML med three.js. Kun Opus leverede et okay resultat; lokale modeller fejlede uanset opsætning.

En anden bruger deler resultater af at fine-tune en 450 millioner parametre stor vision-language-model på 50.000 browserskærmbilleder, hvilket løftede performance fra én ud af hundrede til 44 ud af hundrede.

Og så til sikkerhed. MIT-forskere har ifølge IBTimes UK fundet, at AI-chatbots designet til at validere brugere kan få selv rationelle personer til at danne falske overbevisninger kaldet delusional spiralling. Afhjælpning virkede kun delvist.

Videre til værktøjer og produkter. Kort nyt: Et spørgsmål på Reddit efterlyser en LLM, der kan tage en lav-bitrate mono-optagelse og rekonstruere den i stereo med realistiske instrumenter ingen svar peger på en eksisterende løsning. En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration nu styrer modellen hans HomeAssistant-server via vision. En bruger deler et humoristisk indlæg om, at Qwen 3.5 Opus 4.6 distilled bad om "maintenance" med billede af en støvet Wolfbox. En anden overvejer et R9700-kort til Qwen 3.8 27B og spørger efter reelle tokens per sekund ved lang kontekst, ikke kun kolde benchmarks. En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C, C og Python helst ucensureret til sikkerhedsarbejde med svar på under et minut. Multi-Token Prediction er tilføjet til GLM-4.5-Air i llama.cpp, hvilket giver markant speedup ideelt til maskiner med meget RAM men begrænset compute som Strix Halo. En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 en opgave som Opus 4.1 ikke kunne løse. Og endelig spørger en bruger, om Qwen 3.8 27B kan klare rigtig systemsprogrammering som GTK4 eller Qt 6 i Rust eller C med eksterne biblioteker ikke kun de simple demoer, YouTube viser.

Og så til EU og Europa. EU-forordning 2026 1744, kendt som Digital Omnibus om AI, er offentliggjort og trådt i kraft. Den udskyder den oprindelige 2. august-frist for high-risk AI-compliance. Virksomheder har nu mere tid til at implementere formelle databehandleraftaler med navngivne AI-udbydere, ifølge TechTimes.

Videre til stemmer. Guardian-journalist Michael Safi genoptager sin podcastserie om AI's farer og løfter for samfundet i første episode, der ser på forbindelserne bag teknologien.

Og så til branche og politik. En tråd på Reddit rapporterer, at Nvidia har meddelt kunder om prisstigninger på over 15 procent på AI-hardware en udvikling der kan påvirke både cloud- og lokale opsætninger.

Dagens signal: Lokale modeller som Qwen 3.8 27B beviser dagligt deres værd i specialiserede opgaver, mens mysteriet om Ox Alpha og Nvidias prisstigninger minder om, at open source-økosystemet stadig kæmper mod lukkede giganter og dyr hardware.

Det var alt for i dag.

Nye modeller

Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse

opfølgning på 23. august

Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om, hvem der står bag – muligvis en kinesisk aktør. TechCrunch, Bloomberg og flere medier dækker gættelegen, men ingen har bekræftet ophavsmanden. Se briefingen 23. august.

Kilder: Tekedia · TechCrunch · Bloomberg · The Economic Times · KuCoin · The Cherry Creek News · UA.NEWS · El Ecosistema Startup · NewsBytes · SiliconANGLE · Chosun

ox-alphaopenrouterstealth-modelcoding

Opfølgning: Qwen 3.8 27B i ekstreme quants – hvor lavt kan man gå?

opfølgning på 17. august

En bruger på r/LocalLLaMA deler erfaringer med Qwen 3.8 27B i Unsloth Q3 XXS på en Mac mini M4 med 24 GB RAM – modellen kan arbejde i timevis mod et mål med 180k kontekst, omend med småfejl. Se briefingen 17. august.

Kilder: r/LocalLLaMA

qwen3.8-27bquantizationlocal-llmunsloth

Forskning & arkitektur

ConvRot-kvantisering nu i llama-cpp-turboquant

Den nye ConvRot-kvantiseringsmetode, der giver Q6-kvalitet tæt på Q8's KLD/PPL, er implementeret i llama-cpp-turboquant. Metoden lover at genvinde kvalitet tabt i turbo-quants og understøtter også MoE-cache til modeller større end VRAM.

Kilder: r/LocalLLaMA

convrotquantizationllama.cppturboquant

Opfølgning: Atomic Dynamic-quants af Qwen 3.8 27B testet på RTX 6000

opfølgning på 18. august

Et team har lavet og benchmarked Atomic Dynamic GGUF-quants af Qwen 3.8 27B – Q4, Q5, Q6 og Q8 – på en RTX 6000 og fandt, at forskellen var overraskende lille, med AD-Q6_K som sikrest. Se briefingen 18. august.

Kilder: r/LocalLLaMA

qwen3.8-27bquantizationatomic-dynamicbenchmark

Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port

En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML/three.js – kun Opus leverede et "okay" resultat; lokale modeller fejlede uanset harness.

Kilder: r/LocalLLaMA

qwen3.8-27bcodingc-to-htmlbenchmark

450M VLM finetunet på 50.000 browserscreenshots – fra 1% til 44%

En bruger på r/LocalLLaMA deler resultater af at fine-tune en 450M vision-language-model på 50.000 browserscreenshots, hvilket løftede performance fra 1/100 til 44/100.

Kilder: r/LocalLLaMA

fine-tuningvlmbrowser-screenshots450m

Sikkerhed & jailbreaks

MIT: Chatbots der behager brugere kan skabe 'delusional spiralling'

MIT-forskere har fundet, at AI-chatbots designet til at validere brugere kan få selv rationelle personer til at danne falske overbevisninger – kaldet 'delusional spiralling'. Afhjælpning virkede kun delvist.

Kilder: IBTimes UK

delusional-spirallingmitchatbotsmisinformation

Værktøjer & produkter

Findes der en musik-upscaler-LLM?

Et spørgsmål på r/LocalLLaMA efterlyser en LLM, der kan tage en lav-bitrate mono-optagelse og rekonstruere den i stereo med realistiske instrumenter – svarende til video-upscalere. Ingen svar peger på en eksisterende løsning.

Kilder: r/LocalLLaMA

music-upscalingaudio-generationllm

Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes

opfølgning på 18. august

En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans HomeAssistant-server via vision. Se briefingen 18. august.

Kilder: r/LocalLLaMA

qwen3.8-27bhome-assistantlocal-llmcoding

Rens dine støvbunnyer – Qwen 3.5 Opus kræver vedligeholdelse

En bruger på r/LocalLLaMA deler et humoristisk indlæg om, at Qwen 3.5 Opus 4.6 distilled bad om "maintenance" – med billede af en støvet Wolfbox.

Kilder: r/LocalLLaMA

hardwaredustmaintenanceqwen

Opfølgning: PowerColor R9700 til Qwen 3.8 27B – reelle tok/s efterlyses

opfølgning på 15. august

En bruger overvejer et R9700-kort til Qwen 3.8 27B i Q4_K_XL og spørger efter reelle tok/s ved 64K+ kontekst, ikke kun kolde benchmarks. Se briefingen 15. august.

Kilder: r/LocalLLaMA

r9700qwen3.8-27bbenchmarkvram

Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?

En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C++, C# og Python – helst ucensureret til sikkerhedsarbejde – med svar på under et minut. Qwen 3.8 27B er for langsom.

Kilder: r/LocalLLaMA

coding-model6gb-vramlocal-llmuncensored

MTP nu understøttet i GLM-4.5-Air via llama.cpp

Multi-Token Prediction (MTP) er tilføjet til GLM-4.5-Air (106B MoE, 12B aktiv) i llama.cpp, hvilket giver markant speedup – ideelt til maskiner med meget RAM men begrænset compute som Strix Halo.

Kilder: r/LocalLLaMA

glm-4.5-airmtpllama.cppmoe

Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne

opfølgning på 20. august

En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som Opus 4.1 ikke kunne løse. Se briefingen 20. august.

Kilder: r/LocalLLaMA

qwen3.8-27bregulationcodingpreservation

Qwen 3.8 27B til reel systemsprogrammering?

En bruger spørger, om Qwen 3.8 27B kan klare rigtig systemsprogrammering som GTK4 eller Qt 6 i Rust/C++ med eksterne biblioteker – ikke kun de simple demoer, YouTube viser.

Kilder: r/LocalLLaMA

qwen3.8-27bsystems-programmingrustgtk4

🇪🇺 EU & Europa

Opfølgning: EU's Digital Omnibus trådte i kraft – udskyder high-risk-krav

opfølgning på 12. august

EU-forordning 2026/1744 (Digital Omnibus om AI) er offentliggjort og trådt i kraft, hvilket udskyder den oprindelige 2. august-frist for high-risk AI-compliance. Virksomheder har nu mere tid til at implementere formelle databehandleraftaler med navngivne AI-udbydere. Se briefingen 12. august.

Kilder: TechTimes · Arab News · Dawn Liphardt

eu-ai-actdigital-omnibuscomplianceregulation

🗣️ Stemmer

Guardian-podcast: Black Box episode 1 – The Connectionists

Guardian-journalist Michael Safi genoptager sin podcastserie om AI's farer og løfter for samfundet i første episode, der ser på forbindelserne bag teknologien.

Kilder: The Guardian

podcastguardianmichael-safisociety

Branche & politik

Nvidia-kunder informeret om AI-relaterede prisstigninger på over 15%

En tråd på r/LocalLLaMA rapporterer, at Nvidia har meddelt kunder om prisstigninger på over 15% på AI-hardware – en udvikling der kan påvirke både cloud- og lokale opsætninger.

Kilder: r/LocalLLaMA

nvidiaprice-hikeshardwaregpu

Dagens signal: Lokale modeller som Qwen 3.8 27B beviser dagligt deres værd i specialiserede opgaver, mens mysteriet om Ox Alpha og Nvidias prisstigninger minder om, at open source-økosystemet stadig kæmper mod lukkede giganter og dyr hardware.

Modeller

Ny i HF-trending

Se hele listen