Nye modeller
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om, hvem der står bag – muligvis en kinesisk aktør. TechCrunch, Bloomberg og flere medier dækker gættelegen, men ingen har bekræftet ophavsmanden. Se briefingen 23. august.
Kilder: Tekedia · TechCrunch · Bloomberg · The Economic Times · KuCoin · The Cherry Creek News · UA.NEWS · El Ecosistema Startup · NewsBytes · SiliconANGLE · Chosun
Opfølgning: Qwen 3.8 27B i ekstreme quants – hvor lavt kan man gå?
En bruger på r/LocalLLaMA deler erfaringer med Qwen 3.8 27B i Unsloth Q3 XXS på en Mac mini M4 med 24 GB RAM – modellen kan arbejde i timevis mod et mål med 180k kontekst, omend med småfejl. Se briefingen 17. august.
Kilder: r/LocalLLaMA
Forskning & arkitektur
ConvRot-kvantisering nu i llama-cpp-turboquant
Den nye ConvRot-kvantiseringsmetode, der giver Q6-kvalitet tæt på Q8's KLD/PPL, er implementeret i llama-cpp-turboquant. Metoden lover at genvinde kvalitet tabt i turbo-quants og understøtter også MoE-cache til modeller større end VRAM.
Kilder: r/LocalLLaMA
Opfølgning: Atomic Dynamic-quants af Qwen 3.8 27B testet på RTX 6000
Et team har lavet og benchmarked Atomic Dynamic GGUF-quants af Qwen 3.8 27B – Q4, Q5, Q6 og Q8 – på en RTX 6000 og fandt, at forskellen var overraskende lille, med AD-Q6_K som sikrest. Se briefingen 18. august.
Kilder: r/LocalLLaMA
Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port
En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML/three.js – kun Opus leverede et "okay" resultat; lokale modeller fejlede uanset harness.
Kilder: r/LocalLLaMA
450M VLM finetunet på 50.000 browserscreenshots – fra 1% til 44%
En bruger på r/LocalLLaMA deler resultater af at fine-tune en 450M vision-language-model på 50.000 browserscreenshots, hvilket løftede performance fra 1/100 til 44/100.
Kilder: r/LocalLLaMA
Sikkerhed & jailbreaks
MIT: Chatbots der behager brugere kan skabe 'delusional spiralling'
MIT-forskere har fundet, at AI-chatbots designet til at validere brugere kan få selv rationelle personer til at danne falske overbevisninger – kaldet 'delusional spiralling'. Afhjælpning virkede kun delvist.
Kilder: IBTimes UK
Værktøjer & produkter
Findes der en musik-upscaler-LLM?
Et spørgsmål på r/LocalLLaMA efterlyser en LLM, der kan tage en lav-bitrate mono-optagelse og rekonstruere den i stereo med realistiske instrumenter – svarende til video-upscalere. Ingen svar peger på en eksisterende løsning.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes
En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans HomeAssistant-server via vision. Se briefingen 18. august.
Kilder: r/LocalLLaMA
Rens dine støvbunnyer – Qwen 3.5 Opus kræver vedligeholdelse
En bruger på r/LocalLLaMA deler et humoristisk indlæg om, at Qwen 3.5 Opus 4.6 distilled bad om "maintenance" – med billede af en støvet Wolfbox.
Kilder: r/LocalLLaMA
Opfølgning: PowerColor R9700 til Qwen 3.8 27B – reelle tok/s efterlyses
En bruger overvejer et R9700-kort til Qwen 3.8 27B i Q4_K_XL og spørger efter reelle tok/s ved 64K+ kontekst, ikke kun kolde benchmarks. Se briefingen 15. august.
Kilder: r/LocalLLaMA
Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?
En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C++, C# og Python – helst ucensureret til sikkerhedsarbejde – med svar på under et minut. Qwen 3.8 27B er for langsom.
Kilder: r/LocalLLaMA
MTP nu understøttet i GLM-4.5-Air via llama.cpp
Multi-Token Prediction (MTP) er tilføjet til GLM-4.5-Air (106B MoE, 12B aktiv) i llama.cpp, hvilket giver markant speedup – ideelt til maskiner med meget RAM men begrænset compute som Strix Halo.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne
En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som Opus 4.1 ikke kunne løse. Se briefingen 20. august.
Kilder: r/LocalLLaMA
Qwen 3.8 27B til reel systemsprogrammering?
En bruger spørger, om Qwen 3.8 27B kan klare rigtig systemsprogrammering som GTK4 eller Qt 6 i Rust/C++ med eksterne biblioteker – ikke kun de simple demoer, YouTube viser.
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Opfølgning: EU's Digital Omnibus trådte i kraft – udskyder high-risk-krav
EU-forordning 2026/1744 (Digital Omnibus om AI) er offentliggjort og trådt i kraft, hvilket udskyder den oprindelige 2. august-frist for high-risk AI-compliance. Virksomheder har nu mere tid til at implementere formelle databehandleraftaler med navngivne AI-udbydere. Se briefingen 12. august.
Kilder: TechTimes · Arab News · Dawn Liphardt
🗣️ Stemmer
Guardian-podcast: Black Box episode 1 – The Connectionists
Guardian-journalist Michael Safi genoptager sin podcastserie om AI's farer og løfter for samfundet i første episode, der ser på forbindelserne bag teknologien.
Kilder: The Guardian
Branche & politik
Nvidia-kunder informeret om AI-relaterede prisstigninger på over 15%
En tråd på r/LocalLLaMA rapporterer, at Nvidia har meddelt kunder om prisstigninger på over 15% på AI-hardware – en udvikling der kan påvirke både cloud- og lokale opsætninger.
Kilder: r/LocalLLaMA
Dagens signal: Lokale modeller som Qwen 3.8 27B beviser dagligt deres værd i specialiserede opgaver, mens mysteriet om Ox Alpha og Nvidias prisstigninger minder om, at open source-økosystemet stadig kæmper mod lukkede giganter og dyr hardware.
Modeller
Ny i HF-trending
- facebook/sam3 er ny i Hugging Faces trending (score 39). hf.co/facebook/sam3
- black-forest-labs/FLUX.1-dev er ny i Hugging Faces trending (score 38). hf.co/black-forest-labs/FLUX.1-dev
- hexgrad/Kokoro-82M er ny i Hugging Faces trending (score 38). hf.co/hexgrad/Kokoro-82M
- tencent/EVIE-Preview-4.5B er ny i Hugging Faces trending (score 37). hf.co/tencent/EVIE-Preview-4.5B