News-Tracker

onsdag 26. august 2026

AI & LLM · daglig briefing


hent mp3
Manuskript
Godmorgen, her er dagens AI-overblik for onsdag 26. august 2026. I dag byder programmet på nye modeller, sikkerhedstrusler, værktøjer og et par historier fra branchen.

Vi starter med nye modeller. Den nye Qwen 3.8 Flash Next er en såkaldt MoE-model med 125 milliarder parametre, men kun omkring seks milliarder aktive. Det betyder, at den kun bruger en lille del af sine parametre, hver gang den svarer, hvilket gør den hurtig og billig at køre. Arkitekturen har desuden en sparsom n-gram-tabel på 51 milliarder poster, og det gør fire-bit kvantisering på omkring 82 gigabyte mulig. Ifølge Reddit-brugere er den dermed ideel til offload og lokal kørsel.

Kort nyt: Med QUASAR-værktøjet kan Qwen 3.8 27-milliarder-modellen kvantiseres til fire bit med næsten urørt kvalitet checkpointen fylder 19,7 gigabyte, og tabet på GPQA-Diamond er kun en halv procent. En bruger viser, at den kvantiserede 27-milliarder-model genererer korrekt ThreeJS-kode på en RTX 3090, når thinking high er aktiveret. En anden kvantiseret 27-milliarder-model på kun 10,93 gigabyte skrev en korrekt fysik-simulering efter 100 minutter og 108.000 output-tokens på en Quadro RTX 5000. Og som vi nævnte i går: Fine-tunes af Qwen 3.6 35-milliarder-modellen med tre milliarder aktive parametre slår originalen og nærmer sig Qwen 3.8 27-milliarder-modellen i tool-calling.

Og så til sikkerhed og jailbreaks. Først en opfølgning på Hugging Face-hacket, som vi også fulgte i går. Efter angrebet måtte Hugging Face ty til kinesiske open-weight-modeller, fordi de kommercielle modellers guardrails blokerede forsvaret. Det afslører et paradoks: De modeller, der skulle være nemmest at kontrollere, var netop dem, der stod i vejen, da sikkerhedsteamet selv skulle handle hurtigt. De modeller, der normalt markedsføres som de sikreste, viste sig altså at være de sværeste at bruge i en krisesituation.

Kort nyt: Forskere viser med angrebet InjecMEM, at én enkelt interaktion kan plante skjulte instruktioner i en agents hukommelse og styre dens fremtidige svar. Værktøjet LLM Guard renser input for skjulte instruktioner, før de når modellen vigtigt i en æra med agentisk AI. AutoDAN bruger en hierarkisk genetisk algoritme til at generere menneskelæsbare jailbreak-prompts, der omgår sikkerhedsmekanismer uden at ligne volapyk. Og automatiserede red team-værktøjer simulerer virkelige angreb på AI-modeller for at afdække jailbreaks og datalækage.

Videre til værktøjer og produkter. Apple har lanceret en ny Mac mini med M6-chippen, der ifølge Gizmodo giver fire gange hurtigere AI-ydeevne end forgængeren. Chippen har neurale acceleratorer i hver GPU-kerne og en dobbelt Neural Engine med seksten kerner, så den er tydeligvis bygget til lokale modeller. Mac mini starter ved 899 dollars med 16 gigabyte unified memory. Dermed bliver den også et oplagt bud for dem, der vil eksperimentere med lokale modeller uden at bruge en formue.

Kort nyt: Studerende har bygget TeXbrain, en open-source LaTeX-editor i browseren, der kører pdfTeX i WebAssembly og understøtter offline brug og git. En bruger med et GTX 2060-kort med seks gigabyte og 32 gigabyte RAM får råd til lokale modeller svaret er kvantiserede småmodeller og CPU-offload. Til den kommende 125-milliarders MoE-model diskuterer brugere, om M5 Ultra med dobbelt båndbredde er bedre end M5 Max med 32 gigabyte mere RAM regnestykket peger på Ultra til fire-bit kvantisering. Og en bærbar rig i et FormD T1-kabinet med RTX Pro 6000 og 96 gigabyte RAM kører Qwen 3.8 27-milliarder-modellen i fuld BF16-præcision med 262.000 tokens kontekst og 175.000 tokens prefill på 102 sekunder brugeren foretrækker det frem for kvantisering til juridisk arbejde.

Og så til stemmer i debatten. Andrew Ng relancerer DeepLearning.AI med fokus på AI Engineering. Han trækker tråde til DevOps-bevægelsen og citerer Andrej Karpathy, der har sagt, at der vil være markant flere AI-ingeniører end machine learning-ingeniører. Pointen er, at det ikke længere kun handler om at træne modeller, men om at bygge systemer omkring dem. Det er en markant omlægning for en af de mest kendte stemmer i AI-verdenen.

Til sidst branche og politik. Mysteriet om modellen Ox Alpha vokser. Den topper leaderboards, men intet laboratorium vil tage æren, og spekulationerne om kinesisk oprindelse fortsætter. Historien har kørt siden mandag, og jo længere tid der går uden et svar, jo mere opmærksomhed får den. Indtil videre er der ingen, der har taget ansvaret, og det er usædvanligt i en branche, hvor laboratorier normalt gerne vil stå frem.

Kort nyt: Geoffrey Hinton, Bill Gates og Pave Leo fjortende advarer om AI's eksistentielle og økonomiske risici fra jobtab til økonomisk kolonialisme.

Dagens signal: Fra mystiske leaderboard-toppere til nye memory-injection-angreb og kvantiseringsgennembrud dagen viser en AI-verden, hvor sikkerhed, åbenhed og lokal kørsel konstant spændes mod hinanden. Det var alt for i dag.

Nye modeller

Qwen3.8-Flash-Next: 125B MoE med n-gram-tabel kan blive local-friendly

Arkitekturen har ~6B aktive parametre og en sparsom n-gram-tabel på 51B, hvilket gør 4-bit kvantisering på ~82 GB mulig – ideel til offload.

Kilder: reddit.com

qwen3.8-flash-nextmoelocal-llmmemory-estimate

Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet

QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.

Kilder: reddit.com

qwen3.8-27bmxfp4quasarquantization

Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090

Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.

Kilder: reddit.com

qwen3.8-27bquantizedthreejscoding

Kvantiseret Qwen3.8-27B skriver korrekt fysik-simulering på 16 GB GPU

opfølgning på 17. august

27B-model i IQ3_XXS (10,93 GB) implementerer coherent transfer-matrix-metoden korrekt efter 100 minutter og 108K output-tokens på en Quadro RTX 5000.

Kilder: reddit.com

qwen3.8-27bquantizedtmmphysics

Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter

opfølgning på 25. august

Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. briefingen 25. august

Kilder: reddit.com

qwen3.6-35b-a3btool-callingbenchmarkornith

Sikkerhed & jailbreaks

Opfølgning: Hugging Face-hack afslører paradoks i open-weight-sikkerhed

opfølgning på 25. august

Efter angreb måtte Hugging Face ty til kinesiske open-weight-modeller, da kommercielle modellers guardrails blokerede forsvaret. briefingen 25. august

Kilder: cointelegraph.com · nytimes.com · en.bloomingbit.io · dawnliphardt.com · fortune.com

hugging-faceopen-weightscybersecurityrogue-ai

InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt

opfølgning på 21. august

Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. briefingen 21. august

Kilder: arxiv.org · csoonline.com · malwarebytes.com · securityscientist.net

injecmemmemory-injectionllm-agentsjailbreak

LLM Guard: 12 spørgsmål og svar om prompt-sanitering

Værktøjet renser input for skjulte instruktioner, før de når LLM'en. Artiklen understreger vigtigheden af sanitering i en æra med agentisk AI.

Kilder: securityscientist.net · securityscientist.net

llm-guardsanitizationprompt-injection

AutoDAN: Genetisk algoritme genererer menneskelæsbare jailbreak-prompts

AutoDAN bruger hierarkisk genetisk algoritme til at udvikle semantisk meningsfulde angreb, der omgår LLM-sikkerhedsmekanismer uden at ligne gibberish.

Kilder: securityscientist.net · securityscientist.net

autodanjailbreakgenetic-algorithmllm-security

AI Red Team Tooling: 12 spørgsmål og svar om automatiseret sikkerhedstest

Værktøjer simulerer virkelige angreb på AI-modeller for at afdække sårbarheder som jailbreaks og datalækage.

Kilder: securityscientist.net

red-teamingllm-securitytooling

Værktøjer & produkter

Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne

Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB unified memory.

Kilder: reddit.com · gizmodo.com · beingguru.com

applem6mac-minineural-engine

TeXbrain: LaTeX-editor i browseren med pdfTeX via WASM og indbygget git

Studerende bygger open-source-editor uden backend, der kører pdfTeX i WebAssembly. Understøtter lokal fillæsning, offline brug og git via isomorphic-git.

Kilder: github.com

texbraingateswasmopen-source

Sådan kører du LLM'er som almindelig bruger med lavt budget

Bruger med GTX 2060 6GB og 32GB RAM spørger om vej til lokale modeller. Svar inkluderer kvantiserede småmodeller og CPU-offload.

Kilder: reddit.com

local-llmbeginner-guidelow-resource

M5 Ultra 96GB vs M5 Max 128GB: Hvad er bedst til Qwen3.8-Flash-Next?

opfølgning på 17. august

Debat om dobbelt båndbredde (Ultra) vs. 32 GB mere RAM (Max) til den kommende 125B MoE-model. Napkin-math peger på Ultra til 4-bit kvantisering.

Kilder: reddit.com

mac-studiom5-ultram5-maxlocal-llm

Bærbar datacenter-rig kører Qwen3.8-27B BF16 med 262K kontekst

opfølgning på 21. august

FormD T1 med RTX Pro 6000 Blackwell og 96 GB RAM håndterer 175K tokens prefill på 102 sekunder. Brugeren foretrækker BF16 frem for kvantisering til juridisk præcision.

Kilder: reddit.com

portable-rigrtx-pro-6000bf16local-llm

🗣️ Stemmer

Andrew Ng relancerer DeepLearning.AI med fokus på AI Engineering

Ng trækker tråde til DevOps-bevægelsen og citerer Karpathy: "Der vil være markant flere AI Engineers end ML Engineers."

Kilder: ecosistemastartup.com · latent.space

andrew-ngdeeplearning-aiai-engineering

Branche & politik

Ox Alpha-mysteriet vokser – ingen vil stå ved modellen

opfølgning på 24. august

Den mystiske model Ox Alpha topper leaderboards, men ingen lab vil tage æren. Spekulationerne om kinesisk oprindelse fortsætter. briefingen 24. august

Kilder: merca20.com · euronews.com · voiceofemirates.com · indexbox.io · businesstoday.in · fortune.com · nytimes.com · futurism.com · thenational.scot

ox-alphamystery-modelchinalm-arena

Eksperter og ledere advarer: AI kan erstatte menneskeheden

Geoffrey Hinton, Bill Gates og Pave Leo XIV advarer alle om AI's eksistentielle og økonomiske risici – fra jobtab til økonomisk kolonialisme.

Kilder: futura-sciences.com · arstechnica.com · ibtimes.co.uk · fortune.com · georgetown.edu · theguardian.com

ai-riskhintongatespope-leo-xiv

Dagens signal: Fra mystiske leaderboard-toppere til nye memory-injection-angreb og kvantiseringsgennembrud – dagen viser en AI-verden, hvor sikkerhed, åbenhed og lokal kørsel konstant spændes mod hinanden.

Modeller

Ny i indekset

  • K2-V2 (high) er ny i Artificial Analysis' indeks (intelligence 14.2, MBZUAI Institute of Foundation Models).
  • LFM2.5-2.6B er ny i Artificial Analysis' indeks (intelligence 11, Liquid AI). hf.co/LiquidAI/LFM2.5-2.6B
  • Granite 4.0 1B er ny i Artificial Analysis' indeks (intelligence 1.6, IBM). hf.co/ibm-granite/granite-4.0-1b

Score ændret

Se hele listen