Nye modeller
Qwen3.8-Flash-Next: 125B MoE med n-gram-tabel kan blive local-friendly
Arkitekturen har ~6B aktive parametre og en sparsom n-gram-tabel på 51B, hvilket gør 4-bit kvantisering på ~82 GB mulig – ideel til offload.
Kilder: reddit.com
Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet
QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.
Kilder: reddit.com
Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090
Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.
Kilder: reddit.com
Kvantiseret Qwen3.8-27B skriver korrekt fysik-simulering på 16 GB GPU
27B-model i IQ3_XXS (10,93 GB) implementerer coherent transfer-matrix-metoden korrekt efter 100 minutter og 108K output-tokens på en Quadro RTX 5000.
Kilder: reddit.com
Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter
Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. briefingen 25. august
Kilder: reddit.com
Sikkerhed & jailbreaks
Opfølgning: Hugging Face-hack afslører paradoks i open-weight-sikkerhed
Efter angreb måtte Hugging Face ty til kinesiske open-weight-modeller, da kommercielle modellers guardrails blokerede forsvaret. briefingen 25. august
Kilder: cointelegraph.com · nytimes.com · en.bloomingbit.io · dawnliphardt.com · fortune.com
InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt
Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. briefingen 21. august
Kilder: arxiv.org · csoonline.com · malwarebytes.com · securityscientist.net
LLM Guard: 12 spørgsmål og svar om prompt-sanitering
Værktøjet renser input for skjulte instruktioner, før de når LLM'en. Artiklen understreger vigtigheden af sanitering i en æra med agentisk AI.
Kilder: securityscientist.net · securityscientist.net
AutoDAN: Genetisk algoritme genererer menneskelæsbare jailbreak-prompts
AutoDAN bruger hierarkisk genetisk algoritme til at udvikle semantisk meningsfulde angreb, der omgår LLM-sikkerhedsmekanismer uden at ligne gibberish.
Kilder: securityscientist.net · securityscientist.net
AI Red Team Tooling: 12 spørgsmål og svar om automatiseret sikkerhedstest
Værktøjer simulerer virkelige angreb på AI-modeller for at afdække sårbarheder som jailbreaks og datalækage.
Kilder: securityscientist.net
Værktøjer & produkter
Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne
Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB unified memory.
Kilder: reddit.com · gizmodo.com · beingguru.com
TeXbrain: LaTeX-editor i browseren med pdfTeX via WASM og indbygget git
Studerende bygger open-source-editor uden backend, der kører pdfTeX i WebAssembly. Understøtter lokal fillæsning, offline brug og git via isomorphic-git.
Kilder: github.com
Sådan kører du LLM'er som almindelig bruger med lavt budget
Bruger med GTX 2060 6GB og 32GB RAM spørger om vej til lokale modeller. Svar inkluderer kvantiserede småmodeller og CPU-offload.
Kilder: reddit.com
M5 Ultra 96GB vs M5 Max 128GB: Hvad er bedst til Qwen3.8-Flash-Next?
Debat om dobbelt båndbredde (Ultra) vs. 32 GB mere RAM (Max) til den kommende 125B MoE-model. Napkin-math peger på Ultra til 4-bit kvantisering.
Kilder: reddit.com
Bærbar datacenter-rig kører Qwen3.8-27B BF16 med 262K kontekst
FormD T1 med RTX Pro 6000 Blackwell og 96 GB RAM håndterer 175K tokens prefill på 102 sekunder. Brugeren foretrækker BF16 frem for kvantisering til juridisk præcision.
Kilder: reddit.com
🗣️ Stemmer
Andrew Ng relancerer DeepLearning.AI med fokus på AI Engineering
Ng trækker tråde til DevOps-bevægelsen og citerer Karpathy: "Der vil være markant flere AI Engineers end ML Engineers."
Kilder: ecosistemastartup.com · latent.space
Branche & politik
Ox Alpha-mysteriet vokser – ingen vil stå ved modellen
Den mystiske model Ox Alpha topper leaderboards, men ingen lab vil tage æren. Spekulationerne om kinesisk oprindelse fortsætter. briefingen 24. august
Kilder: merca20.com · euronews.com · voiceofemirates.com · indexbox.io · businesstoday.in · fortune.com · nytimes.com · futurism.com · thenational.scot
Eksperter og ledere advarer: AI kan erstatte menneskeheden
Geoffrey Hinton, Bill Gates og Pave Leo XIV advarer alle om AI's eksistentielle og økonomiske risici – fra jobtab til økonomisk kolonialisme.
Kilder: futura-sciences.com · arstechnica.com · ibtimes.co.uk · fortune.com · georgetown.edu · theguardian.com
Dagens signal: Fra mystiske leaderboard-toppere til nye memory-injection-angreb og kvantiseringsgennembrud – dagen viser en AI-verden, hvor sikkerhed, åbenhed og lokal kørsel konstant spændes mod hinanden.
Modeller
Ny i indekset
- K2-V2 (high) er ny i Artificial Analysis' indeks (intelligence 14.2, MBZUAI Institute of Foundation Models).
- LFM2.5-2.6B er ny i Artificial Analysis' indeks (intelligence 11, Liquid AI). hf.co/LiquidAI/LFM2.5-2.6B
- Granite 4.0 1B er ny i Artificial Analysis' indeks (intelligence 1.6, IBM). hf.co/ibm-granite/granite-4.0-1b
Score ændret
- G9v3-39A5B: intelligence 31.6 → 34 (+2.4). hf.co/ai9stars/G9v3-39A5B