Nye modeller
Opfølgning: Zhipu afslører Ox Alpha som GLM-5.3-Flash og udgiver vægte
Det anonyme Ox Alpha viste sig at være Zhipus GLM-5.3-Flash med 320 mia. parametre (18 mia. aktive) – den første native multimodale model i GLM-5-serien. Vægtene er nu frit tilgængelige. briefingen 14. august
Opfølgning: Gemini Omni 1.1 Flash giver udviklere mere kontrol
Google har opdateret Gemini Omni Flash med bedre styring af multimodal inferens. Opdateringen giver udviklere finere kontrol over modellens adfærd. briefingen 20. august
Kilder: Google DeepMind · Hacker News
Agent Arena Code: GLM og Qwen viser markant fremgang
Foreløbige resultater fra Agent Arena Code viser, at GLM og Qwen er tæt på at matche Mythos. Åbne vægte har rykket sig markant på to måneder.
Kilder: r/LocalLLaMA
Forskning & arkitektur
Google DeepMind piloterer verdens første dobbeltblindede AI-evalueringer
DeepMind afprøver dobbeltblindede tests for at reducere bias i AI-benchmarking. Metoden kan blive ny standard for objektiv modelvurdering.
Kilder: Google DeepMind
Ensemble af Qwen3.8-27B-modeller matcher Fable-5 på kodning
Et nyt papir viser, at flere Qwen3.8-27B-modeller sammen kan matche Fable-5 på LiveCodeBench Hard – til en femtedel af prisen. Metoden kan demokratisere avanceret kodegenerering.
Kilder: r/LocalLLaMA
Terminal-Bench-Science evaluerer AI-agenter på videnskabelige workflows
En ny benchmark tester AI-agenters evne til at udføre reelle forskningsopgaver i terminalen. Målet er at kvantificere, hvor godt AI kan assistere i videnskabelige processer.
Kilder: Hacker News
Sikkerhed & jailbreaks
Opfølgning: AI-penetrationstestning – hvordan prompt injection udnytter LLM'ers arkitektur
En ny guide forklarer, hvordan instruktioner og brugerinput deler samme kanal, hvilket er roden til prompt injection. Agent-værktøjer gør problemet værre, da et jailbreak kan føre til uautoriserede handlinger. briefingen 26. august
Kilder: Artic Sledge · Solulab
Værktøjer & produkter
Opfølgning: Qwen 3.8 27B QAT Q2 kører i kun 13-14 GB RAM med minimal kvalitetsnedgang
En bruger rapporterer, at QAT-kvantiseret Qwen 3.8 27B i Q2 med DFlash og Q5 KV-cache bruger 13-14 GB RAM og stadig matcher Sonnet 4.6. Ekstrem kompression uden stort tab. briefingen 19. august
Kilder: r/LocalLLaMA
Opfølgning: gemma4.c – en moderne LLM på 700 linjer C, hurtigere end llama.cpp
En udvikler har skrevet en komplet inferens-runtime til Gemma 4 E2B i 700 linjer C. På en Ryzen 7 7700 opnås 639 tok/s prefill og 25,9 tok/s generation – hurtigere end llama.cpp. briefingen 25. august
Kilder: r/LocalLLaMA
Opfølgning: Over 200.000 tokens kontekst på 16 GB VRAM med Qwen 3.8 27B
En bruger kører Qwen 3.8 27B med IQ3_XXS-kvantisering og 200k+ kontekst på 16 GB VRAM. Prompt processing falder til 400 tk/s, men kvaliteten er stadig god. briefingen 17. august
Kilder: r/LocalLLaMA
Opfølgning: llama.cpp support til Qwen3.8-Flash-Next er nu merged
GGUF til Qwen3.8-Flash-Next kan nu downloades og kører med 55 tok/s på 4×3090. Samfundet får hurtigt adgang til den nyeste Flash-variant. briefingen 19. august
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Opfølgning: Danmarks AI-ambition kræver data, vi ikke har
Et debatindlæg på Version2 påpeger, at Danish Foundation Models mangler tilstrækkelige danske data til at indfri ambitionen om førende AI i offentlig sektor. Tre konkrete forslag skal løse problemet. briefingen 27. august
Kilder: Version2
↻ 4 kilder, 1 uafhængige — resten bringer samme tekst
🗣️ Stemmer
Opfølgning: Bill Gates advarer om, at AI kan få mange job til at forsvinde for altid
Gates advarer om, at AI kan eliminere store jobkategorier, og at der ikke er nogen plan for, hvad der så skal ske. Han arbejder på at få Kina med til globale risikobegrænsninger. briefingen 27. august
Kilder: TIME · r/LocalLLaMA · Punch
Opfølgning: Hinton og Bengio advarer om superintelligent AI, der kan manipulere mennesker
Hinton frygter, at AI bliver smartere end os og vil manipulere os – og at udviklingen er uundgåelig i et kapitalistisk system. Bengio er hovedforfatter på advarslen. briefingen 17. august
Kilder: Republika · Mundo Deportivo
Branche & politik
Opfølgning: Nvidia opkøber HuggingFace – og dermed også llama.cpp og holdet bag
Nvidia overtager både HuggingFace-platformen og llama.cpp-holdet, hvilket sås tvivl om projektets fremtid som åbent værktøj. Usikkerheden er stor, da Nvidia har en dårlig historik med open source. briefingen 27. august
Kilder: r/LocalLLaMA · Ars Technica
Dommer: Trumps blacklisting af Anthropic var ulovlig
En føderal dommer har slået fast, at Trump-administrationens sortlistning af Anthropic var ulovlig. Afgørelsen kan få konsekvenser for, hvordan USA regulerer AI-virksomheder fremover.
Kilder: Hacker News
TIME udnævner 100 mest indflydelsesrige AI-personligheder 2026
TIME's fjerde årlige liste over de 100 mest indflydelsesrige personer i AI er udkommet, opdelt i fire kategorier. Listen markerer, hvem der reelt sætter dagsordenen i feltet.
↻ 10 kilder, 3 uafhængige — resten bringer samme tekst
Ny Honda Accord i Canyon River Blue Metallic
Saratoga Honda præsenterer 2026-modellen af Honda Accord med avancerede sikkerhedsfunktioner og luksuriøst interiør. Ikke AI-relateret.
Kilder: Saratoga Honda
↻ 4 kilder, 1 uafhængige — resten bringer samme tekst
Dagens signal: Nvidias opkøb af HuggingFace og llama.cpp kaster skygger over open source-økosystemet, mens kinesiske open-weight-modeller som GLM-5.3 og Qwen 3.8 samtidig rykker grænserne for, hvad åbne vægte kan præstere.
Modeller
Ny i indekset
- GLM-5.3-Flash er ny i Artificial Analysis' indeks (intelligence 57.5, Z AI). hf.co/zai-org/GLM-5.3-Flash
- DeepSeek V4 Flash Vision (Reasoning, Max Effort) er ny i Artificial Analysis' indeks (intelligence 51.5, DeepSeek).
- Granite 4.2 8B er ny i Artificial Analysis' indeks (intelligence 19.6, IBM). hf.co/ibm-granite/granite-4.2-8b
- Granite 4.2 3B er ny i Artificial Analysis' indeks (intelligence 14.3, IBM). hf.co/ibm-granite/granite-4.2-3b