Forskning & arkitektur
Opfølgning: Ny forskning adskiller offentlige og private kapaciteter i åbne vægte
To nye papirer foreslår metoder til at kontrollere sensitive kapaciteter i open-weight-modeller uden at forhindre forskning. briefingen 29. august. Overvågning af fine-tuning og adskillelse af funktioner er nøglen.
Kilder: awesomepapers.io · mlanthology.org
Kan ngram-embeddings bruges til dynamisk, kontinuerlig læring under inferens?
Reddit-bruger foreslår en "live" ngram-tabel oven på Qwen 3.8 Flash' frosne embeddings – nye "hukommelser" dannes, gamle henfalder. Spekulativ, men fascinerende idé.
Kilder: r/LocalLLaMA
Sikkerhed & jailbreaks
OpenAI-forsker sætter 70% sandsynlighed for menneskelig udryddelse inden tre år
En OpenAI-sikkerhedsforsker vurderer 70% risiko for AI-udryddelse inden 2029, mens Anthropics Evan Hubinger og Geoffrey Hinton sætter oddsene over 10% – ekstreme estimater, der vækker opsigt langt ud over forskningsmiljøet.
Kilder: beincrypto.com · latimes.com · businessinsider.com · latimes.com · the-independent.com · www.businessinsider.com · wthr.com · startuphub.ai · businessinsider.com · latimes.com · thenews.com.pk · thenextweb.com · archive.fo
Opfølgning: Den nye AI-panik handler om autonome agenter, ikke superintelligens
Stigende bekymring retter sig mod at give AI-systemer autonomi til at finde sårbarheder og skrive kode. briefingen 11. september. Flere medier spørger: hvis labbene selv frygter udryddelse, hvorfor stopper de så ikke?
Kilder: linkdood.com · cp24.com · ctvnews.ca · theconversation.com · dailymail.com · rfi.fr · indiatimes.com
16 nye ICLR-papirer kortlægger jailbreak-landskabet – fra GraphShield til neuron-analyse
GraphShield modellerer informationsflow i netværket for at detektere jailbreaks, mens JULI angriber via selv-introspektion og STAR automatiserer red-teaming. En regulær tsunami af sikkerhedsforskning.
Kilder: mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · lacuna.tiptreesystems.com · mlanthology.org · mlanthology.org · lacuna.tiptreesystems.com · lacuna.tiptreesystems.com · mlanthology.org
↻ 16 kilder, 1 uafhængige — resten bringer samme tekst
Prompt injection i AI-agenter: omfattende review viser eksploderende angrebsflade
Model Context Protocol (MCP) og agent-systemer åbner for tool poisoning og credential theft. Reviewet dokumenterer reelle hændelser og giver en taksonomi af angreb.
Kilder: awesomepapers.io · dev.to
Værktøjer & produkter
Perplexity sætter sin lid til GPT-6 Astra til kritiske systemer
Perplexity bruger OpenAI's GPT-6 Astra til at skrive kommunikation, ændre software og overvåge produktion – med langt mindre manuel kontrol end tidligere.
AI-agenters sikkerhedsrisici: 10 ting du skal vide
AI-agenter planlagger, bruger værktøjer og udfører handlinger – og den største risiko er ikke hallucinationer, men uautoriseret eksekvering af kode.
Kilder: analyticsinsight.net · forbes.com
Gammel GPU kan speede mmproj op til 10x med llama.cpp
Ét flag – --mmdev CUDA1 – kan lade en sekundær, langsom GPU håndtere vision mmproj og frigøre VRAM til inferens. Praktisk hack til lokal multi-GPU.
Kilder: r/LocalLLaMA
2B LLM finjusteret på WhatsApp-chat – 80% menneskelig winrate
En udvikler trænede Qwen 2B på en seks-personers gruppechat. Modellen lærte slang og reaktioner, men mangler dyb forståelse. Cookbook med reproducerbar pipeline på GitHub.
Kilder: r/LocalLLaMA
Opfølgning: Er Qwen-Next ringere end 3.8 27B til kodning?
Bruger på M5 Max finder, at Qwen 3.8 27B q8 klarer svære kodetasks bedre end Qwen-Next. Flere oplever samme tendens. briefingen 29. august.
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Opfølgning: UK kan ikke bare slukke en løbsk AI-model – og EU kræver kontrol
Den britiske regering erkender, at der ikke findes en "off"-knap for rogue AI. EU-kommissionen svarer med at kræve kontrol, mens AI Act'ens håndhævelse træder i kraft 2. august 2026. briefingen 11. september.
Kilder: startupfortune.com · tribune.com.pk
Cohere i avancerede forhandlinger om 3 milliarder dollar – europæisk alternativ vokser
Canadiske Cohere forhandler om at rejse op til 3 mia. dollars og har allieret sig med tyske Aleph Alpha for at styrke sin position i Europa som et uafhængigt alternativ til amerikanske tech-giganter.
Kilder: theglobeandmail.com · cryptobriefing.com
EU-kommissær Virkkunen efterlyser globale AI-regler efter udryddelsesadvarsel
EU's tech-chef Henna Virkkunen opfordrer til globale AI-regler og fortsat internationalt samarbejde om AI-risici i kølvandet på Coxon-advarslen.
Kilder: ua.news · politico.eu
Rygte: 16 Moonshot-medarbejdere anholdt efter Kina-distillation af Claude
Anthropic rapporterer, at Kimi videresendte PLA-brugeres anmodninger til Claude til destillation. Rygter siger, at 16 Moonshot-medarbejdere blev anholdt for lækagen.
Kilder: r/LocalLLaMA
Branche & politik
Opfølgning: Jacob Coxon-affæren udløser en "præference-kaskade" i AI-debatten
Den afgåede Anthropic-forsker Jacob Coxon advarer om udryddelse inden 2030. Zvi Mowshowitz kalder det en kaskade, hvor flere tør sige højt, hvad de frygter. briefingen 11. september. NPR og Scientific American dækker historien bredt.
Kilder: independentsentinel.com · thezvi.substack.com · thezvi.substack.com · scientificamerican.com · npr.org
Opfølgning: Kongressens interesse for AI-regulering vokser efter whistleblower-advarsler
Lovgivere på begge sider af gangen kræver handling efter advarsler om, at AI kan overtage menneskelig kontrol, men der er ingen konsensus om tilgangen. briefingen 10. september.
Kilder: washingtontimes.com · politico.eu
Opfølgning: Åbne vægte ≠ open source – og det betyder noget nu i bestyrelseslokalet
Enterprise-valget mellem lukkede og open-weight-modeller er ikke sort/hvidt. Artiklen forklarer, hvorfor open source-definitionen og risikostyring er blevet et bestyrelsesspørgsmål. briefingen 29. august.
Kilder: ca.finance.yahoo.com · mlanthology.org
Dagens signal: Ekstreme udryddelsesestimater fra labbets egne forskere presser både politikere og medier til at tage AI-risiko alvorligt, mens en eksplosion af jailbreak-forskning viser, at feltet selv ved, hvor skrøbelige modellerne er.
Modeller
Ny i indekset
- DeepSeek V4.1 Flash (Reasoning, Max Effort) er ny i Artificial Analysis' indeks (intelligence 39.5, DeepSeek). hf.co/deepseek-ai/DeepSeek-V4.1-Flash
- Ling-3.0-flash-VL er ny i Artificial Analysis' indeks (intelligence 24.8, InclusionAI). hf.co/inclusionAI/Ling-3.0-flash-VL
Score ændret
- Qwen3.6 35B A3B (Reasoning): intelligence 22.3 → 18.8 (-3.5). hf.co/Qwen/Qwen3.6-35B-A3B
- Qwen3.8-Flash-Next: intelligence 42.2 → 39.9 (-2.3). hf.co/Qwen/Qwen3.8-Flash-Next
- … og 3 mere