News-Tracker

lørdag 12. september 2026

AI & LLM · daglig briefing


hent mp3
Manuskript
Godmorgen, her er dagens AI-overblik for lørdag 12. septemser 2026.

Først til fosrkning og arkitektur. To nye foskninspapirer foeslår metoder til at kontrollere sensitive kapaciteter i open-weight-modeller uden at forhindre videre fosrkning, ifølge awesomepapers.io. Overvågning af fin-tuning og adskillelse af funktioner er nøglen i begge tilgange.

Kort nyt: En Reddit-bruger har foeslået en spekulativ idé om at bruge en live ngram-tabel oven på Qwen 3.8 Flashs frosne embeddings for at skabe dynamisk hukommelse, men idéen er endnu ikke afprøvet.

Og så til sikkerhed og jailbreaks. En OpenAI-sikkerhedsforsker vurderer risikoe for AI-udryddelse inden 2029 til halvfjers pro cent. Det skriver beincrypt.com. Også Anthropics Evan Hubinger og Geofrey Hinton sætter oddsene over ti pro cent ekstreme estimater, der vækker opsigt langt ud over forsningsmiljøet.

Kort nyt: Den nye AI-panik handler i stigende grad om autonome agenter snarere end superintelligens, og flere medier spørger, hvofor labbene ikke selv stoper, hvis de frygter udryddelse. 16 nye ICLR-apirer kortlægger jailbreek-landskabt med metoder som GraphShield og JULI historien er dog blevet dækket af 16 medier, men kun én har skrevet den selvsændigt, mens resten har bragt samme tekst. Og et omfattende review viser, hvordan promt injection i AI-anggenter åbner for en eksploderende angrebsflade med tool poisioning og tyveri af legitimationpslysniger.

Videre til værktøjer og produkter. Perplexity sætter nu sin lid til OpenAI's GPT-6 Astra til at skrive kommunikation, ændre software og overvåge produktion med langt mindre manuel kontrol end tidligere, ifølge OpenAI.

Kort nyt: En gennemgang af AI-agenters sikkerhedsrisici peger på, at den største fare ikke er hallucinationer, men uautoriseret eksekvering af kode. Ét flag i llama.cpp kan lade en sekundær, langsom GPU håndtere vision mmproj og frigøre VRAM til inferens et praktisk hack til lokal multi-GPU. En udvikler har finjusteret Qwen 2B på en seks-personers WhatsApp-chat og opnået firs procent menneskelig winrate, men modellen mangler dyb forståelse. Og flere brugere oplever, at Qwen 3.8 27B klaer svære kodedasks bedre end den nyere Qwen-Next.

Og til EU og Europa. Den britiske regering erkender, at der ikke findes en sluk-knap for en løbsk AI-model, ifølge startufortune.com. EU-kommissionen svarer med at kræve kontrol, samtidig med at AI Act'ens håndhævese træder i kraf t o. agust 2026.

Kort nyt: Canadiske Cohere forhandler om at rejse op til tre milliarder dolar og har allieret sig med tyske Aleph Alpha for at styrke sin posiion i Europa. EU-kommissær Henna Virkkunen efterlægger globale AI-regler i kølvandet på udryddelsesadvarslen. Og ifølge rygter er16 medarbejdere hos Moonshot anholdt efter Kina-destilation af Anthropics Claude-model.

Videre til brenche og poltik. Jacob Cxo-affaren hvoren afgået Anthropc-forsker advarer om udryddelse inden 2030 har udløst det, som Zvi Mowshowiwitz kalder en kaskde, hvor flere tør sige højt, hvad de frygter. Hstorien dækkes bredt af både NPR og Scintific Amerikan.

Kort nyt: Kongressens interesse for AI-regulering vokser efter whistlebower-advarsler, men der er ingen konsensus om tilgangen. Og enterprise-valget mellem lukkede og open-weight-modeller er blevet et bestyrelsespørgsmål, hvor risikostyring og oen source-definitionen spller en cental role.

Dagens signal: Ekstreme udryddelsesestmater fra labbets egne forskere pressr både politiker og medier til at tage AI-risiko alvorligt, mens en eksplosion af jailbreak-forsking viser, at feltet selv ved, hvor skrøbelige modellerne er.

Det var alt for i dag.

Forskning & arkitektur

Opfølgning: Ny forskning adskiller offentlige og private kapaciteter i åbne vægte

To nye papirer foreslår metoder til at kontrollere sensitive kapaciteter i open-weight-modeller uden at forhindre forskning. briefingen 29. august. Overvågning af fine-tuning og adskillelse af funktioner er nøglen.

Kilder: awesomepapers.io · mlanthology.org

open-weightscapability-controlrisk-management

Kan ngram-embeddings bruges til dynamisk, kontinuerlig læring under inferens?

Reddit-bruger foreslår en "live" ngram-tabel oven på Qwen 3.8 Flash' frosne embeddings – nye "hukommelser" dannes, gamle henfalder. Spekulativ, men fascinerende idé.

Kilder: r/LocalLLaMA

ngram-embeddingsrsilive-trainingqwen-3.8

Sikkerhed & jailbreaks

OpenAI-forsker sætter 70% sandsynlighed for menneskelig udryddelse inden tre år

opfølgning på 4. september

En OpenAI-sikkerhedsforsker vurderer 70% risiko for AI-udryddelse inden 2029, mens Anthropics Evan Hubinger og Geoffrey Hinton sætter oddsene over 10% – ekstreme estimater, der vækker opsigt langt ud over forskningsmiljøet.

Kilder: beincrypto.com · latimes.com · businessinsider.com · latimes.com · the-independent.com · www.businessinsider.com · wthr.com · startuphub.ai · businessinsider.com · latimes.com · thenews.com.pk · thenextweb.com · archive.fo

extinction-riskopenaianthropicsafety-research

Opfølgning: Den nye AI-panik handler om autonome agenter, ikke superintelligens

opfølgning på 11. september

Stigende bekymring retter sig mod at give AI-systemer autonomi til at finde sårbarheder og skrive kode. briefingen 11. september. Flere medier spørger: hvis labbene selv frygter udryddelse, hvorfor stopper de så ikke?

Kilder: linkdood.com · cp24.com · ctvnews.ca · theconversation.com · dailymail.com · rfi.fr · indiatimes.com

existential-riskai-agentsautonomous-systems

16 nye ICLR-papirer kortlægger jailbreak-landskabet – fra GraphShield til neuron-analyse

GraphShield modellerer informationsflow i netværket for at detektere jailbreaks, mens JULI angriber via selv-introspektion og STAR automatiserer red-teaming. En regulær tsunami af sikkerhedsforskning.

Kilder: mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · mlanthology.org · lacuna.tiptreesystems.com · mlanthology.org · mlanthology.org · lacuna.tiptreesystems.com · lacuna.tiptreesystems.com · mlanthology.org

↻ 16 kilder, 1 uafhængige — resten bringer samme tekst

jailbreak-detectiongraphshieldiclr-2026adversarial-attacks

Prompt injection i AI-agenter: omfattende review viser eksploderende angrebsflade

Model Context Protocol (MCP) og agent-systemer åbner for tool poisoning og credential theft. Reviewet dokumenterer reelle hændelser og giver en taksonomi af angreb.

Kilder: awesomepapers.io · dev.to

prompt-injectionai-agentsmcpvulnerability

Værktøjer & produkter

Perplexity sætter sin lid til GPT-6 Astra til kritiske systemer

Perplexity bruger OpenAI's GPT-6 Astra til at skrive kommunikation, ændre software og overvåge produktion – med langt mindre manuel kontrol end tidligere.

Kilder: OpenAI · OpenAI

perplexitygpt-6-astraagentic-systemsopenai

AI-agenters sikkerhedsrisici: 10 ting du skal vide

AI-agenter planlagger, bruger værktøjer og udfører handlinger – og den største risiko er ikke hallucinationer, men uautoriseret eksekvering af kode.

Kilder: analyticsinsight.net · forbes.com

ai-agentssafety-risksunauthorized-execution

Gammel GPU kan speede mmproj op til 10x med llama.cpp

Ét flag – --mmdev CUDA1 – kan lade en sekundær, langsom GPU håndtere vision mmproj og frigøre VRAM til inferens. Praktisk hack til lokal multi-GPU.

Kilder: r/LocalLLaMA

llama.cppmmprojgpu-offloadinglocal-llm

2B LLM finjusteret på WhatsApp-chat – 80% menneskelig winrate

En udvikler trænede Qwen 2B på en seks-personers gruppechat. Modellen lærte slang og reaktioner, men mangler dyb forståelse. Cookbook med reproducerbar pipeline på GitHub.

Kilder: r/LocalLLaMA

fine-tuning2b-modelwhatsapplocal-llm

Opfølgning: Er Qwen-Next ringere end 3.8 27B til kodning?

opfølgning på 29. august

Bruger på M5 Max finder, at Qwen 3.8 27B q8 klarer svære kodetasks bedre end Qwen-Next. Flere oplever samme tendens. briefingen 29. august.

Kilder: r/LocalLLaMA

qwen-nextqwen-3.8codinglocal-llm

🇪🇺 EU & Europa

Opfølgning: UK kan ikke bare slukke en løbsk AI-model – og EU kræver kontrol

opfølgning på 11. september

Den britiske regering erkender, at der ikke findes en "off"-knap for rogue AI. EU-kommissionen svarer med at kræve kontrol, mens AI Act'ens håndhævelse træder i kraft 2. august 2026. briefingen 11. september.

Kilder: startupfortune.com · tribune.com.pk

ai-raceregulationgovernmenteu

Cohere i avancerede forhandlinger om 3 milliarder dollar – europæisk alternativ vokser

Canadiske Cohere forhandler om at rejse op til 3 mia. dollars og har allieret sig med tyske Aleph Alpha for at styrke sin position i Europa som et uafhængigt alternativ til amerikanske tech-giganter.

Kilder: theglobeandmail.com · cryptobriefing.com

coherealeph-alphafundingdigital-sovereignty

EU-kommissær Virkkunen efterlyser globale AI-regler efter udryddelsesadvarsel

EU's tech-chef Henna Virkkunen opfordrer til globale AI-regler og fortsat internationalt samarbejde om AI-risici i kølvandet på Coxon-advarslen.

Kilder: ua.news · politico.eu

global-regulationhenna-virkkuneneuropean-commission

Rygte: 16 Moonshot-medarbejdere anholdt efter Kina-distillation af Claude

Anthropic rapporterer, at Kimi videresendte PLA-brugeres anmodninger til Claude til destillation. Rygter siger, at 16 Moonshot-medarbejdere blev anholdt for lækagen.

Kilder: r/LocalLLaMA

anthropicmoonshotkimidistillationchina

Branche & politik

Opfølgning: Jacob Coxon-affæren udløser en "præference-kaskade" i AI-debatten

opfølgning på 11. september

Den afgåede Anthropic-forsker Jacob Coxon advarer om udryddelse inden 2030. Zvi Mowshowitz kalder det en kaskade, hvor flere tør sige højt, hvad de frygter. briefingen 11. september. NPR og Scientific American dækker historien bredt.

Kilder: independentsentinel.com · thezvi.substack.com · thezvi.substack.com · scientificamerican.com · npr.org

extinction-riskcoxonanthropicpreference-cascade

Opfølgning: Kongressens interesse for AI-regulering vokser efter whistleblower-advarsler

opfølgning på 10. september

Lovgivere på begge sider af gangen kræver handling efter advarsler om, at AI kan overtage menneskelig kontrol, men der er ingen konsensus om tilgangen. briefingen 10. september.

Kilder: washingtontimes.com · politico.eu

congressregulationwhistleblowerunited-states

Opfølgning: Åbne vægte ≠ open source – og det betyder noget nu i bestyrelseslokalet

opfølgning på 29. august

Enterprise-valget mellem lukkede og open-weight-modeller er ikke sort/hvidt. Artiklen forklarer, hvorfor open source-definitionen og risikostyring er blevet et bestyrelsesspørgsmål. briefingen 29. august.

Kilder: ca.finance.yahoo.com · mlanthology.org

open-weightsopen-sourceenterprise-ailicensing

Dagens signal: Ekstreme udryddelsesestimater fra labbets egne forskere presser både politikere og medier til at tage AI-risiko alvorligt, mens en eksplosion af jailbreak-forskning viser, at feltet selv ved, hvor skrøbelige modellerne er.

Modeller

Ny i indekset

Score ændret

Se hele listen