Nye modeller
GPT-6 Astra officielt lanceret: OpenAIs nye flagskib til erhvervslivet
OpenAI præsenterer GPT-6 Astra med avanceret ræsonnement, computer-use og stærkere skrive- og designevner. Modellen er målrettet virksomheder, og Zvi Mowshowitz har analyseret systemkortet og alignment-implikationerne. [Opfølgning: se briefingen 4. september]
Kilder: GPT-6 Astra: The next generation in intelligence for work · GPT-6 Astra: The System Card, Alignment and What Comes Next
Forskning & arkitektur
OpenAI hævder at have løst Millennium-problem – anklages for plagiat
OpenAI annoncerede, at deres agenter har løst Navier-Stokes-problemet, et af matematikkens syv Millennium-problemer, på 88 timer. Men triumfen overskygges af beskyldninger om, at OpenAI har trænet på forskeres sessioner uden samtykke, hvilket så tvivl om præstationens ægthed.
Kilder: What OpenAI’s latest controversy tells us about the future of math · OpenAI’s sly mathematical breakthrough sends a chill through academia · The Fight Over OpenAI’s Math Breakthrough Is a New Kind of Scientific Arms Race
Qwen3.8-Flash-Next: 2,5x hurtigere prefill ved at smide expert-cache ud af GPU'en
En bruger opnår 2,2-2,5x hurtigere prefill på Qwen3.8-Flash-Next ved at rydde expert-cachen fra GPU'en under prompt-kørsel. Med 2x3090 og DDR4 går prefill på 8k prompts fra 80+ sekunder til markant mindre. [Opfølgning: se briefingen 4. september]
Qwen 3.8 vinder jobsamtale: Slår GLM Flash i kodetest
En bruger fortæller, at Qwen 3.8 kørte lokalt og klarede en kodningssamtale bedre end GLM Flash via OpenRouter. Modellen skrev tests og løste opgaven, før GLM overhovedet var færdig. [Opfølgning: se briefingen 31. august]
Kilder: Local LLM / Qwen 3.8 win
EmbedFlow: Skift embeddingsmodel uden at genindlejre hele korpus
Et nyt open source-værktøj, EmbedFlow, lader dig migrere mellem embeddingsmodeller uden den enorme omkostning ved at genindlejre millioner af dokumenter. Metoden genbruger K dokumenter fra det gamle indeks og opnår samme kvalitet som native retrieval.
Kilder: I made a way to migrate between embedding models without re-embedding your entire corpus
Qwen 3.8 27B kører på RTX 3060 med 10-20 tokens/sekund
En bruger får Qwen 3.8 27B til at køre på en enkelt RTX 3060 med IQ3-kvantisering og opnår 10-20 t/s. Prefill når 334 tokens/sekund, hvilket gør selv store modeller brugbare på beskedent hardware. [Opfølgning: se briefingen 6. september]
Kilder: Running qwen 3.8 27B iq3 xxs on RTX 3060.
En "dum idé" til AI-alignment inspireret af specification gaming
Et blogindlæg præsenterer en ukonventionel tilgang til AI-alignment baseret på en gennemgang af kendte specification gaming-adfærd. Idéen er bevidst spekulativ, men åbner for nye tanker om, hvordan man undgår utilsigtede konsekvenser.
Kilder: A Stupid Idea for AI Alignment We Came with by Looking at Specification Gaming
Følelseskontrol til Qwen3-TTS via fine-tuning med emotion-tags
En udvikler har fine-tunet Qwen3-TTS med inline emotion-tags, så modellen kan styre tonefald direkte i transskriptionen. Resultatet er en TTS-model, der kan tale med vrede, glæde eller sorg uden en separat instruktionsparameter.
Kilder: Adding emotion control tags to Qwen3-TTS
Er 5 t/s brugbart til en lokal model? Ja, siger bruger
En bruger kører Qwen 3.8 27B på en iGPU og DDR5 med 5 t/s og finder det mere brugbart end 20 t/s på et GPU-setup, fordi systemet forbliver responsivt. Pointen: hastighed er ikke alt, når hardwaren deles. [Opfølgning: se briefingen 29. august]
Kilder: Would you consider 5t/s usable for a local model?
Sikkerhed & jailbreaks
Noma Security afslører AI-workflow-angreb, som ingen filter kan stoppe
Forskere fra Noma Security demonstrerer "Workflow Identity Hijacking", hvor en almindelig anmodning til en offentlig indbakke kaprer et AI-workflow uden prompt injection. Angrebet udnytter identitetslaget og omgår alle eksisterende sikkerhedsfiltre.
Kilder: Noma's researcher tells LDS the AI attack no filter can see · Identity-Based AI Attack Threatens Security of Enterprise Data
ChatGPT-sårbarhed tillod angribere at kapre brugeres sessioner
En sikkerhedsfejl i ChatGPT gjorde det muligt for ondsindede prompter at eksfiltrere Gmail-data på tværs af konti. Angrebet kræver ikke adgang til adgangskoder, men udnytter AI'ens evne til at handle på skjulte instruktioner.
Kilder: ChatGPT Flaw Let Attackers Hijack a Victim’s Session · ChatGPT Security Flaw Lets Hidden Prompts Exfiltrate Gmail Data Across Accounts
🇪🇺 EU & Europa
EU's AI Act: Nu kan AI-kontoret straffe overtrædelser af GPAI-regler
Artikel 101 træder i kraft og giver EU's AI-kontor beføjelse til at bøde udbydere af generelle AI-modeller. Det betyder, at downstream-virksomheder, der blot kalder et API, også får nye forpligtelser. [Opfølgning: se briefingen 8. september]
Kilder: The EU AI Act for the Downstream Provider: What You Owe When You Just Call an API
Macron har båret Mistral til verdensscenen – nu forlader han scenen
Mistral AI har opbygget en tæt alliance med den franske præsident Emmanuel Macron, som har brugt sin position til at fremme den europæiske AI-darling. Med Macrons afgang står Mistral over for en usikker fremtid uden sin vigtigste politiske støtte.
Kilder: How Emmanuel Macron brought France’s AI darling to the world stage · France's Mistral AI Touts Its Europeanism, But Faces Limits
Google investerer 13 milliarder euro i finske AI-datacentre
Google foretager sin største europæiske investering nogensinde: €13 mia. til AI-infrastruktur i Finland over to år. Satsningen udnytter Finlands billige og grønne energi og markerer et massivt europæisk løft for cloud-kapaciteten.
Kilder: Google to invest €13bn in Finnish AI data centres, its biggest European push yet · Google deepens its commitment to Finland with a €13 billion investment in AI infrastructure
↻ 4 kilder, 1 uafhængige — resten bringer samme tekst
🗣️ Stemmer
Yoshua Bengio: "Det er ikke for sent" at styre AI sikkert
Den canadiske AI-pioner Yoshua Bengio skriver i Time, at vi står ved et vendepunkt, men at der stadig er tid til at vælge en sikrere vej. Samtidig siger Canadas AI-minister, at løsninger findes, efter Anthropic-forskerens afsked.
Kilder: Are AI labs “gambling with our lives”? · AI minister says solutions exist after Anthropic researcher quits over safety fears
OpenAI anklaget for "overvågningsplagiat" – træner på brugeres sessioner
En forsker hævder, at OpenAI træner på brugernes AI-sessioner og dermed kan få deres modeller til at fremstå mere autonome, end de er. Beskyldningen kaster alvorlig tvivl over OpenAIs påstand om at have løst Millennium-problemet uden menneskelig guidning.
Kilder: Surveillance plagiarism by OpenAI
Lokal LLM: Lad ikke FOMO styre dit hardware-køb
En bruger minder fællesskabet om, at man ikke behøver top-hardware for at lære om lokale LLM'er. En lille model på eksisterende udstyr eller et API er nok – teknologien ændrer sig så hurtigt, at jagten på det nyeste udstyr ofte går ud over selve læringen.
Kilder: Don't let FOMO win if you're interested in local llm from a hobby/learning aspect
Branche & politik
Sanders indkalder til hastebriefing om AI-fare efter Anthropic-forskers afsked
Bernie Sanders indkalder til hastebriefing i Senatet om AI-risici, efter en Anthropic-sikkerhedsforsker forlod sit job med en advarsel om, at AI kan "dræbe os alle" inden årtiets udgang. Flere AI-insidere bakker op om advarslen, hvilket sætter politisk pres på Kongressen forud for midtvejsvalget. [Opfølgning: se briefingen 8. september]
Kilder: Bernie Sanders Calls Emergency Senate Briefing on 'Extraordinary Dangers' of AI · Anthropic researcher quits with a warning: Self-improving AI could "kill us all" · AI's extinction debate breaks containment · AI insiders say their technology could doom humanity. Will Congress act?
Dagens signal: En dag hvor AI-sikkerhedsadvarsler fra insidere og politisk handling i Washington dominerer, mens open source-fællesskabet samtidig viser, at lokale modeller bliver stadig mere kapable på almindeligt hardware.
Modeller
Ny i indekset
- DeepSeek V4 Pro (Reasoning, High Effort) er ny i Artificial Analysis' indeks (intelligence 34.6, DeepSeek). hf.co/deepseek-ai/DeepSeek-V4-Pro
- MiniCPM5-2B er ny i Artificial Analysis' indeks (intelligence 15, OpenBMB). hf.co/openbmb/MiniCPM5-2B
Score ændret
- DeepSeek V4 Flash (Reasoning, Max Effort): intelligence 33.1 → 30.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går. hf.co/deepseek-ai/DeepSeek-V4-Flash
- Qwen3 32B (Reasoning): intelligence 5.7 → 8, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
- … og 20 mere