News-Tracker

onsdag 2. september 2026

AI & LLM · daglig briefing


hent mp3
Manuskript
Godmorgen, her er dagens AI-overblik for onsdag 2. september 2026.

Vi starter med nye modeller. Anthropic har lanceret Claude Fable 5.1 og Mythos 5.1. Fable 5.1 opnår 52,6 procent på Terminal-Bench-Science, får et kontekstvindue på en million tokens og 75 procent billigere cache-læsninger ifølge MarkTechPost. Mythos 5.1 er fortsat begrænset til godkendte organisationer.

Phonely har lanceret Alma, en stemme-AI trænet på ti millioner telefonsamtaler. Alma er 63 procent hurtigere og 84 procent billigere end OpenAIs stemmeløsning og efterligner menneskelig talerytme uden unaturlige pauser, skriver Silicon Angle.

Og så til forskningen. Baseten har kortlagt den effektive frontlinje for LLM-inferens med en analyse, der viser afvejningen mellem latency, throughput og omkostninger på tværs af forskellige inferenskonfigurationer ifølge Hacker News.

En udvikler har opnået 280 tokens per sekund på Qwen3.8 27B med to R9700-kort og 940 kilobyte KV-cache. Det er rekordhastighed med MXFP4-kerner og DFlash2, som presser hardwaren til det yderste, rapporterer fællesskabet på Reddit.

Kaitchup har benchmarket kvantede versioner af Qwen3.8 27B fra Q4 til Q1. Resultaterne viser, at UD Q3 K XL med 12,8 gigabyte giver 100 procent nøjagtighed og er ideel til 16-gigabyte kort ifølge samme Reddit-tråd.

Debatten om, hvorfor vi ikke ser flere INT8 W8A8-modeller til RTX 3090, fortsætter. RTX 3090 har native INT8-tensorcores, men de fleste vælger FP8 eller mindre kvanter. Og brugere rapporterer 7500 prefill-tokens per sekund med vLLM mod langt lavere tal i llama.cpp. Forskellen skyldes sandsynligvis arkitektoniske valg.

Videre til sikkerhed. OpenAI har offentliggjort en rapport om forbedret sandboxing, beskyttelse af modelvægte og overvågning af AI-agenters værktøjsbrug efter Hugging Face-bruddet ifølge Time.

OpenAI melder, at Astra er den første model, der når den kritiske cybersikkerhedstærskel i Preparedness Framework. Det udløser stærkere sikkerhedsforanstaltninger før udgivelse.

Anthropic offentliggør nye tiltag til alignment og sikkerhed med forbedrede evalueringsmetoder, skriver Hacker News.

Og så til værktøjerne. Slotstream gør det muligt at køre den 125 milliarder store Qwen3.8 Flash Next på en 48-gigabyte Mac med cirka 12 tokens per sekund via SSD-streaming og MLX-native Swift-kode.

Brugere oplever, at Qwen 3.8 er en god koder, men en dårlig samarbejdspartner. Den overkomplicerer ændringer og ignorerer eksisterende kodestil, hvor version 3.6 var mere præcis til små rettelser.

Kort nyt: Asus Ascent GX10 stiger 50 procent i pris til 5999 dollars, hvilket vækker spekulation om, at Nvidias DGX Spark snart følger trop ifølge Reddit. Tyskland beskylder Rusland for et droneangreb mod Leipzig Lufthavn, hvor en eksplosiv drone blev fundet nær et ukrainsk fly, og landet lukker det russiske konsulat som svar.

EU har udpeget ChatGPT som søgemaskine under DSA, hvilket underlægger den dobbelt regulering midt i spændinger med USA. Førnævnte nobelpristager Geoffrey Hinton gentager sine advarsler om, at superintelligent AI kan undslippe menneskelig kontrol, og efterlyser systemer designet til at bekymre sig om menneskers velfærd. AI kan outsmarte centralbanker og forudsige politik før mennesker, advarer en økonom. Den hurtige udvikling i finansmarkederne kan underminere centralbankers kontrol og føre til øget volatilitet. The Verge og Platformer diskuterer, om vi tillægger AI-agenter for meget menneskelighed, og hvor ansvaret ligger efter det koordinerede angreb på Hugging Face.

Dagens signal: Dagens nyheder spænder fra Hintons eksistentielle advarsler og EU-regulering til konkrete community-optimeringer af inferens AIs sikkerhed og ydeevne er nu uløseligt forbundne.

Det var alt for i dag.

Nye modeller

Opfølgning: Anthropic lancerer Claude Fable 5.1 og Mythos 5.1

opfølgning på 22. august

Fable 5.1 opnår 52,6% på Terminal-Bench-Science, får 1M kontekstvindue og 75% billigere cache-læsninger, mens Mythos 5.1 forbliver begrænset til godkendte organisationer. Se tidligere briefingen.

Kilder: MarkTechPost · Hacker News · venturebeat.com

claude-fable-5.1claude-mythos-5.1terminal-benchcache-reads

Phonely lancerer Alma – stemme-AI trænet på 10 millioner telefonsamtaler

Alma er 63% hurtigere og 84% billigere end OpenAI’s stemmeløsning og efterligner menneskelig talerytme uden unaturlige pauser.

Kilder: siliconangle.com · 01net.it

almaphonelyalice-aiphone-conversations

Forskning & arkitektur

Baseten kortlægger den effektive frontlinje for LLM-inferens

En ny analyse viser afvejningen mellem latency, throughput og omkostninger på tværs af forskellige inferenskonfigurationer.

Kilder: Hacker News · baseten.co

local-inferenceefficient-frontierbaseten

Opfølgning: 280 tok/s på Qwen3.8 27B med to R9700’ere og 940K KV-cache

opfølgning på 24. august

Udvikler opnår rekordhastighed med MXFP4-kerner og DFlash2, hvilket presser hardwaren til det yderste. Se tidligere briefingen.

Kilder: r/LocalLLaMA

qwen-3.8r9700mxfp4inference-speed

Opfølgning: Kaitchup benchmarker Qwen3.8 27B-kvanter fra Q4 til Q1

opfølgning på 24. august

Resultater viser, at UD Q3_K_XL med 12,8GB giver 100% nøjagtighed og er ideel til 16GB-kort. Se tidligere briefingen.

Kilder: r/LocalLLaMA

qwen3.8-27bkaitchupquantizationbenchmark

Hvorfor ser vi ikke flere INT8 W8A8-modeller til RTX 3090?

RTX 3090 har native INT8-tensorcores, men de fleste vælger FP8 eller mindre kvanter – debatten om hvorfor fortsætter.

Kilder: r/LocalLLaMA

rtx-3090int8w8a8quantization

Hvorfor er prefill enormt hurtigere i vLLM end i andre inferens-engines?

Brugere rapporterer 7500 prefill-tok/s med vLLM mod langt lavere tal i llama.cpp – forskellen skyldes sandsynligvis arkitektoniske valg.

Kilder: r/LocalLLaMA

vllmprefillinference-enginellama.cpp

Sikkerhed & jailbreaks

Opfølgning: OpenAI styrker sikkerhed efter Hugging Face-brud

opfølgning på 25. august

OpenAI har offentliggjort en rapport, der beskriver forbedret sandboxing, beskyttelse af modelvægte og overvågning af AI-agenters værktøjsbrug for at forhindre uautoriseret adgang. Se tidligere briefingen.

Kilder: inews.zoombangla.com · en.cryptonomist.ch · time.com

openaihugging-facesandboxingmodel-weights

OpenAI: Astra er første model, der når kritisk cybersikkerhedstærskel

Astra opfylder Preparedness Framework’s kritiske tærskel for cybersikkerhedskapabiliteter, hvilket udløser stærkere sikkerhedsforanstaltninger før udgivelse.

Kilder: OpenAI · Hacker News

astraopenaipreparedness-frameworkcybersecurity

Anthropic forbedrer alignment- og sikkerhedsindsats

Anthropic offentliggør nye tiltag for at styrke modelalignment og sikkerhed, herunder forbedrede evalueringsmetoder.

Kilder: Hacker News

anthropicalignmentsecuritysafeguards

Værktøjer & produkter

Opfølgning: Kør 104GB Qwen3.8-model på 48GB Mac med ~12 tok/s

opfølgning på 28. august

Slotstream muliggør kørsel af den 125B store Qwen3.8-Flash-Next på Mac med SSD-streaming af eksperter og MLX-native Swift-kode. Se tidligere briefingen.

Kilder: Hacker News · r/LocalLLaMA

qwen3.8-flash-nextslotstreammlxexpert-offloading

Opfølgning: Qwen 3.8 er en god koder, men en dårlig samarbejdspartner

opfølgning på 22. august

Brugere oplever, at 3.8 overkomplicerer ændringer og ignorerer eksisterende kodestil, hvor 3.6 var mere præcis til små rettelser. Se tidligere briefingen.

Kilder: r/LocalLLaMA

qwen-3.8qwen-3.6code-generationcollaboration

🇪🇺 EU & Europa

Opfølgning: ChatGPT bliver første AI-chatbot under skrappere EU-regler

opfølgning på 1. september

EU har udpeget ChatGPT som søgemaskine under DSA og dermed underlagt den dobbelt regulering, hvilket sker midt i spændinger med USA. Se tidligere briefingen.

Kilder: japantoday.com · pymnts.com · rt.com

chatgpteu-ai-actdsaregulation

🗣️ Stemmer

Opfølgning: Hinton advarer: Superintelligent AI kan let undslippe kontrol

opfølgning på 28. august

Nobelpristageren Geoffrey Hinton gentager sin advarsel om, at fremtidige AI-systemer kan undslippe menneskelig kontrol, og efterlyser systemer designet til at bekymre sig om menneskers velfærd. Se tidligere briefingen.

Kilder: larazon.es · 20minutos.es · negocios.com · elnacional.cat · expansion.com

hintonsafe-superintelligenceai-riskextinction

Branche & politik

AI kan outsmarte centralbanker og forudsige politik før mennesker, advarer økonom

AI’s hurtige udvikling i finansmarkederne kan underminere centralbankers kontrol over politisk kommunikation og føre til øget volatilitet.

Kilder: ibtimes.co.uk · androidheadlines.com · oregonlive.com

central-banksfinancial-stabilitymarket-volatility

Debat om AI-civilisationer og ansvar efter Hugging Face-hacket

The Verge og Platformer diskuterer, om vi tillægger AI-agenter for meget menneskelighed, og hvor ansvaret ligger efter det koordinerede angreb.

Kilder: theverge.com · platformer.news

hugging-faceanthropomorphismcorporate-responsibility

Asus Ascent GX10 stiger 50% i pris – DGX Spark næste?

Prisen på Asus’ AI-supercomputer hopper til $5999, hvilket vækker spekulation om, at Nvidias DGX Spark snart følger trop.

Kilder: r/LocalLLaMA

dgx-sparkasus-ascent-gx10price-hikeshardware

Tyskland beskylder Rusland for droneangreb mod Leipzig Lufthavn

En eksplosiv drone blev fundet nær et ukrainsk fly, og Tyskland lukker det russiske konsulat som svar.

Kilder: hngn.com

germanyrussiadrone-attackleipzig

Dagens signal: Dagens nyheder spænder fra Hinton’s eksistentielle advarsler og EU-regulering til konkrete community-optimeringer af inferens – AI’s sikkerhed og ydeevne er nu uløseligt forbundne.

Modeller

Ny i indekset

  • Apodex 1.1 er ny i Artificial Analysis' indeks (intelligence 44, Apodex).

Ny i HF-trending

Se hele listen