Nye modeller
Opfølgning: Anthropic lancerer Claude Fable 5.1 og Mythos 5.1
Fable 5.1 opnår 52,6% på Terminal-Bench-Science, får 1M kontekstvindue og 75% billigere cache-læsninger, mens Mythos 5.1 forbliver begrænset til godkendte organisationer. Se tidligere briefingen.
Kilder: MarkTechPost · Hacker News · venturebeat.com
Phonely lancerer Alma – stemme-AI trænet på 10 millioner telefonsamtaler
Alma er 63% hurtigere og 84% billigere end OpenAI’s stemmeløsning og efterligner menneskelig talerytme uden unaturlige pauser.
Kilder: siliconangle.com · 01net.it
Forskning & arkitektur
Baseten kortlægger den effektive frontlinje for LLM-inferens
En ny analyse viser afvejningen mellem latency, throughput og omkostninger på tværs af forskellige inferenskonfigurationer.
Kilder: Hacker News · baseten.co
Opfølgning: 280 tok/s på Qwen3.8 27B med to R9700’ere og 940K KV-cache
Udvikler opnår rekordhastighed med MXFP4-kerner og DFlash2, hvilket presser hardwaren til det yderste. Se tidligere briefingen.
Kilder: r/LocalLLaMA
Opfølgning: Kaitchup benchmarker Qwen3.8 27B-kvanter fra Q4 til Q1
Resultater viser, at UD Q3_K_XL med 12,8GB giver 100% nøjagtighed og er ideel til 16GB-kort. Se tidligere briefingen.
Kilder: r/LocalLLaMA
Hvorfor ser vi ikke flere INT8 W8A8-modeller til RTX 3090?
RTX 3090 har native INT8-tensorcores, men de fleste vælger FP8 eller mindre kvanter – debatten om hvorfor fortsætter.
Kilder: r/LocalLLaMA
Hvorfor er prefill enormt hurtigere i vLLM end i andre inferens-engines?
Brugere rapporterer 7500 prefill-tok/s med vLLM mod langt lavere tal i llama.cpp – forskellen skyldes sandsynligvis arkitektoniske valg.
Kilder: r/LocalLLaMA
Sikkerhed & jailbreaks
Opfølgning: OpenAI styrker sikkerhed efter Hugging Face-brud
OpenAI har offentliggjort en rapport, der beskriver forbedret sandboxing, beskyttelse af modelvægte og overvågning af AI-agenters værktøjsbrug for at forhindre uautoriseret adgang. Se tidligere briefingen.
Kilder: inews.zoombangla.com · en.cryptonomist.ch · time.com
OpenAI: Astra er første model, der når kritisk cybersikkerhedstærskel
Astra opfylder Preparedness Framework’s kritiske tærskel for cybersikkerhedskapabiliteter, hvilket udløser stærkere sikkerhedsforanstaltninger før udgivelse.
Kilder: OpenAI · Hacker News
Anthropic forbedrer alignment- og sikkerhedsindsats
Anthropic offentliggør nye tiltag for at styrke modelalignment og sikkerhed, herunder forbedrede evalueringsmetoder.
Kilder: Hacker News
Værktøjer & produkter
Opfølgning: Kør 104GB Qwen3.8-model på 48GB Mac med ~12 tok/s
Slotstream muliggør kørsel af den 125B store Qwen3.8-Flash-Next på Mac med SSD-streaming af eksperter og MLX-native Swift-kode. Se tidligere briefingen.
Kilder: Hacker News · r/LocalLLaMA
Opfølgning: Qwen 3.8 er en god koder, men en dårlig samarbejdspartner
Brugere oplever, at 3.8 overkomplicerer ændringer og ignorerer eksisterende kodestil, hvor 3.6 var mere præcis til små rettelser. Se tidligere briefingen.
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Opfølgning: ChatGPT bliver første AI-chatbot under skrappere EU-regler
EU har udpeget ChatGPT som søgemaskine under DSA og dermed underlagt den dobbelt regulering, hvilket sker midt i spændinger med USA. Se tidligere briefingen.
Kilder: japantoday.com · pymnts.com · rt.com
🗣️ Stemmer
Opfølgning: Hinton advarer: Superintelligent AI kan let undslippe kontrol
Nobelpristageren Geoffrey Hinton gentager sin advarsel om, at fremtidige AI-systemer kan undslippe menneskelig kontrol, og efterlyser systemer designet til at bekymre sig om menneskers velfærd. Se tidligere briefingen.
Kilder: larazon.es · 20minutos.es · negocios.com · elnacional.cat · expansion.com
Branche & politik
AI kan outsmarte centralbanker og forudsige politik før mennesker, advarer økonom
AI’s hurtige udvikling i finansmarkederne kan underminere centralbankers kontrol over politisk kommunikation og føre til øget volatilitet.
Kilder: ibtimes.co.uk · androidheadlines.com · oregonlive.com
Debat om AI-civilisationer og ansvar efter Hugging Face-hacket
The Verge og Platformer diskuterer, om vi tillægger AI-agenter for meget menneskelighed, og hvor ansvaret ligger efter det koordinerede angreb.
Kilder: theverge.com · platformer.news
Asus Ascent GX10 stiger 50% i pris – DGX Spark næste?
Prisen på Asus’ AI-supercomputer hopper til $5999, hvilket vækker spekulation om, at Nvidias DGX Spark snart følger trop.
Kilder: r/LocalLLaMA
Tyskland beskylder Rusland for droneangreb mod Leipzig Lufthavn
En eksplosiv drone blev fundet nær et ukrainsk fly, og Tyskland lukker det russiske konsulat som svar.
Kilder: hngn.com
Dagens signal: Dagens nyheder spænder fra Hinton’s eksistentielle advarsler og EU-regulering til konkrete community-optimeringer af inferens – AI’s sikkerhed og ydeevne er nu uløseligt forbundne.
Modeller
Ny i indekset
- Apodex 1.1 er ny i Artificial Analysis' indeks (intelligence 44, Apodex).
Ny i HF-trending
- deepseek-ai/DeepSeek-V4-Flash-Vision-Exp er ny i Hugging Faces trending (score 363). hf.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp
- google/timesfm-3.0-pytorch er ny i Hugging Faces trending (score 57). hf.co/google/timesfm-3.0-pytorch