Nye modeller
Opfølgning: Z.AI's GLM-5.3 overgår amerikanske modeller i cybersikkerhed – udgivelse forsinket
Det kinesiske open-weight-model GLM-5.3 slår benchmarks, men udgivelsen er udskudt efter uventede hacking-evner. briefingen 11. august
Kilder: ecosistemastartup.com · WIRED · MLQ News · The New Stack
Opfølgning: Alibaba lover nyt Qwen 3.8 open-weight-model i næste uge
Community manager bekræfter en mellemstor model over 100B parametre uden early access. briefingen 8. august
Kilder: r/LocalLLaMA · Analytics Insight
Opfølgning: GLM-5.3 benchmarkresultater offentliggjort – konkurrencedygtig med topmodeller
Artificial Analysis viser, at GLM-5.3 præsterer stærkt på tværs af standardtest. briefingen 18. august
Kilder: Artificial Analysis · r/LocalLLaMA
Forskning & arkitektur
UI-Mate: Open-weight GUI-agent sætter ny state-of-the-art på computeropgaver
Tencent præsenterer UI-Mate-27B, der opnår 77% på OSWorld-Verified via in-context demonstrationer.
Kilder: arXiv · r/LocalLLaMA
Status på 1-bit og ternære modeller: Bonsai, Hy-MT1.5, Maple-Preview og flere
En omfattende opdatering dækker nye PRs for CUDA/Vulkan og optimeringer, der giver 15-40% hastighedsforøgelse.
Kilder: r/LocalLLaMA
Sikkerhed & jailbreaks
Opfølgning: OpenAI lancerer initiativ til demokratisk tilsyn med AI i national sikkerhed
OpenAI præsenterer værktøjer og træning til regeringer efter sikkerhedsbruddet hos Hugging Face. Samtidig sænker de udviklingstempoet. briefingen 18. august
Kilder: OpenAI · The Guardian · Bloomberg · WIRED · TechCrunch
Microsoft Copilot afslører egne sårbarheder ved prompt injection
Forskere fik Copilot til at lække sin egen arkitektur og muliggøre et-klik-datatyveri via 'CoSnitch'-angreb.
Kilder: mljconsultancy.net · Ars Technica · Dark Reading · The Hacker News
Værktøjer & produkter
Opfølgning: DFlash2 giver Qwen 3.8 27B op til 200 tk/s på RTX 5090
Ny spekulativ dekodningsteknik i llama.cpp øger hastigheden markant på kodegenerering, men kræver mere hukommelse. briefingen 8. august
Kilder: r/LocalLLaMA · r/LocalLLaMA
Andrej Karpathys LLM-wiki ændrede måden, jeg arbejder på
Platformer beskriver, hvordan en personlig wiki med LLM-integration revolutionerer research og skrivning.
Kilder: platformer.news · www.platformer.news
Opfølgning: DeepSeek V4 Flash 12x hurtigere på M3 Ultra med optimerede kernels
En bruger opnår 1,6 sekunder pr. chat-turn via sparse attention-optimeringer og KV-cache-prewarming. briefingen 6. august
Kilder: r/LocalLLaMA
Opfølgning: Fællesskabet søger den bedste 'abliterated' Qwen 3.8 27B til reverse engineering
Brugere rapporterer om afvisninger ved forsøg på at dekompilere gammel kode og leder efter en usensureret version. briefingen 13. august
Kilder: r/LocalLLaMA
Alibabas RISC-V CPU XuanTie C950 kører Qwen 3.8 27B med 30 tokens i sekundet
En demonstration viser, at en RISC-V-processor kan inferere store sprogmodeller uden GPU.
Kilder: r/LocalLLaMA
Opfølgning: Cerebras lancerer CS-4 – næste generation af wafer-scale AI-hardware
Cerebras annoncerer CS-4, der fortsætter deres massive chip-tilgang til træning og inferens. briefingen 8. august
Kilder: Cerebras · Hacker News
Fællesskabet søger det bedste værktøj til offline Wikipedia-RAG
En bruger spørger efter en fungerende løsning til at integrere Wikipedia-søgning i lokale LLM-workflows.
Kilder: r/LocalLLaMA
Opfølgning: Ling-3.0 (BailingMoE3) understøttes nu officielt i llama.cpp
PR #26608 er merged, og GGUF-kvantiseringer er tilgængelige – benchmarks på Intel Arc B580 viser 114 tk/s. briefingen 17. august
Kilder: r/LocalLLaMA
🇪🇺 EU & Europa
Opfølgning: EU-Kommissionen udgiver retningslinjer for højrisiko-AI – ikke juridisk bindende
De nye retningslinjer afgrænser, hvornår et AI-system er højrisiko, men kun EU-domstolen kan fortolke endeligt. briefingen 12. august
Kilder: fusefy.ai · Forbes · Personnel Today
Opfølgning: Cypern foreslår bøder på op til 35 millioner euro for AI-overtrædelser
Et lovforslag under offentlig høring vil implementere EU's AI Act med markante sanktioner. briefingen 8. august
Kilder: Cyprus Mail · Las Provincias
Branche & politik
AI gør det sværere for nyuddannede at få job – men økonomer er uenige
NPR dækker stigende arbejdsløshed blandt unge med nye grader, mens Gary Marcus påpeger, at bekymringen vokser.
Kilder: NPR · Gary Marcus
Dagens signal: En dag præget af sikkerhedsreaktioner efter Hugging Face-hacket, samtidig med at open-weight-modeller fra Kina og nye inferensteknikker presser grænserne for, hvad der kan køres lokalt.
Modeller
Ny i HF-trending
- FireRedTeam/FireRedTTS3 er ny i Hugging Faces trending (score 41). hf.co/FireRedTeam/FireRedTTS3