Nye modeller
Opfølgning: Kimi K3 sender chip-aktier i frit fald
Moonshot AIs 2,8 billioner-parameter open-weight model er live og får Nasdaq til at ryste. Vægtene frigives 27. juli. Se briefingen 18. juli.
Kilder: easternherald.com · Fortune · også: bankinfosecurity.com · cryptobriefing.com · techtimes.com · mezha.net · axios.com · wccftech.com · thenews.com.pk · notebookcheck.net · www.latent.space
Qwen 3.8 Max på vej med åbne vægte
Alibaba annoncerer Qwen 3.8 Max Preview — en MoE-model med 2,4 billioner parametre, der frigives open-weight. Det kan sætte nye standarder for, hvad open source-formater kan præstere.
Kilder: r/LocalLLaMA · Qwencloud · Twitter · også: Hacker News · Hacker News
Qwen 3.8 Max nu live på app
Modellen er tilgængelig via chat.qwen.ai og mobilappen. Brugere kan straks teste den nye MoE-model.
Kilder: r/LocalLLaMA
Brugerne håber på en mindre variant af Qwen 3.8
2,4 billioner parametre er voldsomt. En Reddit-bruger ønsker sig en sub-0,5B-model som alternativ, og peger på Minimax M3 som eksempel.
Kilder: r/LocalLLaMA
Gør klar til Qwen 3.8: Forbered VRAM
Opslag på r/LocalLLaMA opfordrer til at gøre plads i hukommelsen. Den kommende store model kræver betydelige ressourcer.
Kilder: r/LocalLLaMA
Forskning & arkitektur
Sakana AI træner neurale net uden backpropagation – når 96,7% på MNIST
Error Diffusion overholder Dale-princippet og skalerer til CIFAR-10, hvilket bringer biologisk plausibel læring tættere på praktisk brug.
Kilder: MarkTechPost · TechTimes
Opfølgning: Brugere finjusterer ternære Bonsai 8B på egen data
PrismML's ternære model kan specialiseres via finjustering, men kræver en speciel llama.cpp-fork. Se briefingen 17. juli.
Kilder: r/LocalLLaMA
Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling
Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.
Kilder: r/LocalLLaMA
microgpt: Karpathys minimalistiske GPT-2-implementering
Andrej Karpathy delte en kompakt GPT-2-kode, der er et lærerigt værktøj til at forstå transformerarkitektur. En anden Gist indeholder ChatGPT-Dan-jailbreak.
Kilder: Karpathy Gist · Dan Jailbreak Gist
ASCIITermDraw Bench tester VLM'ers evne til at tegne i ASCII
Ny benchmark med 80 opgaver måler, om vision-sprogmodeller kan generere og redigere ASCII-diagrammer præcist. Opgaver spænder fra netværkstopologi til softwarearkitektur.
Kilder: r/LocalLLaMA
Kan AI blive bevidst? Ny rapport med Yoshua Bengio
En tværfaglig rapport, omtalt i AOL, undersøger muligheden for AI-bevidsthed. De fleste anser det for principielt muligt, men formen er omstridt.
Kilder: AOL · også: theguardian.com
Hvordan LLM'er lærer at styre ræsonnementets dybde
Sebastian Raschka gennemgår, hvordan sprogmodeller kan trænes til at arbejde i low-, medium- og high-effort-tilstande. Forståelsen er afgørende for at balancere hastighed og kvalitet i produktionssystemer.
Kilder: Ahead of AI · blog.donweb.com
Perplexity udgiver WANDR – benchmark til dybdegående research-agenter
WANDR indeholder 500 opgaver, der kræver både bred og dyb søgning med verificerbare kilder. Perplexity Search as Code opnår 0,363 soft F1 og sætter en ny standard for agent-evaluering.
Kilder: MarkTechPost
Frontier-modeller fejler stadig i matematiske beviser
En ny benchmark viser, at selv de bedste LLM'er har store problemer med at konstruere og verificere komplekse matematiske beviser. Thinking Machines åbnede samtidig Inkling, en stor MoE-model med 1M kontekstvindue.
Kilder: The Sequence Radar
Sikkerhed & jailbreaks
AI brugt som medskyldig i tredobbelt mord i Bengaluru
En teknolog brugte prompts til at få instruktioner om at dræbe, rense og flytte lig. Politiet siger, at ekstrem isolation skabte en "eliminer dem"-mentalitet uden kontakt til virkeligheden.
Kilder: Indian Express
Værktøjer & produkter
Google Cloud lancerer 'Always-On Memory Agent' – erstatter RAG og embeddings
En referenceimplementering på Gemini 3.1 Flash-Lite bruger løbende LLM-konsolidering i stedet for vektordatabase, med SQLite som hukommelse.
Kilder: MarkTechPost
Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU
En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se briefingen 17. juli.
Kilder: r/LocalLLaMA
Opfølgning: Qwen 3.6 føles mindre intelligent end Gemma 4 trods bedre benchmarks
Brugere oplever, at Gemma 4 26a4B (QAT) er mere sammenhængende i praksis. Se briefingen 18. juli.
Kilder: r/LocalLLaMA
Detaljeret guide: Kør Qwen 27B med GHCP Copilot Harness i højeste kvalitet
En Reddit-bruger deler optimerede indstillinger baseret på hundredvis af timers test i virksomhedsmiljøer.
Kilder: r/LocalLLaMA
Spørgsmål: Kan Inkling køre med llama.cpp på CPU og RAM alene?
En bruger efterspørger launch-script til at køre Inkling uden GPU.
Kilder: r/LocalLLaMA · også: r/LocalLLaMA
Claude Code bruger nu Bun skrevet i Rust
Simon Willison påviste, at Claude Code kører på en Rust-port af Bun. Opstarten er 10 % hurtigere på Linux — en sjælden, men vigtig infrastrukturforbedring.
Kilder: Simon Willison · Hacker News
Tutorial: Finjustér Qwen3 med LoRA på én GPU i Google Colab
MarkTechPost viser en komplet workflow med NVIDIA NeMo AutoModel, der lader dig træne Qwen3-0.6B på en enkelt GPU. Nyttig guide for alle, der vil eksperimentere med LoRA uden dyr hardware.
Kilder: MarkTechPost
Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?
Brugeren fortæller om erfaringer med Qwen3.5-397B på M2 Ultra og arbejdet med at fikse KV-cache i llama.cpp. Se briefingen 17. juli for baggrunden om DeepSeek V4 Flash.
Kilder: r/LocalLLaMA
Hvilke oversete lokale modeller bruger du dagligt?
En tråd på r/LocalLLaMA samler anbefalinger af modeller uden for mainstream som Qwen 3.6 og Gemma 4. Tråden afslører flere skjulte perler, der fortjener mere opmærksomhed blandt lokale AI-entusiaster.
Kilder: r/LocalLLaMA
10 open-source no-code platformer til LLM-apps og RAG
MarkTechPost runder 10 platforme op, der gør retrieval, agenter og workflows tilgængelige via visuelle værktøjer og almindeligt engelsk. Hver platform har verificeret licens og bedste anvendelsesområde.
Kilder: MarkTechPost
FastFlowLM slutter sig til AMD for at fremme AI-inferens
Holdet bag FastFlowLM er nu en del af AMD. Samarbejdet skal accelerere udviklingen af AI-inferens, hvilket kan styrke AMD's position i hardware-konkurrencen mod Nvidia.
Kilder: r/LocalLLaMA
AI-boomet presser GPU-priserne i vejret
Brugere på r/LocalLLaMA diskuterer de høje priser på GPU'er til lokal AI. Et spring fra RTX 4060 Ti til brugbare modeller koster over 1.000 dollars, og "AI-skatten" gør opgraderinger uoverkommelige.
Kilder: r/LocalLLaMA
Kan Tensor-RT LLM køre fuld præcision uden nok VRAM?
En bruger på r/LocalLLaMA spørger, om frameworks som Tensor-RT LLM eller DeepSpeed kan streame vægte for store MoE-modeller som Hy3. Svarene mangler endnu, men spørgsmålet er centralt for lokal inferens.
Kilder: r/LocalLLaMA
Top AI-agenter til forretningsautomatisering
InvestGlass gennemgår de bedste AI-agenter til at strømline forretningsprocesser. Listen fokuserer på øget effektivitet og produktivitet gennem automatisering.
Kilder: InvestGlass
🇪🇺 EU & Europa
EU's AI-forordning: Mærkning af chatbots og deepfakes træder i kraft 2. august
Selvom de fleste højrisikoregler er udskudt til 2027, står artikel 50 om gennemsigtighed fast. Virksomheder skal være klar til at mærke AI-genereret indhold.
Kilder: digitalapplied.com · Silicon Canals
Tysk SooFi-team lancerer åben MoE-model med Mamba-arkitektur
Soofi S 30B-A3B er en hybrid Mamba–Transformer-model med 30B parametre, målrettet tysk og engelsk. Modellen udkommer som open-source, hvilket styrker Europas uafhængighed på sprogmodelområdet.
Kilder: r/LocalLLaMA
Europas demokrati afhænger af håndhævelse af hadtale-lovgivning
Digital Services Act (DSA) er et vigtigt skridt, men fragmenteret håndhævelse underminerer effekten. Platforme skal holdes ansvarlige for systematiske risici fra anbefalingsalgoritmer.
Kilder: The Jerusalem Post
MiCA-håndhævelse kræver skærpet crypto-compliance
EU's MiCA-forordning er nu aktiv, og regulatorer har adgang til transaktionsdata. Virksomheder skal matche marketing med whitepapers og behandle smart contracts som juridiske dokumenter.
Kilder: techlaw.attorney
🗣️ Stemmer
Emily Bender: LLM'er kan hverken forske eller begå forskningsfusk
Sprogforskeren kritiserer medier for at forveksle AI med LLM'er og tillægge modeller agens, de ikke har.
Kilder: Emily Bender · Emily Bender
AI-mani lammer global beslutningstagning
Nik Suresh afslører, hvordan topchefer uden AI-erfaring præsenterer urealistiske strategier, og medarbejdere koder i Zig for at redde jobbet. Det viser en kultur, hvor frygt for at miste kontrakter forhindrer ærlighed.
Kilder: Simon Willison
Branche & politik
OpenAI-strateg: Open-weight-modeller sænker AI-investeringer
Dean W. Ball fra OpenAIs strategiske fremtidsenhed analyserer, at Kinas open-weight-modeller kan føre til statsstyret AI-infrastruktur – og at USA bør svare med regulering.
Kilder: r/LocalLLaMA · også: axios.com · americanbazaaronline.com
Palantir-CEO: AI vil gøre mig til milliardær – arbejdere taber
Alex Karp forudser, at AI omformer hvide-krave-job som globaliseringen gjorde med fabriksjob, og efterlyser handling nu.
Kilder: ibtimes.com · easterneye.biz · også: billionaires.africa · thenational.scot
Open source-samling i Shanghai fejrer Qwen-lanceringen
Inden for et døgn samledes miljøet i Shanghai. Flere open source-modelannonceringer forventes snart.
Kilder: r/LocalLLaMA
IonixAIChain hypes næste bølge af kryptovaluta med AI-drevet presale
Flere pressemeddelelser på openpr.com promoverer IonixAIChain som den næste store kryptovaluta på Solana. Indholdet er rent salgsmateriale uden teknisk substans og bør læses med stor skepsis.
Kilder: openpr.com · openpr.com · openpr.com
Dagens signal: AI-manien skaber både urealistiske forventninger i topledelser og reelle hardware-flaskehalse for dem, der faktisk vil bygge.