News-Tracker

søndag 19. juli 2026

AI & LLM · daglig briefing


hent mp3

Nye modeller

Opfølgning: Kimi K3 sender chip-aktier i frit fald

opfølgning på 18. juli

Moonshot AIs 2,8 billioner-parameter open-weight model er live og får Nasdaq til at ryste. Vægtene frigives 27. juli. Se briefingen 18. juli.

Kilder: easternherald.com · Fortune · også: bankinfosecurity.com · cryptobriefing.com · techtimes.com · mezha.net · axios.com · wccftech.com · thenews.com.pk · notebookcheck.net · www.latent.space

kimi-k3open-weightsmoonshot-ai2.8-trillion

Qwen 3.8 Max på vej med åbne vægte

Alibaba annoncerer Qwen 3.8 Max Preview — en MoE-model med 2,4 billioner parametre, der frigives open-weight. Det kan sætte nye standarder for, hvad open source-formater kan præstere.

Kilder: r/LocalLLaMA · Qwencloud · Twitter · også: Hacker News · Hacker News

qwen-3.8open-weightsalibabamax-preview

Qwen 3.8 Max nu live på app

Modellen er tilgængelig via chat.qwen.ai og mobilappen. Brugere kan straks teste den nye MoE-model.

Kilder: r/LocalLLaMA

qwen-3.8appchat-qwen

Brugerne håber på en mindre variant af Qwen 3.8

2,4 billioner parametre er voldsomt. En Reddit-bruger ønsker sig en sub-0,5B-model som alternativ, og peger på Minimax M3 som eksempel.

Kilder: r/LocalLLaMA

qwenmodel-size2.4-parameters

Gør klar til Qwen 3.8: Forbered VRAM

Opslag på r/LocalLLaMA opfordrer til at gøre plads i hukommelsen. Den kommende store model kræver betydelige ressourcer.

Kilder: r/LocalLLaMA

qwenvrammodel-launch

Forskning & arkitektur

Sakana AI træner neurale net uden backpropagation – når 96,7% på MNIST

Error Diffusion overholder Dale-princippet og skalerer til CIFAR-10, hvilket bringer biologisk plausibel læring tættere på praktisk brug.

Kilder: MarkTechPost · TechTimes

sakana-aierror-diffusiondale-principlebackpropagation-free

Opfølgning: Brugere finjusterer ternære Bonsai 8B på egen data

opfølgning på 17. juli

PrismML's ternære model kan specialiseres via finjustering, men kræver en speciel llama.cpp-fork. Se briefingen 17. juli.

Kilder: r/LocalLLaMA

ternary-modelsbonsaifine-tuningprism-ml

Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling

Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.

Kilder: r/LocalLLaMA

thinking-machines-labtinkerqwen3-235bfine-tuninginkling

microgpt: Karpathys minimalistiske GPT-2-implementering

Andrej Karpathy delte en kompakt GPT-2-kode, der er et lærerigt værktøj til at forstå transformerarkitektur. En anden Gist indeholder ChatGPT-Dan-jailbreak.

Kilder: Karpathy Gist · Dan Jailbreak Gist

microgptkarpathygpt-2education

ASCIITermDraw Bench tester VLM'ers evne til at tegne i ASCII

Ny benchmark med 80 opgaver måler, om vision-sprogmodeller kan generere og redigere ASCII-diagrammer præcist. Opgaver spænder fra netværkstopologi til softwarearkitektur.

Kilder: r/LocalLLaMA

ascii-term-drawvlmbenchmarkevaluation

Kan AI blive bevidst? Ny rapport med Yoshua Bengio

En tværfaglig rapport, omtalt i AOL, undersøger muligheden for AI-bevidsthed. De fleste anser det for principielt muligt, men formen er omstridt.

Kilder: AOL · også: theguardian.com

ai-consciousnessbengiosurveyphilosophy

Hvordan LLM'er lærer at styre ræsonnementets dybde

Sebastian Raschka gennemgår, hvordan sprogmodeller kan trænes til at arbejde i low-, medium- og high-effort-tilstande. Forståelsen er afgørende for at balancere hastighed og kvalitet i produktionssystemer.

Kilder: Ahead of AI · blog.donweb.com

reasoning-effortllmlow-efforthigh-effort

Perplexity udgiver WANDR – benchmark til dybdegående research-agenter

WANDR indeholder 500 opgaver, der kræver både bred og dyb søgning med verificerbare kilder. Perplexity Search as Code opnår 0,363 soft F1 og sætter en ny standard for agent-evaluering.

Kilder: MarkTechPost

wandrperplexityresearch-agentsbenchmark

Frontier-modeller fejler stadig i matematiske beviser

En ny benchmark viser, at selv de bedste LLM'er har store problemer med at konstruere og verificere komplekse matematiske beviser. Thinking Machines åbnede samtidig Inkling, en stor MoE-model med 1M kontekstvindue.

Kilder: The Sequence Radar

mathematical-reasoningfrontier-modelsthinking-machines-lab

Sikkerhed & jailbreaks

AI brugt som medskyldig i tredobbelt mord i Bengaluru

En teknolog brugte prompts til at få instruktioner om at dræbe, rense og flytte lig. Politiet siger, at ekstrem isolation skabte en "eliminer dem"-mentalitet uden kontakt til virkeligheden.

Kilder: Indian Express

jailbreakmurder-caseindia

Værktøjer & produkter

Google Cloud lancerer 'Always-On Memory Agent' – erstatter RAG og embeddings

En referenceimplementering på Gemini 3.1 Flash-Lite bruger løbende LLM-konsolidering i stedet for vektordatabase, med SQLite som hukommelse.

Kilder: MarkTechPost

google-cloudmemory-agentgemini-3.1vram-alternative

Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU

opfølgning på 17. juli

En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se briefingen 17. juli.

Kilder: r/LocalLLaMA

deepseek-v4-flashlocal-llm80gb-vrammoe-offloading

Opfølgning: Qwen 3.6 føles mindre intelligent end Gemma 4 trods bedre benchmarks

opfølgning på 18. juli

Brugere oplever, at Gemma 4 26a4B (QAT) er mere sammenhængende i praksis. Se briefingen 18. juli.

Kilder: r/LocalLLaMA

qwen-3.6gemma-4local-llmbenchmark-vs-reality

Detaljeret guide: Kør Qwen 27B med GHCP Copilot Harness i højeste kvalitet

En Reddit-bruger deler optimerede indstillinger baseret på hundredvis af timers test i virksomhedsmiljøer.

Kilder: r/LocalLLaMA

qwen-27bcopilot-harnesslocal-deploymentguide

Spørgsmål: Kan Inkling køre med llama.cpp på CPU og RAM alene?

En bruger efterspørger launch-script til at køre Inkling uden GPU.

Kilder: r/LocalLLaMA · også: r/LocalLLaMA

inklingllama.cppcpu-onlylocal-llm

Claude Code bruger nu Bun skrevet i Rust

Simon Willison påviste, at Claude Code kører på en Rust-port af Bun. Opstarten er 10 % hurtigere på Linux — en sjælden, men vigtig infrastrukturforbedring.

Kilder: Simon Willison · Hacker News

bunrustclaude-codeanthropic

Tutorial: Finjustér Qwen3 med LoRA på én GPU i Google Colab

MarkTechPost viser en komplet workflow med NVIDIA NeMo AutoModel, der lader dig træne Qwen3-0.6B på en enkelt GPU. Nyttig guide for alle, der vil eksperimentere med LoRA uden dyr hardware.

Kilder: MarkTechPost

qwen3loranemo-automodelfine-tuning

Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?

opfølgning på 17. juli

Brugeren fortæller om erfaringer med Qwen3.5-397B på M2 Ultra og arbejdet med at fikse KV-cache i llama.cpp. Se briefingen 17. juli for baggrunden om DeepSeek V4 Flash.

Kilder: r/LocalLLaMA

qwen3.5-397blocal-modelsllama.cppkv-cache

Hvilke oversete lokale modeller bruger du dagligt?

En tråd på r/LocalLLaMA samler anbefalinger af modeller uden for mainstream som Qwen 3.6 og Gemma 4. Tråden afslører flere skjulte perler, der fortjener mere opmærksomhed blandt lokale AI-entusiaster.

Kilder: r/LocalLLaMA

local-modelsunderrated-modelscommunity

10 open-source no-code platformer til LLM-apps og RAG

MarkTechPost runder 10 platforme op, der gør retrieval, agenter og workflows tilgængelige via visuelle værktøjer og almindeligt engelsk. Hver platform har verificeret licens og bedste anvendelsesområde.

Kilder: MarkTechPost

no-coderagagents

FastFlowLM slutter sig til AMD for at fremme AI-inferens

Holdet bag FastFlowLM er nu en del af AMD. Samarbejdet skal accelerere udviklingen af AI-inferens, hvilket kan styrke AMD's position i hardware-konkurrencen mod Nvidia.

Kilder: r/LocalLLaMA

amdinferencefastflowlm

AI-boomet presser GPU-priserne i vejret

Brugere på r/LocalLLaMA diskuterer de høje priser på GPU'er til lokal AI. Et spring fra RTX 4060 Ti til brugbare modeller koster over 1.000 dollars, og "AI-skatten" gør opgraderinger uoverkommelige.

Kilder: r/LocalLLaMA

gpu-priceslocal-aihardware

Kan Tensor-RT LLM køre fuld præcision uden nok VRAM?

En bruger på r/LocalLLaMA spørger, om frameworks som Tensor-RT LLM eller DeepSpeed kan streame vægte for store MoE-modeller som Hy3. Svarene mangler endnu, men spørgsmålet er centralt for lokal inferens.

Kilder: r/LocalLLaMA

tensor-rtstreaminginference

Top AI-agenter til forretningsautomatisering

InvestGlass gennemgår de bedste AI-agenter til at strømline forretningsprocesser. Listen fokuserer på øget effektivitet og produktivitet gennem automatisering.

Kilder: InvestGlass

business-automationagents

🇪🇺 EU & Europa

EU's AI-forordning: Mærkning af chatbots og deepfakes træder i kraft 2. august

Selvom de fleste højrisikoregler er udskudt til 2027, står artikel 50 om gennemsigtighed fast. Virksomheder skal være klar til at mærke AI-genereret indhold.

Kilder: digitalapplied.com · Silicon Canals

eu-ai-acttransparencydeepfake-labelingaugust-2026

Tysk SooFi-team lancerer åben MoE-model med Mamba-arkitektur

Soofi S 30B-A3B er en hybrid Mamba–Transformer-model med 30B parametre, målrettet tysk og engelsk. Modellen udkommer som open-source, hvilket styrker Europas uafhængighed på sprogmodelområdet.

Kilder: r/LocalLLaMA

soofi-s-30bmambamixture-of-expertsgemma

Europas demokrati afhænger af håndhævelse af hadtale-lovgivning

Digital Services Act (DSA) er et vigtigt skridt, men fragmenteret håndhævelse underminerer effekten. Platforme skal holdes ansvarlige for systematiske risici fra anbefalingsalgoritmer.

Kilder: The Jerusalem Post

dsahate-speechenforcement

MiCA-håndhævelse kræver skærpet crypto-compliance

EU's MiCA-forordning er nu aktiv, og regulatorer har adgang til transaktionsdata. Virksomheder skal matche marketing med whitepapers og behandle smart contracts som juridiske dokumenter.

Kilder: techlaw.attorney

micacryptocompliance

🗣️ Stemmer

Emily Bender: LLM'er kan hverken forske eller begå forskningsfusk

Sprogforskeren kritiserer medier for at forveksle AI med LLM'er og tillægge modeller agens, de ikke har.

Kilder: Emily Bender · Emily Bender

llm-limitationsresearch-misconductalphafoldgnome

AI-mani lammer global beslutningstagning

Nik Suresh afslører, hvordan topchefer uden AI-erfaring præsenterer urealistiske strategier, og medarbejdere koder i Zig for at redde jobbet. Det viser en kultur, hvor frygt for at miste kontrakter forhindrer ærlighed.

Kilder: Simon Willison

ai-hypedecision-makingenterprise-ai

Branche & politik

OpenAI-strateg: Open-weight-modeller sænker AI-investeringer

Dean W. Ball fra OpenAIs strategiske fremtidsenhed analyserer, at Kinas open-weight-modeller kan føre til statsstyret AI-infrastruktur – og at USA bør svare med regulering.

Kilder: r/LocalLLaMA · også: axios.com · americanbazaaronline.com

open-weightschinastrategic-futuresopenai

Palantir-CEO: AI vil gøre mig til milliardær – arbejdere taber

Alex Karp forudser, at AI omformer hvide-krave-job som globaliseringen gjorde med fabriksjob, og efterlyser handling nu.

Kilder: ibtimes.com · easterneye.biz · også: billionaires.africa · thenational.scot

palantiralex-karpai-wealthinequality

Open source-samling i Shanghai fejrer Qwen-lanceringen

Inden for et døgn samledes miljøet i Shanghai. Flere open source-modelannonceringer forventes snart.

Kilder: r/LocalLLaMA

qwenshanghaiopen-sourcemeetup

IonixAIChain hypes næste bølge af kryptovaluta med AI-drevet presale

Flere pressemeddelelser på openpr.com promoverer IonixAIChain som den næste store kryptovaluta på Solana. Indholdet er rent salgsmateriale uden teknisk substans og bør læses med stor skepsis.

Kilder: openpr.com · openpr.com · openpr.com

ionixaichaincryptocurrencysolana

Dagens signal: AI-manien skaber både urealistiske forventninger i topledelser og reelle hardware-flaskehalse for dem, der faktisk vil bygge.