Nye modeller
Kimi K3: Verdens største open-weight model er her
Moonshot AI har lanceret Kimi K3 med 2,8 billioner parametre, som slår Claude Fable og GPT-5.6 Sol på flere benchmarks. Modellen udgives open-weight den 27. juli og udløste aktiefald hos kinesiske konkurrenter.
Kilder: Outlook Business · Tom's Hardware · Bloomberg · The Neuron Daily · Decrypt · Transformer News · Neowin · Yahoo Finance · også: voice.lapaas.com · businessinsider.com · www.businessinsider.com · digitaltrends.com
Opfølgning: Thinking Machines Lab lancerer Inkling – en alsidig open-weight-basismodel
Inkling er ikke den stærkeste model, men designet som en bred, balanceret foundation-model til finjustering. Se briefingen 17. juli.
Kilder: HPCwire
Forskning & arkitektur
Opfølgning: Kimi K3 i praksis – blandede førstehåndsindtryk
Brugere på r/LocalLLaMA rapporterer, at Kimi K3 topper NextJS eval og science-queries, men flere er skeptiske over for benchmarks og nævner, at brugeroplevelsen halter efter. Se briefingen 17. juli.
Kilder: r/LocalLLaMA · r/LocalLLaMA · r/LocalLLaMA · også: r/LocalLLaMA
Opfølgning: MacBook vs. 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp
En bruger testede DeepSeek-V4-Flash på en M5 Max MacBook (2,45 bit kvantisering) mod to DGX Spark (FP8/FP4). Mac'en vandt 54% mod 52% på Terminal-Bench 2.1 – overraskende tæt. Se briefingen 17. juli.
Kilder: r/LocalLLaMA · r/LocalLLaMA
Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis
En bruger skiftede fra Qwen3.6-27b til Gemma4-31b som primær kodningsagent og løste på én dag bugs, der havde stået på i uger. Qwen fungerede bedre som reviewer og QA-agent.
Kilder: r/LocalLLaMA
Forskning: Negativ-bit-kvantisering bryder den fysiske grænse for komprimering
Ved at udnytte fase-inverteret tensor-embedding hævdes det at opnå stabil inferens med negative bit-konfigurationer. Artiklen er satire, men illustrerer grænsen for kvantiseringsspekulation.
Kilder: r/LocalLLaMA
Synsmodel trænes til at se som en menneskelig annotator – og afsløres når den lyver
Microsofts pipeline udtrækker struktureret metadata fra visuelle aktiver, begrænser output til foruddefinerede værdier og bruger en ground-truth-evaluering til at måle kvalitet.
Kilder: Microsoft DevBlogs
Sikkerhed & jailbreaks
Observabilitet er ikke nok til højrisiko-AI – Diagrid Catalyst lukker hullet
Diagrid Catalyst adresserer et compliance-gab i EU's AI Act, som traditionelle observabilitetsværktøjer ikke kan: manipuleringssikre logfiler og runtime-autorisation af agenter.
Kilder: Efficiently Connected
Værktøjer & produkter
Lokal LLM på Tailscale: Farvel til ChatGPT
En XDA-udvikler beskriver, hvordan han satte en lokal LLM op på en hjemmeserver via Tailscale og stoppede med at betale for ChatGPT. Telefonen når serveren lige så let som OpenAI's cloud.
Kilder: XDA Developers
Observer: Open source-skærmovervågning med lokal LLM er blevet brugervenlig
Efter et års feedback er Observer-appen blevet markant lettere at sætte op – skriv én sætning, og den konfigurerer sig selv. Kører lokalt i browseren via transformers.js.
Kilder: r/LocalLLaMA
iPhone 18 Pro lanceres om to måneder med 12 nye funktioner
MacRumors opsummerer rygterne: mindre Dynamic Island, nye kamerafunktioner og forbedret AI-ydeevne. Ingen LLM-nyheder, men relevant for edge-AI-hardware.
Kilder: MacRumors
Gratis AI-designværktøj lader dig koble din lokale LLM på – og det virker overraskende godt
Paper-appen lader dig bruge en lokal model via MCP til designarbejde direkte på din egen hardware. Et sjældent eksempel på en hosted tool, der respekterer privatlivet.
Kilder: XDA Developers
LLM-kliche-highlighter: værktøj der spotter AI-genereret sprog
Simon Willison fik Fable 5 til at vibe-code en app, der fremhæver ti typiske mønstre i LLM-skrift. Et nyttigt redskab til at gennemskue floskler som "no fluff, no filler".
Kilder: Simon Willison
Hvad din lokale LLM faktisk er god til – og hvad den ikke er
Lokale LLM'er fejler på store, komplekse spørgsmål, men excellerer på afgrænsede opgaver. Artiklen giver praktisk vejledning i at vælge de rigtige brugsscenarier.
Kilder: How-To Geek
Branche & politik
Opfølgning: Kina har udslettet USA's AI-forspring, mener Axios
Axios hævder, at Kimi K3's open-weight-strategi udvisker USA's teknologiske forspring. Artiklen fremhæver, at åbne vægte bliver "soft-power-infrastruktur" ligesom dollaren. Se briefingen 17. juli.
Kilder: Axios · The Standard
Open source-accelerationen truer Anthropic og OpenAI's forretningsmodel
En debattråd på r/LocalLLaMA argumenterer for, at open source-modeller som Kimi K3, Minimax 3 Pro og GLM 5.3 tvinger de store labs til at "destillere" kundernes viden og ekspandere vertikalt for at forsvare deres værdiansættelser.
Kilder: r/LocalLLaMA
Forbes: Store AI-labs lobbyer imod den eneste vej til at vinde kapløbet
Forbes hævder, at de store labs' lobbyister spreder FUD om kinesiske modeller for at få regulerede virksomheder til at trække sig. Åbne vægte er "soft-power-infrastruktur", som Kina nu kopierer.
Kilder: Forbes
Techstructive: Kimi K3 er den bedste frontend-model – open source vinder
Et nyhedsbrev fremhæver, at Kimi K3 overgår lukkede frontend-modeller og understreger, at open source-økosystemet accelererer hurtigere end de proprietære labs.
Kilder: Techstructive Weekly
Kinesisk AI har rykket sig – og sætter fokus på open-weight skiftet
Moonshot AIs Kimi K3-model viser, at kinesiske AI-modeller har taget et kvantespring, hvilket forstærker tendensen mod open-weight-modeller. Men de kræver stadig betydelig teknisk ekspertise at implementere.
Kilder: CNBC
FastFlowLM slutter sig til AMD for at fremme AI-inferens
FastFlowLM's letvægts inferenssoftware bliver en del af AMDs strategi for at forbedre AI-performance og effektivitet på tværs af hardwarestacken.
Kilder: HPCwire
VigilSAR udgiver defense-ISR LLM-benchmark med Kimi K3-debut
Den specialiserede forsvarsplatform VigilSAR har offentliggjort en ny leaderboard, der tester sprogmodellers evner inden for efterretnings- og overvågningsdomæner.
Kilder: 1023 Jack
Dagens signal: Dagens nyheder viser en tydelig polarisering mellem åbne, lokale værktøjer og stadigt mere specialiserede, regulerede enterprise-løsninger.