News-Tracker

fredag 17. juli 2026

AI & LLM · daglig briefing


hent mp3

Nye modeller

Moonshot AI frigiver Kimi K3 med 2,8 billioner parametre

Morgan Stanley-analytikere kalder K3 et vendepunkt for kinesiske LLMs, der nu matcher amerikanske ledere i modelstørrelse, ydeevne og pris. Modellen imponerer udviklere med stærke kodeegenskaber og lave API-omkostninger, og den åbne vægtstrategi skaber pres på Silicon Valley.

Kilder: Investing.com · MLQ News · TrilogyAI · også: Simon Willison · Fortune · Kimi K2 · The Hindu · SquaredTech · Big News Network · Business Standard · Business Insider · Business Insider · Cryptobriefing · Graphify Guides · ZeroHedge

kimi-k3moonshot-aiopen-weightsllm

Thinking Machines Lab frigiver Inkling open-weights model

Mira Muratis nye laboratorium lancerer Inkling med 975B totale parametre (41B aktive) som Apache-2.0 licenseret multimodal model. Modellen er ikke frontier-niveau, men designet som stærk base for finetuning via deres Tinker-platform.

Kilder: Simon Willison · Techzine Global · også: Msukhareva Substack

inklingthinking-machines-labopen-weightsmira-muratiapache-2.0

Soofi S: Ny europæisk open source-model med 30B parametre

En ny europæisk open source-model er dukket op med 30 milliarder parametre (30B-A3B). Modellen er lokalt kørbar og kommer med et par tænkende preview-versioner. Det er stadig tidlige dage, men viser en ny aktør på det europæiske AI-kort.

Kilder: Reddit LocalLLaMA

soofi-seuropean-aiopen-source30b-parameters

Kimi K3 slår Claude Sonnet 5 på Simple Bench

Kimi K3 (max) har demonstreret overlegen performance ved at slå Claude Sonnet 5 på Simple Bench. Resultatet understøtter Moonshot AI's påstande om, at modellen kan konkurrere med de førende amerikanske modeller.

Kilder: r/LocalLLaMA

kimi-k3benchmarkmoonshot-ai

Bonsai 27B kører lokalt på iPhone i kun 3,9GB

PrismML har bygget Bonsai ved at kvantisere Qwen3.6-27B ned til 1-bit, hvilket reducerer størrelsen fra ~54GB til 3,9GB. Modellen bevarer ~90% af benchmark-scores og kører på iPhone 15 Pro Max med 8GB RAM.

Kilder: r/LocalLLaMA · også: r/LocalLLaMA

bonsai-27bbinary-quantizationmobile-aiprism-ml

Længsel efter nye små sprogmodeller

Siden april er der ikke kommet nye udgaver af Gemma eller Qwen, og communityet spørger, hvornår næste bølge af kompakte LLM'er lander.

Kilder: r/LocalLLaMA

small-llmsgemmaqwen

Forskning & arkitektur

SEED: Ny metode til agent-baseret reinforcement learning

Forskere introducerer SEED, der konverterer afsluttede trajektorier til "hindsight skills" og distillerer adfærd tilbage til policy-modellen. Metoden adresserer supervisionsgabet mellem episode-level belønninger og token-level læring.

Kilder: arXiv

seedreinforcement-learningagentic-rldistillation

Ny teknik muliggør long-context finetuning med begrænset VRAM

Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med 4-bit QLoRA når metoden 16.384 tokens med 15,28 GB VRAM.

Kilder: arXiv

long-contextfine-tuninghgavram-optimization

Kan RAID0 af SSD'er erstatte VRAM til lokal LLM-inference?

En bruger undersøger, om kombinationen af mange hurtige SSD'er i RAID0 kan give tilstrækkelig båndbredde til at køre store modeller lokalt. Metoden kunne være en billigere alternativ til dyrt VRAM, men latency og overhead er ukendte faktorer.

Kilder: r/LocalLLaMA

ssd-raid0local-inferencevram-alternativehardware

Analyse: Hvad pelican benchmark afslører om Kimi K3

En teknisk gennemgang undersøger Kimi K3's præstationer på pelican benchmark og hvad resultaterne fortæller om modellens styrker og begrænsninger sammenlignet med konkurrenterne.

Kilder: Hacker News

kimi-k3benchmarkpelican-benchmark

Kimi K3 nægter at lække sin system prompt

Et eksempel viser Kimi K3's svar når den bliver bedt om at afsløre sin system prompt: "Is there something I can actually help you with today?" Modellen afviser høfligt men bestemt.

Kilder: Simon Willison

kimi-k3ai-personalitysystem-prompt

Claude Platform Docs opdateret med modeloversigt

Anthropic har opdateret dokumentationen med en oversigt over tilgængelige Claude-modeller og deres performance-sammenligninger.

Kilder: platform.claude.com

claude-modelsanthropicmodel-comparison

Sikkerhed & jailbreaks

Meta's tilsynsråd afslører at førende AI-modeller undgår kritik af autoritære regimer

En undersøgelse fra Meta's Oversight Board viser, at populære AI-modeller fra Anthropic, DeepSeek, Google, Meta og OpenAI markant sjældnere kritiserer regeringer og ledere kendt for at begrænse ytringsfrihed. Modellerne har altså en indbygget politisk bias.

Kilder: The Verge · også: The Verge

meta-oversight-boardpolitical-biasllm-safetyanthropicdeepseekgoogle

Kritik: Claude Code er en "misfeature"

En analyse peger på fundamentale problemer med Claude Code fra Anthropic, og hvordan designvalg kan skabe utilsigtede problemer for udviklere. Artiklen undersøger de underliggende årsager til modellens problematiske adfærd.

Kilder: Hacker News

claude-codeanthropicdeveloper-tools

Værktøjer & produkter

NotebookLM skifter navn til Gemini Notebook

Googles AI-noteværktøj NotebookLM omdøbes til Gemini Notebook som del af produktkonsolidering. Navneskiftet afspejler Googles strategi om at samle AI-værktøjer under Gemini-brandet.

Kilder: Hacker News

notebooklmgemini-notebookgooglerebranding

reCamera Pro kombinerer computer vision med LLM/VLM på enheden

Seeed Studios nye AI-kamera bruger Rockchip RV1126B med 3 TOPS NPU til on-device vision, men understøtter også LLM, VLM, STT og TTS workloads. Enheden demonstrerer voksende integration af AI i edge-enheder.

Kilder: CNX Software

recamera-proedge-aicomputer-visionrockchip

On-chain obligationsmarked hvor udstedere er AI-agenter

Et nyt eksperimentelt protokol, sellbonds.now, lader AI-agenter udstede gæld og låne USDC on-chain. Projektet demonstrerer konceptet om "agentic autonomous finance" hvor AI-agenter agerer som selvstændige finansielle aktører.

Kilder: Hacker News

ai-agentsdefiautonomous-finance

NVIDIA NeMo Automodel og 🤗 Diffusers til skaleret finetuning

NVIDIA har udgivet en guide til at finetune video- og imagemodeller i stor skala ved hjælp af NeMo Automodel integreret med Hugging Face Diffusers.

Kilder: Hugging Face

nvidia-nemodiffusersfine-tuningscalability

Privat lokal AI på NVIDIA DGX Spark med Ollama

En vejledning til at hoste private lokale AI-modeller på NVIDIA's nye DGX Spark desktop-enhed med 748GB RAM. Sætningen erstatter dyre enterprise cloud AI-abonnementer med lokal inference.

Kilder: geeky-gadgets.com

local-aiollamaopen-webuinvidia-dgx-spark

Brugererfaring: Bonsai-Ternary-27B på 4060Ti 16GB

En bruger deler erfaringer med at køre Bonsai-Ternary-27B på et relativt beskedent setup med 4060Ti 16GB til knowledge management og produktivitetsopgaver. Modellen håndterer komplekse workflows inklusiv Obsidian-integration og projektstyring.

Kilder: r/LocalLLaMA

bonsai-ternary-27blocal-llmproductivity

Monotype lancerer MCP-stik til AI-styret skrifttypehåndtering

Virksomheder kan nu integrere brand-godkendte fonte og licenskontrol direkte i AI-workflows via Monotypes nye connector.

Kilder: TechEdgeAI

mcpenterprise-aitypographymonotype

1 million kontekst på en RTX 5090 med DeepSeek V4 Flash

DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er stadig plads til optimering.

Kilder: r/LocalLLaMA

deepseek-v4-flashllama.cpprtx-5090local-llm

Alice AI opdateret til version 26.17.1

Alice AI har fået en ny opdatering (26.17.1) til Android. Det er en rutineopdatering af stemmeassistenten.

Kilder: APKMirror

alice-aiandroidapk

6x3090 vs 8x3090: Er opgraderingen værd?

En bruger overvejer at gå fra seks til otte RTX 3090'ere via en PCIe-splitter for at køre DeepSeek Flash V4 i Q8 med stor kontekst. Nytteværdien er tvivlsom, da to kort ville køre på 8x PCIe-båndbredde.

Kilder: r/LocalLLaMA

3090multi-gpulocal-llmpcie

TinyMCE AI afslører sin LLM-gateway-arkitektur

TinyMCE's AI-lag bruger en gateway til at afkoble teksteditoren fra LLM-udbydere, med model-routing, prompt-orchestrering og JWT-baserede tilladelser. Det giver fleksibel og sikker integration uden at binde sig til én model.

Kilder: TinyMCE

tinymcellm-gatewaymodel-routingjwt

Branche & politik

Moonshot AI roses for ærlig lancering af Kimi K3

Kimi K3-teamet skrev i deres lancering, at modellen stadig halter efter de stærkeste proprietære modeller. Denne sjældne ærlighed i AI-lanceringer modtager stor respekt fra fællesskabet.

Kilder: r/LocalLLaMA

kimi-k3transparencymoonshot-aibenchmark-honesty

Axios: Kina har udslettet USA's AI-førsteplads

Med Kimi K3's lancering hævder Axios, at Kina nu matcher amerikanske frontier-modeller med open-weights tilgængelighed. Udviklingen udfordrer den traditionelle opfattelse af amerikansk AI-dominans.

Kilder: r/LocalLLaMA

china-aiusa-leadopen-weightskimi-k3

Spørgsmål om fremtidens tilgængelige open-source modeller

Med modeller som Kimi K3 (2.8T) og Inkling (975B) krævende dyrt hardware stilles spørgsmålstegn ved, om der stadig vil blive frigivet mindre 20B-120B modeller. Hvis kun institutioner med adskillige B300'er eller PRO 6000'er kan køre modellerne, risikerer individers adgang at forsvinde.

Kilder: r/LocalLLaMA

open-weightsaccessibilityhardware-requirementschinese-labs

Mira Murati: Ny Inkling-model adresserer virksomhedernes IP-bekymringer

I kølvandet på advarsler fra Microsofts Satya Nadella og Palantirs Alex Karp om virksomheders IP-afgivelse lancerer Thinking Machines Lab en open-weight løsning designet til enterprise-finetuning.

Kilder: Benzinga · også: Firstpost

inklingip-protectionenterprise-aithinking-machines-lab

Forbes: AI omskriver "det menneskelige operativsystem" – men hype overhaler virkeligheden

Spredningskurven for AI-teknologi komprimeres til få år, men artiklen advarer om, at hypen stadig overgår, hvad LLM'er reelt kan levere.

Kilder: Forbes

ai-adoptionhype-cyclediffusion

XPengs nye L03-SUV udfordrer Tesla og BMW med LLM-styring

Den kinesiske elbil XPeng Mona L03 får LLM-baserede stemmestyringer og semiautonom kørsel til en pris omkring 280.000 kr. Den viser, hvordan store sprogmodeller integreres direkte i forbrugerprodukter.

Kilder: motortrend.com

xpengmona-l03evllm

Dagens signal: Kinas åbne vægte-model rykker grænserne for, hvad open-source kan, mens vestlige værktøjer fokuserer på sikker infrastruktur.