Nye modeller
Moonshot AI frigiver Kimi K3 med 2,8 billioner parametre
Morgan Stanley-analytikere kalder K3 et vendepunkt for kinesiske LLMs, der nu matcher amerikanske ledere i modelstørrelse, ydeevne og pris. Modellen imponerer udviklere med stærke kodeegenskaber og lave API-omkostninger, og den åbne vægtstrategi skaber pres på Silicon Valley.
Kilder: Investing.com · MLQ News · TrilogyAI · også: Simon Willison · Fortune · Kimi K2 · The Hindu · SquaredTech · Big News Network · Business Standard · Business Insider · Business Insider · Cryptobriefing · Graphify Guides · ZeroHedge
Thinking Machines Lab frigiver Inkling open-weights model
Mira Muratis nye laboratorium lancerer Inkling med 975B totale parametre (41B aktive) som Apache-2.0 licenseret multimodal model. Modellen er ikke frontier-niveau, men designet som stærk base for finetuning via deres Tinker-platform.
Kilder: Simon Willison · Techzine Global · også: Msukhareva Substack
Soofi S: Ny europæisk open source-model med 30B parametre
En ny europæisk open source-model er dukket op med 30 milliarder parametre (30B-A3B). Modellen er lokalt kørbar og kommer med et par tænkende preview-versioner. Det er stadig tidlige dage, men viser en ny aktør på det europæiske AI-kort.
Kilder: Reddit LocalLLaMA
Kimi K3 slår Claude Sonnet 5 på Simple Bench
Kimi K3 (max) har demonstreret overlegen performance ved at slå Claude Sonnet 5 på Simple Bench. Resultatet understøtter Moonshot AI's påstande om, at modellen kan konkurrere med de førende amerikanske modeller.
Kilder: r/LocalLLaMA
Bonsai 27B kører lokalt på iPhone i kun 3,9GB
PrismML har bygget Bonsai ved at kvantisere Qwen3.6-27B ned til 1-bit, hvilket reducerer størrelsen fra ~54GB til 3,9GB. Modellen bevarer ~90% af benchmark-scores og kører på iPhone 15 Pro Max med 8GB RAM.
Kilder: r/LocalLLaMA · også: r/LocalLLaMA
Længsel efter nye små sprogmodeller
Siden april er der ikke kommet nye udgaver af Gemma eller Qwen, og communityet spørger, hvornår næste bølge af kompakte LLM'er lander.
Kilder: r/LocalLLaMA
Forskning & arkitektur
SEED: Ny metode til agent-baseret reinforcement learning
Forskere introducerer SEED, der konverterer afsluttede trajektorier til "hindsight skills" og distillerer adfærd tilbage til policy-modellen. Metoden adresserer supervisionsgabet mellem episode-level belønninger og token-level læring.
Kilder: arXiv
Ny teknik muliggør long-context finetuning med begrænset VRAM
Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med 4-bit QLoRA når metoden 16.384 tokens med 15,28 GB VRAM.
Kilder: arXiv
Kan RAID0 af SSD'er erstatte VRAM til lokal LLM-inference?
En bruger undersøger, om kombinationen af mange hurtige SSD'er i RAID0 kan give tilstrækkelig båndbredde til at køre store modeller lokalt. Metoden kunne være en billigere alternativ til dyrt VRAM, men latency og overhead er ukendte faktorer.
Kilder: r/LocalLLaMA
Analyse: Hvad pelican benchmark afslører om Kimi K3
En teknisk gennemgang undersøger Kimi K3's præstationer på pelican benchmark og hvad resultaterne fortæller om modellens styrker og begrænsninger sammenlignet med konkurrenterne.
Kilder: Hacker News
Kimi K3 nægter at lække sin system prompt
Et eksempel viser Kimi K3's svar når den bliver bedt om at afsløre sin system prompt: "Is there something I can actually help you with today?" Modellen afviser høfligt men bestemt.
Kilder: Simon Willison
Claude Platform Docs opdateret med modeloversigt
Anthropic har opdateret dokumentationen med en oversigt over tilgængelige Claude-modeller og deres performance-sammenligninger.
Kilder: platform.claude.com
Sikkerhed & jailbreaks
Meta's tilsynsråd afslører at førende AI-modeller undgår kritik af autoritære regimer
En undersøgelse fra Meta's Oversight Board viser, at populære AI-modeller fra Anthropic, DeepSeek, Google, Meta og OpenAI markant sjældnere kritiserer regeringer og ledere kendt for at begrænse ytringsfrihed. Modellerne har altså en indbygget politisk bias.
Kilder: The Verge · også: The Verge
Kritik: Claude Code er en "misfeature"
En analyse peger på fundamentale problemer med Claude Code fra Anthropic, og hvordan designvalg kan skabe utilsigtede problemer for udviklere. Artiklen undersøger de underliggende årsager til modellens problematiske adfærd.
Kilder: Hacker News
Værktøjer & produkter
NotebookLM skifter navn til Gemini Notebook
Googles AI-noteværktøj NotebookLM omdøbes til Gemini Notebook som del af produktkonsolidering. Navneskiftet afspejler Googles strategi om at samle AI-værktøjer under Gemini-brandet.
Kilder: Hacker News
reCamera Pro kombinerer computer vision med LLM/VLM på enheden
Seeed Studios nye AI-kamera bruger Rockchip RV1126B med 3 TOPS NPU til on-device vision, men understøtter også LLM, VLM, STT og TTS workloads. Enheden demonstrerer voksende integration af AI i edge-enheder.
Kilder: CNX Software
On-chain obligationsmarked hvor udstedere er AI-agenter
Et nyt eksperimentelt protokol, sellbonds.now, lader AI-agenter udstede gæld og låne USDC on-chain. Projektet demonstrerer konceptet om "agentic autonomous finance" hvor AI-agenter agerer som selvstændige finansielle aktører.
Kilder: Hacker News
NVIDIA NeMo Automodel og 🤗 Diffusers til skaleret finetuning
NVIDIA har udgivet en guide til at finetune video- og imagemodeller i stor skala ved hjælp af NeMo Automodel integreret med Hugging Face Diffusers.
Kilder: Hugging Face
Privat lokal AI på NVIDIA DGX Spark med Ollama
En vejledning til at hoste private lokale AI-modeller på NVIDIA's nye DGX Spark desktop-enhed med 748GB RAM. Sætningen erstatter dyre enterprise cloud AI-abonnementer med lokal inference.
Kilder: geeky-gadgets.com
Brugererfaring: Bonsai-Ternary-27B på 4060Ti 16GB
En bruger deler erfaringer med at køre Bonsai-Ternary-27B på et relativt beskedent setup med 4060Ti 16GB til knowledge management og produktivitetsopgaver. Modellen håndterer komplekse workflows inklusiv Obsidian-integration og projektstyring.
Kilder: r/LocalLLaMA
Monotype lancerer MCP-stik til AI-styret skrifttypehåndtering
Virksomheder kan nu integrere brand-godkendte fonte og licenskontrol direkte i AI-workflows via Monotypes nye connector.
Kilder: TechEdgeAI
1 million kontekst på en RTX 5090 med DeepSeek V4 Flash
DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er stadig plads til optimering.
Kilder: r/LocalLLaMA
Alice AI opdateret til version 26.17.1
Alice AI har fået en ny opdatering (26.17.1) til Android. Det er en rutineopdatering af stemmeassistenten.
Kilder: APKMirror
6x3090 vs 8x3090: Er opgraderingen værd?
En bruger overvejer at gå fra seks til otte RTX 3090'ere via en PCIe-splitter for at køre DeepSeek Flash V4 i Q8 med stor kontekst. Nytteværdien er tvivlsom, da to kort ville køre på 8x PCIe-båndbredde.
Kilder: r/LocalLLaMA
TinyMCE AI afslører sin LLM-gateway-arkitektur
TinyMCE's AI-lag bruger en gateway til at afkoble teksteditoren fra LLM-udbydere, med model-routing, prompt-orchestrering og JWT-baserede tilladelser. Det giver fleksibel og sikker integration uden at binde sig til én model.
Kilder: TinyMCE
Branche & politik
Moonshot AI roses for ærlig lancering af Kimi K3
Kimi K3-teamet skrev i deres lancering, at modellen stadig halter efter de stærkeste proprietære modeller. Denne sjældne ærlighed i AI-lanceringer modtager stor respekt fra fællesskabet.
Kilder: r/LocalLLaMA
Axios: Kina har udslettet USA's AI-førsteplads
Med Kimi K3's lancering hævder Axios, at Kina nu matcher amerikanske frontier-modeller med open-weights tilgængelighed. Udviklingen udfordrer den traditionelle opfattelse af amerikansk AI-dominans.
Kilder: r/LocalLLaMA
Spørgsmål om fremtidens tilgængelige open-source modeller
Med modeller som Kimi K3 (2.8T) og Inkling (975B) krævende dyrt hardware stilles spørgsmålstegn ved, om der stadig vil blive frigivet mindre 20B-120B modeller. Hvis kun institutioner med adskillige B300'er eller PRO 6000'er kan køre modellerne, risikerer individers adgang at forsvinde.
Kilder: r/LocalLLaMA
Mira Murati: Ny Inkling-model adresserer virksomhedernes IP-bekymringer
I kølvandet på advarsler fra Microsofts Satya Nadella og Palantirs Alex Karp om virksomheders IP-afgivelse lancerer Thinking Machines Lab en open-weight løsning designet til enterprise-finetuning.
Kilder: Benzinga · også: Firstpost
Forbes: AI omskriver "det menneskelige operativsystem" – men hype overhaler virkeligheden
Spredningskurven for AI-teknologi komprimeres til få år, men artiklen advarer om, at hypen stadig overgår, hvad LLM'er reelt kan levere.
Kilder: Forbes
XPengs nye L03-SUV udfordrer Tesla og BMW med LLM-styring
Den kinesiske elbil XPeng Mona L03 får LLM-baserede stemmestyringer og semiautonom kørsel til en pris omkring 280.000 kr. Den viser, hvordan store sprogmodeller integreres direkte i forbrugerprodukter.
Kilder: motortrend.com
Dagens signal: Kinas åbne vægte-model rykker grænserne for, hvad open-source kan, mens vestlige værktøjer fokuserer på sikker infrastruktur.