News-Tracker

Søgning

AI & LLM · daglig briefing


5 research-rapport(er) for »coding«

hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting

… Best open coding model for 128GB RAM? [2026]](https://www.reddit.com/r/LocalLLaMA/comments/1qawd0z/best_open_coding_model_for_128gb_ram_2026 …

fredag 7. august 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Der er heller ingen uafhængige målinger, der bekræfter [8]'s påstand om, at Qwen 3.6 27B "outperformed a 397B model on coding benchmarks …

fredag 7. august 2026 · research

Qwen 3.8 27b

… Flagship-Level Coding in a 27B Dense Model](https://qwen.ai/blog?id=qwen3.6-27b) 6. [Qwen3.6 - How to Run Locally | Unsloth …

mandag 3. august 2026 · research

Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?

… this-year-170000070.html) 4. [Anthropic bolsters AI model Claude's coding, agentic abilities with Opus 4.5](https://finance.yahoo.com/news/anthropic …

torsdag 30. juli 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Her anbefales Qwen3.6-27B dense til "real coding agent work" på en enkelt 24GB GPU (RTX 3090Ti). Kilden angiver, at Qwen3.6-27B …

torsdag 30. juli 2026 · research

50 briefing-resultat(er) for »coding«

Real-SWE: Nyt benchmark tester AI på private virksomhedskodebaser

Benchmarket evaluerer modeller på rigtige, private enterprise-kodebaser frem for syntetiske opgaver. Diskuteres på Hacker News og r/LocalLLaMA.

søndag 13. september 2026 · Forskning & arkitektur real-swebenchmarkenterprise-codecoding-agents

Opfølgning: Er Qwen-Next ringere end 3.8 27B til kodning?

Bruger på M5 Max finder, at Qwen 3.8 27B q8 klarer svære kodetasks bedre end Qwen-Next. Flere oplever samme tendens. [briefingen 29 …

lørdag 12. september 2026 · Værktøjer & produkter qwen-nextqwen-3.8codinglocal-llm

Qwen 3.8 vinder jobsamtale: Slår GLM Flash i kodetest

En bruger fortæller, at Qwen 3.8 kørte lokalt og klarede en kodningssamtale bedre end GLM Flash via OpenRouter. Modellen skrev tests og løste …

torsdag 10. september 2026 · Forskning & arkitektur qwen-3.8local-llmcodinginterview

Udvikler: Modellerne er fine, værktøjerne er problemet

En erfaren udvikler beskriver, hvordan AI-harness og konteksthåndtering skaber en 'slop-spiral' med bugs. Han mener, at modeller som Qwen3.8-27B er …

tirsdag 8. september 2026 · Værktøjer & produkter coding-agentstoolingdeveloper-experienceqwen-3.8

OpenAI afslører intern forskningsacceleration og RSI-dag

OpenAI har offentliggjort et indblik i deres interne brug af kodningsagenter og en markant stigning i AI-udgifter pr. forsker siden juli. Chief Scientist …

mandag 7. september 2026 · Forskning & arkitektur openairecursive-self-improvementcoding-agentsgpt-6-astra

Timnit Gebru: AI-coding gav depression og dårligere software

Timnit Gebru deler et blogindlæg, hvor AI-assisteret kodning fører til depression, apati og eksistentiel frygt – og værre software. Hun fremhæver også miljø- og …

søndag 6. september 2026 · 🗣️ Stemmer timnit-gebruai-codingdeveloper-wellbeing

OKF Agent Memory: git-baseret hukommelse til kodningsagenter

Nyt open source-projekt giver AI-kodningsagenter vedvarende, git-native hukommelse. Diskuteret på Hacker News.

søndag 6. september 2026 · Værktøjer & produkter agent-memorygitcoding-agents

Syv spørgsmål før AI-coding-udrulning

Artikel lister, hvad bestyrelser bør kræve svar på: dokumenteret værdi, afgrænset adgang, ansvarsplacering og stopbetingelser.

søndag 6. september 2026 · Branche & politik ai-codinggovernanceboard-risk

Guide: AI-genereret kode har forudsigelige sikkerhedshuller

Sårbarheder som injection og hardcodede hemmeligheder er typiske, og prompter uden eksplicitte sikkerhedskrav giver svagere kode. Tjeklisten hjælper udviklere med at lukke hullerne.

lørdag 5. september 2026 · Sikkerhed & jailbreaks ai-code-securityprompt-injectionsecure-codingchecklist

Meta lover Muse Spark 1.3 som svar på OpenAI og Anthropic

Meta siger, at selskabet nu har indhentet konkurrenterne med Muse Spark 1.3, der bruger ~20 % færre værktøjskald og ~25 % færre tokens end 1 …

fredag 4. september 2026 · Nye modeller muse-spark-1.3metaopen-weightscoding

Vision-støtte gør Qwen 3.8 27B til en bedre kodeassistent

Brugere på LocalLLaMA rapporterer, at vision-versionen af Qwen 3.8 27B automatisk tager screenshots for at verificere kode, hvilket reducerer stille fejl. Kører …

tirsdag 1. september 2026 · Værktøjer & produkter qwen-3.8visioncodingvlm

"Intelligence Density" – nyt mål for kodning pr. parameter

En aggregator på tværs af SWE-bench, DeepSWE, Terminal-Bench og Code Arena beregner hvor meget kodningsintelligens hver parameter leverer. Små modeller straffes for …

mandag 31. august 2026 · Forskning & arkitektur coding-benchmarksintelligence-densityswe-benchagentic-coding

Opfølgning: GLM-5.3 nu open-weight – 50% bedre kode og state-of-the-art på cyberexploits

ZAI har frigivet GLM-5.3 som åbne vægte: samme basismodel som 5.2, men post-træning giver markant bedre kodning og en uventet …

lørdag 29. august 2026 · Nye modeller glm-5.3open-weightscodingcyber-capability

Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090

Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.

onsdag 26. august 2026 · Nye modeller qwen3.8-27bquantizedthreejscoding

Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse

Ox Alpha er fortsat gratis og slår Claude Fable på kodning, men identiteten forbliver ukendt – Xiaomi og DeepSeek er blevet afskrevet som kilder. [briefingen …

tirsdag 25. august 2026 · Nye modeller ox-alphaopenroutermystery-modelcoding-benchmarks

Opfølgning: Qwen 3.6 bygger C-compiler autonomt

En bruger fik Qwen 3.6 27B til at kode en C99-compiler via et specialbygget harness med subagenter – en test af grænserne for …

tirsdag 25. august 2026 · Værktøjer & produkter qwenc-compileragentic-harnessautonomous-coding

Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse

Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om …

mandag 24. august 2026 · Nye modeller ox-alphaopenrouterstealth-modelcoding

Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes

En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans …

mandag 24. august 2026 · Værktøjer & produkter qwen3.8-27bhome-assistantlocal-llmcoding

Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?

En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C++, C# og Python – helst ucensureret til sikkerhedsarbejde – med svar på under …

mandag 24. august 2026 · Værktøjer & produkter coding-model6gb-vramlocal-llmuncensored

Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne

En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som …

mandag 24. august 2026 · Værktøjer & produkter qwen3.8-27bregulationcodingpreservation

Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port

En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML/three …

mandag 24. august 2026 · Forskning & arkitektur qwen3.8-27bcodingc-to-htmlbenchmark

Mysterie-modellen Ox Alpha slår GPT-5.6 Sol og Claude Fable 5 i kodning

En anonym model kaldet Ox Alpha er dukket op på OpenRouter og overgår angiveligt topmodeller som GPT-5.6 Sol og Claude Fable 5 …

søndag 23. august 2026 · Nye modeller ox-alphacodingopenroutergpt-5.6-solclaude-fable-5

Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning

Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …

søndag 23. august 2026 · Værktøjer & produkter qwen3.8-27bcodingquantcontextqwen3.6-27b

Ox Alpha – gratis stealth-model med 1M kontekst i en uge

Modellen, hvis oprindelse er ukendt, tilbydes gratis på tværs af OpenCode, Command Code og OpenRouter med 100T tokens/dag og nul datalagring.

lørdag 22. august 2026 · Nye modeller ox-alphastealth-modelfree-apicoding

Qwen3.8-27B Q6 kører 20 timers agentisk kode uden stop

På en RTX 3090 + RTX 3060 holdt modellen 60–63 tokens/s gennem et helt døgns målrettet arbejde. [Se tidligere dækning](/archive/2026-08 …

lørdag 22. august 2026 · Nye modeller qwen3.8-27bagentic-codingrtx-3090rtx-3060

Qwen3.8 27B i 3bit på MacBook Air: 63 timer – men flysimulatoren virkede

En bruger fik agentisk kode til at producere en flysimulator på en M2 med 24 GB. Google AI Studio klarede det på 20 minutter …

lørdag 22. august 2026 · Nye modeller qwen3.8-27bmacbook-air3bit-quantagentic-coding

Simon Willison: Linjer kode giver stadig mening som produktivitetsmål

Willison argumenterer for, at kodningsagenter reelt øger produktiviteten, men kræver senior-erfaring for at opretholde kvalitet.

fredag 21. august 2026 · 🗣️ Stemmer simon-willisoncoding-agentsproductivitylines-of-code

Bruger skifter fra Claude til lokal Qwen3.8 – 'jeg er fri'

En Reddit-bruger rapporterer at have erstattet Claude Pro med en lokal Qwen3.8-27B på en RTX 5090M, og oplever kun få kompromiser.

fredag 21. august 2026 · Værktøjer & produkter qwen-3.8local-llmclaudecoding

Qwen3.8-27B klarer sig dårligt på SlopCodeBench – god som copilot, ikke alene

Modellen scorer kun 17,6 % på strenge checkpoints og 13,3 % på sværere delmængder. Den kan løse problemer med klar retning, men ikke styre …

torsdag 20. august 2026 · Nye modeller qwen-3.8slopcodebenchcodingbenchmark

Hvem koder ikke på fuld auto med lokale LLMs? – debat på Reddit

En tråd spørger, hvor mange der stadig holder sig til manuelle eller semi-manuelle udviklingsworkflows. Svarene afslører skepsis over for at lade selv en …

torsdag 20. august 2026 · Værktøjer & produkter local-llmcodingworkflowmanual

Opfølgning: GLM-5.3 lanceret med 50% bedre kodning og cyber-capabilities

Z.ai's nye open-weight model GLM-5.3 hævdes at være "den hidtil dygtigste" til cybersecurity-opgaver, med 50% forbedring i kodning …

tirsdag 18. august 2026 · Nye modeller glm-5.3z-aicodingcybersecurityopen-weights

Opfølgning: Spil bygget i to prompts med Qwen 3.8 27B – kører på to RTX 3060

En bruger på Reddit byggede et komplet HTML/CSS/JS-spil med Qwen 3.8 27B i to prompts lokalt på to RTX 3060 …

tirsdag 18. august 2026 · Værktøjer & produkter qwen-3.8codinglocal-llmreddit

Lokal agentic coding benchmark: Qwen 3.8 27B medium reasoning er sweet spot

En omfattende benchmark viser at medium reasoning mode i Qwen 3.8 27B giver højest score med markant færre tokens end xhigh mode. Kører …

tirsdag 18. august 2026 · Forskning & arkitektur qwen-3.8agentic-codingbenchmarkreasoning-effort

Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest

En bruger-test med rekursiv trætegning i Python viser en "kæmpe" kvalitetsforskel mellem Qwen 3.6 og 3.8. Den nye model forstår komplekse …

mandag 17. august 2026 · Nye modeller qwen-3.827bqwen-3.6coding

Opfølgning: GLM-5.3 lanceret som 743-milliarder-parameter open-weights-model

Z.ai har lanceret GLM-5.3, en 743-milliarder-parameter open-weights-kodemodel, og vægtene kommer snart på Hugging Face. Udfordringen til de …

søndag 16. august 2026 · Nye modeller glm-5.3z-aiopen-weightscoding

Opfølgning: Qwen3.8-27B mestrer ray-tracer i BASIC – 3.6 gav op

I en agentisk BASIC-ray-tracer-test klarede 3.8 opgaven på egen hånd, hvor 3.6 krævede ekstra prompting. Det er et konkret …

søndag 16. august 2026 · Nye modeller qwen3.8-27bqwen3.6-27bagentic-harnesscoding

Qwen3.8-27B one-shot en Super Mario-klon lokalt

En lokal Q8-GGUF på Framework Desktop skrev en Super Mario-klon i ét forsøg. Langsom, men ekstremt kompetent til nattejobs – og MTP-varianter …

søndag 16. august 2026 · Nye modeller qwen3.8-27bggufcodinglocal-llm

Fællesskabet kortlægger: hvilken harness til Qwen 3.8-27B?

En afstemning i r/LocalLLaMA kortlægger, hvilke kode-harnesses der faktisk bruges til Qwen3.8-27B. Resultatet giver en de facto-anbefaling til nye …

søndag 16. august 2026 · Værktøjer & produkter harnessqwen3.8-27bcodinglocal-llm

GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning

Z.ai udgav GLM-5.3 uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE …

lørdag 15. august 2026 · Nye modeller glm-5.3z-aipost-trainingcoding

Hvad AI's historie kan lære os om kvantecomputingens fremtid

En analyse på SD Times trækker paralleller mellem AI-udviklingen og kvantecomputing, herunder Karpathys "vibe coding"-begreb. Samtidig diskuteres, hvordan universiteter bør håndtere AI …

onsdag 12. august 2026 · Forskning & arkitektur quantum-computinghistoryparallelskarpathy

Opfølgning: Tokenisering afslører Qwens kode-fordel over Gemma

Samme kode på 330 linjer blev til 1609 tokens i Qwen 35B mod 4258 i Gemma 26B. Qwen behandler kode som et specifikt inputformat …

søndag 9. august 2026 · Forskning & arkitektur tokenizationqwengemmacoding-performance

Opfølgning: Kimi K3 topper kodningsbenchmark som første kinesiske model

Moonshot AIs 2,8 billioner parameters model er open-weight og sætter nye standarder. Det lægger pres på prissætningen hos amerikanske frontløbere. Se [briefingen …

søndag 9. august 2026 · Nye modeller kimi-k3moonshot-aicoding-benchmarksopen-weights

Tencent open-sourcerer agenthukommelse med versionering og adgangsstyring

TencentDB Agent Memory v2.0 er en team-level memory hub, der strukturerer samtaler, kode og dokumenter i fire genbrugelige assets med ACL-baseret …

lørdag 8. august 2026 · Værktøjer & produkter tencentagent-memoryopen-sourcecoding-agents

Cloudflare open-sourcer platform til vibe-coding

Cloudflare har udgivet sin agent-platform som open source, så ikke-kodere kan bygge apps og workflows. Platformen sætter gang i en ny bølge …

fredag 7. august 2026 · Værktøjer & produkter cloudflarevibe-codingagentsopen-source

Meta lancerer Muse Code og Muse Spark 1.2 med fokus på kodning

Muse Spark 1.2 er optimeret til kodegenerering og debugging, og Muse Code er en terminalbaseret kodningsagent. Prisen er konkurrencedygtig med Gemini Flash.

torsdag 6. august 2026 · Nye modeller metamuse-sparkmuse-codecoding-agents

Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig

Andrej Karpathy fik Claude Opus 5 til at bygge en 3D-verden af Ringenes Herre på to timer for 10 dollars – 5.500 linjer …

tirsdag 4. august 2026 · 🗣️ Stemmer karpathyclaude-opus-5coding-benchmarkslord-of-the-rings

Hvorfor er næsten alle nye benchmarks kodningsfokuserede?

En debat på r/LocalLLaMA efterlyser flere benchmarks til sprogindlæring, kreativ skrivning og STEM-ræsonnement. Kodningsfokus risikerer at overse vigtige anvendelsesområder.

søndag 2. august 2026 · Forskning & arkitektur benchmarkcoding-biasmmlu-proevaluation

Bruger spørger: Bedste setup til lokal LLM på RTX 3090 og 48 GB RAM

Reddit-bruger søger stabilt OS og framework til coding og web-søgning på 24 GB VRAM. Ollama kørte langsomt, Unsloth var hurtigt men ustabilt.

søndag 26. juli 2026 · Værktøjer & produkter local-llmrtx-3090ollamaunsloth

Andrej Karpathy: Drop perfekte prompts – tal bare løs

AI-forskeren bag "vibe coding" anbefaler at tale frit til sprogmodeller i stedet for at forme omhyggelige instruktioner. Naturlig samtale giver ofte bedre svar.

lørdag 25. juli 2026 · 🗣️ Stemmer andrej-karpathypromptingvibe-coding

Gemma 4 opdateret – lokalt testet på M5 Pro med OpenCode

Den opdaterede Gemma 4 (26B A4B, Q6) kører med 60 t/s på en Apple M5 Pro og fungerer godt til backendkodning, men UI …

fredag 24. juli 2026 · Nye modeller gemma-4opencodelocal-llmcoding