Søgning
5 research-rapport(er) for »coding«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… Best open coding model for 128GB RAM? [2026]](https://www.reddit.com/r/LocalLLaMA/comments/1qawd0z/best_open_coding_model_for_128gb_ram_2026 …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Der er heller ingen uafhængige målinger, der bekræfter [8]'s påstand om, at Qwen 3.6 27B "outperformed a 397B model on coding benchmarks …
Qwen 3.8 27b
… Flagship-Level Coding in a 27B Dense Model](https://qwen.ai/blog?id=qwen3.6-27b) 6. [Qwen3.6 - How to Run Locally | Unsloth …
Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?
… this-year-170000070.html) 4. [Anthropic bolsters AI model Claude's coding, agentic abilities with Opus 4.5](https://finance.yahoo.com/news/anthropic …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Her anbefales Qwen3.6-27B dense til "real coding agent work" på en enkelt 24GB GPU (RTX 3090Ti). Kilden angiver, at Qwen3.6-27B …
50 briefing-resultat(er) for »coding«
Real-SWE: Nyt benchmark tester AI på private virksomhedskodebaser
Benchmarket evaluerer modeller på rigtige, private enterprise-kodebaser frem for syntetiske opgaver. Diskuteres på Hacker News og r/LocalLLaMA.
Opfølgning: Er Qwen-Next ringere end 3.8 27B til kodning?
Bruger på M5 Max finder, at Qwen 3.8 27B q8 klarer svære kodetasks bedre end Qwen-Next. Flere oplever samme tendens. [briefingen 29 …
Qwen 3.8 vinder jobsamtale: Slår GLM Flash i kodetest
En bruger fortæller, at Qwen 3.8 kørte lokalt og klarede en kodningssamtale bedre end GLM Flash via OpenRouter. Modellen skrev tests og løste …
Udvikler: Modellerne er fine, værktøjerne er problemet
En erfaren udvikler beskriver, hvordan AI-harness og konteksthåndtering skaber en 'slop-spiral' med bugs. Han mener, at modeller som Qwen3.8-27B er …
OpenAI afslører intern forskningsacceleration og RSI-dag
OpenAI har offentliggjort et indblik i deres interne brug af kodningsagenter og en markant stigning i AI-udgifter pr. forsker siden juli. Chief Scientist …
Timnit Gebru: AI-coding gav depression og dårligere software
Timnit Gebru deler et blogindlæg, hvor AI-assisteret kodning fører til depression, apati og eksistentiel frygt – og værre software. Hun fremhæver også miljø- og …
OKF Agent Memory: git-baseret hukommelse til kodningsagenter
Nyt open source-projekt giver AI-kodningsagenter vedvarende, git-native hukommelse. Diskuteret på Hacker News.
Syv spørgsmål før AI-coding-udrulning
Artikel lister, hvad bestyrelser bør kræve svar på: dokumenteret værdi, afgrænset adgang, ansvarsplacering og stopbetingelser.
Guide: AI-genereret kode har forudsigelige sikkerhedshuller
Sårbarheder som injection og hardcodede hemmeligheder er typiske, og prompter uden eksplicitte sikkerhedskrav giver svagere kode. Tjeklisten hjælper udviklere med at lukke hullerne.
Meta lover Muse Spark 1.3 som svar på OpenAI og Anthropic
Meta siger, at selskabet nu har indhentet konkurrenterne med Muse Spark 1.3, der bruger ~20 % færre værktøjskald og ~25 % færre tokens end 1 …
Vision-støtte gør Qwen 3.8 27B til en bedre kodeassistent
Brugere på LocalLLaMA rapporterer, at vision-versionen af Qwen 3.8 27B automatisk tager screenshots for at verificere kode, hvilket reducerer stille fejl. Kører …
"Intelligence Density" – nyt mål for kodning pr. parameter
En aggregator på tværs af SWE-bench, DeepSWE, Terminal-Bench og Code Arena beregner hvor meget kodningsintelligens hver parameter leverer. Små modeller straffes for …
Opfølgning: GLM-5.3 nu open-weight – 50% bedre kode og state-of-the-art på cyberexploits
ZAI har frigivet GLM-5.3 som åbne vægte: samme basismodel som 5.2, men post-træning giver markant bedre kodning og en uventet …
Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090
Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha er fortsat gratis og slår Claude Fable på kodning, men identiteten forbliver ukendt – Xiaomi og DeepSeek er blevet afskrevet som kilder. [briefingen …
Opfølgning: Qwen 3.6 bygger C-compiler autonomt
En bruger fik Qwen 3.6 27B til at kode en C99-compiler via et specialbygget harness med subagenter – en test af grænserne for …
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om …
Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes
En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans …
Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?
En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C++, C# og Python – helst ucensureret til sikkerhedsarbejde – med svar på under …
Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne
En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som …
Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port
En udvikler testede Qwen 3.8 27B mod Opus 5 på at porte et 39.000-linjers C-spil til single-file HTML/three …
Mysterie-modellen Ox Alpha slår GPT-5.6 Sol og Claude Fable 5 i kodning
En anonym model kaldet Ox Alpha er dukket op på OpenRouter og overgår angiveligt topmodeller som GPT-5.6 Sol og Claude Fable 5 …
Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning
Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …
Ox Alpha – gratis stealth-model med 1M kontekst i en uge
Modellen, hvis oprindelse er ukendt, tilbydes gratis på tværs af OpenCode, Command Code og OpenRouter med 100T tokens/dag og nul datalagring.
Qwen3.8-27B Q6 kører 20 timers agentisk kode uden stop
På en RTX 3090 + RTX 3060 holdt modellen 60–63 tokens/s gennem et helt døgns målrettet arbejde. [Se tidligere dækning](/archive/2026-08 …
Qwen3.8 27B i 3bit på MacBook Air: 63 timer – men flysimulatoren virkede
En bruger fik agentisk kode til at producere en flysimulator på en M2 med 24 GB. Google AI Studio klarede det på 20 minutter …
Simon Willison: Linjer kode giver stadig mening som produktivitetsmål
Willison argumenterer for, at kodningsagenter reelt øger produktiviteten, men kræver senior-erfaring for at opretholde kvalitet.
Bruger skifter fra Claude til lokal Qwen3.8 – 'jeg er fri'
En Reddit-bruger rapporterer at have erstattet Claude Pro med en lokal Qwen3.8-27B på en RTX 5090M, og oplever kun få kompromiser.
Qwen3.8-27B klarer sig dårligt på SlopCodeBench – god som copilot, ikke alene
Modellen scorer kun 17,6 % på strenge checkpoints og 13,3 % på sværere delmængder. Den kan løse problemer med klar retning, men ikke styre …
Hvem koder ikke på fuld auto med lokale LLMs? – debat på Reddit
En tråd spørger, hvor mange der stadig holder sig til manuelle eller semi-manuelle udviklingsworkflows. Svarene afslører skepsis over for at lade selv en …
Opfølgning: GLM-5.3 lanceret med 50% bedre kodning og cyber-capabilities
Z.ai's nye open-weight model GLM-5.3 hævdes at være "den hidtil dygtigste" til cybersecurity-opgaver, med 50% forbedring i kodning …
Opfølgning: Spil bygget i to prompts med Qwen 3.8 27B – kører på to RTX 3060
En bruger på Reddit byggede et komplet HTML/CSS/JS-spil med Qwen 3.8 27B i to prompts lokalt på to RTX 3060 …
Lokal agentic coding benchmark: Qwen 3.8 27B medium reasoning er sweet spot
En omfattende benchmark viser at medium reasoning mode i Qwen 3.8 27B giver højest score med markant færre tokens end xhigh mode. Kører …
Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest
En bruger-test med rekursiv trætegning i Python viser en "kæmpe" kvalitetsforskel mellem Qwen 3.6 og 3.8. Den nye model forstår komplekse …
Opfølgning: GLM-5.3 lanceret som 743-milliarder-parameter open-weights-model
Z.ai har lanceret GLM-5.3, en 743-milliarder-parameter open-weights-kodemodel, og vægtene kommer snart på Hugging Face. Udfordringen til de …
Opfølgning: Qwen3.8-27B mestrer ray-tracer i BASIC – 3.6 gav op
I en agentisk BASIC-ray-tracer-test klarede 3.8 opgaven på egen hånd, hvor 3.6 krævede ekstra prompting. Det er et konkret …
Qwen3.8-27B one-shot en Super Mario-klon lokalt
En lokal Q8-GGUF på Framework Desktop skrev en Super Mario-klon i ét forsøg. Langsom, men ekstremt kompetent til nattejobs – og MTP-varianter …
Fællesskabet kortlægger: hvilken harness til Qwen 3.8-27B?
En afstemning i r/LocalLLaMA kortlægger, hvilke kode-harnesses der faktisk bruges til Qwen3.8-27B. Resultatet giver en de facto-anbefaling til nye …
GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning
Z.ai udgav GLM-5.3 uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE …
Hvad AI's historie kan lære os om kvantecomputingens fremtid
En analyse på SD Times trækker paralleller mellem AI-udviklingen og kvantecomputing, herunder Karpathys "vibe coding"-begreb. Samtidig diskuteres, hvordan universiteter bør håndtere AI …
Opfølgning: Tokenisering afslører Qwens kode-fordel over Gemma
Samme kode på 330 linjer blev til 1609 tokens i Qwen 35B mod 4258 i Gemma 26B. Qwen behandler kode som et specifikt inputformat …
Opfølgning: Kimi K3 topper kodningsbenchmark som første kinesiske model
Moonshot AIs 2,8 billioner parameters model er open-weight og sætter nye standarder. Det lægger pres på prissætningen hos amerikanske frontløbere. Se [briefingen …
Tencent open-sourcerer agenthukommelse med versionering og adgangsstyring
TencentDB Agent Memory v2.0 er en team-level memory hub, der strukturerer samtaler, kode og dokumenter i fire genbrugelige assets med ACL-baseret …
Cloudflare open-sourcer platform til vibe-coding
Cloudflare har udgivet sin agent-platform som open source, så ikke-kodere kan bygge apps og workflows. Platformen sætter gang i en ny bølge …
Meta lancerer Muse Code og Muse Spark 1.2 med fokus på kodning
Muse Spark 1.2 er optimeret til kodegenerering og debugging, og Muse Code er en terminalbaseret kodningsagent. Prisen er konkurrencedygtig med Gemini Flash.
Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig
Andrej Karpathy fik Claude Opus 5 til at bygge en 3D-verden af Ringenes Herre på to timer for 10 dollars – 5.500 linjer …
Hvorfor er næsten alle nye benchmarks kodningsfokuserede?
En debat på r/LocalLLaMA efterlyser flere benchmarks til sprogindlæring, kreativ skrivning og STEM-ræsonnement. Kodningsfokus risikerer at overse vigtige anvendelsesområder.
Bruger spørger: Bedste setup til lokal LLM på RTX 3090 og 48 GB RAM
Reddit-bruger søger stabilt OS og framework til coding og web-søgning på 24 GB VRAM. Ollama kørte langsomt, Unsloth var hurtigt men ustabilt.
Andrej Karpathy: Drop perfekte prompts – tal bare løs
AI-forskeren bag "vibe coding" anbefaler at tale frit til sprogmodeller i stedet for at forme omhyggelige instruktioner. Naturlig samtale giver ofte bedre svar.
Gemma 4 opdateret – lokalt testet på M5 Pro med OpenCode
Den opdaterede Gemma 4 (26B A4B, Q6) kører med 60 t/s på en Apple M5 Pro og fungerer godt til backendkodning, men UI …