Søgning
5 research-rapport(er) for »coding-model«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… Best open coding model for 128GB RAM? [2026]](https://www.reddit.com/r/LocalLLaMA/comments/1qawd0z/best_open_coding_model_for_128gb_ram_2026 …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Der er heller ingen uafhængige målinger, der bekræfter [8]'s påstand om, at Qwen 3.6 27B "outperformed a 397B model on coding benchmarks …
Qwen 3.8 27b
… Flagship-Level Coding in a 27B Dense Model](https://qwen.ai/blog?id=qwen3.6-27b) 6. [Qwen3.6 - How to Run Locally | Unsloth …
Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?
… opus-5-model-as-company-preps-for-ipo-later-this-year-170000070.html) 4. [Anthropic bolsters AI model Claude's coding, agentic abilities with …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… releases-ai-models-that-can-control-pcs-and-phones/) 9. [Qwen3-Coder-Next: The Complete 2026 Guide to Running Powerful AI Coding Agents Locally …
24 briefing-resultat(er) for »coding-model«
Real-SWE: Nyt benchmark tester AI på private virksomhedskodebaser
Benchmarket evaluerer modeller på rigtige, private enterprise-kodebaser frem for syntetiske opgaver. Diskuteres på Hacker News og r/LocalLLaMA.
Qwen 3.8 vinder jobsamtale: Slår GLM Flash i kodetest
… lokalt og klarede en kodningssamtale bedre end GLM Flash via OpenRouter. Modellen skrev tests og løste opgaven, før GLM overhovedet var færdig. [Opfølgning: se …
Udvikler: Modellerne er fine, værktøjerne er problemet
… Han mener, at modeller som Qwen3.8-27B er gode nok, men værktøjerne halter.
OpenAI afslører intern forskningsacceleration og RSI-dag
… Chief Scientist Jakub Pachocki beskriver modellen som et "fremmed sind".
"Intelligence Density" – nyt mål for kodning pr. parameter
… Små modeller straffes for ikke at kunne autonomt arbejde.
Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090
Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha er fortsat gratis og slår Claude Fable på kodning, men identiteten forbliver ukendt – Xiaomi og DeepSeek er blevet afskrevet som kilder. [briefingen …
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om …
Opfølgning: Qwen 3.8 27B får bruger til at nuke OpenWebUI – og lykkes
En frustreret bruger fik endelig Qwen 3.8 27B til at køre lokalt efter at have nulstillet sin docker-konfiguration – nu styrer modellen hans …
Bedste kodningsmodel til 6 GB VRAM og 64 GB RAM?
En bruger med begrænset hardware søger en pålidelig lokal kodningsmodel til C, C++, C# og Python – helst ucensureret til sikkerhedsarbejde – med svar på under …
Qwen 3.8 27B vs. Opus 5: 39.000 linjer C til HTML-port
… porte et 39.000-linjers C-spil til single-file HTML/three.js – kun Opus leverede et "okay" resultat; lokale modeller fejlede uanset harness.
Mysterie-modellen Ox Alpha slår GPT-5.6 Sol og Claude Fable 5 i kodning
En anonym model kaldet Ox Alpha er dukket op på OpenRouter og overgår angiveligt topmodeller som GPT-5.6 Sol og Claude Fable 5 …
Ox Alpha – gratis stealth-model med 1M kontekst i en uge
Modellen, hvis oprindelse er ukendt, tilbydes gratis på tværs af OpenCode, Command Code og OpenRouter med 100T tokens/dag og nul datalagring.
Qwen3.8-27B Q6 kører 20 timers agentisk kode uden stop
På en RTX 3090 + RTX 3060 holdt modellen 60–63 tokens/s gennem et helt døgns målrettet arbejde. [Se tidligere dækning](/archive/2026-08 …
Qwen3.8-27B klarer sig dårligt på SlopCodeBench – god som copilot, ikke alene
Modellen scorer kun 17,6 % på strenge checkpoints og 13,3 % på sværere delmængder. Den kan løse problemer med klar retning, men ikke styre …
Hvem koder ikke på fuld auto med lokale LLMs? – debat på Reddit
… Svarene afslører skepsis over for at lade selv en 9B-model køre frit.
Opfølgning: GLM-5.3 lanceret med 50% bedre kodning og cyber-capabilities
Z.ai's nye open-weight model GLM-5.3 hævdes at være "den hidtil dygtigste" til cybersecurity-opgaver, med 50% forbedring i kodning …
Qwen 3.8 27B knuser 3.6 i kodeopgaver – Turtle-grafik som lakmustest
… Den nye model forstår komplekse instruktioner markant bedre.
Opfølgning: GLM-5.3 lanceret som 743-milliarder-parameter open-weights-model
Z.ai har lanceret GLM-5.3, en 743-milliarder-parameter open-weights-kodemodel, og vægtene kommer snart på Hugging Face. Udfordringen til de …
GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning
… uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE og finder 1.097 kritiske sårbarheder.
Opfølgning: Kimi K3 topper kodningsbenchmark som første kinesiske model
Moonshot AIs 2,8 billioner parameters model er open-weight og sætter nye standarder. Det lægger pres på prissætningen hos amerikanske frontløbere. Se [briefingen …
Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig
… Han påpeger, at test af AI-modeller er gået fra simple prompts til kompleks software engineering, men at modellerne stadig mangler evnen til selv …
Opfølgning: Laguna S 2.1 får rettet reasoning-mode – community finder fejl i chat-template
… reasoning-fasen ikke startede. Løsningen var at sammenligne med Qwens template. Modellen er fortsat Vestens stærkeste open-weight-kodningsmodel. [briefingen 22. juli](/archive/2026 …
Poolside udgiver Laguna S 2.1 – en open-weight kodningsmodel med imponerende ydeevne
Poolside lancerer Laguna S 2.1, en 118B MoE-model med kun 8B aktive parametre. Den matcher langt større modeller på SWE-Bench og …