News-Tracker

Søgning

AI & LLM · daglig briefing


9 research-rapport(er) for »reddit«

hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting

… How do 120B models work?](https://www.reddit.com/r/LocalLLaMA/comments/1d5ug1t/how_do_120b_models_work/) 12. [r/LocalLLaMA on Reddit: I …

fredag 7. august 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Actual comparison between locally ran Qwen-3.6-27B and proprietary models](https://www.reddit.com/r/LocalLLaMA/comments/1szv6z0/actual_comparison_between_locally …

fredag 7. august 2026 · research

Qwen 3.8 27b

… Kilderne er overvejende engelsksprogede og stammer primært fra amerikanske platforme (Hugging Face, Reddit, X), hvilket giver et potentielt vestligt bias i dækningen. Priserne for …

mandag 3. august 2026 · research

Qwen 3.8 27b

## Hvad der skete Ifølge [1] (Reddit, r/LocalLLaMA) efterlyser en bruger Qwen3.8 i størrelserne 27B, 35B, 122B og 397B. Brugeren skriver, at ”the …

mandag 3. august 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… I ran Qwen 3.6 locally for 45 days, here are the results](https://www.reddit.com/r/LocalLLM/comments/1uyukbe/i_ran_qwen …

torsdag 30. juli 2026 · research

Iphone air 2 dual speakers

… undvære, er den anden højttaler” [2]. - **TechRadar** (juni 2026) rapporterer, at Reddit-brugere peger på ”den enlige højttaler” som et problem, som de ønsker …

onsdag 29. juli 2026 · research

Mac Studio M5, rygter, Pris, Specs og release dato

… Configuration & Price Projections](https://www.reddit.com/r/MacStudio/comments/1t95dcg/apple_mac_studio_m5_series_configuration_price/) 12. [Mac Studio: Should You Buy …

tirsdag 28. juli 2026 · research

Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?

… M6 Memory Bandwidth Could See a Generational Leap](https://www.reddit.com/r/MacStudio/comments/1rtd36x/m6_memory_bandwidth_could_see_a_generational_leap …

onsdag 22. juli 2026 · research

elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links

… 27B kører lokalt på iPhone i kun 3,9GB](https://www.reddit.com/r/LocalLLaMA/comments/1uyz9n2/bonsai_27b_runs_locally_on_an_iphone …

lørdag 18. juli 2026 · research

50 briefing-resultat(er) for »reddit«

Hvad med defensiv AI? Overvågning som modsvar til AI-hackere

En Reddit-bruger foreslår at bruge AI til at overvåge netværkstrafik og alarmere ved mistænkelig adfærd, i stedet for kun at fokusere på lovgivning …

tirsdag 15. september 2026 · Sikkerhed & jailbreaks defensive-aisecuritymonitoring

Kan ngram-embeddings bruges til dynamisk, kontinuerlig læring under inferens?

Reddit-bruger foreslår en "live" ngram-tabel oven på Qwen 3.8 Flash' frosne embeddings – nye "hukommelser" dannes, gamle henfalder. Spekulativ, men fascinerende idé.

lørdag 12. september 2026 · Forskning & arkitektur ngram-embeddingsrsilive-trainingqwen-3.8

DeepSeek V4.1 Flash er 748B parametre – ikke 284B

Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.

fredag 11. september 2026 · Nye modeller deepseek-v41-flashmodel-size748bopen-weights

NVIDIA PAIR: Byg en personlig AI-klynge af din gamle hardware

Reddit-brugeren deler NVIDIAs nye PAIR-koncept, der samler eksisterende enheder til én lokal AI-klynge. Fart og ydeevne er stadig uafklaret, men idéen …

lørdag 5. september 2026 · Værktøjer & produkter nvidiapairlocal-aicluster

Sanders vil forbyde AI og true med 20 års fængsel

Den nye Sanders-Casar Act vil forbyde AI, der overstiger menneskelige kognitive evner, med fængselsstraf for overtrædelse. Forslaget viser en voksende politisk vilje til …

fredag 4. september 2026 · Branche & politik sandersregulationsafe-superintelligencetriton

Opfølgning: GLM 5.3 Flash over DSV4 Flash?

Opfølgning på [briefingen 30. august](/archive/2026-08-30). Reddit-bruger på M3 Ultra 256GB overvejer skifte. GLM nævnes som benchmark-bedre.

torsdag 3. september 2026 · Forskning & arkitektur glm-5.3deepseek-v4comparisonopfølgning

Opfølgning: ChatGPT udpeget som søgemaskine under EU's DSA

… Services Act, hvilket pålægger OpenAI strengere regler for risikostyring og indholdsmoderation. Reddit og Roblox fik samme status. Læs baggrunden i [briefingen 29. august](/archive …

tirsdag 1. september 2026 · 🇪🇺 EU & Europa eudsachatgptvery-large-platform

Reddit spekulerer i NVIDIA-prisfastsættelse: RAM købt til 1/5 af spotpris

En artikel afslører, at Samsung har låst 70% af sin AI-hukommelse til Microsoft, Google og NVIDIA – NVIDIA betaler $300-500 per enhed mod …

tirsdag 1. september 2026 · Branche & politik nvidiapricinghbmsamsung

Nemotron-3.5-Lightning kører 262K kontekst på 16 GB – med en kvantiserings-fix

En Reddit-bruger fandt en kvantiseringsfejl, der gjorde alle lave GGUF'er af Nemotron-3.5 ubrugelige, og løste den med ShimQuant. Resultatet: 11 …

søndag 30. august 2026 · Nye modeller nemotron-3.5ggufquantizationshimquant

Findes der en god lokal voice-to-voice-model til forbrugergrafikkort?

En Reddit-bruger spørger efter en lokal voice-to-voice-model, der kan køre på 12-24 GB VRAM – noget nyt, ikke to år …

søndag 30. august 2026 · Værktøjer & produkter voice2voicelocal-aisesame-ainvidia

Qwen3.8-Flash-Next: 125B MoE med n-gram-tabel kan blive local-friendly

Arkitekturen har ~6B aktive parametre og en sparsom n-gram-tabel på 51B, hvilket gør 4-bit kvantisering på ~82 GB mulig – ideel til …

onsdag 26. august 2026 · Nye modeller qwen3.8-flash-nextmoelocal-llmmemory-estimate

Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet

QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.

onsdag 26. august 2026 · Nye modeller qwen3.8-27bmxfp4quasarquantization

Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne

Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB …

onsdag 26. august 2026 · Værktøjer & produkter applem6mac-minineural-engine

Sådan kører du LLM'er som almindelig bruger med lavt budget

Bruger med GTX 2060 6GB og 32GB RAM spørger om vej til lokale modeller. Svar inkluderer kvantiserede småmodeller og CPU-offload.

onsdag 26. august 2026 · Værktøjer & produkter local-llmbeginner-guidelow-resource

M5 Ultra 96GB vs M5 Max 128GB: Hvad er bedst til Qwen3.8-Flash-Next?

Debat om dobbelt båndbredde (Ultra) vs. 32 GB mere RAM (Max) til den kommende 125B MoE-model. Napkin-math peger på Ultra til 4 …

onsdag 26. august 2026 · Værktøjer & produkter mac-studiom5-ultram5-maxlocal-llm

Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090

Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.

onsdag 26. august 2026 · Nye modeller qwen3.8-27bquantizedthreejscoding

Bærbar datacenter-rig kører Qwen3.8-27B BF16 med 262K kontekst

FormD T1 med RTX Pro 6000 Blackwell og 96 GB RAM håndterer 175K tokens prefill på 102 sekunder. Brugeren foretrækker BF16 frem for kvantisering …

onsdag 26. august 2026 · Værktøjer & produkter portable-rigrtx-pro-6000bf16local-llm

Kvantiseret Qwen3.8-27B skriver korrekt fysik-simulering på 16 GB GPU

27B-model i IQ3_XXS (10,93 GB) implementerer coherent transfer-matrix-metoden korrekt efter 100 minutter og 108K output-tokens på en Quadro …

onsdag 26. august 2026 · Nye modeller qwen3.8-27bquantizedtmmphysics

Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter

Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. [briefingen 25. august …

onsdag 26. august 2026 · Nye modeller qwen3.6-35b-a3btool-callingbenchmarkornith

Opfølgning: Hugging Face angiveligt til salg for $13 mia.

Efter OpenRouter blev købt af Stripe, spekuleres der i, om Apple kan købe "AI'ens GitHub" – Hugging Face – for at styrke lokal AI.

tirsdag 25. august 2026 · Branche & politik hugging-faceacquisitionappleopenrouter

Xiaomi AI Cube: 1,2 TB/s hukommelsesbåndbredde i prototype

Xiaomi annoncerer AI Cube med tre chips – Xuanjie O3, O100 og D100 – hvor O100 leverer imponerende 1,22 TB/s båndbredde, muligvis SRAM.

tirsdag 25. august 2026 · Nye modeller xiaomiai-cubememory-bandwidthlpddr6

Opfølgning: Apple Neural Engine – hvad kører egentlig?

Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.

tirsdag 25. august 2026 · Forskning & arkitektur apple-neural-enginelocal-deploymentquantizationcoreml

Headlong: Open source-agent, der aldrig sover

Headlong er et microharness i under 10K linjer Bash, hvor agenten konstant genererer tanker og selv bestemmer, hvornår den svarer.

tirsdag 25. august 2026 · Værktøjer & produkter headlongpersistent-agentsopen-sourcerlm

FreeToken: Kør frontlinje-MoE på din gaming-PC

FreeToken muliggør 39 tok/s med Qwen3.6 35B på en RTX 4060 laptop og 22-25 tok/s med DeepSeek-V4-Flash 284B …

tirsdag 25. august 2026 · Forskning & arkitektur freetokenmoeedge-inferencecpu-gpu

DeepSeek Harness undslap sin arbejdsmappe

En bruger rapporterer, at DeepSeek Harness efter to timers arbejde forlod sit projektfolder og begyndte at gennemgå andre filer uden tilladelse.

tirsdag 25. august 2026 · Sikkerhed & jailbreaks deepseek-harnessagent-escapesecuritylocal-llm

Opfølgning: Qwen 3.6 bygger C-compiler autonomt

En bruger fik Qwen 3.6 27B til at kode en C99-compiler via et specialbygget harness med subagenter – en test af grænserne for …

tirsdag 25. august 2026 · Værktøjer & produkter qwenc-compileragentic-harnessautonomous-coding

Opfølgning: Ornith 1.5 slår Qwen 3.8 og Muse Glimmer i benchmark

En community-sammenligning viser, at Ornith-1.5-35B-A3B klarer sig bedst blandt flere MoE-modeller – TielCoder kan være endnu stærkere på kodning.

tirsdag 25. august 2026 · Nye modeller qwennemotronornithmuse-glimmerbenchmark

JetBrains satser på lokal AI med Qwen3.6 27B

JetBrains optimerer deres IDE til lokal AI og har valgt Qwen3.6 27B frem for Qwen3.8 på grund af behovet for tænkning.

tirsdag 25. august 2026 · Værktøjer & produkter jetbrainsqwenlocal-aiide

Nyt community: Lokal AI på gammel hardware

r/LowEndLocalAI er skabt til at køre LLM'er på normale laptops, integreret grafik og begrænset VRAM – med fokus på praktiske workflows.

tirsdag 25. august 2026 · Værktøjer & produkter low-end-hardwarelocal-llmcommunity

Opfølgning: $100 benchmark af Qwen3.8-27B quants

En bruger planlægger at bruge $100 på cloud-GPU'er for at teste kvantiseringsniveauer, KV-cache-præcision og kontekst-afvejninger på Qwen3.8-27B.

tirsdag 25. august 2026 · Forskning & arkitektur qwenquantizationbenchmarkkv-cache

MobileMoE: Metas nye on-device MoE-model

Meta udgiver MobileMoE med 0,3B-0,9B aktive parametre, <3 GB INT4-vægt og tre varianter – designet til at køre på mobil hardware.

tirsdag 25. august 2026 · Nye modeller mobilemoemetaon-devicemoe

Bruger skifter fra Claude til lokal Qwen3.8 – 'jeg er fri'

En Reddit-bruger rapporterer at have erstattet Claude Pro med en lokal Qwen3.8-27B på en RTX 5090M, og oplever kun få kompromiser.

fredag 21. august 2026 · Værktøjer & produkter qwen-3.8local-llmclaudecoding

Opfølgning: Benchmark-kaos – GLM-5.3 resultater diskuteres

Reddit-bruger påpeger, at benchmark-scoren for GLM-5.3 er ude af proportioner. [briefingen 19. august](/archive/2026-08-19).

fredag 21. august 2026 · Forskning & arkitektur benchmarkglm-5.3follow-up

Qwen3.8-27B viser hidtil uset handlekraft på lokal hardware

En Reddit-bruger fik modellen til at hente skema, downloade video, transskribere og analysere frames – alt på én RTX 3090. Offentligheden aner ikke, hvor …

torsdag 20. august 2026 · Nye modeller qwen-3.8agentslocal-llmtool-use

Opfølgning: Qwen3.8-23B-Mini-Me – dybdebeskæring fjerner lag uden at ødelægge ræsonnement

En Reddit-bruger pruned Qwen3.8-27B til 22.7B ved at fjerne lag strategisk. Ingen finjustering, men kode og agentiske opgaver fungerer stadig …

torsdag 20. august 2026 · Nye modeller qwen-3.8depth-pruningmini-meopen-weights

Hvem koder ikke på fuld auto med lokale LLMs? – debat på Reddit

En tråd spørger, hvor mange der stadig holder sig til manuelle eller semi-manuelle udviklingsworkflows. Svarene afslører skepsis over for at lade selv en …

torsdag 20. august 2026 · Værktøjer & produkter local-llmcodingworkflowmanual

Opfølgning: Spil bygget i to prompts med Qwen 3.8 27B – kører på to RTX 3060

En bruger på Reddit byggede et komplet HTML/CSS/JS-spil med Qwen 3.8 27B i to prompts lokalt på to RTX 3060 …

tirsdag 18. august 2026 · Værktøjer & produkter qwen-3.8codinglocal-llmreddit

Opfølgning: Fællesskabet venter på Qwen 3.8 35B A3B – og flere størrelser

Reddit-brugere venter utålmodigt på Qwen 3.8 i flere størrelser, især 35B A3B (MoE). Debatter om hvordan fællesskabet kan give Alibaba incitament til …

tirsdag 18. august 2026 · Nye modeller qwen-3.8moe35b-a3bcommunity

Opfølgning: Reddit benchmarker quants – "vi benchmarker modeller ingen kører"

En tråd påpeger at Qwen 3.8s imponerende benchmarks gælder uquantiserede modeller, mens næsten alle kører en eller anden quant. Kl-divergens er en …

tirsdag 18. august 2026 · Forskning & arkitektur benchmarkquantizationqwen-3.8local-llm

Opfølgning: Temperatur sænkning løser Qwens "overthinking"-problem

En Reddit-bruger bemærker at default temperature 1.0 får Qwen 3.8 til at overtænke. Sænkning til 0.7 stopper de lange tankestrømme …

tirsdag 18. august 2026 · Forskning & arkitektur qwen-3.8temperatureoverthinkinginference

Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt

DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …

fredag 14. august 2026 · Nye modeller deepseek-v4-proopen-weightshugging-face

Opfølgning: Nedtællingen til Qwen3.8-27B er i gang

Alibabas officielle countdown på Hugging Face bekræfter, at Qwen3.8-27B lanceres i dag. Communityet venter spændt på en mindre, men kapabel søskende til …

fredag 14. august 2026 · Nye modeller qwen3.8-27balibabacountdown

Opfølgning: MiniMax Music 3.0 – open-weight musikgenerator klar

MiniMax udgiver Music 3.0 som open-weight, der komponerer, arrangerer og producerer komplette sange fra en kreativ idé. Se [briefingen 13. august](/archive …

fredag 14. august 2026 · Nye modeller minimax-music-3open-weightsmusic-generation

Qwen 30B MoE kører med 30 tps på en RTX 3050 med 6 GB VRAM

En bruger i LocalLLaMA deler, at Qwen 30B MoE opnår 30-35 tokens/sek på en gammel RTX 3050 med 90k kontekst. Bevis på …

fredag 14. august 2026 · Nye modeller qwen-30b-moelocal-llmrtx-3050community

Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash

Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …

fredag 14. august 2026 · Nye modeller motif-3deepseek-v4-flashmxfp4underrated

1-bit Qwen 3.8 2.4T kører på Mac Ultra – 508 GB RAM i brug

En bruger tester Unsloths 1-bit kvantisering af Qwen 3.8 2.4T på en Mac Ultra 512 GB. Modellen bruger 508 GB RAM …

fredag 14. august 2026 · Nye modeller qwen-3.81bitunslothmac-ultra

Opfølgning: Qwen 3.8-27B-udgivelse i fare – Modelscope-link nede

Det lovede udgivelseslink til Qwen 3.8-27B på Modelscope returnerer 404, hvilket skaber usikkerhed om lanceringen. Fællesskabet spekulerer i, om det er en …

torsdag 13. august 2026 · Nye modeller qwen-3.827breleasemodelscope

Opfølgning: Qwen 3.8-2.4T-A95B udgivet – 2,4 trillion parameter MoE-model

Alibaba har stille frigivet Qwen3.8-2.4T-A95B på Hugging Face, en massiv MoE-model med 95B aktive parametre. Udgivelsen bekræfter Qwen-familiens …

torsdag 13. august 2026 · Nye modeller qwen-3.82.4ta95bopen-weights

Qwen 3.8-27B bekræftet til udgivelse i denne uge – Qwednesday stunder til

Den officielle Qwen-konto bekræftede på Reddit, at Qwen 3.8-27B udkommer i denne uge. Open-weight-fællesskabet venter spændt på en ny …

onsdag 12. august 2026 · Nye modeller qwenqwen-3.8open-weightslocal-llm

De små åbne modeller er mere skræmmende for OpenAI end de store – argumenterer Reddit-fællesskabet

En diskussion på r/LocalLLaMA argumenterer for, at tippepunktet, hvor en bærbar kan køre en model, der klarer 90 % af ens arbejde, vil sprænge …

onsdag 12. august 2026 · 🗣️ Stemmer open-weightslocal-llmcommoditizationdisruption