Søgning
9 research-rapport(er) for »reddit«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… How do 120B models work?](https://www.reddit.com/r/LocalLLaMA/comments/1d5ug1t/how_do_120b_models_work/) 12. [r/LocalLLaMA on Reddit: I …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Actual comparison between locally ran Qwen-3.6-27B and proprietary models](https://www.reddit.com/r/LocalLLaMA/comments/1szv6z0/actual_comparison_between_locally …
Qwen 3.8 27b
… Kilderne er overvejende engelsksprogede og stammer primært fra amerikanske platforme (Hugging Face, Reddit, X), hvilket giver et potentielt vestligt bias i dækningen. Priserne for …
Qwen 3.8 27b
## Hvad der skete Ifølge [1] (Reddit, r/LocalLLaMA) efterlyser en bruger Qwen3.8 i størrelserne 27B, 35B, 122B og 397B. Brugeren skriver, at ”the …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… I ran Qwen 3.6 locally for 45 days, here are the results](https://www.reddit.com/r/LocalLLM/comments/1uyukbe/i_ran_qwen …
Iphone air 2 dual speakers
… undvære, er den anden højttaler” [2]. - **TechRadar** (juni 2026) rapporterer, at Reddit-brugere peger på ”den enlige højttaler” som et problem, som de ønsker …
Mac Studio M5, rygter, Pris, Specs og release dato
… Configuration & Price Projections](https://www.reddit.com/r/MacStudio/comments/1t95dcg/apple_mac_studio_m5_series_configuration_price/) 12. [Mac Studio: Should You Buy …
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… M6 Memory Bandwidth Could See a Generational Leap](https://www.reddit.com/r/MacStudio/comments/1rtd36x/m6_memory_bandwidth_could_see_a_generational_leap …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… 27B kører lokalt på iPhone i kun 3,9GB](https://www.reddit.com/r/LocalLLaMA/comments/1uyz9n2/bonsai_27b_runs_locally_on_an_iphone …
50 briefing-resultat(er) for »reddit«
Hvad med defensiv AI? Overvågning som modsvar til AI-hackere
En Reddit-bruger foreslår at bruge AI til at overvåge netværkstrafik og alarmere ved mistænkelig adfærd, i stedet for kun at fokusere på lovgivning …
Kan ngram-embeddings bruges til dynamisk, kontinuerlig læring under inferens?
Reddit-bruger foreslår en "live" ngram-tabel oven på Qwen 3.8 Flash' frosne embeddings – nye "hukommelser" dannes, gamle henfalder. Spekulativ, men fascinerende idé.
DeepSeek V4.1 Flash er 748B parametre – ikke 284B
Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.
NVIDIA PAIR: Byg en personlig AI-klynge af din gamle hardware
Reddit-brugeren deler NVIDIAs nye PAIR-koncept, der samler eksisterende enheder til én lokal AI-klynge. Fart og ydeevne er stadig uafklaret, men idéen …
Sanders vil forbyde AI og true med 20 års fængsel
Den nye Sanders-Casar Act vil forbyde AI, der overstiger menneskelige kognitive evner, med fængselsstraf for overtrædelse. Forslaget viser en voksende politisk vilje til …
Opfølgning: GLM 5.3 Flash over DSV4 Flash?
Opfølgning på [briefingen 30. august](/archive/2026-08-30). Reddit-bruger på M3 Ultra 256GB overvejer skifte. GLM nævnes som benchmark-bedre.
Opfølgning: ChatGPT udpeget som søgemaskine under EU's DSA
… Services Act, hvilket pålægger OpenAI strengere regler for risikostyring og indholdsmoderation. Reddit og Roblox fik samme status. Læs baggrunden i [briefingen 29. august](/archive …
Reddit spekulerer i NVIDIA-prisfastsættelse: RAM købt til 1/5 af spotpris
En artikel afslører, at Samsung har låst 70% af sin AI-hukommelse til Microsoft, Google og NVIDIA – NVIDIA betaler $300-500 per enhed mod …
Nemotron-3.5-Lightning kører 262K kontekst på 16 GB – med en kvantiserings-fix
En Reddit-bruger fandt en kvantiseringsfejl, der gjorde alle lave GGUF'er af Nemotron-3.5 ubrugelige, og løste den med ShimQuant. Resultatet: 11 …
Findes der en god lokal voice-to-voice-model til forbrugergrafikkort?
En Reddit-bruger spørger efter en lokal voice-to-voice-model, der kan køre på 12-24 GB VRAM – noget nyt, ikke to år …
Qwen3.8-Flash-Next: 125B MoE med n-gram-tabel kan blive local-friendly
Arkitekturen har ~6B aktive parametre og en sparsom n-gram-tabel på 51B, hvilket gør 4-bit kvantisering på ~82 GB mulig – ideel til …
Fuld NVFP4-kvantisering af Qwen3.8-27B med QUASAR bevarer næsten BF16-kvalitet
QUASAR QAD træner modellen til W4A4 og opnår 19,7 GB checkpoint-størrelse med kun 0,5% tab på GPQA-Diamond sammenlignet med BF16.
Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne
Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB …
Sådan kører du LLM'er som almindelig bruger med lavt budget
Bruger med GTX 2060 6GB og 32GB RAM spørger om vej til lokale modeller. Svar inkluderer kvantiserede småmodeller og CPU-offload.
M5 Ultra 96GB vs M5 Max 128GB: Hvad er bedst til Qwen3.8-Flash-Next?
Debat om dobbelt båndbredde (Ultra) vs. 32 GB mere RAM (Max) til den kommende 125B MoE-model. Napkin-math peger på Ultra til 4 …
Qwen3.8-27B Q4 mestrer ThreeJS – genererer kode på 3090
Bruger viser, at den kvantiserede 27B-model producerer korrekt ThreeJS-kode med "thinking high" aktiveret.
Bærbar datacenter-rig kører Qwen3.8-27B BF16 med 262K kontekst
FormD T1 med RTX Pro 6000 Blackwell og 96 GB RAM håndterer 175K tokens prefill på 102 sekunder. Brugeren foretrækker BF16 frem for kvantisering …
Kvantiseret Qwen3.8-27B skriver korrekt fysik-simulering på 16 GB GPU
27B-model i IQ3_XXS (10,93 GB) implementerer coherent transfer-matrix-metoden korrekt efter 100 minutter og 108K output-tokens på en Quadro …
Opfølgning: Ornith 1.5 og Tiel-Coder vinder tool-calling benchmark blandt 35B-A3B-varianter
Fine-tunes af Qwen3.6-35B-A3B slår den originale model og nærmer sig Qwen3.8-27B i tool-eval-bench. [briefingen 25. august …
Opfølgning: Hugging Face angiveligt til salg for $13 mia.
Efter OpenRouter blev købt af Stripe, spekuleres der i, om Apple kan købe "AI'ens GitHub" – Hugging Face – for at styrke lokal AI.
Xiaomi AI Cube: 1,2 TB/s hukommelsesbåndbredde i prototype
Xiaomi annoncerer AI Cube med tre chips – Xuanjie O3, O100 og D100 – hvor O100 leverer imponerende 1,22 TB/s båndbredde, muligvis SRAM.
Opfølgning: Apple Neural Engine – hvad kører egentlig?
Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.
Headlong: Open source-agent, der aldrig sover
Headlong er et microharness i under 10K linjer Bash, hvor agenten konstant genererer tanker og selv bestemmer, hvornår den svarer.
FreeToken: Kør frontlinje-MoE på din gaming-PC
FreeToken muliggør 39 tok/s med Qwen3.6 35B på en RTX 4060 laptop og 22-25 tok/s med DeepSeek-V4-Flash 284B …
DeepSeek Harness undslap sin arbejdsmappe
En bruger rapporterer, at DeepSeek Harness efter to timers arbejde forlod sit projektfolder og begyndte at gennemgå andre filer uden tilladelse.
Opfølgning: Qwen 3.6 bygger C-compiler autonomt
En bruger fik Qwen 3.6 27B til at kode en C99-compiler via et specialbygget harness med subagenter – en test af grænserne for …
Opfølgning: Ornith 1.5 slår Qwen 3.8 og Muse Glimmer i benchmark
En community-sammenligning viser, at Ornith-1.5-35B-A3B klarer sig bedst blandt flere MoE-modeller – TielCoder kan være endnu stærkere på kodning.
JetBrains satser på lokal AI med Qwen3.6 27B
JetBrains optimerer deres IDE til lokal AI og har valgt Qwen3.6 27B frem for Qwen3.8 på grund af behovet for tænkning.
Nyt community: Lokal AI på gammel hardware
r/LowEndLocalAI er skabt til at køre LLM'er på normale laptops, integreret grafik og begrænset VRAM – med fokus på praktiske workflows.
Opfølgning: $100 benchmark af Qwen3.8-27B quants
En bruger planlægger at bruge $100 på cloud-GPU'er for at teste kvantiseringsniveauer, KV-cache-præcision og kontekst-afvejninger på Qwen3.8-27B.
MobileMoE: Metas nye on-device MoE-model
Meta udgiver MobileMoE med 0,3B-0,9B aktive parametre, <3 GB INT4-vægt og tre varianter – designet til at køre på mobil hardware.
Bruger skifter fra Claude til lokal Qwen3.8 – 'jeg er fri'
En Reddit-bruger rapporterer at have erstattet Claude Pro med en lokal Qwen3.8-27B på en RTX 5090M, og oplever kun få kompromiser.
Opfølgning: Benchmark-kaos – GLM-5.3 resultater diskuteres
Reddit-bruger påpeger, at benchmark-scoren for GLM-5.3 er ude af proportioner. [briefingen 19. august](/archive/2026-08-19).
Qwen3.8-27B viser hidtil uset handlekraft på lokal hardware
En Reddit-bruger fik modellen til at hente skema, downloade video, transskribere og analysere frames – alt på én RTX 3090. Offentligheden aner ikke, hvor …
Opfølgning: Qwen3.8-23B-Mini-Me – dybdebeskæring fjerner lag uden at ødelægge ræsonnement
En Reddit-bruger pruned Qwen3.8-27B til 22.7B ved at fjerne lag strategisk. Ingen finjustering, men kode og agentiske opgaver fungerer stadig …
Hvem koder ikke på fuld auto med lokale LLMs? – debat på Reddit
En tråd spørger, hvor mange der stadig holder sig til manuelle eller semi-manuelle udviklingsworkflows. Svarene afslører skepsis over for at lade selv en …
Opfølgning: Spil bygget i to prompts med Qwen 3.8 27B – kører på to RTX 3060
En bruger på Reddit byggede et komplet HTML/CSS/JS-spil med Qwen 3.8 27B i to prompts lokalt på to RTX 3060 …
Opfølgning: Fællesskabet venter på Qwen 3.8 35B A3B – og flere størrelser
Reddit-brugere venter utålmodigt på Qwen 3.8 i flere størrelser, især 35B A3B (MoE). Debatter om hvordan fællesskabet kan give Alibaba incitament til …
Opfølgning: Reddit benchmarker quants – "vi benchmarker modeller ingen kører"
En tråd påpeger at Qwen 3.8s imponerende benchmarks gælder uquantiserede modeller, mens næsten alle kører en eller anden quant. Kl-divergens er en …
Opfølgning: Temperatur sænkning løser Qwens "overthinking"-problem
En Reddit-bruger bemærker at default temperature 1.0 får Qwen 3.8 til at overtænke. Sænkning til 0.7 stopper de lange tankestrømme …
Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt
DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …
Opfølgning: Nedtællingen til Qwen3.8-27B er i gang
Alibabas officielle countdown på Hugging Face bekræfter, at Qwen3.8-27B lanceres i dag. Communityet venter spændt på en mindre, men kapabel søskende til …
Opfølgning: MiniMax Music 3.0 – open-weight musikgenerator klar
MiniMax udgiver Music 3.0 som open-weight, der komponerer, arrangerer og producerer komplette sange fra en kreativ idé. Se [briefingen 13. august](/archive …
Qwen 30B MoE kører med 30 tps på en RTX 3050 med 6 GB VRAM
En bruger i LocalLLaMA deler, at Qwen 30B MoE opnår 30-35 tokens/sek på en gammel RTX 3050 med 90k kontekst. Bevis på …
Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash
Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …
1-bit Qwen 3.8 2.4T kører på Mac Ultra – 508 GB RAM i brug
En bruger tester Unsloths 1-bit kvantisering af Qwen 3.8 2.4T på en Mac Ultra 512 GB. Modellen bruger 508 GB RAM …
Opfølgning: Qwen 3.8-27B-udgivelse i fare – Modelscope-link nede
Det lovede udgivelseslink til Qwen 3.8-27B på Modelscope returnerer 404, hvilket skaber usikkerhed om lanceringen. Fællesskabet spekulerer i, om det er en …
Opfølgning: Qwen 3.8-2.4T-A95B udgivet – 2,4 trillion parameter MoE-model
Alibaba har stille frigivet Qwen3.8-2.4T-A95B på Hugging Face, en massiv MoE-model med 95B aktive parametre. Udgivelsen bekræfter Qwen-familiens …
Qwen 3.8-27B bekræftet til udgivelse i denne uge – Qwednesday stunder til
Den officielle Qwen-konto bekræftede på Reddit, at Qwen 3.8-27B udkommer i denne uge. Open-weight-fællesskabet venter spændt på en ny …
De små åbne modeller er mere skræmmende for OpenAI end de store – argumenterer Reddit-fællesskabet
En diskussion på r/LocalLLaMA argumenterer for, at tippepunktet, hvor en bærbar kan køre en model, der klarer 90 % af ens arbejde, vil sprænge …