Søgning
1 research-rapport(er) for »deepseek-v4-flash«
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp](https://www.reddit.com/r/LocalLLaMA/comments/1uzaf54/one_macbook_vs_2_dgx_spark_deepseekv4flash_scored …
43 briefing-resultat(er) for »deepseek-v4-flash«
DeepSeek V4.1 Flash slår Astra på ny benchmark – overraskende sejr
DeepSeeks V4.1 Flash-model har indtaget førstepladsen på Artificial Analysis' nye Intelligence Index v4.3-benchmark og slår dermed både Astra og Fable …
DeepSeek V4.1 Flash er 748B parametre – ikke 284B
Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.
Opfølgning: DeepSeek V4 Flash vs. Qwen3.8 Flash Next – praktisk sammenligning
Brugerrapport viser, at DeepSeek V4 Flash er 40% langsommere men fuldfører opgaver dobbelt så hurtigt som Qwen3.8 Flash Next. [briefingen 31. august](/archive …
Benchmarks fra 4x Radeon AI Pro R9700-builds efterspurgt
En bruger overvejer en 4x R9700-server til DeepSeek V4 Flash og Qwen 3.8 Flash og spørger om erfaringer.
Opfølgning: DeepSeek V4 Flash vs GLM 5.3 Flash på to GX10
Opfølgning på [briefingen 30. august](/archive/2026-08-30). Bruger rapporterer GLM vinder på skrivekvalitet og vision, DeepSeek på tokenhastighed.
Opfølgning: GLM 5.3 Flash over DSV4 Flash?
Opfølgning på [briefingen 30. august](/archive/2026-08-30). Reddit-bruger på M3 Ultra 256GB overvejer skifte. GLM nævnes som benchmark-bedre.
Opfølgning: Import AI 471: Hugging Face bekymrer, DeepSeek V4 Flash Vision udkommer
… Samtidig er DeepSeek V4 Flash Vision med billedanalyse ude. Læs baggrunden i [briefingen 22. august](/archive/2026-08-22).
GLM 5.3 Flash slår DeepSeek V4 Flash på HumanEval på 2x DGX Spark
En bruger benchmarkede GLM 5.3 Flash (NVFP4) mod DeepSeek V4 Flash 0731 på to DGX Spark: GLM vandt med 97,0% mod 94 …
DeepSeek V4 Flash kører 67-84 tok/s på to GX10'er
En bruger fik DeepSeek V4 Flash til at køre stabilt på to ASUS GX10 DGX-computere med over 65 tok/s sustained og en …
FreeToken: Kør frontlinje-MoE på din gaming-PC
FreeToken muliggør 39 tok/s med Qwen3.6 35B på en RTX 4060 laptop og 22-25 tok/s med DeepSeek-V4-Flash 284B …
Kan DeepSeek V4 Flash destilleres på Nemotron 3.5 Lightning?
En bruger på r/LocalLLaMA spørger, om man kan destillere DeepSeek V4 Flash 0731 på en 2x Asus GX10-klynge for at forbedre Nemotron …
Opfølgning: DeepSeek V4 Flash q4+ kører på 128 GB RAM + 60 GB VRAM
Trods forventning om kun q2-kvanter lykkes det en bruger at køre DeepSeek V4 Flash i 4-bit+ med acceptable tokens/s på en …
DeepSeek Harness v0.1.1 ude – understøtter nu vision og billedanalyse
Den nye adapter til DeepSeek-V4-Flash-Vision-Exp gør det muligt at sende billeder i /goal og /plan, samt vedhæfte filer via MCP …
Fine-tuning af Cactus Needle 2 matcher DeepSeek v4 på specifikke opgaver
Henry fra Cactus viser, at Needle 2 efter finjustering overgår DeepSeek v4 Flash på afgrænsede opgaver – men advarer mod overfitting.
Opfølgning: DeepSeek V4 Flash 12x hurtigere på M3 Ultra med optimerede kernels
En bruger opnår 1,6 sekunder pr. chat-turn via sparse attention-optimeringer og KV-cache-prewarming. [briefingen 6. august](/archive/2026-08-06)
Lokal agentic coding benchmark: Qwen 3.8 27B medium reasoning er sweet spot
… Kører på niveau med DeepSeek V4 Flash men mere effektivt.
Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash
Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …
Opfølgning: DeepSeek V4 Flash fik basic vision via 40M connector trænet på 100K eksempler
En udvikler gav DeepSeek V4 Flash basic vision ved at fryse modellen og træne en 40M connector mellem MoonViT-encoder og sprogmodellen på 100K …
Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode
Brugere rapporterer, at Q8_K_XL-versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager …
Opfølgning: DSpark draft-model giver kun 1-2 tok/s – MTP langt hurtigere
En bruger oplevede, at DSpark draft-modellen til DeepSeek V4 Flash var ekstremt langsom (1-2 tok/s) sammenlignet med MTP's 30-40 …
Benchmarks til DeepSeek Flash 0731 kvant-test efterspurgt
En bruger med flere kvants af DeepSeek Flash 0731 leder efter offentlige benchmarks, der kan måle kvant-effekter med omkring 1 million tokens.
Opfølgning: DeepSeek V4 Flash 0731 lander på ARC-AGI – blandede reaktioner
Hugging Face-spidsen DeepSeek V4 Flash 0731 er nu evalueret på ARC-AGI, hvor den viser styrke i ræsonnering, men brugere påpeger alvorlige fejl …
Opfølgning: DeepSeek V4 Flash kører på 2x DGX Spark – RAM-hovedpine
En bruger serverer 304B DeepSeek V4 Flash på tværs af to DGX Spark med 128 GB unified memory hver, men kæmper med OS-hukommelse …
DeepSeek V4 Flash dumpede i kontoropgaver – brugere frustrerede
En tråd på r/LocalLLaMA dokumenterer, at DeepSeek V4 Flash fejler spektakulært i referatskrivning og tekstresumé på trods af høje benchmark-scorer. Modellen er …
Opfølgning: DeepSeek V4 Flash kører 10-17 t/s på MacBook M5 Pro med SSD-streaming
En bruger fik DeepSeek V4 Flash til at køre på en 64 GB MacBook via DS4-engineens SSD-streaming, med imponerende hastighed. MoE-modeller …
Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5
En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …
Opfølgning: DeepSeek V4 Flash 2-bit kvant opnår 100% i SQL-benchmark
En reddit-bruger kører en 2-bit kvantiseret DeepSeek V4 Flash på to RTX 3080 og får perfekt score i et SQL-test. Kun …
Qwen 3.8-Max lanceret – Alibaba sætter ny standard med 2,4 billioner parametre
… Samtidig viser brugerrapporter, at DeepSeek V4 Flash i fuld præcision nærmer sig GLM 5.2-niveau, men at kvantisering rammer modellen hårdt.
Opfølgning: DeepSeek V4 Flash kører på brugt serverhardware – 33 tok/s på to RTX 3090
En bruger har fået DeepSeek V4 Flash (284B MoE) til at køre på en gammel quad-Xeon DDR4-server med to RTX 3090'ere …
Opfølgning: DSpark giver DeepSeek V4 Flash op til 2x hastighed på A40
TensorSharp benchmark viser 1,5-2x speedup med spekulativ dekodning. 10K-token dokumenter kører 2,03x hurtigere. [Se tidligere briefingen 1. august](/archive/2026 …
Opfølgning: DeepSeek V4 Flash kører 16 t/s på M1 Ultra efter patch
Med IQ3_XXS kvantisering og patchet LM Studio engine opnås 15-16 tok/s på 128GB M1 Ultra. [Se tidligere briefingen 1. august](/archive …
Opfølgning: DeepSeek V4 Flash kører på RTX 3090 med 12,5 tok/s via CPU-spild
En bruger fik DeepSeek-V4-Flash-0731 til at køre på et enkelt 24 GB-kort ved at lægge MoE-eksperter i system-RAM …
Opfølgning: Simon Willison: DeepSeek V4 Flash er bedste value-per-intelligence lige nu
Willison fremhæver, at modellen til $0,14/$0,27 per million tokens slår langt større modeller på intelligensindekset. Det gør den til et attraktivt …
DeepSeek V4 Flash svigter stadig på regel-følge – bruger påpeger kompressionsproblem
En lokal bruger rapporterer, at modellen ignorerer regler og skills, fordi den gemmer dem som komprimerede summaries. Det viser, at benchmarks ikke altid afspejler …
DeepSeek V4 Flash opdateret – og communityet hungrer efter 70-80B MoE-modeller
DeepSeek har opdateret V4 Flash med store agentiske forbedringer, samtidig med at communityet efterlyser nye 70-80B MoE-modeller til lokal kørsel.
Opfølgning: DeepSeek V4 Flash kører lossless på en enkelt A100 med 17,7 t/s
Nye benchmarks viser, at den opdaterede V4 Flash kører tabsfrit på 40 GB A100 og matcher Sonnet 5 på DeepSWE. [briefingen 24. juli](/archive …
Opfølgning: DeepSeek V4 Flash kører 30 t/s på M5 Max via DS4-engine
En community-medlem har kvantiseret den nye V4 Flash til DS4 DwarfStar og opnår dobbelt hastighed i forhold til llama.cpp. [briefingen 18. juli …
Opfølgning: DeepSeek V4 Flash når 105 t/s på to 4090D – Blackwell-kerner genimplementeret i Triton
En udvikler har skrevet alle Blackwell-eksklusive kernels om i Triton, så DeepSeek V4 Flash kører på Ada GPU'er. Resultatet er 2-3x …
Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU
En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se [briefingen 17. juli](/archive/2026-07-17).
Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?
… juli](/archive/2026-07-17) for baggrunden om DeepSeek V4 Flash.
Opfølgning: MacBook vs. 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp
En bruger testede DeepSeek-V4-Flash på en M5 Max MacBook (2,45 bit kvantisering) mod to DGX Spark (FP8/FP4). Mac'en vandt …
1 million kontekst på en RTX 5090 med DeepSeek V4 Flash
DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er …
6x3090 vs 8x3090: Er opgraderingen værd?
En bruger overvejer at gå fra seks til otte RTX 3090'ere via en PCIe-splitter for at køre DeepSeek Flash V4 i Q8 …