Søgning
1 research-rapport(er) for »deepseek-v4.1«
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp](https://www.reddit.com/r/LocalLLaMA/comments/1uzaf54/one_macbook_vs_2_dgx_spark_deepseekv4flash_scored …
33 briefing-resultat(er) for »deepseek-v4.1«
DeepSeek V4.1 Flash slår Astra på ny benchmark – overraskende sejr
DeepSeeks V4.1 Flash-model har indtaget førstepladsen på Artificial Analysis' nye Intelligence Index v4.3-benchmark og slår dermed både Astra og Fable …
DeepSeek V4.1 Flash er 748B parametre – ikke 284B
Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.
Lokale open source-modeller finder 10 ud af 12 sikkerhedshuller
En bruger har kørt 1.665 modelkørsler mod 27 offentlige repos: open source-modeller som DeepSeek-V4 og GLM-5.1 fandt næsten alle …
Opfølgning: DeepSeek V4 Flash q4+ kører på 128 GB RAM + 60 GB VRAM
Trods forventning om kun q2-kvanter lykkes det en bruger at køre DeepSeek V4 Flash i 4-bit+ med acceptable tokens/s på en …
DeepSeek Harness v0.1.1 ude – understøtter nu vision og billedanalyse
Den nye adapter til DeepSeek-V4-Flash-Vision-Exp gør det muligt at sende billeder i /goal og /plan, samt vedhæfte filer via MCP …
Opfølgning: DeepSeek V4 Flash 12x hurtigere på M3 Ultra med optimerede kernels
En bruger opnår 1,6 sekunder pr. chat-turn via sparse attention-optimeringer og KV-cache-prewarming. [briefingen 6. august](/archive/2026-08-06)
Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene
… og kun ét point efter GLM-5.2 (753B) og DeepSeek V4 Pro (1,6B parametre). Det cementerer den lille åbne model som en …
Lokal agentic coding benchmark: Qwen 3.8 27B medium reasoning er sweet spot
… Kører på niveau med DeepSeek V4 Flash men mere effektivt.
Opfølgning: Alibaba frigiver Qwen3.8-2.4T – DeepSeek svarer med V4-Pro
Alibaba har nu frigivet vægtene til Qwen3.8-Max med 2,4 billioner parametre, mens DeepSeek lancerer V4-Pro og hæver API-priser. De …
Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt
DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …
Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash
Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …
Opfølgning: DeepSeek V4 Pro 0813 ude på OpenRouter – ingen officiel annoncering
DeepSeek har stille lanceret V4 Pro 0813 via API, uden pressemeddelelse eller bekræftelse af open weights. Modellen viser markant forskellige resultater på tværs af …
Opfølgning: DeepSeek V4 Flash fik basic vision via 40M connector trænet på 100K eksempler
En udvikler gav DeepSeek V4 Flash basic vision ved at fryse modellen og træne en 40M connector mellem MoonViT-encoder og sprogmodellen på 100K …
Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode
… versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager sig. [briefingen 1. august](/archive/2026 …
Opfølgning: DSpark draft-model giver kun 1-2 tok/s – MTP langt hurtigere
En bruger oplevede, at DSpark draft-modellen til DeepSeek V4 Flash var ekstremt langsom (1-2 tok/s) sammenlignet med MTP's 30-40 …
Benchmarks til DeepSeek Flash 0731 kvant-test efterspurgt
En bruger med flere kvants af DeepSeek Flash 0731 leder efter offentlige benchmarks, der kan måle kvant-effekter med omkring 1 million tokens.
Opfølgning: DeepSeek V4 Flash kører på 2x DGX Spark – RAM-hovedpine
En bruger serverer 304B DeepSeek V4 Flash på tværs af to DGX Spark med 128 GB unified memory hver, men kæmper med OS-hukommelse …
Opfølgning: DeepSeek V4 Flash kører 10-17 t/s på MacBook M5 Pro med SSD-streaming
En bruger fik DeepSeek V4 Flash til at køre på en 64 GB MacBook via DS4-engineens SSD-streaming, med imponerende hastighed. MoE-modeller …
Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5
En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …
Opfølgning: DeepSeek V4 Flash 2-bit kvant opnår 100% i SQL-benchmark
En reddit-bruger kører en 2-bit kvantiseret DeepSeek V4 Flash på to RTX 3080 og får perfekt score i et SQL-test. Kun …
Opfølgning: DSpark giver DeepSeek V4 Flash op til 2x hastighed på A40
TensorSharp benchmark viser 1,5-2x speedup med spekulativ dekodning. 10K-token dokumenter kører 2,03x hurtigere. [Se tidligere briefingen 1. august](/archive/2026 …
Opfølgning: DeepSeek V4 Flash kører 16 t/s på M1 Ultra efter patch
Med IQ3_XXS kvantisering og patchet LM Studio engine opnås 15-16 tok/s på 128GB M1 Ultra. [Se tidligere briefingen 1. august](/archive …
Opfølgning: DeepSeek V4 Flash kører på RTX 3090 med 12,5 tok/s via CPU-spild
En bruger fik DeepSeek-V4-Flash-0731 til at køre på et enkelt 24 GB-kort ved at lægge MoE-eksperter i system-RAM …
Opfølgning: Simon Willison: DeepSeek V4 Flash er bedste value-per-intelligence lige nu
Willison fremhæver, at modellen til $0,14/$0,27 per million tokens slår langt større modeller på intelligensindekset. Det gør den til et attraktivt …
Opfølgning: DeepSeek V4 Flash kører lossless på en enkelt A100 med 17,7 t/s
Nye benchmarks viser, at den opdaterede V4 Flash kører tabsfrit på 40 GB A100 og matcher Sonnet 5 på DeepSWE. [briefingen 24. juli](/archive …
Opfølgning: DeepSeek V4 Flash kører 30 t/s på M5 Max via DS4-engine
En community-medlem har kvantiseret den nye V4 Flash til DS4 DwarfStar og opnår dobbelt hastighed i forhold til llama.cpp. [briefingen 18. juli …
Opfølgning: DeepSeek V4 Flash når 105 t/s på to 4090D – Blackwell-kerner genimplementeret i Triton
… så DeepSeek V4 Flash kører på Ada GPU'er. Resultatet er 2-3x speedup for agent-arbejdsbelastninger. [briefingen 17. juli](/archive/2026-07-17)
Opfølgning: 10 open-source no-code-platforme til LLM-apps og RAG
… og sammenligningen af Kimi K3, DeepSeek V4 Pro og GLM-5.2 også er i fokus. Se [briefingen 19. juli](/archive/2026-07-19).
Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU
En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se [briefingen 17. juli](/archive/2026-07-17).
Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?
… Se [briefingen 17. juli](/archive/2026-07-17) for baggrunden om DeepSeek V4 Flash.
Opfølgning: MacBook vs. 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp
En bruger testede DeepSeek-V4-Flash på en M5 Max MacBook (2,45 bit kvantisering) mod to DGX Spark (FP8/FP4). Mac'en vandt …
1 million kontekst på en RTX 5090 med DeepSeek V4 Flash
DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er …
6x3090 vs 8x3090: Er opgraderingen værd?
En bruger overvejer at gå fra seks til otte RTX 3090'ere via en PCIe-splitter for at køre DeepSeek Flash V4 i Q8 …