News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »deepseek-v4.1«

Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?

… 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp](https://www.reddit.com/r/LocalLLaMA/comments/1uzaf54/one_macbook_vs_2_dgx_spark_deepseekv4flash_scored …

onsdag 22. juli 2026 · research

33 briefing-resultat(er) for »deepseek-v4.1«

DeepSeek V4.1 Flash slår Astra på ny benchmark – overraskende sejr

DeepSeeks V4.1 Flash-model har indtaget førstepladsen på Artificial Analysis' nye Intelligence Index v4.3-benchmark og slår dermed både Astra og Fable …

mandag 14. september 2026 · Nye modeller deepseek-v4.1artificial-analysisbenchmarkastra

DeepSeek V4.1 Flash er 748B parametre – ikke 284B

Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.

fredag 11. september 2026 · Nye modeller deepseek-v41-flashmodel-size748bopen-weights

Lokale open source-modeller finder 10 ud af 12 sikkerhedshuller

En bruger har kørt 1.665 modelkørsler mod 27 offentlige repos: open source-modeller som DeepSeek-V4 og GLM-5.1 fandt næsten alle …

tirsdag 8. september 2026 · Sikkerhed & jailbreaks cybersecurityopen-source-modelsdeepseek-v4glm-5.1

Opfølgning: DeepSeek V4 Flash q4+ kører på 128 GB RAM + 60 GB VRAM

Trods forventning om kun q2-kvanter lykkes det en bruger at køre DeepSeek V4 Flash i 4-bit+ med acceptable tokens/s på en …

søndag 23. august 2026 · Værktøjer & produkter deepseek-v4-flashquantlocal-llmllama.cpp

DeepSeek Harness v0.1.1 ude – understøtter nu vision og billedanalyse

Den nye adapter til DeepSeek-V4-Flash-Vision-Exp gør det muligt at sende billeder i /goal og /plan, samt vedhæfte filer via MCP …

lørdag 22. august 2026 · Værktøjer & produkter deepseek-harnessdeepseek-v4-flash-visionmultimodal

Opfølgning: DeepSeek V4 Flash 12x hurtigere på M3 Ultra med optimerede kernels

En bruger opnår 1,6 sekunder pr. chat-turn via sparse attention-optimeringer og KV-cache-prewarming. [briefingen 6. august](/archive/2026-08-06)

onsdag 19. august 2026 · Værktøjer & produkter deepseek-v4m3-ultrasparse-attentionkv-cache

Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene

… og kun ét point efter GLM-5.2 (753B) og DeepSeek V4 Pro (1,6B parametre). Det cementerer den lille åbne model som en …

tirsdag 18. august 2026 · Nye modeller qwen-3.8open-weightsbenchmarkchinese-ai

Opfølgning: Alibaba frigiver Qwen3.8-2.4T – DeepSeek svarer med V4-Pro

Alibaba har nu frigivet vægtene til Qwen3.8-Max med 2,4 billioner parametre, mens DeepSeek lancerer V4-Pro og hæver API-priser. De …

fredag 14. august 2026 · Nye modeller qwen-3.8deepseek2.4-trillionopen-weights

Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt

DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …

fredag 14. august 2026 · Nye modeller deepseek-v4-proopen-weightshugging-face

Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash

Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …

fredag 14. august 2026 · Nye modeller motif-3deepseek-v4-flashmxfp4underrated

Opfølgning: DeepSeek V4 Pro 0813 ude på OpenRouter – ingen officiel annoncering

DeepSeek har stille lanceret V4 Pro 0813 via API, uden pressemeddelelse eller bekræftelse af open weights. Modellen viser markant forskellige resultater på tværs af …

torsdag 13. august 2026 · Nye modeller deepseek-v4-proopenrouterapichina

Opfølgning: DeepSeek V4 Flash fik basic vision via 40M connector trænet på 100K eksempler

En udvikler gav DeepSeek V4 Flash basic vision ved at fryse modellen og træne en 40M connector mellem MoonViT-encoder og sprogmodellen på 100K

tirsdag 11. august 2026 · Nye modeller deepseek-v4-flashvisionmoonvitconnector

Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode

… versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager sig. [briefingen 1. august](/archive/2026 …

mandag 10. august 2026 · Værktøjer & produkter deepseek-v4ggufopencodecontext-length

Opfølgning: DSpark draft-model giver kun 1-2 tok/s – MTP langt hurtigere

En bruger oplevede, at DSpark draft-modellen til DeepSeek V4 Flash var ekstremt langsom (1-2 tok/s) sammenlignet med MTP's 30-40 …

søndag 9. august 2026 · Forskning & arkitektur deepseek-v4-flashspeculative-decodingdsparkmtp

Benchmarks til DeepSeek Flash 0731 kvant-test efterspurgt

En bruger med flere kvants af DeepSeek Flash 0731 leder efter offentlige benchmarks, der kan måle kvant-effekter med omkring 1 million tokens.

søndag 9. august 2026 · Værktøjer & produkter deepseek-v4-flashbenchmarkquantizationevaluation

Opfølgning: DeepSeek V4 Flash kører på 2x DGX Spark – RAM-hovedpine

En bruger serverer 304B DeepSeek V4 Flash på tværs af to DGX Spark med 128 GB unified memory hver, men kæmper med OS-hukommelse …

lørdag 8. august 2026 · Værktøjer & produkter deepseek-v4-flashdgx-sparkvllmlocal-inference

Opfølgning: DeepSeek V4 Flash kører 10-17 t/s på MacBook M5 Pro med SSD-streaming

En bruger fik DeepSeek V4 Flash til at køre på en 64 GB MacBook via DS4-engineens SSD-streaming, med imponerende hastighed. MoE-modeller …

torsdag 6. august 2026 · Nye modeller deepseek-v4-flashssd-streaminglocal-llmmacbook

Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5

En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …

onsdag 5. august 2026 · Forskning & arkitektur deepseek-v4-flash1m-contextrtx-5090local-llm

Opfølgning: DeepSeek V4 Flash 2-bit kvant opnår 100% i SQL-benchmark

En reddit-bruger kører en 2-bit kvantiseret DeepSeek V4 Flash på to RTX 3080 og får perfekt score i et SQL-test. Kun …

onsdag 5. august 2026 · Forskning & arkitektur deepseek-v4-flash2-bit-quantsql-benchmarklocal-llm

Opfølgning: DSpark giver DeepSeek V4 Flash op til 2x hastighed på A40

TensorSharp benchmark viser 1,5-2x speedup med spekulativ dekodning. 10K-token dokumenter kører 2,03x hurtigere. [Se tidligere briefingen 1. august](/archive/2026 …

mandag 3. august 2026 · Forskning & arkitektur deepseek-v4-flashdsparkspeculative-decoding

Opfølgning: DeepSeek V4 Flash kører 16 t/s på M1 Ultra efter patch

Med IQ3_XXS kvantisering og patchet LM Studio engine opnås 15-16 tok/s på 128GB M1 Ultra. [Se tidligere briefingen 1. august](/archive …

mandag 3. august 2026 · Forskning & arkitektur deepseek-v4m1-ultralm-studio

Opfølgning: DeepSeek V4 Flash kører på RTX 3090 med 12,5 tok/s via CPU-spild

En bruger fik DeepSeek-V4-Flash-0731 til at køre på et enkelt 24 GB-kort ved at lægge MoE-eksperter i system-RAM …

søndag 2. august 2026 · Værktøjer & produkter deepseek-v4-flashlocal-llmrtx-3090llama.cpp

Opfølgning: Simon Willison: DeepSeek V4 Flash er bedste value-per-intelligence lige nu

Willison fremhæver, at modellen til $0,14/$0,27 per million tokens slår langt større modeller på intelligensindekset. Det gør den til et attraktivt …

søndag 2. august 2026 · 🗣️ Stemmer simon-willisondeepseek-v4-flashopenroutervalue-per-intelligence

Opfølgning: DeepSeek V4 Flash kører lossless på en enkelt A100 med 17,7 t/s

Nye benchmarks viser, at den opdaterede V4 Flash kører tabsfrit på 40 GB A100 og matcher Sonnet 5 på DeepSWE. [briefingen 24. juli](/archive …

lørdag 1. august 2026 · Nye modeller deepseek-v4-flashgguflocal-inferencebenchmark

Opfølgning: DeepSeek V4 Flash kører 30 t/s på M5 Max via DS4-engine

En community-medlem har kvantiseret den nye V4 Flash til DS4 DwarfStar og opnår dobbelt hastighed i forhold til llama.cpp. [briefingen 18. juli …

lørdag 1. august 2026 · Værktøjer & produkter deepseek-v4-flashds4dwarfstargguf

Opfølgning: DeepSeek V4 Flash når 105 t/s på to 4090D – Blackwell-kerner genimplementeret i Triton

… så DeepSeek V4 Flash kører på Ada GPU'er. Resultatet er 2-3x speedup for agent-arbejdsbelastninger. [briefingen 17. juli](/archive/2026-07-17)

fredag 24. juli 2026 · Forskning & arkitektur deepseek-v4-flashtritonvllmada-gpu

Opfølgning: 10 open-source no-code-platforme til LLM-apps og RAG

… og sammenligningen af Kimi K3, DeepSeek V4 Pro og GLM-5.2 også er i fokus. Se [briefingen 19. juli](/archive/2026-07-19).

mandag 20. juli 2026 · Værktøjer & produkter no-coderagagentsopen-source

Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU

En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se [briefingen 17. juli](/archive/2026-07-17).

søndag 19. juli 2026 · Værktøjer & produkter deepseek-v4-flashlocal-llm80gb-vrammoe-offloading

Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?

… Se [briefingen 17. juli](/archive/2026-07-17) for baggrunden om DeepSeek V4 Flash.

søndag 19. juli 2026 · Værktøjer & produkter qwen3.5-397blocal-modelsllama.cppkv-cache

Opfølgning: MacBook vs. 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp

En bruger testede DeepSeek-V4-Flash på en M5 Max MacBook (2,45 bit kvantisering) mod to DGX Spark (FP8/FP4). Mac'en vandt …

lørdag 18. juli 2026 · Forskning & arkitektur deepseek-v4-flashquantizationlocal-inferencebenchmark

1 million kontekst på en RTX 5090 med DeepSeek V4 Flash

DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er …

fredag 17. juli 2026 · Værktøjer & produkter deepseek-v4-flashllama.cpprtx-5090local-llm

6x3090 vs 8x3090: Er opgraderingen værd?

En bruger overvejer at gå fra seks til otte RTX 3090'ere via en PCIe-splitter for at køre DeepSeek Flash V4 i Q8 …

fredag 17. juli 2026 · Værktøjer & produkter 3090multi-gpulocal-llmpcie