News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »deepseek-v4«

Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?

… 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp](https://www.reddit.com/r/LocalLLaMA/comments/1uzaf54/one_macbook_vs_2_dgx_spark_deepseekv4flash_scored …

onsdag 22. juli 2026 · research

50 briefing-resultat(er) for »deepseek-v4«

DeepSeek V4.1 Flash slår Astra på ny benchmark – overraskende sejr

DeepSeeks V4.1 Flash-model har indtaget førstepladsen på Artificial Analysis' nye Intelligence Index v4.3-benchmark og slår dermed både Astra og Fable …

mandag 14. september 2026 · Nye modeller deepseek-v4.1artificial-analysisbenchmarkastra

DeepSeek V4.1 Flash er 748B parametre – ikke 284B

Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.

fredag 11. september 2026 · Nye modeller deepseek-v41-flashmodel-size748bopen-weights

Lokale open source-modeller finder 10 ud af 12 sikkerhedshuller

… open source-modeller som DeepSeek-V4 og GLM-5.1 fandt næsten alle fejl, hvorimod Claude Opus 5 fandt 0 ud af 8.

tirsdag 8. september 2026 · Sikkerhed & jailbreaks cybersecurityopen-source-modelsdeepseek-v4glm-5.1

Opfølgning: DeepSeek V4 Flash vs. Qwen3.8 Flash Next – praktisk sammenligning

Brugerrapport viser, at DeepSeek V4 Flash er 40% langsommere men fuldfører opgaver dobbelt så hurtigt som Qwen3.8 Flash Next. [briefingen 31. august](/archive …

mandag 7. september 2026 · Nye modeller deepseek-v4-flashqwen3.8-flash-nextcomparisonlocal-llm

Benchmarks fra 4x Radeon AI Pro R9700-builds efterspurgt

En bruger overvejer en 4x R9700-server til DeepSeek V4 Flash og Qwen 3.8 Flash og spørger om erfaringer.

mandag 7. september 2026 · Værktøjer & produkter radeon-ai-pro-r9700amdbenchmarkdeepseek-v4

Opfølgning: DeepSeek V4 Flash vs GLM 5.3 Flash på to GX10

Opfølgning på [briefingen 30. august](/archive/2026-08-30). Bruger rapporterer GLM vinder på skrivekvalitet og vision, DeepSeek på tokenhastighed.

torsdag 3. september 2026 · Forskning & arkitektur deepseek-v4glm-5.3dgx-sparkcomparison

Opfølgning: GLM 5.3 Flash over DSV4 Flash?

Opfølgning på [briefingen 30. august](/archive/2026-08-30). Reddit-bruger på M3 Ultra 256GB overvejer skifte. GLM nævnes som benchmark-bedre.

torsdag 3. september 2026 · Forskning & arkitektur glm-5.3deepseek-v4comparisonopfølgning

Opfølgning: Import AI 471: Hugging Face bekymrer, DeepSeek V4 Flash Vision udkommer

… Samtidig er DeepSeek V4 Flash Vision med billedanalyse ude. Læs baggrunden i [briefingen 22. august](/archive/2026-08-22).

tirsdag 1. september 2026 · 🗣️ Stemmer hugging-faceai-safetydeepseekagents

GLM 5.3 Flash slår DeepSeek V4 Flash på HumanEval på 2x DGX Spark

En bruger benchmarkede GLM 5.3 Flash (NVFP4) mod DeepSeek V4 Flash 0731 på to DGX Spark: GLM vandt med 97,0% mod 94 …

søndag 30. august 2026 · Nye modeller glm-5.3deepseek-v4humanevalmxfp4

DeepSeek V4 Flash kører 67-84 tok/s på to GX10'er

En bruger fik DeepSeek V4 Flash til at køre stabilt på to ASUS GX10 DGX-computere med over 65 tok/s sustained og en …

søndag 30. august 2026 · Værktøjer & produkter deepseek-v4dgx-sparklocal-inferencemxfp4

FreeToken: Kør frontlinje-MoE på din gaming-PC

FreeToken muliggør 39 tok/s med Qwen3.6 35B på en RTX 4060 laptop og 22-25 tok/s med DeepSeek-V4-Flash 284B …

tirsdag 25. august 2026 · Forskning & arkitektur freetokenmoeedge-inferencecpu-gpu

Kan DeepSeek V4 Flash destilleres på Nemotron 3.5 Lightning?

En bruger på r/LocalLLaMA spørger, om man kan destillere DeepSeek V4 Flash 0731 på en 2x Asus GX10-klynge for at forbedre Nemotron …

søndag 23. august 2026 · Forskning & arkitektur distillationdeepseek-v4-flashnemotron-3.5-lightninglocal-llm

Opfølgning: DeepSeek V4 Flash q4+ kører på 128 GB RAM + 60 GB VRAM

Trods forventning om kun q2-kvanter lykkes det en bruger at køre DeepSeek V4 Flash i 4-bit+ med acceptable tokens/s på en …

søndag 23. august 2026 · Værktøjer & produkter deepseek-v4-flashquantlocal-llmllama.cpp

DeepSeek Harness v0.1.1 ude – understøtter nu vision og billedanalyse

Den nye adapter til DeepSeek-V4-Flash-Vision-Exp gør det muligt at sende billeder i /goal og /plan, samt vedhæfte filer via MCP …

lørdag 22. august 2026 · Værktøjer & produkter deepseek-harnessdeepseek-v4-flash-visionmultimodal

Fine-tuning af Cactus Needle 2 matcher DeepSeek v4 på specifikke opgaver

Henry fra Cactus viser, at Needle 2 efter finjustering overgår DeepSeek v4 Flash på afgrænsede opgaver – men advarer mod overfitting.

fredag 21. august 2026 · Værktøjer & produkter cactus-needle-2fine-tuningdeepseek-v4benchmark

Opfølgning: DeepSeek V4 Flash 12x hurtigere på M3 Ultra med optimerede kernels

En bruger opnår 1,6 sekunder pr. chat-turn via sparse attention-optimeringer og KV-cache-prewarming. [briefingen 6. august](/archive/2026-08-06)

onsdag 19. august 2026 · Værktøjer & produkter deepseek-v4m3-ultrasparse-attentionkv-cache

Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene

… max) og kun ét point efter GLM-5.2 (753B) og DeepSeek V4 Pro (1,6B parametre). Det cementerer den lille åbne model som …

tirsdag 18. august 2026 · Nye modeller qwen-3.8open-weightsbenchmarkchinese-ai

Opfølgning: Alibaba frigiver Qwen3.8-2.4T – DeepSeek svarer med V4-Pro

Alibaba har nu frigivet vægtene til Qwen3.8-Max med 2,4 billioner parametre, mens DeepSeek lancerer V4-Pro og hæver API-priser. De …

fredag 14. august 2026 · Nye modeller qwen-3.8deepseek2.4-trillionopen-weights

Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt

DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …

fredag 14. august 2026 · Nye modeller deepseek-v4-proopen-weightshugging-face

Opfølgning: Motif 3 NVFP4 – den oversete konkurrent til DeepSeek V4 Flash

Communityet anbefaler Motif 3 NVFP4 som et alternativ til DeepSeek V4 Flash 0731 med bedre samtale-flow. Modellen blev overskygget af DeepSeek-lanceringen dagen …

fredag 14. august 2026 · Nye modeller motif-3deepseek-v4-flashmxfp4underrated

Opfølgning: DeepSeek V4 Pro 0813 ude på OpenRouter – ingen officiel annoncering

DeepSeek har stille lanceret V4 Pro 0813 via API, uden pressemeddelelse eller bekræftelse af open weights. Modellen viser markant forskellige resultater på tværs af …

torsdag 13. august 2026 · Nye modeller deepseek-v4-proopenrouterapichina

Opfølgning: DeepSeek V4 Flash fik basic vision via 40M connector trænet på 100K eksempler

En udvikler gav DeepSeek V4 Flash basic vision ved at fryse modellen og træne en 40M connector mellem MoonViT-encoder og sprogmodellen på 100K …

tirsdag 11. august 2026 · Nye modeller deepseek-v4-flashvisionmoonvitconnector

Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode

Brugere rapporterer, at Q8_K_XL-versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager …

mandag 10. august 2026 · Værktøjer & produkter deepseek-v4ggufopencodecontext-length

Opfølgning: DSpark draft-model giver kun 1-2 tok/s – MTP langt hurtigere

En bruger oplevede, at DSpark draft-modellen til DeepSeek V4 Flash var ekstremt langsom (1-2 tok/s) sammenlignet med MTP's 30-40 …

søndag 9. august 2026 · Forskning & arkitektur deepseek-v4-flashspeculative-decodingdsparkmtp

Benchmarks til DeepSeek Flash 0731 kvant-test efterspurgt

En bruger med flere kvants af DeepSeek Flash 0731 leder efter offentlige benchmarks, der kan måle kvant-effekter med omkring 1 million tokens.

søndag 9. august 2026 · Værktøjer & produkter deepseek-v4-flashbenchmarkquantizationevaluation

Opfølgning: DeepSeek V4 Flash 0731 lander på ARC-AGI – blandede reaktioner

Hugging Face-spidsen DeepSeek V4 Flash 0731 er nu evalueret på ARC-AGI, hvor den viser styrke i ræsonnering, men brugere påpeger alvorlige fejl …

lørdag 8. august 2026 · Nye modeller deepseek-v4-flasharc-agibenchmark

Opfølgning: DeepSeek V4 Flash kører på 2x DGX Spark – RAM-hovedpine

En bruger serverer 304B DeepSeek V4 Flash på tværs af to DGX Spark med 128 GB unified memory hver, men kæmper med OS-hukommelse …

lørdag 8. august 2026 · Værktøjer & produkter deepseek-v4-flashdgx-sparkvllmlocal-inference

DeepSeek V4 Flash dumpede i kontoropgaver – brugere frustrerede

En tråd på r/LocalLLaMA dokumenterer, at DeepSeek V4 Flash fejler spektakulært i referatskrivning og tekstresumé på trods af høje benchmark-scorer. Modellen er …

lørdag 8. august 2026 · Nye modeller deepseek-v4-flashliabilitylanguage-tasks

Opfølgning: Er ældre modeller som GLM 5.2 og Kimi 2.7 stadig relevante?

Med ankomsten af Kimi K3, Qwen 3.8 Max og DeepSeek V4 Pro spørger community, om tidligere topmodeller stadig duer til langvarig kodning. [briefingen …

fredag 7. august 2026 · Forskning & arkitektur qwen-3.8kimi-k3deepseek

Opfølgning: DeepSeek V4 Flash kører 10-17 t/s på MacBook M5 Pro med SSD-streaming

En bruger fik DeepSeek V4 Flash til at køre på en 64 GB MacBook via DS4-engineens SSD-streaming, med imponerende hastighed. MoE-modeller …

torsdag 6. august 2026 · Nye modeller deepseek-v4-flashssd-streaminglocal-llmmacbook

Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5

En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …

onsdag 5. august 2026 · Forskning & arkitektur deepseek-v4-flash1m-contextrtx-5090local-llm

Opfølgning: DeepSeek V4 Flash 2-bit kvant opnår 100% i SQL-benchmark

En reddit-bruger kører en 2-bit kvantiseret DeepSeek V4 Flash på to RTX 3080 og får perfekt score i et SQL-test. Kun …

onsdag 5. august 2026 · Forskning & arkitektur deepseek-v4-flash2-bit-quantsql-benchmarklocal-llm

Qwen 3.8-Max lanceret – Alibaba sætter ny standard med 2,4 billioner parametre

Alibaba har udgivet Qwen 3.8-Max, en open-weight MoE-model med 2,4 billioner parametre, der matcher Kimi K3 og DeepSeek V4

tirsdag 4. august 2026 · Nye modeller qwen3-8-maxdeepseek-v4-flashopen-weightsmoe

Opfølgning: DeepSeek V4 Flash kører på brugt serverhardware – 33 tok/s på to RTX 3090

En bruger har fået DeepSeek V4 Flash (284B MoE) til at køre på en gammel quad-Xeon DDR4-server med to RTX 3090'ere …

tirsdag 4. august 2026 · Nye modeller deepseek-v4-flashinferencertx-3090cpu-gpu

Opfølgning: DSpark giver DeepSeek V4 Flash op til 2x hastighed på A40

TensorSharp benchmark viser 1,5-2x speedup med spekulativ dekodning. 10K-token dokumenter kører 2,03x hurtigere. [Se tidligere briefingen 1. august](/archive/2026 …

mandag 3. august 2026 · Forskning & arkitektur deepseek-v4-flashdsparkspeculative-decoding

Opfølgning: DeepSeek V4 Flash kører 16 t/s på M1 Ultra efter patch

Med IQ3_XXS kvantisering og patchet LM Studio engine opnås 15-16 tok/s på 128GB M1 Ultra. [Se tidligere briefingen 1. august](/archive …

mandag 3. august 2026 · Forskning & arkitektur deepseek-v4m1-ultralm-studio

Opfølgning: DeepSeek V4 Flash kører på RTX 3090 med 12,5 tok/s via CPU-spild

En bruger fik DeepSeek-V4-Flash-0731 til at køre på et enkelt 24 GB-kort ved at lægge MoE-eksperter i system-RAM …

søndag 2. august 2026 · Værktøjer & produkter deepseek-v4-flashlocal-llmrtx-3090llama.cpp

Opfølgning: Simon Willison: DeepSeek V4 Flash er bedste value-per-intelligence lige nu

Willison fremhæver, at modellen til $0,14/$0,27 per million tokens slår langt større modeller på intelligensindekset. Det gør den til et attraktivt …

søndag 2. august 2026 · 🗣️ Stemmer simon-willisondeepseek-v4-flashopenroutervalue-per-intelligence

DeepSeek V4 Flash svigter stadig på regel-følge – bruger påpeger kompressionsproblem

En lokal bruger rapporterer, at modellen ignorerer regler og skills, fordi den gemmer dem som komprimerede summaries. Det viser, at benchmarks ikke altid afspejler …

søndag 2. august 2026 · Nye modeller deepseek-v4-flashrules-followingcompressioncritique

DeepSeek V4 Flash opdateret – og communityet hungrer efter 70-80B MoE-modeller

DeepSeek har opdateret V4 Flash med store agentiske forbedringer, samtidig med at communityet efterlyser nye 70-80B MoE-modeller til lokal kørsel.

lørdag 1. august 2026 · Nye modeller deepseek-v4-flashopen-weightslocal-llmagents

Opfølgning: DeepSeek V4 Flash kører lossless på en enkelt A100 med 17,7 t/s

Nye benchmarks viser, at den opdaterede V4 Flash kører tabsfrit på 40 GB A100 og matcher Sonnet 5 på DeepSWE. [briefingen 24. juli](/archive …

lørdag 1. august 2026 · Nye modeller deepseek-v4-flashgguflocal-inferencebenchmark

Opfølgning: DeepSeek V4 Flash kører 30 t/s på M5 Max via DS4-engine

En community-medlem har kvantiseret den nye V4 Flash til DS4 DwarfStar og opnår dobbelt hastighed i forhold til llama.cpp. [briefingen 18. juli …

lørdag 1. august 2026 · Værktøjer & produkter deepseek-v4-flashds4dwarfstargguf

Opfølgning: DeepSeek V4 Flash når 105 t/s på to 4090D – Blackwell-kerner genimplementeret i Triton

En udvikler har skrevet alle Blackwell-eksklusive kernels om i Triton, så DeepSeek V4 Flash kører på Ada GPU'er. Resultatet er 2-3x …

fredag 24. juli 2026 · Forskning & arkitektur deepseek-v4-flashtritonvllmada-gpu

Åbne modeller når frontier-niveau i cyberangreb, viser AISI-test

UK AI Security Institute måler, at open-weight-modeller som GLM-5.2 og DeepSeek V4-Pro nu kun er 4-7 måneder bag …

mandag 20. juli 2026 · Sikkerhed & jailbreaks aisicyber-capabilityopen-weightssecurity

Opfølgning: 10 open-source no-code-platforme til LLM-apps og RAG

MarkTechPost runder værktøjer op, mens Google Clouds Always-On Memory Agent og sammenligningen af Kimi K3, DeepSeek V4 Pro og GLM-5.2 også …

mandag 20. juli 2026 · Værktøjer & produkter no-coderagagentsopen-source

Opfølgning: DeepSeek V4 Flash kører på 80 GB VRAM med MoE-lag på CPU

En Reddit-bruger deler detaljeret opsætning med tre GPU'er og offloading af ekspertlag til CPU. Se [briefingen 17. juli](/archive/2026-07-17).

søndag 19. juli 2026 · Værktøjer & produkter deepseek-v4-flashlocal-llm80gb-vrammoe-offloading

Opfølgning: 192 GB RAM – hvad kører fællesskabet på store modeller?

… juli](/archive/2026-07-17) for baggrunden om DeepSeek V4 Flash.

søndag 19. juli 2026 · Værktøjer & produkter qwen3.5-397blocal-modelsllama.cppkv-cache

Opfølgning: MacBook vs. 2× DGX Spark – DeepSeek V4 Flash i kvantiseringskamp

En bruger testede DeepSeek-V4-Flash på en M5 Max MacBook (2,45 bit kvantisering) mod to DGX Spark (FP8/FP4). Mac'en vandt …

lørdag 18. juli 2026 · Forskning & arkitektur deepseek-v4-flashquantizationlocal-inferencebenchmark

1 million kontekst på en RTX 5090 med DeepSeek V4 Flash

DeepSeek V4 Flash kører nu med 1 million tokens kontekst på en enkelt RTX 5090 via llama.cpp. Præstationen er solid, men der er …

fredag 17. juli 2026 · Værktøjer & produkter deepseek-v4-flashllama.cpprtx-5090local-llm