News-Tracker

Søgning

AI & LLM · daglig briefing


3 research-rapport(er) for »apple-silicon«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… På DGX Spark måler fællesskabet 28–33 tokens per sekund med NVFP4 via vLLM 0.24.0, mens Apple Silicon med MTPLX v2 når …

fredag 7. august 2026 · research

Qwen 3.8 27b

… For Apple Silicon rapporteres 82,8 t/s på M3 Ultra med optimeret hastighedsbuild [9]. ## Åbne spørgsmål Der er betydelige huller i informationen om …

mandag 3. august 2026 · research

Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?

Apple Silicon Benchmark Comparison](https://www.promptquorum.com/local-llms/apple-silicon-m5-local-llm) 21. [How M5 Ultra and M7 Ultra could fix …

onsdag 22. juli 2026 · research

8 briefing-resultat(er) for »apple-silicon«

Opfølgning: 22 tokens/sek – Qwen3.8 Flash Next på 32GB MacBook Air

Cherenkov-inference engine slår rekord på Apple Silicon ved at streame eksperter prædiktivt fra SSD og falde tilbage til lavere kvantisering ved pres. [Se …

fredag 11. september 2026 · Forskning & arkitektur qwen-3.8apple-siliconinferenceoptimization

MLX på Mac M5: Er det overflødigt?

Bruger finder llama.cpp nu matcher eller overgår MLX på prefill. M5 Pro når 300+ tok/s med Q8 GGUF.

torsdag 3. september 2026 · Værktøjer & produkter mlxllama.cppapple-siliconqwen-3.8

Perplexity open-sourcer Mac-inferens til Qwen 3.6

Perplexity udgiver "lily" – en inferensserver optimeret til Apple Silicon.

torsdag 3. september 2026 · Værktøjer & produkter perplexityinference-servermacqwen-3.6

Opfølgning: Qwen3.8-27B når 45+ tps på M-series efter tuning

Bruger deler optimeringsargs, der giver 45+ tokens/sekund på Apple Silicon. [briefingen 17. august](/archive/2026-08-17).

fredag 21. august 2026 · Værktøjer & produkter qwen-3.8optimizationm-seriesperformance

Apple Silicon-inference: "Softwarestakken er et rod"

To ugers test viser, at ingen framework samler prefix-caching, spekulativ afkodning og paged KV-cache på Apple Silicon. vLLM-metal er tættest, mens …

søndag 16. august 2026 · Værktøjer & produkter apple-siliconmlx-lmvllm-metalinference

Qwen 3.8-27B op til 3× hurtigere på Apple Silicon med mlx-dspark

Et nyt værktøj udnytter spekulativ dekodning til at accelerere modellen markant på M4 Pro. 8-bit kvalitet opnås med hastighed over 20 tok/s.

lørdag 15. august 2026 · Værktøjer & produkter qwen-3.8apple-siliconspeculative-decodingmlx

Opfølgning: Rust-baseret ML-sprog til læring og lokale agenter

En pensioneret platformingeniør udvikler et ML-programmeringssprog i Rust, der kan træne på CPU, Apple Silicon og NVIDIA. Målet er at skabe lokale kodningsagenter …

mandag 10. august 2026 · Værktøjer & produkter educationrustlocal-trainingtools

Logue: Open-source macOS-app til mødenoter KØRER 100% lokalt

Bitwize har open-sourcet Logue (MIT) – en privatlivsvenlig app til transskription og skrivning på Apple Silicon. Ingen data forlader din maskine som standard.

søndag 26. juli 2026 · Værktøjer & produkter loguemacosmlxon-device