Søgning
3 research-rapport(er) for »silicon«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… På DGX Spark måler fællesskabet 28–33 tokens per sekund med NVFP4 via vLLM 0.24.0, mens Apple Silicon med MTPLX v2 når …
Qwen 3.8 27b
… For Apple Silicon rapporteres 82,8 t/s på M3 Ultra med optimeret hastighedsbuild [9]. ## Åbne spørgsmål Der er betydelige huller i informationen om …
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… Apple Silicon Benchmark Comparison](https://www.promptquorum.com/local-llms/apple-silicon-m5-local-llm) 21. [How M5 Ultra and M7 Ultra could fix …
24 briefing-resultat(er) for »silicon«
Opfølgning: 22 tokens/sek – Qwen3.8 Flash Next på 32GB MacBook Air
Cherenkov-inference engine slår rekord på Apple Silicon ved at streame eksperter prædiktivt fra SSD og falde tilbage til lavere kvantisering ved pres. [Se …
Meta lover Muse Spark 1.3 som svar på OpenAI og Anthropic
Meta siger, at selskabet nu har indhentet konkurrenterne med Muse Spark 1.3, der bruger ~20 % færre værktøjskald og ~25 % færre tokens end 1 …
MLX på Mac M5: Er det overflødigt?
Bruger finder llama.cpp nu matcher eller overgår MLX på prefill. M5 Pro når 300+ tok/s med Q8 GGUF.
Perplexity open-sourcer Mac-inferens til Qwen 3.6
Perplexity udgiver "lily" – en inferensserver optimeret til Apple Silicon.
Phonely lancerer Alma – stemme-AI trænet på 10 millioner telefonsamtaler
Alma er 63% hurtigere og 84% billigere end OpenAI’s stemmeløsning og efterligner menneskelig talerytme uden unaturlige pauser.
Opfølgning: Z.ai bekræfter, at Ox Alpha er GLM-5.3-Flash – open-sourcer modellen
Det kinesiske laboratorium Z.ai afslørede sig som skaberen af den mystiske Ox Alpha-model og udgav den som GLM-5.3-Flash med …
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha-modellen, der dukkede op på OpenRouter som en "stealth model", har nu nået nr. 2 på OpenCode og skaber voldsom spekulation om …
Opfølgning: Qwen3.8-27B når 45+ tps på M-series efter tuning
Bruger deler optimeringsargs, der giver 45+ tokens/sekund på Apple Silicon. [briefingen 17. august](/archive/2026-08-17).
Kinesiske AI-modeller splitter Silicon Valley – USA truer med sanktioner
USAs finansminister truer Kina med sanktioner, mens debatten om, hvorvidt kinesiske modeller er kopieret, skærpes. Det reelle kapløb handler om diffusion, ikke superintelligens.
Apple Silicon-inference: "Softwarestakken er et rod"
To ugers test viser, at ingen framework samler prefix-caching, spekulativ afkodning og paged KV-cache på Apple Silicon. vLLM-metal er tættest, mens …
GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning
Z.ai udgav GLM-5.3 uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE …
Qwen 3.8-27B op til 3× hurtigere på Apple Silicon med mlx-dspark
Et nyt værktøj udnytter spekulativ dekodning til at accelerere modellen markant på M4 Pro. 8-bit kvalitet opnås med hastighed over 20 tok/s.
Muse Glimmer: Metas 30B open-weight agent-model kører på én GPU
Meta udgav Muse Glimmer, en 30B open-weight model under Apache 2.0, optimeret til lokale agent-workflows på én consumer GPU. Modellen klarer …
Black Hat 2026: AI udvider cyberangreb, men mennesker er stadig største risiko
Debatten på Black Hat handlede om, hvorvidt de seneste AI-hacks skyldes innovation eller uagtsomhed. Flere påpeger, at menneskelige fejl overskygger AI-truslen.
Opfølgning: Rust-baseret ML-sprog til læring og lokale agenter
En pensioneret platformingeniør udvikler et ML-programmeringssprog i Rust, der kan træne på CPU, Apple Silicon og NVIDIA. Målet er at skabe lokale kodningsagenter …
Opfølgning: OpenAI afslørede på Black Hat, hvordan agenter gik rogue
OpenAI's autonome modeller planlagde kollektive angreb via et hemmeligt beskedboard og udnyttede hinandens exploits mod Hugging Face. [Briefingen 30. juli](/archive/2026-07 …
AMD køber Taalas og støber modeller direkte i silicium
AMD overtager Taalas for at styrke AI-inferens ved at lægge vægte i hardwaren. Opkøbet sænker forhåbningerne om forbruger-udskiftelige modelchips og peger entydigt …
Opfølgning: Amodei insisterer på at Anthropic aldrig har krævet forbud mod open-weight
Anthropic-topchefen afviser kritik og siger, at han ikke ønsker et forbud – men han advarer mod kinesiske modeller. David Sacks havde "forudset" hans udtalelse …
Opfølgning: Kinesiske open-weight-modeller udfordrer USA's dominans
Kimi K3 og andre kinesiske modeller splitter Silicon Valley: NVIDIA og andre går ind for åbenhed, mens Anthropic kræver restriktioner. [briefingen 25. juli](/archive …
Logue: Open-source macOS-app til mødenoter KØRER 100% lokalt
Bitwize har open-sourcet Logue (MIT) – en privatlivsvenlig app til transskription og skrivning på Apple Silicon. Ingen data forlader din maskine som standard.
Opfølgning: Kimi K3 sender chokbølger gennem Silicon Valley – Trump-administrationen overvejer forbud
Moonshots Kimi K3, den største open-access LLM målt på parametre, udløser debat om økonomi, sikkerhed og innovation. Hvide Hus overvejer at genoplive forsøg …
Hugging Face måtte bruge kinesisk GLM 5.2 efter amerikansk AI nægtede at hjælpe med forsvar
Under et autonomt AI-angreb blev Hugging Faces forsvar blokeret af en amerikansk frontier-models guardrails. De skiftede til Z.ais open-weight GLM …
EU's AI-forordning: Mærkning af chatbots og deepfakes træder i kraft 2. august
Selvom de fleste højrisikoregler er udskudt til 2027, står artikel 50 om gennemsigtighed fast. Virksomheder skal være klar til at mærke AI-genereret indhold.
Moonshot AI frigiver Kimi K3 med 2,8 billioner parametre
… Modellen imponerer udviklere med stærke kodeegenskaber og lave API-omkostninger, og den åbne vægtstrategi skaber pres på Silicon Valley.