Søgning
1 research-rapport(er) for »c-engine«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… coding claim · GitHub](https://gist.github.com/magnus919/178c2f4fb6513ec74d977fe7213f33da) 2. [Qwen3.6-27B-FP8 reaches 90.0% on SWE-bench Verified with an engineered …
15 briefing-resultat(er) for »c-engine«
Opfølgning: 22 tokens/sek – Qwen3.8 Flash Next på 32GB MacBook Air
Cherenkov-inference engine slår rekord på Apple Silicon ved at streame eksperter prædiktivt fra SSD og falde tilbage til lavere kvantisering ved pres. [Se …
AI og social engineering tømmer ældres opsparing
Svindlere bruger romance, venskab og falske AI-trading-tilbud på sociale medier til at omgå personlige sikkerhedsgrænser og dræne ældres opsparing.
Opfølgning: Qwen3.5 0.8B kører 2,9× hurtigere på CPU med custom engine
En bruger har bygget et C++-engine og 4-bit-format, der giver 2,9× prefill og 1,7× batch-16 throughput mod llama …
Hvorfor er prefill enormt hurtigere i vLLM end i andre inferens-engines?
Brugere rapporterer 7500 prefill-tok/s med vLLM mod langt lavere tal i llama.cpp – forskellen skyldes sandsynligvis arkitektoniske valg.
Apple lancerer Mac mini med M6-chip og 4x hurtigere AI-ydeevne
Ny M6-chip har Neural Accelerators i hver GPU-kerne og Dual 16-core Neural Engine. Mac mini starter ved $899 med 16 GB …
Andrew Ng relancerer DeepLearning.AI med fokus på AI Engineering
Ng trækker tråde til DevOps-bevægelsen og citerer Karpathy: "Der vil være markant flere AI Engineers end ML Engineers."
Opfølgning: Apple Neural Engine – hvad kører egentlig?
Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.
Opfølgning: Qwen 3.8 27B emulerer gammelt POS-system – noget Opus 4 ikke kunne
En udvikler brugte Qwen 3.8 27B til at reverse-engineere og emulere et Sam4S SPS-2000 POS-system fra 2006 – en opgave som …
Opfølgning: C-baseret BitNet-inference når 36 tok/s på Xeon CPU
En open source-motor i ren C kører 1.58-bit ternære modeller med 95% af teoretisk hukommelsesbåndbredde. Viser potentialet for CPU-only inferens …
Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig
Andrej Karpathy fik Claude Opus 5 til at bygge en 3D-verden af Ringenes Herre på to timer for 10 dollars – 5.500 linjer …
Opfølgning: Kimi K3 kører på én CPU med 8 GB RAM – 33 sekunder per token
En C99-inference engine streamer eksperter fra NVMe. 176 KB binary, ingen GPU. Ikke praktisk, men imponerende ingeniørarbejde. [Se tidligere briefingen 30. juli](/archive …
Opfølgning: DeepSeek V4 Flash kører 30 t/s på M5 Max via DS4-engine
En community-medlem har kvantiseret den nye V4 Flash til DS4 DwarfStar og opnår dobbelt hastighed i forhold til llama.cpp. [briefingen 18. juli …
Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis
… Gemini 3.5 Flash og Claude Opus 5 i virkelige opgaver som e-mail-skrivning og prompt-engineering. Debatten om, hvorvidt nuværende benchmarks fanger …
Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder
Claude Mythos arbejdede i 60 timer til en pris på ~100.000 dollars og opdagede matematiske svagheder i HAWK og en svag AES-variant …
Hvordan bliver man Research Engineer hos et stort LLM-laboratorium?
Et blogindlæg og en HN-tråd giver praktiske råd til jobsøgning i AI-feltet. Samtidig debatteres LLM-brug i Debian.